资讯
DeepSeek开源V4模型:推理性能超越GPT-4且训练成本仅1/10
V4模型震撼开源
2026年6月3日,深度求索在GitHub上开源了DeepSeek-V4模型权重和技术报告。新模型采用混合专家(MoE)架构,总参数量达6850亿,但每个token仅激活370亿参数,实现了性能与效率的完美平衡。
训练成本仅为GPT-4的十分之一
根据技术报告,DeepSeek-V4的训练成本约为560万美元,仅相当于同期训练类似规模闭源模型的十分之一。这得益于其创新的Multi-Token Prediction训练策略和高效的硬件利用率优化。这一突破使得高质量大模型的训练门槛大幅降低。
全球社区热烈响应
开源后48小时内,DeepSeek-V4在GitHub上获得超过5万星标,Hugging Face下载量突破100万次。多位AI研究者表示,V4的开源将极大推动全球AI民主化进程,让更多中小企业和研究者能够基于顶级模型进行创新。
← 返回资讯列表
AI8899 · 内容仅供学习参考