← 资讯列表
资讯

DeepSeek开源V4模型:推理性能超越GPT-4且训练成本仅1/10

📅 2026/6/3 08:00:00👁 1 阅读⏱ 约 2 分钟

V4模型震撼开源

2026年6月3日,深度求索在GitHub上开源了DeepSeek-V4模型权重和技术报告。新模型采用混合专家(MoE)架构,总参数量达6850亿,但每个token仅激活370亿参数,实现了性能与效率的完美平衡。

编程代码图

训练成本仅为GPT-4的十分之一

根据技术报告,DeepSeek-V4的训练成本约为560万美元,仅相当于同期训练类似规模闭源模型的十分之一。这得益于其创新的Multi-Token Prediction训练策略和高效的硬件利用率优化。这一突破使得高质量大模型的训练门槛大幅降低。

全球社区热烈响应

开源后48小时内,DeepSeek-V4在GitHub上获得超过5万星标,Hugging Face下载量突破100万次。多位AI研究者表示,V4的开源将极大推动全球AI民主化进程,让更多中小企业和研究者能够基于顶级模型进行创新。

← 返回资讯列表 AI8899 · 内容仅供学习参考