← 资讯列表
资讯

Mistral发布Large 3模型:120B参数MoE架构正面挑战GPT-5.5

📅 2026/6/22 08:00:00👁 1 阅读⏱ 约 2 分钟

120B MoE架构,开源欧洲最强模型

AI芯片

6月22日,法国AI公司Mistral正式发布Mistral Large 3模型。该模型采用混合专家架构(MoE),总参数120B,每次推理激活约24B参数。在Hugging Face Open LLM Leaderboard上,Large 3的综合得分超越了此前所有开源模型。Mistral同步宣布以Apache 2.0协议开源模型权重,并发布技术报告详细说明训练方法。

基准测试全面对标GPT-5.5

Mistral公布的基准测试数据显示,Large 3在MMLU-Pro上得分88.2%,HumanEval代码测试上达到93.1%,均小幅超过GPT-5.5。在多语言能力方面,Large 3支持法语、英语、中文、德语等12种语言,其中法语的生成质量显著领先所有模型。Mistral CEO Arthur Mensch表示,欧洲不需要在AI领域做追随者,Large 3证明了欧洲有能力打造世界级的AI模型。

欧洲算力自主加速

值得注意的是,Large 3完全在欧洲本土的超算中心完成训练,使用的是法国Jean Zay超算和德国JUPITER集群。在AI主权讨论日益激烈的背景下,Mistral的突破被视为欧洲AI自主可控的重要一步。Mistral同时宣布与法国电信Orange和德国SAP达成企业合作,推动Large 3在欧洲企业市场的落地。

← 返回资讯列表 AI8899 · 内容仅供学习参考