模型#跑分#模型推理

Mistral Large 4:欧洲万亿参数旗舰

1T 参数 MoE、自家欧洲机房 3800 块 Blackwell 训练;Coding 49.8% 领先,月底开放权重。

Mistral 官方横幅:「#1 in Sovereign AI.」,像素猫坐在橙红色渐变上

Mistral 官方 10 月 6 日发布 Mistral Large 4 公开预览版,官方绰号「Le Chonk」:总参数 1 万亿、激活 49B 的原生多模态混合推理 MoE——从零训练于自家欧洲数据中心的 3800 块 NVIDIA Grace Blackwell GPU,强化学习阶段每天生成约 330 亿 token——3800 块顶级芯片的体量说明,「高效」路线的尽头同样是大写的基础设施开支,只是被更好的单位经济模型包装了起来。这是欧洲第一次拿出与中美旗舰正面比参数表的模型,官方定位直白:「#1 in Sovereign AI」。

要点

  • 架构:1T 总参数 / 49B 激活的 MoE,指令与推理混合、多模态输入
  • 训练:3800 块 Grace Blackwell,全部位于 Mistral 自有欧洲数据中心
  • 编码:Coding Agent Index 49.8%,领先 DeepSeek V4 Pro 0813 与 Qwen3.8 Max
  • 盲测:Surge AI 五模型盲测排第二(3.74),仅次于 Claude Opus 5(4.22)
  • 安全:CyberGym-E2E 82%「全场最高」,Lakera B3 抵抗 93.3% 攻击
  • 开放:权重月底开放(先与网络安全伙伴红队);定价输入 $1.36 / 输出 $4.18 每百万 token
  • 资本:同文确认 €30 亿 Series D——欧洲科技史上最大股权轮

基准表里的梯队信息

盲测第二名说明第一梯队(Claude Opus 5)仍有明显身位差;编码与智能体基准领先 DeepSeek、Qwen 说明开源阵营内部座次在重排。The Decoder 的解读点出了另一个维度:Mistral 把「做美国闭源模型拒做的工作」写成了卖点——网攻基准全场最高、HarveyAI 法律基准开源第一,定位是安全敏感行业的欧洲选项,与 Anthropic 招股书自陈灾难风险、OpenAI 的 textGrain 合规水印同处一个「安全即市场」的赛季。

主权叙事的资本背书

€30 亿 Series D 是欧洲科技史上最大股权轮,训练集群完全自有的路线烧钱但买到了两样东西:数据主权(欧洲企业的合规诉求)与供应链独立(不受美国出口政策摆布)。对照 DeepSeek 的 120 亿人民币与美系的万亿估值叙事,2026 年的前沿模型竞赛正式分裂成三套资本-监管语系。

欧洲路线的三年账

Mistral 的路径在过去三年完成了三级跳:从开源小模型的性价比玩家,到 Le Chat 的消费入口,再到今天的自有算力加万亿参数旗舰。30 亿欧元 Series D 的投资逻辑超越「再做一个 OpenAI」的复刻——它要给欧洲主权 AI 买一个自给自足的供应体系:训练在境内、权重可自托管、定价以欧元计。英法德政府与国防合同是这个故事的第一批客户,HarveyAI 法律基准与网攻基准的「安全垂直」强势,瞄准的是对数据出境敏感的金融、法务与关键基础设施行业。

月底权重是真考题

预览版的基准是自家报告,权重开放(月底)之后第三方复现才会给出真判定——参考 Jev 的反 benchmark 立场与估值传闻,行业对「发布时跑分」的信任正在贬值。对欧洲企业,Mistral 第一次提供了「不必出境」的前沿选项;对开源阵营,1T/49B 的配比说明 MoE 军备赛进入「总参数堆叠、激活精打」的新阶段——97% 的参数在等待调用,这既是效率也是赌注:激活路径之外的万亿参数,只有在长上下文与多模态负载里才兑现价值。月底权重开放后,定价与 DeepSeek、Qwen 的对照将决定欧洲旗舰是「可用选项」还是「主权象征」。对中文读者还有一层可参照性:Mistral 与 DeepSeek、Qwen 走的是同一条「开源旗舰+垂直强项」路线,三者的权重许可与商用条款差异,会比跑分更直接影响团队选型。