Mistral Large 4 万亿参数模型开启公开预览

导语

10 月 6 日,法国人工智能公司 Mistral AI 发布新一代旗舰模型 Mistral Large 4(简称 ML4),并即日起开启公开预览。该模型总参数量达 1 万亿(官方模型文档口径为 1.05 万亿),采用原生多模态的混合专家(MoE)架构,每次推理仅激活其中 490 亿参数。Mistral 在官方博客中宣称,ML4 是“美国或欧洲开发的开源权重模型中综合表现最强者”,并把对标矛头直接指向 DeepSeek、Qwen、Kimi、GLM 等中国开源模型。公司同时宣布,模型权重将于 10 月底正式开放。

Mistral 内部给这款模型起了个颇具自嘲意味的代号——“Le Chonk”(意为“大块头”)。从参数规模看,它确实对得起这个名字:这是 Mistral 迄今最大、能力最强的模型,也是欧洲 AI 实验室在开源大模型赛道上迄今最重磅的一次出手。

事件详情:万亿参数,API 即刻可用

根据 Mistral 公布的模型文档,Mistral Large 4 的关键规格如下:

  • 架构与规模:颗粒化混合专家(MoE)模型,总参数约 1.05 万亿,每 token 激活 490 亿参数,激活率仅约 4.7%。这意味着它的推理服务成本更接近中型稠密模型,而非同等参数规模的稠密模型。
  • 多模态能力:原生支持文本与图像输入,配备 16 亿参数的视觉编码器,上下文窗口达 100 万 token,可处理电子表格、文档、图表、技术图纸、PDF 和大型地理空间图像。
  • 训练投入:从零训练约两个月,在 Mistral 自有欧洲数据中心动用约 3800 至 4000 块英伟达 Grace Blackwell GPU 完成,训练语料覆盖 160 多种语言,包括欧盟全部官方语言。
  • 使用方式与定价:公开预览即日起通过 Mistral Studio API 提供,定价为每百万输入 token 1.36 美元、每百万输出 token 4.18 美元。
  • 权重开放计划:Mistral 表示权重将于 10 月底开放(多家媒体引述的具体日期为 10 月 27 日),采用 Mistral 自定义许可。在此之前,公司正与开发者、网络安全机构及政府部门合作测试,并为测试方提供放宽内容限制、增强网络能力的版本。

在能力定位上,Mistral 明确将 ML4 指向企业级工作负载:软件工程、网络安全、金融、法律、科学研究与制造业。公司还表示,第三方评测显示 ML4 在法律与金融任务上领先 GPT-6 Astra,并在 Harvey 的法律智能体基准上领先所有开源模型。

背景分析:押注网络安全,直面中国开源模型

这次发布的竞争叙事相当直白。Mistral 在官方材料中把 ML4 与 DeepSeek V4 Pro、Qwen3.8 Max、Kimi K3、GLM-5.3 逐一对比,宣称其“大幅超越任何来自美国或欧洲的开源权重模型”。首席执行官亚瑟·门施(Arthur Mensch)在阿布扎比的一场会议上进一步表示,ML4 在网络安全等特定维度上已超过中国模型。据路透社报道,门施未点名具体模型,也未说明对比口径。

网络安全是 Mistral 这次主打的差异化卖点。官方公布的成绩包括:在 Cybench 的 40 道安全竞赛题中完成 93%,在一项“复现真实软件漏洞并修复”的测试中达到 82%,为参测模型最高。值得注意的是,Mistral 特别指出,Claude Opus 5.5、GPT-6 Astra 等闭源前沿模型在同一测试中“得分接近于零,因为它们拒绝执行该任务”——这反映的是模型在任务接受度上的政策差异,而非纯粹的技术能力差距。

在代码能力上,Mistral 称 ML4 在 DeepSWE v1.1 上取得 61.7%,综合代码智能体指数 49.8%,高于 DeepSeek V4 Pro 与 Qwen3.8 Max。不过第三方交叉验证给出了更克制的画面:独立媒体引用的交叉检验显示,ML4 在 DeepSWE 上约为 62%,低于 GLM-5.3 的 69%。评测机构 Artificial Analysis 给出的综合智能指数为 38 分,输出速度约每秒 116 token。这些数字均在各自测试条件下得出,不代表所有场景下的相对性能。

这次发布也是 Mistral 完成 30 亿欧元 D 轮融资后的首个重磅动作。Mistral 称这是“欧洲科技公司历史上最大的一笔股权融资”,由三星领投,已于 9 月完成。联合创始人兼首席科学家纪尧姆·朗普勒(Guillaume Lample)表示,ML4 是这轮融资支持路线图的“第一个里程碑”,公司科研团队已从 3 人扩张到约 300 人,随着强化学习收尾和训练算力扩充,模型能力还会继续提升。

影响与展望:欧洲的开源反击,与待验证的承诺

对开源生态而言,ML4 若如期在 10 月底开放权重,将成为欧洲阵营迄今参数规模最大的开源权重模型。Mistral 的定位也很明确:企业和政府可以在自有基础设施或私有云上部署,支持主权基础设施与零数据留存选项,并提供受欧洲法律管辖的欧洲本地部署——这套“欧洲主权 AI”叙事,正是 Mistral 区别于美国巨头和中国实验室的核心卖点。

对开发者来说,API 已可即刻试用,百万 token 1.36 美元输入、4.18 美元输出的定价处于中端水平。但有几个关键事项仍需验证:首先,目前所有亮眼成绩均为 Mistral 官方口径,独立第三方评测尚未大规模跟进;其次,权重开放的具体许可条款、强化学习完成后的最终版本实际表现,都有待 10 月底揭晓;最后,MoE 架构下 1 万亿参数的完整权重对部署硬件要求不低,实际自建门槛可能高于预期。

无论如何,ML4 的登场标志着开源大模型的竞争进入了“万亿参数”新阶段。在 DeepSeek、Qwen 等中国模型持续领跑开源榜单的背景下,欧洲终于拿出了一款正面叫板的作品。这场三方竞赛的下一回合,就看 10 月底的权重开放能否兑现今天的承诺。

发表评论