总部位于巴黎的 Mistral AI 周二推出了 Mistral Large 4,这是一个拥有 1 万亿个参数的人工智能模型。这就是 ChatGPT 和 Claude 等聊天机器人背后的系统,因为参数是它在训练过程中调整的可调整数字——参数越多通常意味着学习能力更强,运行成本也更高。
“[Mistral Large 4] 处于开放模型的前沿,也是迄今为止美国或欧洲最强大的开放权重模型,”Mistral AI 的首席科学家 Guillaume Lample 在 X 上写道。

并非所有这些参数都能同时起作用。 Large 4 采用“专家混合”设计,这意味着模型将每个问题路由到几个专家子网络,因此每个答案仅触发 490 亿个参数。 Mistral 的最后一个旗舰产品 Large 3 也做了同样的事情,活跃用户数为 6750 亿,其中 410 亿。
整个“Le Chonk”绰号有一个背景故事。 6 月,Mistral 将其 Le Chat 助手更名为 Vibe 后,Reddit 和 X 上的粉丝发明了一个名为 Le Chaton Fat 的虚构模型(大致为“肥猫”),拥有 30 万亿个参数、每秒 1,000 次喵叫,以及声称它击败了 Claude Fable 5 的虚假基准测试。
法国政府需要在为时已晚之前阻止 Le Chaton Fat。这就是我们多年来一直被警告要提防的 FAT 起飞! pic.twitter.com/VoaBPJmfBT
- GLIF (@heyglif) 2026 年 6 月 15 日
首席执行官亚瑟·门施 (Arthur Mensch) 附和,回答说该模型实际上被称为“le gros chaton”,法语中“大猫”的意思。随后,米斯特拉尔在其 Vibe 网站上添加了一只卡通猫。现在,其真正的发布帖子将该型号列为“非常正式”的 le Chonk。
米斯特拉尔出售“主权人工智能”——一个国家或公司可以拥有和运行的模型,而无需将其数据交给外部公司。正是出于这个原因,沙特阿拉伯国家支持的 HUMAIN 在 8 月份与该公司签署了一项价值数亿欧元的协议。
Mistral 于 9 月份筹集了 30 亿欧元(33.7 亿美元)的 D 轮融资,该轮融资向投资者出售股票,估值超过 210 亿欧元(236 亿美元),由三星领投。米斯特拉尔表示,Large 4 是资金资助路线图上的第一个里程碑。
Le Chunk 每百万个输入代币的成本为 1.36 美元,每百万个输出代币的成本为 4.18 美元——人工智能公司按照文本块计费,每个文本块大约是四分之三的单词。 Claude Opus 5.5 收费 4 美元和 20 美元,而 GPT-6 Astra 收费 10 美元和 50 美元。
这使得 Large 4 的输入价格约为 Opus 5.5 的三分之一,输出价格约为 Opus 5.5 的五分之一。对阵阿斯特拉,大约是第七和十二。
基准测试说了什么
Mistral 的公告主要将 Large 4 与中国开放权重模型(DeepSeek V4 Pro、Kimi K3、GLM-5.3 和 Qwen3.8 Max)进行基准测试,而“开放权重”意味着任何人都可以下载并运行该模型。 Claude 和 GPT 仅出现在少数比较中,最新的 Claude Opus 5.5 仅出现在网络安全声明中。
在 Surge AI 对编码质量进行的盲人评估中,Mistral Large 4 在 5 个模型中以 3.74 分(满分 5 分)排名第二,落后于 Claude Opus 5 的 4.22 分。
AutomationBench 在模拟商业软件中为 AI 657 处理杂务(财务、人力资源、销售、支持),并对它完成的每项任务目标的份额进行评分,如果违反规则,则得分为零。大4得分59.9分。在Artificial Analysis的板上,Claude Sonnet 5.5达到了71.8,Opus 5.5达到了69.5,Gemini 4 Argon在同一基准上以77.5位居榜首。
DeepSWE 1.1 是开发人员在尝试评估模型编码能力时检查的基准测试之一,Large 4 得分为 62。这高于 GLM-5.3(61 分)和 DeepSeek V4 Pro(57 分),但落后于 Kimi K3(68 分)。Datacurve 自己的排行榜上有 GPT-6 Astra 和 Claude Opus 5(74 分)。
Mistral 表示,它将在 10 月底之前发布 Large 4 的权重(使模型发挥作用的经过训练的数字),这将允许外部开发人员下载该模型并自行测试这些声明。