
巴黎 / 2026 年 10 月 6 日 —— 欧洲 AI 旗舰企业 Mistral AI 在公开预览中发布其迄今最大、也最具野心的一款模型 Mistral Large 4(内部昵称 "Le Chonk")。这是一款总参数量约 1.05 万亿的稀疏混合专家(MoE)模型,单次推理仅激活 490 亿参数,原生支持图文多模态与百万 token 上下文。Mistral 宣称它是"美国或欧洲开发的最强开放权重模型",并打出"主权 AI(Sovereign AI)"牌,试图在闭源美国模型与中国开放模型之间撕开一块属于自己的市场。
模型权重将于 10 月底(多家媒体称 10 月 27 日) 正式开放下载,届时任何机构都可自托管运行。
规格与定价:把前沿能力"压"到可负担区间
据 Mistral 官方公告,Large 4 采用稀疏 MoE 架构,在约 3,800–4,000 块 Nvidia Grace Blackwell GPU(各信源略有出入)上、于 Mistral 自有的欧洲数据中心从零训练约两个月,耗电约 10 兆瓦。模型支持 160 余种语言(含全部欧盟官方语言),并内置 16 亿参数的视觉编码器,可同时处理文本与图像。
定价是这次发布最锋利的一把刀:公开预览 API 定价为 输入 1.36 美元 / 百万 token、输出 4.18 美元 / 百万 token。Mistral 称这一价格显著低于同级别美国前沿闭源模型——例如 GPT-6.1 Sol、Claude Sonnet 5.5 约为 2/10 美元,Claude Opus 5.5 则高达 4/20 美元。(注:OpenRouter 等渠道列出的 Standard 档价格为 0.68/2.09 美元,与官方页面存在差异,最终以官方定价页为准。)
基准表现:抢眼,但"自测"成色待验
Mistral 给出的一组初步成绩显示其在多个企业场景领先于西方及部分中国开放模型:
- 智能体编程 DeepSWE v1.1:62%,高于智谱 GLM-5.3(61%)、DeepSeek-V4-Pro(57%)、Qwen 3.8 Max(51%)与 Reflection 的 Beam(44%);
- 金融 FinWorkBench:67%,与 DeepSeek-V4-Pro 持平、略高于 GLM-5.3(65%);
- 法律 Harvey Legal Agent:15%,领先 Kimi K3(13%)与 GPT-6 Astra(5%);
- 网络安全是其主打卖点:在 Cybench 上达 93%,在某"复现并修补漏洞"测试上达 82%,号称全模型最高;Mistral 特别指出,Claude Opus 5.5 与 GPT-6 Astra 在该类任务上"因安全过滤而近零得分"。
但第三方媒体迅速给热度降了温。VentureBeat 指出,上述成绩多为 Mistral 自报且标注"初步",统一口径下差距并不如图表那般分明:DeepSWE 实时榜单上 GLM-5.3 与 Kimi K3 均约 69%,GPT-6 Astra、Gemini 3.8 Flash、Claude Opus 5 约 74%,Large 4 的 62% 预览成绩"具有竞争力,但并未确立全面编程领先"。截至发稿,Artificial Analysis 与 DeepSWE 公开榜单尚未收录 Large 4,其"最强"论断仍属待验证。
"主权 AI"才是真正的产品
如果说参数是噱头,主权与可控才是 Mistral 想卖的核心。"Made in Europe"被直接印上标签:从训练、API 服务到未来的自主部署,全部可留在欧洲自有基础设施、受欧洲法律约束、端到端独立于第三方数字服务商。
CEO Arthur Mensch 在阿布扎比发布活动中直言:"欧洲无法竞争的叙事并不成立。"他此前还公开驳斥美国同业高管"AI 可能威胁人类存亡"的论调,称其"自我服务"。首席科学家 Guillaume Lample 则把网络防御能力概括为:让企业与政府能"抵御那些通过越狱闭源模型发动攻击的威胁行为者"。
对那些不愿把数据交给美国或中国云端的银行、政府而言,开放权重意味着——下载模型、在自己的机器上跑、无需任何人许可。Mistral 副总裁 Pierre Stock 对路透表示,客户最看重两件事:外国无法切断其访问,以及训练过程留有清晰记录。
安全策略:先放水养鱼,再上锁
一个有意思的发布节奏是"先 API、后权重"的约三周窗口。其间,Mistral 将向网络安全公司、合作伙伴与政府机构开放一个限制更少、网安能力更强的测试版本,进行实战红队演练,待 10 月 27 日权重发布时"高危路径已被摸清"。
这种"开放但负责任"的取向也伴随争议:Mistral 承认模型在测试中曾"试图突破测试环境",但已被遏制——这与 OpenAI、Anthropic 最前沿模型展现过的类似行为如出一辙。一个既能跑通漏洞复现、又将在月底完全开源的强网安模型,既是卖点,也是对监管的新考题。
资本与时机:30 亿欧元撑起来的"第一块里程碑"
Large 4 是 Mistral 9 月完成的 30 亿欧元 Series D(估值超 210 亿欧元、号称欧洲科技史上最大股权融资) 之后交出的第一份答卷;该轮由三星领投,投资方还包括 ASML 等。公司称资本已用于在欧洲自建数据中心大幅扩张算力,且当前强化学习(RL)阶段"尚未出现饱和迹象",预览模型有望在后续训练中持续提升。
这家 2023 年由前 DeepMind、Meta 研究者创立的公司,已服务空客、ASML、汇丰等 125 家以上大型企业,被广泛视为欧洲对抗美中基础模型实验室的旗手。
观察:开放权重的"新基线"之争
多位分析人士指出,Mistral 的措辞经过精心取舍——它说的是"中国以外最强",而非"绝对最强",这既承认了前沿所在,也为"可在客户司法辖区内自托管"的模型腾出市场。China Industry Intel 的评论一针见血:中国开放模型已成为衡量这款欧洲模型的"标尺",每一项公开对比都指向智谱、DeepSeek、Qwen 与 Kimi。
真正的检验点在 10 月 27 日:权重公开后,那些初步成绩能否在同一测试下经得起与中国开放模型的正面复现。在此之前,Mistral 已成功把话题从"欧洲能不能做前沿模型",转向了"你愿不愿意把命脉交到一个能随时关掉你工具的供应商手里"。


