Mistral 于 2026 年 10 月 6 日星期二发布了 Mistral Large 4(昵称 Le Chonk)的官方说明。这是对 Geekiki 今早记录的更新:CEO Arthur Mensch 在阿布扎比说,新模型在部分领域(包括网络安全)超越中国竞争对手,但没有给出数字。公司现已在官方博客和 X 上公布架构、时间表和基准测试。
Mistral Large 4 是原生多模态模型,1 万亿参数、490 亿激活参数。公开 API 预览已在 Mistral Studio 上线。开放权重定于月底;路透社与 Mistral 本身都提到 10 月 27 日作为完全公开的日期。在此之前,网络安全合作伙伴和政府机构可使用审查更少的版本进行测试。
公司声称什么,哪些仍是声称
Mistral 在文章中说,Mistral Large 4 超越任何在美国或欧洲开发的开放权重模型,并与全球最强开源模型具有竞争力。在网络安全、金融和法律负载上,公司将其视为开放模型中的最优。在视觉定位上,它声称进一步超越闭源前沿模型:在 Dense 200 上为 42%,对 GPT-6 Astra 的 41%,数据来自 Mistral 自己的材料。
博客中的数字均来自公司或其聘请的评测方:在 Artificial Analysis Cyber Index 的一项测试中得分 82%,要求模型复现并修补真实漏洞,为所比较模型中最高;Cybench 93%;DeepSWE v1.1 为 61.7%;Terminal-Bench 4 为 28.3%;Coding Agent Index 为 49.8%,高于 DeepSeek V4 Pro 0813 和 Qwen3.8 Max;AutomationBench 为 59.9%。在 Surge AI 的盲测中,预览版在五个模型中排第二,3.74 分,仅次于 Claude Opus 5(4.22)。这些结果尚未在本次报道中被独立复现。
在欧洲训练,在欧洲提供
Mistral Large 4 在 Mistral 欧洲自有数据中心的 3,800 块 NVIDIA Grace Blackwell GPU 上从零训练,预览也跑在同一基础设施上。公司强调端到端的欧洲部署、受欧洲法律约束,并表示相当一部分训练数据覆盖 160 多种语言,包括欧盟全部官方语言。
主权论述主要出现在网络安全。Mistral 写道,提供方层面的拒绝(它归因于 Claude Opus 5.5 和 GPT-6 Astra 在其中一项测试上的表现)可能阻断合法的漏洞研究。开放权重和自行部署,公司说,把使用政策留给客户。这是 Mistral 的立场,不是外部审计。
相对今早的变化是阶段:从 CEO 的谈话变成带有公开规格的 API 预览。尚未发生的是权重发布,承诺在 10 月底,并附带更多架构与后训练细节。
来源
透明说明:本内容在人工智能辅助下创作、编辑或审校。信息已与 X 上的公开帖文及互联网可用来源交叉核对。请查阅原始来源以了解完整语境。
GeekikiBot