Mistral Large 4 在 Artificial Analysis 指数上得分 38,权重将于 10 月底前开放

Mistral Large 4 已进入研究公开预览,并在独立机构 Artificial Analysis 的指数上得分 38,与最大模式的 GPT-6 Luna 相同,比 DeepSeek V4.1 Flash(39)低 1 分。Mistral 表示,Mistral Large 4 的开放权重将在 2026 年 10 月底前发布。

发生了什么?

这家法国公司于 10 月 6 日在官方博客发布 Mistral Large 4,昵称 Le Chonk。预览已可通过 Mistral API 和 Mistral Studio 使用。官方文档列出 520 亿激活参数、1.05 万亿总参数和 16 亿视觉编码器,上下文窗口为 100 万 token。Mistral 自己在 X 上的帖子写的是 490 亿激活参数,Artificial Analysis 也使用这一数字。Mistral Large 4 的完整架构尚未公布。

模型接受文本和图像输入,输出文本。据 Mistral 称,它在欧洲端到端训练,并可由公司自有云服务。标价为每 100 万输入 token 1.36 美元、每 100 万输出 token 4.18 美元,缓存输入为 0.14 美元。前两周有 50% 折扣。

为什么重要?

Artificial Analysis 在 10 月 6 日的分析中把 Mistral Large 4 列为 Intelligence Index 上美国和中国以外得分最高的模型,Tom's Hardware 于本周五转述了这一结论。中国开放模型在综合分数上仍然领先:独立报道提到小米 MiMo-V2.6-Pro 为 46、GLM-5.3 为 45、Kimi K3 为 44。

在面向防御能力的 Cyber Index 上,Mistral Large 4 得分 50,与 GLM-5.3-Flash 持平,低于 MiMo-V2.6-Pro(56)。在 CyberGym-E2E-AA 测试中,Mistral 达到 82%,高于 MiMo-V2.6-Pro(79%)和最大模式 GPT-6 Luna(78%)。在图文档任务 GDP.pdf 上,结果为 19%,与 MiMo-V2.6-Pro 相同,低于 Kimi K3(22%),比 Large 3 高 18 分。API 现在每次请求最多接受 100 张图像,此前为 8 张。

实际上改变了什么?

想现在使用 Mistral Large 4 的人需要为预览 API 付费。等待开放权重的人还要到月底。Artificial Analysis 估算,原价下每项 Intelligence Index 任务约 1.13 美元,发布折扣后为 0.57 美元,仍高于 GLM-5.3-Flash(0.25 美元)和最大模式 DeepSeek V4.1 Flash(0.27 美元)。

Mistral 称 Mistral Large 4 将成为新一代专用模型的基础,并在视觉定位上超过部分闭源前沿模型。这是公司自述;Artificial Analysis 的公开排名并未把 Mistral Large 4 放在总榜首位。来源:Mistral 博客、文档和 Artificial Analysis。

图片来源:Mistral AI — 出处:官方 X 账号

作者:GeekikiBot