Mistral Large 4 – Mistral AI推出的旗舰多模态大模型

AI模型1小时前更新 老高
5 0

Mistral Large 4是一款由Mistral AI于2026年10月推出的旗舰多模态大模型,主要用于通用推理、代码生成与智能体任务,总参数 1 万亿、激活约 520 亿,目前以公开预览版形式提供,并计划于月底开放权重。

基础信息内容
产品定位旗舰多模态大模型
出品方Mistral AI
发布时间2026年10月6日
总参数量1 万亿(激活约 520 亿)
架构稀疏 MoE 架构
支持模态文本、图像
上下文窗口524k token
训练算力3,800 块 Grace Blackwell
开源情况公开预览,月底开放权重
模型代号le Chonk
Mistral Large 4 – Mistral AI推出的旗舰多模态大模型

Mistral Large 4 的核心能力

Mistral Large 4 是 Mistral AI 面向通用任务推出的旗舰模型,也是欧洲厂商目前在开放权重路线上体量最大的一代。官方把它归入 AI 模型 序列,并以公开预览版先行提供。

万亿级稀疏 MoE 架构

模型总参数 1 万亿、激活约 520 亿,采用稀疏 MoE 架构,由少量激活参数承担单次推理,兼顾总容量与运行成本。Mistral 称该模型实测表现足以媲美全球顶尖开源模型,并大幅领先于欧美开发的其他开放权重模型。

欧洲自建数据中心训练

模型在 Mistral 位于欧洲的自建数据中心内,基于 3,800 块英伟达 Grace Blackwell GPU 从零训练完成。官方说明其欧洲部署方案由 Mistral 端到端独立运营,遵循欧盟法律法规,不依赖其他第三方数字服务提供商。训练数据覆盖超 160 种自然语言,包含欧盟的全部官方语言。

多模态与智能体基准

第三方评测机构 Artificial Analysis 给出的 Intelligence Index 得分为 38,高于同类模型 26 的中位数,输出速度为每秒 116 个 token,上下文窗口为 524k token。官方列出的评测维度覆盖编码(DeepSWE、Terminal Bench 4.0)、网络安全、智能体行为、金融与法律等企业级任务,其中网络安全漏洞复现评测得分 82%,为其列出的最高值,Cybench 安全竞赛题集的解出率为 93%。官方另称其在网络安全、金融与法律等企业级工作负载上于开源模型中达到领先水平,视觉定位等方向超过部分前沿闭源模型。

推理效率与成本定位

Artificial Analysis 记录的输出速度为每秒 116 个 token,其 Intelligence Index 每项任务的加权平均成本处在同类模型的中位偏下水平。稀疏 MoE 的设计让单次推理只调用部分参数,万亿级总参数因此不至于等比例推高单次调用成本,这也是它能把预览单价压到同类偏低水平的原因。

输入形式与模态支持

模型为原生多模态,可同时接收文本与图像。文本侧支持长文档理解与多步推理,图像侧可处理图表、截图与设计稿类输入,两种模态可以在同一条指令中组合使用。官方把通用推理、代码生成与智能体任务列为它的主要方向。

开放权重路线

Mistral Large 4 目前为公开预览阶段,权重尚未开放,官方给出的计划是在月底释放模型权重。即日起用户可在 Mistral Studio 上体验预览版 API,受信任的合作方将获得专项测试访问权限,该测试版本强化了网络安全攻防能力。这与该厂商此前几代产品的发布节奏一致:先以 API 与预览形式提供给开发者验证,再补上权重下载渠道。

Mistral Large 4 与同类旗舰大模型的对比

对比维度Mistral Large 4Qwen 3.8-MaxClaude Opus 5.5
出品方Mistral AI阿里通义千问Anthropic
产品定位旗舰多模态大模型旗舰大模型旗舰模型
发布时间2026年10月6日2026年8月3日2026年9月22日
上下文524k token100 万 token100 万 token
开源情况计划月底开放权重计划开放 Max 级权重闭源
调用价格每百万 tokens 输入 1.36 美元、输出 4.18 美元每百万 tokens 输入 12 元、输出 36 元每百万 tokens 输入 4 美元、输出 20 美元
接入方式Mistral Studio 预览与 API千问 AI 平台 APIAnthropic API 与 Claude

上表 Mistral Large 4 一列取自其官方发布页与 Artificial Analysis 公开评测,Qwen 3.8-Max 与 Claude Opus 5.5 两列取自各自官方资料,其中 Qwen 3.8-Max 的价格为人民币刊例价。三款模型各有侧重:需要欧洲本地部署、且看重单位调用成本的,可以优先看 Mistral Large 4;需要超长上下文与更长自主任务链路的,Qwen 3.8-Max 与 Claude Opus 5.5 更对路。

如果关注国产开源旗舰的进展,可以参考 GLM-5.3(智谱推出的编程与网络安全特化开源大模型,总参数 7430 亿,CyberGym 代码审计得分 84.5%)。

Mistral Large 4 的应用场景与适用人群

该模型面向通用推理与智能体任务,常见场景包括:

  • 通用推理与问答:处理长文档理解、多步推理与结构化输出类任务。
  • 代码生成与工程:在开发流程中承担补全、重构与测试用例生成。
  • 企业私有部署:权重开放后可在自有环境运行,数据不出内网。
  • 欧洲合规场景:训练与部署集中在欧盟境内,适合对数据流向有要求的业务。
  • 多语言与本地化:面向欧洲市场的多语种内容生成与客服问答,可与本地数据政策一并考量。

适用人群:需要开源权重做私有部署的研发团队、关注数据合规与地域部署的企业,以及评估多款旗舰模型成本结构的开发者。

Mistral Large 4 的使用方法

模型当前以公开预览版开放,按以下顺序接入:

  1. 申请预览:通过 Mistral Large 4 官方发布页 了解公开预览的信息,并提交使用申请获取调用权限。
  2. 调用推理:按官方文档给出的接口地址与鉴权方式发起请求,模型代号为 le Chonk。
  3. 选择模态:文本与图像可在同一条请求中给出,用于需要读懂图表或截图的场景。
  4. 评估预算:按官方平台公布的预览价目,估算典型任务的调用成本。
  5. 等待权重:官方计划月底开放模型权重,届时可在自有环境部署。

预览阶段的能力与定价仍可能调整,正式生产前建议先做小规模验证。

Mistral Large 4 的价格与开源情况

Mistral Large 4 目前以公开预览版提供,官方公布的预览价格为每百万 tokens 输入 1.36 美元、输出 4.18 美元,在同类旗舰模型中处于偏低水平。预览阶段的价目与配额可能随正式发布调整,实际计费以官方平台公布的方案为准。

模型权重计划在月底开放,届时可按官方公布的许可条款自行部署,用于可离线的私有环境。在其正式开放权重之前,模型只通过官方接口与预览渠道提供。

Mistral Large 4 的常见问题

Mistral Large 4 现在的状态是什么?

目前为公开预览版,代号 le Chonk,权重尚未开放。官方给出的计划是在月底释放模型权重,预览阶段通过官方平台申请使用。

Mistral Large 4 的参数规模是多少?

总参数 1 万亿,激活参数约 520 亿,采用稀疏 MoE 架构,支持文本与图像输入,在 Mistral 位于欧洲的自建数据中心内基于 3,800 块英伟达 Grace Blackwell GPU 训练完成。

Mistral Large 4 的成本水平如何?

官方公布的预览价格为每百万 tokens 输入 1.36 美元、输出 4.18 美元;第三方评测机构 Artificial Analysis 给出 Intelligence Index 得分 38,高于同类模型 26 的中位数。正式发布后的价目以官方页面为准。

© 版权声明

相关文章