暂无菜单项

1T“大胖猫”来了!Mistral Large 4只激活49B,1M上下文与半价API能否翻盘?

发布于 更新于
15

1.05T总参数、49B激活、原生多模态与百万上下文同时上桌;API已进入公开预览,开放权重要等到10月底。

先说预测:Mistral Large 4真正想争的不是“参数最大”这张海报,而是欧洲企业最在意的三件事:开放权重、数据主权和可落地的Agent能力。如果10月底权重按计划放出,它可能成为大型企业私有化模型的新候选;但1T总参数也意味着,本地部署绝不是普通工作站能轻松承担的任务。

Mistral已正式推出Mistral Large 4公开预览版,内部昵称是Le Chonk,也就是社区口中的“大胖猫”。官方规格为1.05T总参数、每个Token激活49B参数,另有1.6B视觉编码器和1M上下文。

Mistral官方发布Mistral Large 4并公布核心规格与开放权重计划
Mistral官方发布Mistral Large 4并公布核心规格与开放权重计划。图片已压缩为WebP,点击查看大图。

两处信息修正:官方写的是使用3800张NVIDIA Grace Blackwell GPU从零训练,并非约4000张;权重发布时间为“10月底”,官方没有确认10月27日。

01 / 1T参数为什么每次只激活49B?

Large 4采用细粒度混合专家(MoE)架构。模型拥有大量专家参数,但处理每个Token时只路由到其中一部分,因此总容量达到1T级,单步计算量则更接近49B激活规模。

项目 Mistral Large 4 意味着什么
总参数 1.05T 容量大,但权重存储和部署要求很高
激活参数 49B / Token 避免每步计算全部1T参数
视觉编码器 1.6B 支持图片、文档和视觉定位
上下文 1M 适合长文档、代码仓库和Agent轨迹

02 / 编程、财务和法律:跑分很亮眼,但别忽略预览版

在官方公布的预览成绩中,Large 4在DeepSWE v1.1达到61.7%,显示出较强的长链软件工程能力;在Finch金融工作流中达到67%。

Mistral Large 4公开预览版在DeepSWE v1.1代码任务中的官方对比成绩
Mistral Large 4公开预览版在DeepSWE v1.1代码任务中的官方对比成绩。图片已压缩为WebP,点击查看大图。
Mistral Large 4在Finch金融工作流基准中的官方对比成绩
Mistral Large 4在Finch金融工作流基准中的官方对比成绩。图片已压缩为WebP,点击查看大图。

Harvey法律Agent基准中,Large 4约为15%,虽然领先对比中的部分开放模型,但全场数字都不高。这更像是在提醒企业:模型可以辅助检索、整理和起草,却不能替代律师完成高风险法律判断。

Mistral Large 4在Harvey法律Agent基准中的官方对比成绩,整体通过率仍然不高
Mistral Large 4在Harvey法律Agent基准中的官方对比成绩,整体通过率仍然不高。图片已压缩为WebP,点击查看大图。

这些数字来自官方发布期评测,强化学习仍在继续。它们可以用来理解模型方向,不能替代同一提示词、同一工具、同一预算下的独立复测。

03 / 视觉定位是Large 4最想打出的差异牌

除了文档和图表理解,Mistral特别强调视觉定位:模型不仅回答“图里有什么”,还要找出目标所在区域。官方展示了Dense200与DIOR-RSVG遥感图任务,并把灾害评估、输电线巡检、农作物观察、技术图纸和CAD作为目标场景。

Mistral Large 4在Dense200与DIOR-RSVG视觉定位任务中的官方对比
Mistral Large 4在Dense200与DIOR-RSVG视觉定位任务中的官方对比。图片已压缩为WebP,点击查看大图。

这类能力对影视与CG从业者同样有价值:它可以成为素材检索、镜头物体标注、场景资产盘点和技术图纸理解的前置模型。不过从“看懂并框出”到“可靠地进入生产流水线”,还需要检测一致性、坐标精度和批量成本测试。

04 / 为什么Mistral反复强调开放权重与欧洲主权?

Large 4在Mistral自有欧洲数据中心训练,公开预览也由同一基础设施提供。官方称训练数据覆盖160多种语言,包括欧盟全部官方语言,并计划提供可选择的欧洲部署区域。

对政府、金融、制造和安全团队来说,价值不只是“模型来自欧洲”,而是能否控制部署位置、审计数据流、在私有环境运行,以及避免关键能力被单一外部服务随时切断。

Mistral公布30亿欧元D轮融资后的算力与模型发展路线
Mistral公布30亿欧元D轮融资后的算力与模型发展路线。图片已压缩为WebP,点击查看大图。

这也是30亿欧元D轮融资后的第一款旗舰模型。资金会继续投入欧洲算力、强化学习和行业模型,但融资规模不能自动等同于产品领先,最终仍要看权重许可、部署成本和客户续费。

05 / 怎么用、多少钱?先看清“公开预览”四个字

模型标识为mistral-large-4,已经可通过Mistral Studio与API体验。官方文档当前显示的促销价格为每百万Token:输入0.68美元、缓存输入0.07美元、输出2.09美元;页面同时划出了1.36、0.14和4.18美元的原价格。

Mistral Large 4官方模型文档页面,列出上下文、功能与当前API价格
Mistral Large 4官方模型文档页面,列出上下文、功能与当前API价格。图片已压缩为WebP,点击查看大图。

使用建议:先拿真实任务做小样本评测,分别记录输入、输出、工具调用和重试成本;不要因为“49B激活”就把它等同于普通49B模型,也不要把当前促销价当成永久价格。

06 / “大胖猫”为什么成了发布主角?

Le Chonk来自互联网对圆滚滚大猫的称呼,也延续了Mistral长期使用猫元素的品牌表达。发布前,CEO Arthur Mensch用法国接力选手末棒逆转夺冠的视频预热;社区则不断追问这只1T参数“大猫”到底有多重。

Mistral CEO发布接力赛逆转视频,为Large 4发布预热
Mistral CEO发布接力赛逆转视频,为Large 4发布预热。图片已压缩为WebP,点击查看大图。
开发者围绕1T参数与“大胖猫”名称展开的社区讨论
开发者围绕1T参数与“大胖猫”名称展开的社区讨论。图片已压缩为WebP,点击查看大图。
Mistral Large 4官方Le Chonk视觉:橙色像素大猫
Mistral Large 4官方Le Chonk视觉:橙色像素大猫。图片已压缩为WebP,点击查看大图。

轻松的梗降低了理解门槛,但产品真正要面对的仍是严肃问题:开放权重的具体许可证是什么、部署需要多少显存和带宽、API促销持续多久,以及预览成绩能否在独立评测中复现。

07 / 做视频网观点

Mistral Large 4把三条趋势放在了一起:MoE继续扩大总容量,视觉和Agent成为旗舰标配,企业客户越来越重视部署主权。它不是“1T参数所以必然更强”,而是试图证明大容量模型也能以较小激活规模服务真实工作流。

现阶段最理性的做法是API先测、权重再等、生产慎迁。等10月底权重、模型卡、许可证和更多独立基准齐全后,才适合认真评估私有化成本。

相关站内内容

Mistral Large 4站内导航:https://www.zuoshipin.com/link/47575.html

Qwen3.8-27B开源解析:https://www.zuoshipin.com/article/23134

DeepSeek V4视觉Agent模型:https://www.zuoshipin.com/article/30147

近期Agent模型横评:https://www.zuoshipin.com/article/13284

大模型本地部署解析:https://www.zuoshipin.com/article/23627

官方资料

Mistral Large 4官方发布说明

Mistral Large 4官方模型文档与价格

常见问题(FAQ)

Mistral Large 4已经正式发布了吗?
Mistral已发布API公开预览版,可在Studio和API中体验;开放权重计划在10月底发布。
Mistral Large 4为什么是1T参数却只激活49B?
它采用细粒度MoE架构,每个Token只调用部分专家,因此拥有1.05T总容量,但单步激活约49B参数。
Mistral Large 4的上下文是多少?
官方模型文档列出的上下文窗口为1M,并支持文本、图片和文档输入。
Mistral Large 4 API多少钱?
官方文档当前显示促销价:每百万Token输入0.68美元、缓存输入0.07美元、输出2.09美元;价格可能随预览和促销调整。
普通电脑能本地运行Mistral Large 4吗?
1.05T权重对存储、显存、内存和带宽要求极高,普通工作站并不适合直接运行完整模型;应等待权重、量化方案和官方部署说明。
0 点赞
0 收藏
分享
0 讨论
反馈
热门资讯
相关素材

暂无数据