首页 > 开源 > Mistral Large 4 来了:一万亿参数、具备原生多模态能力

Mistral Large 4 来了:一万亿参数、具备原生多模态能力

OSChina资讯 2026-10-08 11:56 4 阅读 查看原文

Mistral 发布了他们史上最大的模型。不是迭代,是直接从零训的:1 万亿参数、520 亿稀疏激活的原生多模态模型,代号 Le Chonk(法语昵称,直译大概就是「胖墩」),正式名字 Mistral Large 4。公开预览即日起在 Mistral Studio 上线,权重月底发布。

参数堆叠不是最有意思的部分。最有意思的是它在安全测试里的表现。Artificial Analysis Cyber Index 上,ML4 排全球前五,是中美之外开源模型第一名。其中一个子测试要求模型复现一个真实开源漏洞并打补丁,ML4 拿了 82%。对比组里,Claude Opus 5.5 和 GPT-6 Astra 在这个测试上几乎得零分——不是能力不够,是拒绝执行。安全过滤器不会区分「我在做防御性安全研究」和「我在做攻击」,一块拦了。ML4 因为是开源权重,企业可以自己部署、自己定策略,不会被 API 端的安全策略卡住。Mistral 自己也说,在内部测试里,ML4 在恶意软件分析、漏洞优先级排序和检测规则编写上都证明了实际可用性。

整体能力上,ML4 在 DeepSWE v1.1 拿了 61.7%,Coding Agent Index 综合 49.8%,领先 DeepSeek V4 Pro 和 Qwen3.8 Max。盲评找真人标注员打分(1-5 分,隐藏模型身份),ML4 Preview 排第二(3.74),仅次于 Claude Opus 5(4.22),但高于 Kimi K3(3.59)和 GLM-5.3(3.60)。Agentic 工作流上,AutomationBench(657 个业务场景,覆盖 Gmail、Google Sheets、Slack、Salesforce)得分 59.9%,同样领先同级别开源模型。

ML4 是在 Mistral 自有的欧洲数据中心里训的,3,800 张 NVIDIA Grace Blackwell GPU。Mistral 强调的一个词是 AI sovereignty——模型可以由客户完全自主控制部署,尤其对安全团队而言,API 提供商中途改策略或出问题不会中断正在进行的应急响应工作。模型将同时在多个区域部署,包括一个完全由 Mistral 端到端运营的欧洲节点,独立于其他数字服务商,受欧洲法律管辖。顺便一提,训练数据覆盖 160 多种语言,包含欧盟全部官方语言。

Mistral 表示,ML4 还将作为新一代专用和优化模型的基础。月底权重发布前,他们会与网络安全领导者、经过背书的合作伙伴及国家当局在真实环境中进行红队测试——这批合作方将访问同样经过减轻过滤和扩展网络能力的模型版本,以确保防御方在模型完全公开时就已经准备好了。

来源: