模型发布2 分钟读完Hacker News

Mistral 发布万亿参数开源模型 Large 4,月底开放权重

速览

Mistral AI 今日发布 Mistral Large 4(ML4),这是其迄今最大最强的模型,采用原生多模态架构,拥有 1 万亿参数但仅激活 490 亿。该模型在编码、智能体工作流和网络安全等企业级任务上表现突出,部分领域超越封闭前沿模型。目前可通过预览 API 试用,权重将于本月底开放。

Mistral Large 4 的训练完全在欧洲自有数据中心完成,使用了 3,800 块 NVIDIA Grace Blackwell GPU。模型从零开始训练,其训练数据涵盖超过 160 种语言,包括欧盟所有官方语言。Mistral 强调这一模型是为 AI 主权而建,支持客户自主部署和掌控。

模型在网络安全领域表现尤为突出。在 Artificial Analysis Cyber Index 独立评估中,ML4 全球排名前五,并在开源权重模型中大幅领先。在复现并修补真实软件漏洞的测试中,ML4 得分 82%,位居所有模型之首。相比之下,包括 Claude Opus 5.5 和 GPT-6 Astra 在内的多个领先封闭模型因安全限制拒绝执行同类任务,得分接近零。

在编码和智能体任务方面,ML4 的 Coding Agent Index 综合得分 49.8%,超过 DeepSeek V4 Pro 0813 和 Qwen3.8 Max。在盲测人工评估中,ML4 的编码质量排名第二(3.74 分),仅次于 Claude Opus 5(4.22 分)。在 AutomationBench 的 657 个真实业务工作流测试中,ML4 得分 59.9%。

权重正式发布前,Mistral 正与网络安全企业、合作方及国家机构进行红队测试。这些测试对象将获得减少审核限制、增强网络能力的同一模型版本。模型将在全球多个区域提供服务,其中欧洲部署完全由 Mistral 独立运营,受欧洲法律管辖。

  • 预训练使用了与 Mistral Forge 客户相同的训练、定制和强化学习环境。
  • 预览 API 现已在 Mistral Studio 开放。
  • 模型架构细节、更多基准和微调方法将在权重发布时公布。

Mistral 表示 ML4 还将作为新一代专用和优化模型的基础。

原文Mistral Large 4: "Le Chonk"mistral.ai

#Mistral#大模型#开源

本文由程序自动抓取公开报道,经 AI 筛选与改写生成,未经人工逐条核实,事实以原文为准。