模型发布重点2 分钟读完Simon Willison

Mistral发布Large 4预览:万亿参数模型回归竞争

速览

Mistral今日发布Large 4模型预览,这是一个1万亿参数、490亿活跃参数的模型,在自有集群上训练完成。预览版已通过API提供,开放权重版本承诺本月底发布。该模型在Artificial Analysis上得分38,较去年12月的Large 3大幅提升,被认为重新回到前沿水平约6个月差距的位置。

Mistral Large 4的训练集群由3,800块NVIDIA Grace Blackwell GPU组成,这是Mistral自有基础设施能力的一次展示。模型通过Mistral API提供两种推理级别:「none」和「high」,后者在测试中生成质量更佳,但输出token数反而更少(2,717个对3,275个)。

在Artificial Analysis基准评测中,Large 4得分38,略低于DeepSeek 4.1 Flash(552B参数模型)。对比去年12月的Mistral Large 3仅得9分,这次进步显著。评论认为该模型虽未达到Fable级别,但已重新回到距前沿约6个月的位置。

值得注意的几点:

  • 开放权重版本预计本月底发布,延续了Mistral开源策略
  • 训练完全在自有GPU集群完成,不依赖外部云供应商
  • 推理选项仅有两档,与主流模型的多级推理控制形成差异

原文Introducing Mistral Large 4: Le chonksimonwillison.net

#Mistral#大模型#开源

本文由程序自动抓取公开报道,经 AI 筛选与改写生成,未经人工逐条核实,事实以原文为准。