模型发布重点2 分钟读完Simon Willison
Mistral发布Large 4预览:万亿参数模型回归竞争
速览
Mistral今日发布Large 4模型预览,这是一个1万亿参数、490亿活跃参数的模型,在自有集群上训练完成。预览版已通过API提供,开放权重版本承诺本月底发布。该模型在Artificial Analysis上得分38,较去年12月的Large 3大幅提升,被认为重新回到前沿水平约6个月差距的位置。
Mistral Large 4的训练集群由3,800块NVIDIA Grace Blackwell GPU组成,这是Mistral自有基础设施能力的一次展示。模型通过Mistral API提供两种推理级别:「none」和「high」,后者在测试中生成质量更佳,但输出token数反而更少(2,717个对3,275个)。
在Artificial Analysis基准评测中,Large 4得分38,略低于DeepSeek 4.1 Flash(552B参数模型)。对比去年12月的Mistral Large 3仅得9分,这次进步显著。评论认为该模型虽未达到Fable级别,但已重新回到距前沿约6个月的位置。
值得注意的几点:
- 开放权重版本预计本月底发布,延续了Mistral开源策略
- 训练完全在自有GPU集群完成,不依赖外部云供应商
- 推理选项仅有两档,与主流模型的多级推理控制形成差异
原文Introducing Mistral Large 4: Le chonksimonwillison.net
#Mistral#大模型#开源
本文由程序自动抓取公开报道,经 AI 筛选与改写生成,未经人工逐条核实,事实以原文为准。