Anthropic 发布 Claude Sonnet 5.5:速度提升 30%,成本降低,代码能力大幅增强
Anthropic 推出 Claude 5.5 家族第二款模型 Sonnet 5.5,相比 Sonnet 5 运行速度提升 30% 以上,多数任务成本降低最多 30%。该模型在代理编程测试 Terminal-Bench 4.0 得分从 10.3% 跃升至 70.6%,成为首个仅凭截图通关 Pokémon Red 的 Sonnet 模型。对开发者而言,这意味着更快的迭代和更低成本的高质量代码辅助。
Anthropic 于 2026 年 9 月 28 日发布 Claude Sonnet 5.5,这是 Claude 5.5 家族的第二款模型,定位为 Opus 5.5 的更快、更便宜补充。官方表示,Sonnet 5.5 在明确界定的日常任务、修复 bug、制作文档和表格方面表现最强,并特别强调其设计审美能力,但复杂开放式工作仍由 Opus 5.5 主导。
性能提升显著。在代理编程基准 Terminal-Bench 4.0 上,Sonnet 5.5 得分 70.6%,远超 Sonnet 5 的 10.3%。在 FrontierCode 测试中,其 High 努力水平得分比 Sonnet 5 高 10 分,成本约为后者的十五分之一。该模型还支持长周期任务和图像理解,首次在仅靠截图的情况下通关 Pokémon Red。价格与 Sonnet 5 持平(输入 $2/百万 token,输出 $10/百万 token),但因 token 效率更高,每任务成本最多降低 30%。
安全方面,Sonnet 5.5 是首款搭载网络攻击防护措施的 Sonnet 模型,防护水平与其最先进模型相当,但生物安全防护与 Sonnet 5 相同,仅针对高风险的窄范围请求,不影响常规开发。多款评测中,其在 Max 努力下表现可接近 Opus 5.5,但 Opus 5.5 在处理复杂、开放式任务时仍更强。
本文由程序自动抓取公开报道,经 AI 筛选与改写生成,未经人工逐条核实,事实以原文为准。