Anthropic发布Claude Sonnet 5.5,速度提升三成、成本最高可省三成

Anthropic发布Claude Sonnet 5.5,速度提升三成、成本最高可省三成

  • 2026-09-29
  •  44

关键词: Anthropic Claude Sonnet 5.5 大模型 AI编程

当地时间9月28日,Anthropic推出Claude Sonnet 5.5。这是继一周前旗舰Opus 5.5之后,Claude 5.5家族的第二款模型。从“Anthropic到OpenAI到谷歌”的迭代节拍看,9月底前沿大模型进入加速段。Sonnet 5.5在保持API名义价格不变的前提下,把速度与综合成本同时压低,用工程效率而非降价的策略对标同级竞争。

名义价格不变,成本最高降三成,性能逼近Opus 5.5

Anthropic公布的Sonnet 5.5定价维持Sonnet 5的水平:每百万输入token 2美元、每百万输出token 10美元、每百万缓存读取0.2美元。但模型本身更快、更省token。官方数据显示,Sonnet 5.5输出生成速度提升超过30%;在多步骤工具调用、复杂编程等场景下,因减少冗余推理与工具调用次数,单项任务的实际成本最高可下降30%。这一“名义持平、实际下降”的设计,与近期业内靠降价竞争的路线形成对比,尤为温和。

Anthropic官方基准中,Sonnet 5.5已经逼近甚至超过Opus 5.5的部分成绩:

  • Terminal-Bench 4.0智能体编程:Sonnet 5.5得分70.6%,上代Sonnet 5仅10.3%,压过Opus 5.5在高算力档位(Xhigh)的66.4%;

  • CursorBench 4.0真实编辑器编程场景:55.5%,与Opus 5.5的57.8%相差仅2.3个百分点;

  • FrontierCode 1.1高强度编程测试:High档下比上代高10分,单任务成本约为Sonnet 5的十五分之一;

  • GDPval-AA v2.1知识工作测试:1844分,与Opus 5.5的1846分几乎持平;

  • AA-Briefcase长程知识工作:1811分,高于GPT-6 Sol约300分。(根据The Decoder官方数据,Opus 5.5在该项得1822分,与Sonnet 5.5仅差11分。)

编程之外,Sonnet 5.5在带工具的“人类最后的考试”(Humanity's Last Exam)拿下64.5%,比上代提升近10个百分点,第三方榜单Vals Index首次入榜即排第二,仅落后Opus 5.5约0.47分。

安全防护机制首次向“准旗舰”看齐

因能力跃升较大,Anthropic对Sonnet 5.5采用了与Opus 5.5相近的安全防护:高风险网络安全任务会自动降级回Sonnet 5处理;生物安全护栏则与Sonnet 5一致。模型首次内置防止推理提取的安全分类器,并把“保留思考”机制扩展——Claude的思考内容无法与生成它的账号解绑。这有助于抵御用数千假账户“蒸馏”模型能力的攻击。零数据保留版本同步提供。

Sonnet 5.5已上线Claude平台,并同步接入亚马逊云(AWS)、谷歌云(Google Cloud)与微软Azure。Claude Code支持立即可用,API标识为claude-sonnet-5-5。开发者迁移时需要注意:原先“thinking off”的设置须切换为新的between_tools选项,模型对工具调用的处理方式有所改变。

Anthropic确认新一代Haiku 5.5将在未来几周内推出,定位快速、高吞吐任务。届时Claude 5.5家族将以Opus—Sonnet—Haiku三档覆盖不同预算与响应速度需求。


来源:国际电子商情