据MarkTechPost 9月29日报道,Anthropic发布Claude Sonnet 5.5。这是Claude 5.5系列第二款模型,API列表价维持每百万输入token 2美元、输出10美元不变,在Terminal-Bench 4.0上取得70.6%,较Sonnet 5的10.3%大幅提升,并已通过Claude平台以及AWS、Google Cloud、Microsoft Azure上线。
Anthropic将Sonnet 5.5定位为Opus 5.5更快、更低成本的补充,面向范围明确的日常任务、bug修复,以及文档、幻灯片和电子表格打磨。它是闭源权重模型,不支持自托管。相比Sonnet 5,Anthropic报告四项主要升级:输出生成速度提升30%以上,成为迄今最快Sonnet;单位任务成本最多降低30%,原因是所需token和工具调用更少;写作更清晰;在视觉和长周期工作中,它是首个仅凭截图通关《宝可梦 红》的Sonnet。该模型拥有100万token上下文、128K最大输出和2026年6月可靠知识截止日期,自适应思考默认开启,effort分low、medium、high、xhigh、max五档。
Anthropic公布的测试结果显示,Terminal-Bench 4.0得分为70.6%,Sonnet 5为10.3%,Opus 5.5在Xhigh下为66.4%。CursorBench 4.0为55.5%,比Opus 5.5的57.8%低约2个百分点。FrontierCode 1.1在Xhigh下为52.1%,Max下为46.2%,GPT-6 Sol为49.3%。GDPval-AA v2.1为1844,Opus 5.5为1846,Sonnet 5为1449。OSWorld 2.1计算机使用为80.1%,接近Opus 5.5的81.8%。Humanity’s Last Exam带工具为64.5%,高于此前的54.9%。Anthropic解释,Max结果低于Xhigh,是因为模型更常运行多智能体代码审查,有时导致超时或超出范围的修改,FrontierCode会对此扣分。Anthropic同时表示,Opus 5.5在复杂、开放式工作上仍明显更强。
定价与Sonnet 5相同:每百万输入token 2美元、输出10美元,缓存读取0.20美元、缓存写入2.50美元,为Opus 5.5(4美元/20美元)的一半。节省来自token效率而非降价。Balyasny Asset Management测得每个答案约121K token,Sonnet 5为497K;Base44报告每次应用构建3.6次迭代,Opus 5为7.7次;Zendesk处理工单速度提升20%。Effort默认值因界面而异:Claude Code和Claude应用默认Medium,Claude Platform默认High。
对比竞品,GPT-6 Sol价格同为2美元/10美元(提示最长272K),Gemini 3.1 Pro Preview为2美元/12美元(提示最长200K)。Sonnet 5.5和GPT-6 Sol、Opus 5.5均为正式可用,Gemini 3.1 Pro Preview为预览版;四款模型均不开放权重。Sonnet 5.5还是首款配备网络保障和推理提取分类器的Sonnet。Anthropic发布了迁移指南和系统卡。上述基准由Anthropic报告,GDPval-AA由Artificial Analysis运行,价格按2026年9月28日核验的标准API列表价。