据Android Authority报道,Anthropic于2026年9月22日发布新一代模型Claude Opus 5.5,称其性能、准确度、沟通能力和安全防护均有改善,响应速度比Opus 5快超过30%,典型工作负载下的运行成本约低40%。
Anthropic称,Opus 5.5是其迄今测试过性能最强的模型。在智能体编程、知识工作、跨学科推理、计算机使用和可视化图表识别等基准测试中,该模型领先Fable 5.1、Opus 5、GPT-6 Astra和GPT-5.6 Sol;在业务流程和智能体科学研究基准中排名第二,仅次于GPT-6 Astra。公司还称,新模型生成输出的速度比Opus 5快30%以上。
早期测试者的反馈集中在写作与沟通改善。一名Ramp软件工程师表示,前沿模型输出冗长、难以跟随曾是他最大的困扰,Opus 5.5解决了这一问题,写作像一位好同事,并遵循团队的写作规则。芝加哥交易公司的一名首席工程师称,Opus 5.5的写作比Opus 5更易跟随、更连贯。
Anthropic还给出若干实际任务结果。一名早期测试者用Opus 5.5在不到三小时内审计并修复了一个20万行代码库;完成同一任务,Opus 5耗时超过20小时,使用的token数量为2.5倍。在一项把软件从C语言翻译为Rust的测试中,Opus 5.5耗时9.5小时,Fable 5.1耗时12小时。GitHub的测试者发现,该模型用不到一半的步骤解决了比Opus 5更多的终端任务;Spotify的测试者称其能以更低成本和更快速度完成任务。Clio、Lovable、Quantum等公司的早期测试者也提供了类似反馈。
安全方面,Anthropic强调Opus 5.5的原生分类器会在每个操作运行前进行筛查,并称其防御能力强于前代模型。在编码、工具使用、计算机使用和网页浏览等场景中,该模型缓解提示注入攻击的表现与Opus 5持平或更好。Anthropic还称,在AI安全公司Gray Swan进行的一项基准测试中,Opus 5.5与Fable 5.1并列,创下受测模型中最低的提示注入成功率。
价格方面,Opus 5.5的API输入价格从每百万token5美元降至4美元,输出价格从25美元降至20美元;缓存读取价格从0.5美元降至0.2美元,缓存写入价格从6.25美元降至5美元。Anthropic称,结合token效率提升,典型工作负载下运行Opus 5.5的成本比Opus 5低约40%。
该模型不只面向开发者。普通用户也可使用Claude Opus 5.5,Pro、Max、Team和按席位计费的Enterprise计划设有五小时使用限额。Anthropic同时提高了Pro、Max、Team和Enterprise订阅用户的使用限额。更多信息及早期测试者详细评价可在Anthropic的博客文章中查看。