据SiliconANGLE报道,Anthropic于10月7日发布小型模型Claude Haiku 5.5,其运行成本约为上一代Haiku 4.5的四分之一,同时该公司将中型模型Claude Sonnet 5.5的缓存读取价格下调一半。
Haiku 5.5是5.5代第三个模型,距离9月22日Opus 5.5发布约两周。Anthropic将该模型定位为处理重复性工作,主要面向大批量摘要与分类任务;编程团队也可把它作为子代理,由Opus 5.5或Sonnet 5.5把较小任务交给它执行。公司表示,在标准速度下没有其他Anthropic模型比它更快,因此建议将其用于实时客户支持和浏览器自动化。
价格方面,Haiku 4.5去年10月发布时每百万输入token收费1美元、每百万输出token收费5美元。对于不超过10万token的提示,Anthropic称这覆盖了旧模型约90%的请求,Haiku 5.5的输入和输出价格均便宜90%,分别为每百万token 10美分和50美分。更长的提示享受50%折扣。公司给出的平均节省75%这一数字,考虑了新分词器使每项任务消耗的token略有增加。Haiku 5.5也是首个带可调努力设置的Haiku模型,成本可进一步调整。
10美分和50美分的价格与OpenAI上月推出的低价模型GPT-6 Luna相同。在双方均有得分的六项测试中,Anthropic公布的基准显示Haiku 5.5全部领先。在考察代理通过长多步任务操作真实电脑的OSWorld 2.1离线子集上,新模型得分72.4%,Luna为48.9%。在Terminal-Bench 4.0代理编程测试中,Luna得分16.4%,不到Haiku 5.5的39.2%的一半。对于复杂代理编程,Anthropic仍建议客户使用Sonnet 5.5和Opus 5.5。
Asana是发布前测试Haiku 5.5的客户之一,将其用于AI Teammates代理的评估套件。任务完成延迟比该公司目前使用的模型低30%以上,每个代理轮次的推理速度最高快2.5倍。该公司资深软件工程师Aaron Vinh称“体验明显更快”。
安全方面,Anthropic称对齐测试发现的失准行为实例远少于Haiku 4.5。该模型的网络安全防护允许比Sonnet 5.5更多的防御性工作,渗透测试以及其他攻击者更可能使用的手法仍被阻止;需要更广泛权限的机构可申请Anthropic于周二扩大范围的Cyber Verification Program。
随Haiku一同发布的还有中型模型的价格下调。9月28日推出的Sonnet 5.5,其缓存读取价格从每百万token 20美分降至10美分。由于缓存token在模型消耗中占比很高,Anthropic预计此举将使该模型上多数代理工作成本降低约20%。
Claude Max和Team订阅用户本周起还将获得Claude Platform的月度API额度。Max 5x订阅每月100美元,Max 20x为200美元。Team账户可在用户之间共享最多500美元额度,额度可用于任何Claude模型。
Haiku 5.5现已在Claude Platform以claude-haiku-5-5名称上线,并可通过亚马逊云科技、谷歌云和微软Azure获取。