人工智能公司Anthropic于9月1日发布其最先进的大语言模型Claude Fable 5.1和Claude Mythos 5.1。这两个版本共享同一底层模型,区别在于安全防护等级:Fable 5.1面向所有用户开放,而Mythos 5.1仅限通过审查的网络安全与生命科学组织使用。Anthropic称,Fable 5.1在多项基准测试中创下纪录,其在科研任务测试Terminal-Bench-Science 0.1中得分52.6%,是上一代Fable 5的24.7%的两倍多;在编码基准Terminal-Bench 4.0上得分55.8%,而Mythos 5.1达到60.9%。

新模型同时降低了使用成本。Anthropic将缓存读取价格从每百万token 1美元下调至0.25美元,降幅达75%。该公司表示,这一调整使典型工作负载的整体成本比Fable 5降低约25%,对于依赖AI代理的复杂任务,节省幅度最高可达45%。基础输入与输出价格维持不变,分别为每百万token 10美元和50美元。

Anthropic还宣布调整此前引发企业客户争议的数据保留政策。该公司今年6月随Fable 5推出时要求对该模型的所有流量进行30天数据保留,以防范滥用和网络攻击。尽管Anthropic承诺不会将数据用于训练等非安全目的,仍引发大量企业用户担忧。Anthropic美洲区负责人Kate Jensen表示,公司花费数百小时与客户合作开发替代方案。新的企业安全架构名为Enterprise Frontier Safeguards(EFS),允许企业自行控制数据如何被审查、存储和管理,也可选择完全自动化的安全监控而无需Anthropic人工介入,且不额外收费。该架构将数据存储于客户自己的云服务器上,Anthropic称其提供“完全隐私”,预计今年秋季开始分阶段推出。

与模型发布几乎同步,Anthropic的商业扩张也在加速。据《华尔街日报》援引消息人士称,Anthropic于9月1日前一天与云计算初创公司Lambda签署了一份价值350亿美元的基础设施租赁协议,租用位于得克萨斯州Nueces县一座在建数据中心的容量。该设施由纳斯达克上市公司Hut 8建设,总容量为1吉瓦,英伟达将持有该园区的租约。市场分析据此估算Anthropic购买容量在350至437兆瓦之间。而在此前不到一周,Anthropic已与英国云服务商Nscale签署了一份更大的合同,据称将支付450亿美元租用西弗吉尼亚州数据中心约460兆瓦的计算能力,该设施将配备英伟达最新的Rubin显卡和Vera处理器。

在安全能力方面,Fable 5.1的防护措施比前代更宽松,允许研究人员发现软件漏洞,但渗透测试、漏洞利用生成等高级任务仍会被引导至Opus模型。Anthropic还称,生物安全防护在良性请求上的触发频率降低了85%,网络安全干预数量在Claude Code中减少了约60%。Mythos 5.1据称具备“我们发布过的模型中最强的网络能力”,但在整体不良行为方面比Opus 5略有回退。系统卡显示,Mythos 5.1在应对人类滥用时更容易接受未经证实的授权声明,但相比前代更少忽略明确约束或虚构输入。

此前有报道称,Anthropic和英国AI安全研究所在过去几周披露了早期Claude模型在宽松网络评估条件下对真实系统采取未经授权行动的事件,Anthropic曾暂停外部网络评估并引入额外遏制措施。此次发布的EFS架构被视为对这类治理问题的直接回应。