据量子位报道,人工智能公司Anthropic于9月2日发布Fable 5.1与Mythos 5.1模型。官方称,新模型在8项公开基准测试中全部位列第一,价格最高可降45%,并引入反蒸馏机制,防止思维链被篡改重放。
在性能方面,Fable 5.1在科学研究和代码任务上明显优于上一代Fable 5及OpenAI的GPT-5.6 Sol。用中、低推理程度运行Fable 5.1,效果大致相当于老版Mythos 5在极高推理程度下的表现。价格上,Fable 5.1将缓存读取价格降至每百万token 0.25美元,降幅75%;输入和输出价格保持每百万token 10美元和50美元不变。由于智能体任务中缓存读取占据主要成本,Anthropic称典型工作负载成本较Fable 5下降约25%,高度智能体化任务最高可节省45%。
科研实战方面,Anthropic展示了相关成果。在蛋白质设计中,Mythos 5.1使用开源工具设计高亲和力结合蛋白,三个靶标上的亲和力为Adaptyv Bio竞赛最佳方案的10倍;在全部12个靶标上命中率接近50%,而行业典型命中率为10%至15%。天文学上,Fable 5.1基于NASA麦哲伦号雷达图像训练神经网络,为金星约三分之一表面生成高分辨率地形图,分辨率从此前的10至20公里提升到2至3公里,高度精度提高25%。计算生物学方面,Mythos 5.1编写自定义GPU内核并缓存中间结果,将7个开源深度学习模型运行速度最高提升2.5倍,GPU成本可降低30%至60%。Anthropic计划将这些优化开源。
安全方面,Fable 5.1的网络安全误报率比Fable 5降低60%,现允许用于发现软件漏洞,但禁止开发漏洞利用程序;基础生物学和医学问题误报率降低85%,相关查询仍被导向Opus模型。新引入的反蒸馏机制为每个思维链区块附加签名,若API对话历史被编辑、重排或删除,或系统提示词、工具列表、历史消息等发生变动,签名校验即失败。Anthropic称,新注册API账户将无法在多轮对话中手动编辑上下文同时保留思维链记录。该机制提供“error”与“drop_block”两种失败处理模式,并提供对话内系统消息、轮次级系统消息、tool_addition等替代方案,避免开发者直接修改历史。Anthropic建议直接调用Messages API的开发者将messages数组严格视为只追加,并设置prefix_mismatch_behavior提前测试。
Mythos 5.1仅通过受信访问计划向经审核的网络安全和生命科学机构提供,Fable 5.1面向所有用户开放。另据该报道,OpenAI的新模型Astra尚未完成,只发布了预告;Ilya在模型发布之际呼吁加强网络安全。Fable 5.1与Mythos 5.1的发布被视为Anthropic在大模型竞赛中的最新动作。