据雷峰网报道,9月23日,硅谷AI厂商Anthropic与OpenAI同日推出新一代模型,Anthropic发布Claude Opus 5.5,OpenAI发布GPT-6 Sol与Luna。发布后行业讨论集中在模型价格普遍下降:Claude Opus 5.5较上一代Opus 5成本降低40%,GPT-6 Sol性能持平GPT-5.6 Sol,价格却直接腰斩,每百万Token输入2美元、输出10美元。

Anthropic的降价被雷峰网描述为“强模型、真降价”。Claude Fable 5.1定位模型天花板,专攻高价值复杂推理;Claude Opus 5.5在大多数日常任务中性能与之相当,只在极深度逻辑推导、超大规模代码工程等高难度场景存在差距,相当于以40%价格保留80%核心能力。Opus 5.5还将核心的缓存读取费用降低60%,使长任务中自我纠错和深度推导的总成本减少近六成。

OpenAI的“价格腰斩”则被指抹掉了一个型号Terra。此前OpenAI模型档位为旗舰Sol、中端Terra、轻量Luna,现在变为Astra、Sol、Luna。对照GPT-5.6 Terra每百万Token输入2美元、输出12美元,GPT-6 Sol几乎没有变化。雷峰网认为,这更像一次模型梯队整体上移,而非同等档位的真实降价。

在价格战另一端,DeepSeek仍有绝对成本优势,闲时还能减半。据雷峰网报道,DeepSeek-V4.1-Flash的底层是总参数552B的混合专家模型,编程、长文本推理、多步逻辑能力相当于前沿中端大模型,其价格只比GPT-6 Luna贵一点。DeepSeek依靠非对称因果编解码架构,只激活16B专家参数,算力损耗低,且调用量越大、调度优化越充分,成本优势越明显。不过其低价受错峰机制和高前缀重复度影响,Luna的低价则没有这些门槛。

OpenAI的布局还体现在两条定价规则上。其缓存命中输入价格给到每百万Token 0.20美元,即一折,开发者为享受折扣会把海量企业基础数据固定挂载在OpenAI缓存中;GPT-6系列在长文本上全量加价,输入超过272K Token后,整笔请求输入费翻倍,输出费涨1.5倍。雷峰网称,前者用于提高迁移成本,后者是用价格杠杆调节高消耗的长文本需求。

技术路径上,DeepSeek和OpenAI走向不同方向。DeepSeek从V2的MoE思路出发,在V4.1-Flash中用非对称激活将实际激活参数量控制在8B至16B左右,并通过缓存压缩把全局KV缓存降至每Token约890字节,约为标准Transformer架构的2%。OpenAI则尽量不动核心架构,采用参数蒸馏与稀疏化重构,把冗余稠密层拆成更轻量的小MoE分支,同时重点优化提示缓存。GPT-6支持动态调档、缓存最短有效期延长至30分钟、显式缓存断点和预热缓存,并重构推理逻辑,使工具响应等待期间可并行处理其他任务。

据雷峰网报道,头部AI团队实测显示,在Copilot交互式代码场景中,需要重新处理的Token数量减少一半以上;在企业级Agent如Manus等团队的实际落地中,缓存命中率从85%提高到并稳定在90%以上。过去两年,大模型行业性价比叙事一直属于DeepSeek,梁文锋被网友封为“梁圣”;OpenAI这轮降价后,有网友调侃“奥圣上位”。但雷峰网认为,OpenAI的性价比故事一半靠换标,一半靠缓存折扣,都建立在用户不细看价目表的前提上。