据MarkTechPost报道,OpenAI本周发布GPT-6.1 Sol。该模型升级自GPT-6 Sol,是GPT-6家族的中档模型。OpenAI称,它在智能体编程、电脑操作和专业工作上接近GPT-6 Astra,标准输入和输出价格仅为Astra的五分之一,缓存输入降至每百万tokens 0.10美元,比GPT-6 Sol低50%。该模型已作为托管模型上线,可在OpenAI API中以gpt-6.1-sol调用,并进入ChatGPT Work和Codex。
OpenAI目前提供三档GPT-6模型。GPT-6 Astra每百万tokens输入10美元、输出50美元、缓存输入1美元;GPT-6.1 Sol分别为2美元、10美元和0.10美元;GPT-6 Luna分别为0.10美元、0.50美元和0.01美元。报道称,缓存价格对智能体尤其重要,因为智能体每一步都会重新发送相同的系统提示、工具模式和对话历史。GPT-6.1 Sol的缓存读取成本为未缓存输入费率的5%,低于GPT-6 Sol的10%。
OpenAI在发布文章中称,竞品数字来自公开报告。在DeepSWE v1.1上,GPT-6.1 Sol以约五分之一成本匹配GPT-6 Astra,并在更低推理努力下比GPT-6 Sol最佳成绩高6.4个百分点。在测试复杂专业PDF问答的GDP.pdf上,Sol在带回退机制的情况下超过Claude Opus 5.5,每任务成本不到后者一半。在AutomationBench 1.0.6上,Sol在中等努力下比Opus 5.5高2.2分,成本约为后者三分之一。
电脑操作方面,在OSWorld 2.0离线集上,Sol在最大努力下比GPT-6 Sol高7分,与Astra差距2.1分,每任务成本约为Astra七分之一。在Terminal-Bench Science 0.1上,Sol在最大努力下的得分是GPT-6 Sol两倍以上,每任务平均成本5.47美元,而Opus 5.5为23.21美元,Astra为23.80美元。Astra仍以68.1%领先,OpenAI建议将其用于最难的研究任务。事实性方面,在低努力下,出现事实错误的回答占比从11.4%降至7.7%,降幅约32%。
开发者信息方面,GPT-6.1 Sol上下文窗口为1,050,000 tokens,最大输出128,000 tokens,知识截止日期为2026年4月30日,支持文本和图像输入。reasoning.effort支持low、medium、high、xhigh和max,默认medium,不支持none和minimal。工具调用应使用Responses API,Chat Completions可在不使用工具调用时使用。超过272K输入tokens的提示词,输入和缓存费率按2倍计,输出按1.5倍计。Batch和Flex便宜50%,Fast模式为标准价格2倍。支持美国和欧盟数据驻留,但Fast模式不能与欧盟驻留同时使用,且不支持微调。OpenAI还计划数日内在Codex中推出GPT-6.1 Sol Ultrafast选项,承诺token生成速度最高可达标准速度8倍。
价格对比显示,Claude Sonnet 5.5每百万tokens输入2美元、输出10美元,与Sol标价相同,但Sol缓存输入为0.10美元,是Sonnet 5.5 0.20美元的一半。OpenAI的基准测试将Sol与Opus 5.5比较,而非Sonnet 5.5。Gemini 3.1 Pro Preview输入价格与Sol相同,输出为12美元,仍处于预览阶段。报道指出,标价并非直接成本比较,Anthropic称其较新分词器对相同文本会产生约30%更多tokens。GPT-6.1 Sol为闭源模型,仅通过API提供;Astra仍在最难科学任务上领先。