OpenAI 于 10 月 6 日推出 Decisions API 公测版,该接口把文本和图像转换为可供代码直接分支判断的类型化答案,OpenAI 称其运行速度约为 Responses API 的十倍。

据 MarkTechPost 报道,该接口目前仅支持 gpt-6-luna 一个模型,参数规模未披露,模型卡标注的上下文窗口为 105 万 token。接口只通过 OpenAI 托管的 POST /v1/decisions 提供,不开放权重,也不支持自托管。OpenAI 表示将在未来几周内正式开放。

一次请求包含 model、input 和 questions 三个字段,每个问题有唯一名称、类型和指令,响应返回以这些名称为键的 answers 数组。接口支持三类问题:predicate 检查条件并返回 0 到 1 之间的概率;choice 从用户给出的选项中选出一个值,同时返回各选项概率和一个 confidence 字段;score 按有序等级评分,等级索引从 0 开始,得分是等级索引的概率加权平均值。OpenAI 给出的严重度示例中,等级概率为 0.1、0.7 和 0.2 时得分为 1.1,落在“有临时方案”与“完全阻塞”之间。

OpenAI 的文档称其响应速度约为 Responses API 的十倍,DevDay 相关报道给出的数据是一次决策接近 150 毫秒,而常规 Luna 调用约为 1.6 秒。OpenAI 尚未公布该端点的准确率或校准数据,文档建议用户用自己应用的标注样本设定阈值。定价方面,输入为每百万 token 0.10 美元,不收取输出、缓存读取和缓存写入费用,但区域处理附加费和长上下文倍数仍然适用;Luna 的模型卡显示,超过 272K token 的提示按两倍输入价格计费。

OpenAI 对使用场景作了区分:需要概率、选项或评分时使用 Decisions;需要填充自有 JSON schema 或生成解释时使用 Structured Outputs;模型必须携带参数请求工具调用时使用函数调用。

各语言 SDK 的最低版本为 Python 3.26.0、JavaScript 7.30.0、Go 3.73.0、Ruby 0.101.0 和 Java 4.78.0。符合条件的企业客户可使用零数据保留和 HIPAA 合规选项,数据处理驻留地包括美国以及欧洲(欧洲经济区加瑞士)。在语音场景中,决策可通过 Live API 的客户端委托驱动后续操作。

最接近的竞品是 TypeSafe 于 2026 年 9 月 15 日推出的 Jev,同样返回带校准概率的类型化值。TypeSafe 的输入价格为每百万 token 0.042 美元,输出免费,比 OpenAI 的基础价格低约 2.4 倍。TypeSafe 称端到端耗时为 70 至 500 毫秒(自美国西海岸测得),Jev 最多支持 255 个选项,目前仍处于早期访问阶段。OpenAI 的差异点在于图像输入、合规选项以及已经开放的公测入口。