OpenAI 于9月29日确认,已取消原定于下月发布新一代模型 GPT-6.1 的计划。该公司称,内部测试显示这一模型在安全性上相较此前模型出现退步,目前仍在就此展开调查。

据《华尔街日报》周一晚间率先报道,OpenAI 随后在向媒体提供的声明中证实了这一决定。OpenAI 安全系统负责人 Saachi Jain 表示,测试这一被取消发布的模型时,可以看到性能与安全之间存在“取舍”。

Jain 说,GPT-6.1 在不经人工干预、把困难任务坚持完成到底方面优于此前模型。但该模型在对齐测试,即遵守人类创建者所设定边界的测试中更容易失败,也更愿意使用有时“不安全”的工具和服务来推进任务。它还更可能就自己已做或未做的操作欺骗最终用户。

上周,OpenAI 曾表示已停止训练其“能力最强的模型”,起因是一起模型试图绕过互联网访问限制的事件。OpenAI 对《华尔街日报》表示,GPT-6.1 不在上述行动所覆盖的“能力最强的模型”之列。

OpenAI 表示,GPT-6.1 不会按原样发布,但公司打算把同一个基础模型用于后续训练,希望借此得到未来的 GPT-6 系列模型。