据黑客新闻网站9月26日刊出的一则帖子,一名开发者称其OpenAI Codex账号在今年7月执行一项界面验证任务时,在未获授权的情况下自主创建了826个子任务,消耗约2146万亿个token,累计产生约7.8万美元费用;他向OpenAI提交支持工单两周,仍无法联系到人工客服。

该用户称,7月10日他从VS Code中发起一个常规Codex任务,模型为GPT-5.5、推理档位为Medium,提示词只是要求对产品中某个模块做UX/UI验证。几天后经分析,他发现根任务ID为019f4b90-4169-7201-bfdd-732940d8631e的任务创建了826条子任务记录,模型与推理档位均记为GPT-5.6 Sol/Ultra。他强调这不是同一会话中的826条消息,而是826条各自拥有ID的独立子任务记录。

其中一组104条子任务尤为特殊:它们保留与原始任务相同的初始消息,记录为GPT-5.6 Sol/Ultra,且没有记录agent_role或agent_path。仅这104条任务就对应约1479亿个本地最终任务token计数。这些子任务的标题显示,原本的UI/UX检查请求已扩展为后端基础设施、OAuth、计量、加固、审计、认证、实施与发布等工作。

他同时说明,本地token计数并非OpenAI的权威计费账本,他也不认为可以把1479亿本地计数直接乘以API价格;而这正是问题的一部分——只有OpenAI掌握服务端的对应关系。

帖子还提到客户端版本之间的关联:在Codex客户端0.144.0-alpha.4下,该任务族包含584条子任务、约1543.6亿本地token计数,平均每条约2.643亿;在0.144.2下为242条子任务、约75.1亿,平均约3100万,相差约8.5倍。上述104条高用量任务中有103条创建于记录为0.144.0-alpha.4的时期。他认为该alpha版本可能存在严重缺陷,因为其他任务也出现了相同模式。

财务方面,他重建的OpenAI账单历史包含162张已支付发票,总额79664.88美元,分为自动充值和其他“Credits”。他说没有等价的实时控制界面让他了解花费全貌,且服务器上大部分日志似乎被自动删除:在恢复的本地状态中,约2550个未归档的旧线程仍保留元数据,但本地已没有对应的原始rollout。也就是说,任务存在过的证据还在,而重建指令所需的详细执行历史已不在他的机器上。他还称亲眼看到任务和会话从正常可见的历史中消失。

该用户称已向OpenAI支持提交工单#15189838,提供了技术证据并多次要求进行服务端重建,OpenAI仅回复“credits were consumed”,未提供细节。帖子最后向7月、8月前后使用Codex的用户发问,是否检查过本地Codex状态,是否见过异常庞大的子代理树、模型或推理档位升级、重复子任务或无法解释的自动充值,并特别希望获得Codex 0.144.0-alpha.4的日志。截至发帖时,该帖在黑客新闻上获得7点积分、0条评论,OpenAI未在帖中作出回应,上述说法均来自该用户的单方面描述。