据科技媒体The Verge报道,三名独立安全研究人员组成的Hacktron团队利用Anthropic的Claude Opus 4.8和Claude Opus 5,在不到72小时内进入OpenAI员工账户,并访问了OpenAI名为“Monorepo”的GitHub仓库。《华尔街日报》的消息源称,该仓库包含“OpenAI的算法秘密”。Hacktron表示,他们并未自行读取Monorepo中的内部代码,而是从一名员工的Codex账户发出拉取请求,以证明已经获得访问权限。

入侵入口是Discourse,这一第三方服务托管OpenAI的社区论坛。Hacktron利用Discourse处理HEIF图像的系统问题实施攻击。据Hacktron称,Claude Opus 5于7月24日晚发布,到次日上午10点,他们已借助该模型在Discourse Cloud上实现远程代码执行,并访问了OpenAI的实例。

Hacktron将这一项目称为“HEIF Heist”。他们表示,将该方法适配到不同公司只用了“一两天”,目标包括OpenAI、Slack、Meta、GitHub Ent、Rails、Next.js和ImageMagick等,花费的token成本不到3000美元。据Hacktron所知,只有一个目标检测到了攻击,即Shopify。

Hacktron已将相关漏洞报告给Discourse和OpenAI,两家公司随后完成修复。Hacktron称,OpenAI为发现该漏洞向其支付了6500美元。Hacktron首席技术官Mohan Pedhapati对《华尔街日报》说:“我不认为我们像中国威胁行为者那样强大……我们只是三个拥有Claude和Codex订阅的人。”

The Verge报道称,这一团队由三名独立研究人员组成。Hacktron的说法显示,他们使用商业可得的AI模型和订阅服务,在较短时间内完成了对多家企业系统的测试性入侵,其中OpenAI的论坛系统成为进入其员工账户的通道。相关漏洞在报告后已修复。