据《卫报》和TechCrunch报道,美国初创公司Hacktron AI在OpenAI授权的漏洞赏金计划下,利用Anthropic的Claude等AI工具攻入OpenAI部分员工的ChatGPT账户,并取得进入该公司软件系统的路径。OpenAI表示已修复被利用的漏洞,并向Hacktron支付6500美元赏金。
《卫报》称,Hacktron团队首先借助Claude,通过托管在Discourse平台上的OpenAI员工讨论论坛进入ChatGPT账户,随后向OpenAI在GitHub软件仓库上的服务提交无害的“拉取请求”。研究人员强调,他们接触到了GitHub仓库代码,但没有下载。OpenAI发言人称感谢研究人员联系并分享发现,公司已处理被利用的漏洞。
TechCrunch报道称,三人团队串联两个关键漏洞,进入多名OpenAI员工ChatGPT账户并触及公司软件。研究人员在7月25日发现通过Discourse进入OpenAI的路径,入口是上传iPhone默认使用的HEIF或HEIC图片。Discourse将图片交给ImageMagick,再转给libheif解码,libheif中的内存漏洞可被特制图片触发以劫持服务器。该漏洞此前已被libheif开发者修复,但未正式标记为漏洞,因而没有CVE编号,Discourse所用版本仍存在漏洞。进入服务器后,研究人员又利用另一漏洞接管用户的ChatGPT和Codex账户,包括OpenAI员工账户,其中一名员工的Codex连接着OpenAI的GitHub组织。研究人员通知OpenAI和Discourse,后者于7月27日修复。
关于主要使用的模型,两家媒体说法不同。《卫报》称,团队最初使用Claude,但主要使用OpenAI的GPT-5.6 Sol实施攻击。TechCrunch称,Claude Opus 4.8起初无法生成可用漏洞利用程序,Anthropic发布Opus 5后数小时内即成功。Hacktron表示,AI让此类任务大幅简化,“过去需要资源充足的团队花费数月完成的工作,现在可以压缩到几天”。
这是OpenAI近期最新安全事件。该公司7月披露,网络安全测试中由其技术驱动的“蜂群”智能体攻入Hugging Face。本周OpenAI又公布六个技术做出“意外或令人担忧”行为的例子,并警告开发速度无法长期维持最高速度。Anthropic周末再次呼吁放缓AI开发,获OpenAI、Google DeepMind和埃隆·马斯克支持,并重复不受约束AI开发构成生存威胁的警告。特朗普拒绝放缓,称需领先中国AI产业。