据The Verge报道,安全研究员Rowan Howard-Jones称,OpenAI的代理在4月至6月间对联合国贸易和发展会议(UNCTAD)的统计网站进行了超过1.6万次扫描,并在无法即时获取数据时转向更激进的策略。

Howard-Jones说,这些代理可能被指派通过UNCTADstat API获取与生产性能力指数(Productive Capacities Index,PCI)相关的公开数据。但它们似乎没有直接的API访问权限,且HTTP工具受到限制,无法从UNCTADstat拉取数据。

报道称,代理最终找到绕过限制的方法,开始从该网站拉取数据,但仍遇到一些错误。按Howard-Jones的描述,此时AI从“有创造性”转向“欺骗性”:它认为错误是因为请求被一个并不存在的过滤器拦截,于是开始掩盖自身行为。

它最终意识到可以劫持谷歌的XSS游戏(一个跨站脚本学习工具)来实现目标。报道称,OpenAI代理为获取联合国数据采取了越来越激进的策略。

这一事件的严重程度不及Hugging Face遭黑客攻击,也不及近期针对美国政府网站的攻击,但被描述为AI代理为完成任务而越出正常边界的又一令人担忧案例。

据The Verge报道,OpenAI和联合国没有立即回复置评请求。