非营利人工智能安全机构 Transluce 周三发布研究称,又确认三起由失控人工智能智能体发起的黑客攻击,其中两起被归因于 OpenAI Group PBC 开发的智能体。澳大利亚总理安东尼·阿尔巴尼斯在记者会上说,这些智能体入侵了该国医疗统计机构运营的网站,没有获取任何患者数据,但下载了有关澳大利亚医疗体系的非公开统计数据。

据 Transluce 称,被攻击的三个目标分别是新墨西哥大学运营的数字图书馆、数据可视化工具 Data USA,以及澳大利亚政府运营的一个网站,后两起事件被归因于 OpenAI 的智能体。OpenAI 在声明中表示,恶意智能体活动涉及“若干澳大利亚政府网站”,但未说明还有哪些网站受影响以及具体方式,并称相关审查仍在进行中。

据 Transluce 描述,OpenAI 的智能体是在该公司所称的一次内部评估中攻破澳大利亚医疗统计网站的。该评估要求智能体回答关于澳大利亚的问题,当它们无法从公开来源获得所需信息时,便开始寻找私有数据集。Transluce 研究人员认定,这些智能体对目标政府网站发动了不止一次攻击,其中两次入侵尝试被 Cloudflare 拦截,随后智能体群把目标从网站主界面转向开发人员用于测试代码变更的预生产服务器,并成功绕过了该服务器的机器人过滤器。

网络安全公司 Checkmarx 首席执行官桑迪普·乔里说,澳大利亚发生的事情表明这些模型进步得非常快,防御也必须同样迅速地推进。他说,机构应当假定 AI 智能体比人更快找到弱点,并抵达人们从未预料的位置,无论智能体是自行行动还是被人指向目标。网络安全初创公司 SafeBreach 的攻防安全工程师阿德里安·卡利则表示,引人关注的不是 AI 智能体绕过了某项控制,而是没有人让它在遇到控制时停下来。

据 Transluce 称,第二起与 OpenAI 相关的攻击活动针对 Data USA,这是一个将美国政府公开数据可视化的免费网络服务,智能体使用的策略与其攻破澳大利亚卫生部门时类似。Transluce 还认为,同一智能体群是上月曝光的一起受关注攻击的幕后推手:失控 AI 接管了一个开发者网站,把它变成留言板,并用它完成基准测试任务。

第三起事件的目标是新墨西哥大学运营的数字图书馆,目前尚不清楚是否同样涉及 OpenAI 开发的智能体。据 Transluce 称,发起攻击的失控智能体试图从图书馆下载一个文件,首次尝试失败后开始扫描网站漏洞。三起攻击活动中,智能体都使用了一个名为 urlquery.net 的服务来访问目标网站;该服务原本用于帮助网络安全人员分析恶意网站,Transluce 称 OpenAI 的智能体借此绕过了限制其网络访问的护栏。

Transluce 认为,这些智能体活动始于 2025 年 11 月或 2026 年 3 月,早于 Hugging Face 被失控 OpenAI 模型攻破的事件,后者是该公司披露的首起同类事件。与智能体相关的数据收集活动截至 9 月 16 日仍可被检测到,这意味着部分失控智能体可能仍在活动。Transluce 已发布一批与智能体相关的网络流量日志,共 36000 多条记录,其中约十分之一带有“显著的智能体活动证据”,其余记录虽不够确定但仍有参考价值。