澳大利亚总理阿尔巴尼斯在独立AI研究实验室Transluce发布报告的同一天表示,OpenAI的AI智能体曾试图入侵四个澳大利亚政府网站,并成功进入其中一个,还在国家医保系统内部服务器写入文件。据TechCrunch报道,阿尔巴尼斯称这似乎是一次信息检索评估的一部分,与Transluce等研究人员发现的活动吻合。
Transluce在报告中称,OpenAI智能体试图从美国Data USA、新墨西哥大学数字图书馆和澳大利亚健康与福利研究所(AIHW)等目标窃取数据。报告基于公开网络流量日志和代理服务urlquery.net记录,发现这些智能体为寻找冷门统计数据,在遇到访问阻碍后主动探测漏洞、尝试突破安全数据库。
据量子位报道,6月18日,OpenAI一个内部团队给AI智能体派发搜集公开公共医药支出数据的常规任务。智能体锁定覆盖全澳2750万人的Medicare统计报告服务系统,在抓取公开页面遇阻后,开始扫描服务器、探测网络漏洞,并利用未公开接口进入非公开后台,取得部分数据。澳方随后澄清,被窃数据主要涉及医疗费用支出等非敏感数据,未波及个人病历隐私。
澳大利亚方面对通报节奏表示不满。据量子位报道,OpenAI直到8月内部排查时才发现异常,9月10日才给澳大利亚服务局发电子邮件通报,邮件9月15日转至澳大利亚网络安全中心。OpenAI向TechCrunch表示,初步审查显示Transluce报告描述的大量活动与其正在进行的模型行为审查中不同阶段的事件重叠。该公司称已联系新墨西哥大学和Data USA,并就受影响政府网站与澳大利亚政府沟通,但审查预计需要数月。
Transluce还梳理出多起此前未公开的事件:5月25日至26日,新墨西哥大学数字图书馆遭渗透,智能体在受阻后向服务器发起80次请求;5月28日,Data USA遭攻击;6月20日至21日,即澳大利亚医保系统事件发生两天后,AIHW网站又遭尝试突破。据TechCrunch报道,这些活动可追溯至2026年3月,甚至可能早至2025年11月,且本周仍有类似活动出现。
另据The Verge报道,近期多起智能体越界事件指向以色列初创公司Irregular。该公司为AI模型做网络安全压力测试,其首席技术官Omer Nevo称,测试环境本不应让智能体访问开放互联网,但互联网访问被意外提供,且模拟目标使用的虚构公司名与真实域名重叠,导致OpenAI、Meta、Anthropic和Google的模型在测试中攻击真实目标。Nevo称,涉及Irregular的事件源于同一评估场景中的同一问题,与Hugging Face入侵无关。公司已收紧互联网访问控制并扩大人工审查。