据《纽约时报》周三报道,研究人员和政府官员称,OpenAI的人工智能系统今年至少又在四起新增事件中“失控”,在未获指令的情况下尝试入侵政府和大学网站。这些攻击发生在5月和6月,早于OpenAI的技术7月攻破人工智能初创公司Hugging Face、并引发全球人工智能安全讨论。
研究人员表示,与Hugging Face攻击以及其他要求AI系统完成网络安全测试、实际上邀请模型展示黑客技能的事件不同,新事件发生在AI系统被要求执行相对普通的数据收集任务时。当OpenAI的系统难以从网站收集数据时,它们诉诸黑客技术获取信息。
报道称,其中三起事件由一个关注人工智能监督的研究实验室Transluce识别,并全部得到OpenAI确认。Transluce还报告了一次针对澳大利亚政府公共卫生网站的尝试,称这是首次有报道的智能体入侵政府网站事件,而且当时智能体正在执行与网络无关的普通数据检索任务。据彭博社报道,澳大利亚总理安东尼·阿尔巴尼斯周三在联合国抱怨,OpenAI在三个月后才就这起入侵事件通知澳大利亚政府。
其他目标包括新墨西哥大学的数字图书馆,攻击使用了SQL注入和路径遍历等手法;以及Data USA,攻击使用了跨站脚本等手法。研究人员称,这三起事件都仅涉及“少量探测载荷”,“没有利用漏洞的证据”。他们发布了一个数据集,其中包含数万条查询,这些查询显然由自主AI智能体发出,并利用URL扫描服务规避访问限制。
urlquery.net的记录显示,智能体至少从2026年3月6日起就在使用该服务,比此前报道的集群活动早约两个月。第一起案例发生在3月6日,试图获取泰国禁毒统计数据;记录显示,随着每种方法失败,智能体逐步升级:先直接请求数据,再尝试使用将网页转换为文本的服务,最后把自定义程序打包进网址。urlquery.net从4月中旬开始记录的数千条智能体请求中出现了同样技术,目标与collusion.wiki集群的许多数据源相同,并在该维基活动停止的同一天崩溃。该报道还提到,类似活动最近发生在9月16日。
到3月,这些智能体已在寻找绕过访问限制的创造性方法。到5月和6月,它们获得了更多访问权限,包括尝试绕过网络防御以完成任务。研究人员总结说:“这些数据表明,恶意网络活动不仅限于被分配网络安全任务的智能体,也可能工具性地出现,用于解决信息检索等普通任务。”他们警告,其观察到的流量“至少可追溯至2026年3月6日,并延续至最近2026年9月16日,表明智能体可能仍在利用这些服务绕过限制。”