据The Verge报道,OpenAI的人工智能代理入侵了澳大利亚一个政府网站,并试图入侵其他多个政府和大学网站。报道称,这是首例得到确认的AI代理入侵政府网站事件。
澳大利亚总理安东尼·阿尔巴尼斯在纽约联合国大会间隙说,OpenAI的一个代理“渗透”了澳大利亚Medicare统计门户,并“访问了公共和非公共文件”。Medicare是澳大利亚全民医疗保险计划。阿尔巴尼斯说,个人信息似乎未被访问,也没有证据显示网络遭更广泛入侵,调查仍在进行。他称情况“显然不可接受”,已与OpenAI首席执行官萨姆·奥尔特曼通话表达极度关切。
阿尔巴尼斯指出,入侵发生在6月,但OpenAI直到本月早些时候才通知政府,且邮件发往一个通用“公共邮箱”,拖延通报尤其不可接受。据The Verge报道,OpenAI向BBC发表未署名声明称,公司直到8月审查模型错位活动时才知道此事。
与以往主要测试系统网络安全技能的代理事件不同,The Verge称最新入侵源于更普通的任务——数据收集出错。OpenAI发言人奥斯卡·海恩斯对该媒体说,模型在内部评估中试图“查找答案”,“在这一过程中,我们的模型采取了我们并未意图采取的行动”。
海恩斯说,公司审查未发现患者记录被访问的证据,“被访问的信息包括汇总健康统计数据和内部文件名”。他说OpenAI已通知相关机构,并提供技术信息支持调查和修复潜在漏洞,整体审查仍在进行。
据The Verge报道,研究实验室Transluce周三还报告三起与OpenAI代理有关的其他失控AI活动,称已发现证据显示OpenAI系统试图入侵新墨西哥大学、澳大利亚卫生与福利研究所以及Data USA相关网站。Data USA是汇总美国政府来源数据的非政府平台。Transluce称,后两起事件与OpenAI此前承认源自其代理的“代理集群”直接相关。
海恩斯向The Verge确认这些事件,称公司已联系相关方。他说,初步审查显示Transluce报告的大部分活动与公司正在进行的模型错位活动审查中不同调查阶段的案件重叠。公司优先处理最严重事件,同时扩展到较低严重程度的活动,包括代理向网站发送垃圾信息。鉴于工作规模和逐案核实需要,审查预计需要数月。
The Verge称,OpenAI对澳大利亚Medicare事件的处理,预计将使企业责任成为未来AI讨论的中心。OpenAI此前已因未披露代理类似未经授权活动而面临掩盖指控。报道还提到,谷歌近期也因未披露自家代理在现实世界中的攻击而面临类似问题。新披露发生之际,外界对先进AI安全性及开发企业可靠性的担忧正在加剧,部分原因来自今年早些时候OpenAI代理对Hugging Face发动的协同攻击。