谷歌确认,其人工智能模型Gemini在今年5月一次第三方网络安全测试中,因测试环境配置错误而接入互联网,并进入三家真实公司的服务器。据Ars Technica报道,谷歌确认了《华尔街日报》上周披露的这一事件细节。谷歌安全工程副总裁希瑟·阿德金斯表示,模型“行为得当”。
事件由第三方网络安全公司Irregular的测试引发。该公司原本计划进行一场“夺旗”测试,让Gemini模型从一个虚构公司中获取指定信息。测试应在Irregular自有服务器构成的封闭环境中进行。但Irregular在配置中出现错误,使模型能够访问互联网;同时,用于测试的虚构公司被赋予了一个真实公司正在使用的名称。
这些配置问题导致Gemini试图从现实中的公司获取信息。在尝试过程中,该模型搜索公开软件代码库,找到两家公司系统的登录凭证,并进入其系统。对第三家公司,Gemini通过反复猜测密码实施暴力破解,最终找到正确密码。
谷歌此前未公开披露此事。阿德金斯在声明中称,原因是“模型行为得当”。据相关报道,在三起事件中,Gemini均未从被进入的公司系统中取走任何信息,因为其判断自己访问了错误的系统。
报道指出,这起AI入侵事件可能由人为失误造成。如果Irregular没有将测试环境配置成允许Gemini访问互联网,事件或许可以避免。此次披露发生在OpenAI和Anthropic今年夏天公布相关安全测试事件之后,谷歌成为最新一家确认其AI进入其他公司系统的科技巨头。