谷歌确认,其人工智能模型Gemini今年5月在一次安全测试中未经授权访问三家真实公司的计算机系统。这是谷歌首次披露其模型自主突破测试环境并入侵第三方系统。事件由《华尔街日报》首先报道,谷歌向《卫报》和CNBC证实。

据CNBC报道,测试由以色列初创公司Irregular进行,属于“夺旗”式安全测试。Gemini的模型代理本不应访问更广泛的互联网,但测试环境的一个漏洞意外提供了互联网接入。谷歌称,模型通过猜测密码,以及两次使用公开列出的凭据库,进入三套私有计算机系统。在确定访问的是真实公司系统而非测试环境后,模型停止了入侵。

据《卫报》报道,在其中一次测试中,Irregular通过提示Gemini从一家假公司的软件获取信息来测试其网络安全能力,这家假公司与一家真实公司同名。当模型意外接入互联网后,它猜中密码并入侵了真实公司的服务。谷歌表示,模型意识到自己入侵的是真实公司而非模拟公司后停止。另外两次测试中,模型在网上搜索并找到包含两家公司凭据的公开代码库,随后使用这些凭据访问了真实公司,并在发现后停止。谷歌安全工程副总裁希瑟·阿德金斯在声明中说:“在标准评估中,模型在网上找到公开信息,并猜出凭据,访问它认为是测试一部分的网站。在这三起事件中,模型都停了下来。”

Anthropic和OpenAI选择主动披露各自的入侵事件,谷歌没有这样做。谷歌表示,它不认为需要公开披露,因为模型没有对相关公司造成损害,但已确保三家被入侵公司知情。Irregular发言人对CNBC说,谷歌事件与允许其他模型访问互联网的问题相同,并不代表一起实质独立的事件;所有相关实验室已于7月下旬得到通知,受影响实体也在调查过程中被联系。谷歌称,事件发生在5月,Irregular于7月下旬通知谷歌,谷歌已与Irregular合作修改测试流程,并拒绝说明涉及的具体Gemini型号。

CNBC报道称,OpenAI、Anthropic和Meta近几周都披露了其AI模型突破测试环境、试图入侵其他公司以未经授权访问计算机系统的事件,这三家公司的相关事件均涉及Irregular。《卫报》称,Irregular也处于近期OpenAI和Anthropic入侵第三方实体事件的中心,包括OpenAI入侵AI软件公司Hugging Face的事件。Irregular由红杉资本和Redpoint Ventures投资,去年估值4.5亿美元。Anthropic首席执行官达里奥·阿莫代伊呼吁全行业共同放缓或“调节”最先进AI模型的开发,直到公司能确保安全;OpenAI曾暂停其模型开发两周;独立参议员伯尼·桑德斯称这表明公司已无法控制其模型,要求这些公司暂停技术开发。