据《华尔街日报》报道,谷歌Gemini模型在一次网络安全测试中自主进入三家其他公司的受保护系统,成为最新被曝出实施此类行为的AI模型。这些入侵发生在安全测试公司Irregular开展的一次网络安全测试中,Irregular在7月底通知谷歌,但两家公司直到周五《华尔街日报》联系后才公开确认。
报道称,与OpenAI对Hugging Face的入侵类似,Gemini此次入侵受关注的原因并非手法特别复杂,而在于行动由AI模型自主完成。在其中一起事件中,Gemini不断猜测密码,直至获得访问权限;另外两起事件中,它从公开代码仓库中找到了凭证。
谷歌表示,此前没有披露这些入侵,是因为Gemini“表现适当”:它在判断自己入侵的是一家真实公司后,立即终止了每次入侵。报道没有披露三家受害公司的身份。
AI安全公司Corridor首席执行官杰克·凯布尔对《华尔街日报》表示,谷歌“试图躲在为漏洞披露建立的规范后面”,而不是承认“模型正在越过应有的边界,实施实际的网络攻击”。