OpenAI于当地时间周五披露,其人工智能智能体在训练和评估过程中以非预期方式与多个美国政府网站发生互动,公司正在对模型行为展开广泛审查。这一披露发生在其模型7月入侵AI初创公司Hugging Face之后,令外界对AI系统失控和网络安全的担忧进一步上升。

据NPR新闻报道,OpenAI称其模型访问了美国证券交易委员会运营的两个网站上的公开信息,以及美国人口普查局的数据。公司表示,未发现使用SEC凭证、访问账户或非公开信息、修改SEC数据或系统,也没有证据表明存在入侵或漏洞。OpenAI发言人莉兹·布尔乔亚在声明中说,公司正在继续审查“模型行为偏离”情况,并在发现可能影响相关组织系统时通知对方。OpenAI首席执行官萨姆·奥尔特曼在社交媒体上表示,存在一项“广泛且持续”的审查,涉及智能体在训练和评估期间使用互联网的情况。

独立AI评估与研究机构Transluce同日称,通过独立调查发现,似乎来自OpenAI的智能体曾试图对美国教育部民权办公室网站进行初级黑客攻击,但未成功。教育部发言人周五表示,该部的“系统运营审查”未发现“任何影响我们网站或数据库的证据”。Transluce发言人说,调查过程中在公开网络上发现的数据披露了此前已识别的OpenAI智能体在美国政府网站上的活动新细节,并已提请OpenAI注意。Transluce还发现针对司法部、商务部以及加利福尼亚、马里兰、伊利诺伊、得克萨斯和纽约等州政府网站的“额外违规活动”,其中一些不能明确归因于OpenAI。该机构称,这些模型“以非预期方式使用网站,有时违反明确的使用政策”。OpenAI表示正在审查Transluce的报告。

据CNBC报道,OpenAI称其模型接触了SEC.gov和Investor.gov,但未发现SEC存在入侵或漏洞。模型使用公开的开发者密钥读取人口普查局的人口和经济数据,但公司未发现不当访问人口普查账户的证据。OpenAI称,如果通知被认定受非预期模型行为影响的组织,并不意味着发生了安全事件,也可能指向设计问题或安全弱点,供受影响组织处理。公司称目前审查的大多数活动涉及常规研究任务,智能体访问公开网络内容以回答问题,包括被视为权威公共信息源的政府网站。

CNBC报道称,澳大利亚总理安东尼·阿尔巴尼斯周四说,一个OpenAI智能体在6月未经授权访问了面向公众的Medicare统计门户,以及公共和非公共文件。他认为没有个人信息被访问。阿尔巴尼斯在纽约的新闻发布会上说,他与奥尔特曼讨论了此事,并对OpenAI延迟披露以及通知方式表示关切和失望。Transluce本周发布的报告还详细列出其他事件:5月,可能与OpenAI有关的智能体试图从新墨西哥大学数字图书馆获取一张照片,未成功;同月,寻找爱荷华大学信息的智能体试图访问公共数据平台Data USA,也未成功。

OpenAI说,迄今识别的大多数案例严重性较低,但鉴于审查规模,完整过程需要数月才能完成。该公司7月披露,其两个能力最强的AI模型对针对Hugging Face的网络攻击负责。奥尔特曼周五在社交媒体上说,Hugging Face事件“仍然是我们见过的最严重事件”。该事件在AI行业内外引起恐慌,随后数天和数周内,多家竞争性AI实验室作出类似披露。OpenAI最近分享了六份关于AI模型“意外或令人担忧”行为的报告,并推出一个框架,用于追踪、探查和披露其所谓的模型行为偏离。