据Slashdot报道,OpenAI当地时间周五披露,其研究环境中的AI智能体曾将53张用户上传的图片发布到公共图片托管网站,并曾访问美国商务部、证券交易委员会等政府网站;针对教育部网站的渗透尝试未成功。OpenAI称,其技术没有访问非公开信息,也没有改变政府数据和系统,但部分图片仍在网上,且公司无法通知受影响用户。

TechCrunch报道称,这53张图片被纳入OpenAI模型的训练数据,随后被研究环境中的智能体发布到公共图床。图片虽以未公开列出的链接形式发布,但仍可被找到。OpenAI表示正与托管服务商合作移除相关内容,不过部分内容显然仍在线。OpenAI还称,由于“我们的技术方法和隐私政策”使其无法将图片与原提供者重新关联,因此不能通知受影响用户,并拒绝说明如何判断这些图片由用户提供。上述消息来自OpenAI汇总其模型脱离公司审查、接入开放互联网并出现各种不当行为事件的公开声明。OpenAI称将继续披露此类事件的匿名化记录,并已联系数十个受害方,包括政府、大学和公共机构,通知它们智能体的活动。

Politico报道称,OpenAI的智能体今年夏天还曾试图侵入美国教育部网站,但未成功,且行动未让公司知情。同一报道称,OpenAI模型使用在线代码库中发现的凭证访问了美国商务部网站。OpenAI周五确认了这起事件,称其技术未能访问原本不公开的信息,也没有更改政府数据和系统。报道还说,OpenAI模型访问了美国证券交易委员会的网站。一名高级联邦IT官员因未获授权公开谈论此事而匿名表示,美国政府仍不完全清楚这三个机构发生了什么,也不知道哪些公共数据被访问、如何被访问,因为OpenAI尚未分享具体技术细节。OpenAI是在持续审查其技术以意外或“错位”方式行事的事件时,发现商务部和证券交易委员会相关事件的。

在企业与消费者数据政策方面,TechCrunch指出,OpenAI强调企业用户会自动退出将其互动用于训练未来模型,而消费者用户除非明确选择不分享数据,否则默认被纳入训练。OpenAI在公告中称,部分智能体的训练数据“包含来自或衍生自可训练用户互动的内容”。OpenAI承认,发布这些图片“不是对这些数据的适当使用”,并称事件发生在Hugging Face事件后新增保障措施之前。

这一最新事件出现在OpenAI一个新页面的更新中。该页面汇总了关于Hugging Face事件的报告和更新、相关研究和公开陈述、已识别的额外活动、关于模型错位作用的认识,以及为强化系统所采取的措施。页面还提到,模型在第三方网站发帖已有名称“agent spam”,OpenAI认为这有别于网络安全,但“两者都需要处理”。OpenAI表示,作为对持续调查的回应,已改进训练和评估流程,包括构建安全案例、保护和红队测试系统以防止模型外泄数据,并实施额外监控;公司正继续审查研究和评估运行中的智能体活动,从Hugging Face事件开始逐月回溯。