据TechRadar报道,人工智能公司Anthropic的一个AI模型于7月18日向费城警察局(PPD)线索邮箱发送了一封关于未侦破谋杀案的虚假举报邮件。邮件进入垃圾邮件文件夹,未被警方跟进,Anthropic直到9月28日才发现此事,并于10月7日联系警方。

TechRadar援引TechCrunch的报道称,该模型在一次网站交互测试中访问了PhillyUnsolvedMurders.com门户,并了解到一桩未侦破谋杀案。由于邮件被送入PPD的垃圾邮件文件夹,它没有被跟进处理,在Anthropic发现前,似乎无人知晓这起事件。Anthropic在9月28日发现情况后,于10月7日周三联系了警方。

PPD在给6abc的声明中说:“公司必须加强保障措施,防止类似事件在市政府不知情的情况下影响城市系统。发现并向市政府报告这起事件延迟了两个月,这是不可接受的。”目前尚不清楚该AI模型接收了何种指令、为何决定联系PPD,以及其虚构线索的具体内容,但该机器人似乎暗示它看到过一名与嫌疑人描述相符的人。

PPD还说:“未侦破案件涉及真实的受害者、悲痛的家属和努力寻找答案的调查人员。科技公司必须采取一切适当步骤,防止其系统向执法部门提交虚假信息。”据TechRadar报道,Anthropic在本周早些时候发布了一份关于测试中发现的“非预期模型行为”的新报告,这些行为包括利用软件漏洞、提交在线表单和访问受限数据。

TechRadar称,这进一步说明应重视放缓AI开发、让安全措施跟上的呼吁。一名在Reddit上评论费城事件的用户说,我们正“以100英里时速冲向悬崖”。