据Slashdot在2026年10月5日报道,美国佛罗里达州一名女性因Anthropic人工审核团队发现并上报其Claude对话而被捕;她涉嫌威胁“扫射”李县治安官办公室,并在之后提到获得一把新枪。法庭记录显示,她于9月30日面临佛州法律第836.10条重罪指控,即书面或电子形式威胁实施大规模枪击或恐怖主义行为,案件也把AI聊天审核与执法上报的边界推到台前。

Tom's Hardware的报道称,逮捕报告描述了Anthropic的内容监测机制:系统会扫描聊天中的关键词和可能被视为威胁的内容,并根据严重程度决定是否升级至人工审核。在这起案件中,审核团队决定将发现上报执法部门。这名来自博尼塔斯普林斯的女性在家中被拘留,过程中未发生意外,随后李县治安官办公室一名情报侦探接手案件。

报道指出,逮捕报告目前尚未进入法院卷宗,但查阅法院记录可看到9月30日登记了上述重罪指控。截至报道时,Anthropic没有就案件发表评论。

Anthropic公开隐私政策于9月10日生效,其中称,当公司善意相信“披露对于……防止对任何人或财产造成严重伤害是合理必要的”时,可能向执法部门披露信息。该政策为可能的披露留出空间。

Anthropic针对2025年下半年的政府请求报告则采用更窄的紧急披露标准,即“某人面临死亡或严重人身伤害的危险”,并列出该期间执法部门提出的紧急请求为零;不过,该报告不统计Anthropic自行做出的转介。