女子在 Claude 日记扬言枪击警长办公室,Anthropic 报警致其被捕

女子在 Claude 日记扬言枪击警长办公室,Anthropic 报警致其被捕

据 TechSpot 报道,美国佛罗里达州一名叫 Carli 的女性用户,长期把 Claude 当作私人日记来使用。9 月 26 日,她在日记中写道要去「shoot up」(枪击)李县警长办公室;次日,她又写下自己买了一把新枪。Anthropic 在监测到这些内容后,将相关记录报告给了警方,该女子随后被捕,被控违反佛罗里达州 836.10 法规的二级重罪,即书面暴力威胁罪。从写下威胁到戴上手铐,只隔了不到两天。

Anthropic 向警方报告用户记录的举动,揭示了 AI 聊天产品一个少被明说的现实:你的对话并非只有你和模型可见。主流 AI 公司普遍设有安全审查机制,对涉及暴力、自残、儿童安全等高风险内容进行标记与人工复核。当内容越过法律红线,平台有义务也有动力向执法部门报告:这既是合规要求,也是规避连带责任的自我保护。

写进对话框的每个字都可能被第三只眼看到

事件在 Hacker News 上引发热议,核心争论点是:用户到底该不该把 AI 聊天当作私人日记?一派观点认为,聊天框的拟人化交互天然诱导人倾诉,产品设计有责任把「可能被审查」的风险提示得更醒目;另一派则认为,成年人应当为自己的输入负责,把犯罪计划写进联网产品,本身就是对风险的无视。两种立场背后,是同一个未解问题:AI 时代的隐私边界到底画在哪里。

对普通用户而言,这起事件是一堂代价高昂的隐私课:不要把 AI 对话框当成带锁的日记本。任何输入到联网服务中的文字,理论上都可能经过自动化审查、人工复核,乃至移交执法部门。情绪宣泄式的「气话」与真实威胁之间的界限,在算法眼里可能远比你想象的模糊:一旦被标记,解释成本将由你承担。

气话与真实威胁的界限算法说了算

站在 Anthropic 的立场,这次上报几乎是唯一正确的选择。面对明确指向具体执法机构的暴力威胁,若平台知情不报,一旦悲剧发生将面临难以承受的法律与舆论后果。安全审查机制的存在,恰恰是为了在「用户隐私」与「公共安全」之间划出一条可执行的线:这条线或许粗糙,但不能没有。两害相权,平台只能选择上报。

此案很可能成为 AI 行业的一个标志性判例:它第一次如此直观地展示了「AI 日记」风险的真实代价。未来,各家 AI 公司的用户协议里,关于内容审查与上报义务的条款只会写得更明确。对用户来说,规则很简单:在按下发送键之前,先问自己一句,这句话敢不敢让第三个人看到。想清楚这一点,再决定要不要把秘密交给聊天框。