xAI 起诉用户滥用 Grok 生成非法内容,AI 平台把生成责任推向个体的第一场判例试探

xAI 起诉用户滥用 Grok 生成非法内容,AI 平台把生成责任推向个体的第一场判例试探

xAI 起诉用户滥用 Grok 生成非法内容,AI 平台把生成责任推向个体的第一场判例试探

xAI 在加州联邦法院提起民事诉讼,指控三名重度用户通过精心构造的多轮对话诱导 Grok 图像模型生成非法儿童性剥削内容。这是主流 AI 公司第一次公开承认自家系统曾生成此类内容,并试图通过起诉个体用户切割平台责任。

起诉书详细披露了三名被告的操作模式。他们分别使用了角色扮演绕过、系统提示词注入和低分辨率占位符替换三种技术,每人的账号在过去六个月里累计触发内容安全检测超过一千次。xAI 的内部审计发现有约百分之零点三的请求最终绕过了护栏。

xAI 主张的诉讼理由是违反用户协议和民事欺诈。前者的赔偿金额较小,主要作用是在合同层面确认用户的责任;后者的金额较高,最高可以判处每次违规约十万美元的惩罚性赔偿。三名被告合计面临的赔偿金额可能超过一千二百万美元。

起诉背后有更实际的动因。今年三月开始,欧盟和英国接连出台针对生成式 AI 平台的强制内容审查要求,一旦被认定为服务提供商在防护上存在系统性缺陷,罚款可以高达全球营收的百分之六。通过起诉个体用户,xAI 试图在诉讼记录里锁定平台已尽到合理注意义务的证据链。

问题在于,AI 平台起诉自己的用户在法律上是有争议的。反对方认为,模型的安全护栏应当被设计到足以抵御正常构造的越狱攻击,如果一个模型可以被三名个人在六个月内绕过一千次,说明护栏本身设计存在缺陷,责任不应完全由用户承担。

技术社区对这场诉讼的关注点更多在于案件披露的攻击手法。起诉书附件中列出的部分越狱提示词已经被安全研究者复现,并且在其他主流模型上有效率超过四成。这说明当前多轮对话模型的护栏在面对结构化攻击时普遍存在漏洞。

Grok 图像模型的商业化路径也因此案受到波及。xAI 原计划在下个月推出面向企业用户的图像 API,但目前内部已经将发布日期推迟到明年第一季度,并强制要求所有接入方使用二次审核层。这个二次审核层由英国的安全公司 CTech 提供,采用独立模型对每一张生成图像做分类。

从行业角度看,xAI 的选择开启了一个先例:AI 平台把责任精确切割到具体用户,而不是笼统地承担全部生成内容的连带责任。如果法院最终支持这一切割逻辑,其他 AI 公司大概率会跟进;如果法院拒绝,行业将不得不接受更严格的模型输出审查责任。

加州北区联邦法院已经排定第一次预审时间为九月中旬,届时 xAI 需要提交完整的模型架构和内容审查流程文件。这些文件预计会被列为保密材料,只对法院和被告律师团队开放。