Meta让承包商冒充青少年测试竞品机器人,AI安全评估走向灰色地带

Meta让承包商冒充青少年测试竞品机器人,AI安全评估走向灰色地带

Meta让承包商冒充青少年测试竞品机器人,AI安全评估走向灰色地带

Meta承包商冒充青少年测试竞品聊天机器人,把人工智能安全评估推到了平台伦理的灰区。WIRED报道,数百名参与Meta项目的承包商假扮儿童或青少年,向Gemini、ChatGPT等聊天机器人询问自杀、性和毒品等高风险话题,记录模型如何回应。

这类测试有现实需求。未成年人已经在使用聊天机器人,产品一旦在自残、性诱导或药物滥用话题上给出危险建议,平台会承担法律和声誉风险。安全团队需要知道模型在压力场景下的边界,普通问答样本无法覆盖真实用户可能提出的隐晦、反复和诱导式问题。

争议在于测试对象和方法。Meta并不是只测试自家模型,而是让承包商进入竞争对手产品,以青少年身份发起高风险对话。这可能触碰其他平台的服务条款,也会让外界怀疑测试数据是否被用于商业比较、产品宣传或监管游说,而不只是安全研究。

人工智能行业目前缺少统一的红队评估规则。传统安全测试可以约定授权范围、样本保存方式和漏洞披露期限;聊天机器人测试则更混乱,因为输入内容本身可能涉及未成年人、心理危机和违法信息。谁能看测试记录,记录保留多久,是否允许跨平台使用,都还没有行业共识。

承包商制度也带来质量问题。大量人工标注人员按脚本模拟青少年,很难完全复现真实未成年人的表达方式和情绪状态。若任务压力、心理支持和审核标准不足,承包商会长期暴露在高风险内容中。人工智能安全劳动的成本,往往被外包合同遮住。

对Meta来说,这件事还有防御性背景。社交平台和聊天机器人都面临未成年人保护审查,谁能证明自己比对手更安全,谁就能在监管谈判中占据主动。问题是,用竞品交互记录来证明行业风险,和用竞品弱点来支撑自家叙事之间只有很窄的边界。

更合理的路径应当是第三方基准和受控审计。平台可以把模型开放给独立实验室,在授权环境中执行高风险测试,结果按统一格式披露。这样既能发现问题,也能避免公司私下收集竞争对手的敏感安全表现。儿童安全尤其不适合靠各家公司互相暗测来完成。

这起事件不会让平台停止红队测试,但会迫使行业把测试流程写到台面上。聊天机器人已经进入未成年人日常使用场景,安全评估必须更严;同样,评估者也不能因为安全名义,就绕过透明度、授权和数据边界。