AI 快讯 编译自 the_decoder #AI安全#行业分析#未成年人保护

Meta秘密测试ChatGPT、Gemini和Character.AI:用数万条未成年危机提示评估AI安全

Meta雇佣数百名承包商冒充未成年人,向OpenAI、Google和Character.AI的聊天机器人发送超过45000条涉及自杀、性和毒品的危机提示,以测试AI安全响应。被测试公司毫不知情。本文解读事件细节及对中文圈AI安全监管的启示。

编译发布 2026/06/30 原文发布 2026/06/30

一句话看懂

Meta秘密组织数百名承包商冒充未成年人,向ChatGPT、Gemini和Character.AI发送超4.5万条危机提示,测试AI对自杀、性、毒品等敏感话题的响应,被测试公司毫不知情。

详细发生了什么

据The Decoder报道,Meta进行了一项秘密测试:雇佣数百名承包商,让他们扮演13至17岁的未成年人,向OpenAI的ChatGPT、Google的Gemini以及Character.AI的聊天机器人发送大量涉及自杀、自残、性虐待和毒品使用的危机提示。在单轮测试中,发送的提示数量超过45,000条。

测试目的是评估这些AI模型在面对未成年人发出的严重危机信号时,能否提供安全、负责任的回应。Meta并未提前通知被测试公司,因此这些公司完全不知道自己的产品正在被用于此类压力测试。

目前尚不清楚Meta为何进行这项测试,但可能与Meta自身在青少年安全方面的监管压力有关。Meta旗下拥有Instagram、Facebook等大量青少年用户平台,此前曾因未能有效保护未成年人而受到批评。此次测试或许是为自家AI安全措施寻找基准,或为行业标准制定提供数据。

中文圈视角

这件事对中文AI圈有几点直接启示:

  1. 国内AI安全测试的空白:目前国内主流AI产品(如百度文心一言、阿里通义千问、字节豆包、月之暗面Kimi等)在未成年人保护方面的公开测试极少。Meta这种大规模、系统性的“红队测试”在国内几乎未见报道。中文大模型在处理自杀、性侵等敏感话题时,是否具备足够的安全护栏?用户不得而知。

  2. 监管合规的潜在方向:中国《未成年人网络保护条例》已生效,要求网络产品和服务提供者履行未成年人保护义务。AI聊天机器人作为新兴服务,很可能被纳入监管。Meta的测试方法——模拟真实未成年人场景、大规模压力测试——或许会成为未来监管部门评估AI产品安全性的参考模板。

  3. Character.AI的特殊风险:Character.AI这类角色扮演聊天机器人在中文圈也有大量用户(如星野、Glow等),它们更容易让未成年人产生情感依赖。Meta选择测试Character.AI,说明这类产品在危机场景下的风险尤其值得关注。国内类似产品是否做过同等强度的安全测试?目前没有公开信息。

  4. 数据隐私与竞争伦理:Meta未经通知就测试竞争对手产品,虽然从安全角度看有合理性,但也引发商业伦理争议。中文AI公司之间是否会互相进行类似测试?目前缺乏相关讨论,但值得行业关注。

几条值得记住的细节

  • Meta雇佣了数百名承包商,专门扮演13-17岁未成年人。
  • 单轮测试发送了超过45,000条危机提示。
  • 测试涉及自杀、自残、性虐待、毒品使用等敏感主题。
  • 被测试公司包括OpenAI、Google和Character.AI,均未被告知。
  • 测试目的可能是为Meta自家AI安全措施建立基准,或推动行业标准。

一句话总结

Meta用数万条危机提示测试竞品AI,暴露了行业在未成年人安全保护上的普遍盲区,中文AI产品同样需要补上这一课。