4

Meta 被曝让外包人员伪装未成年人,诱导竞争对手 AI 聊敏感话题

据连线杂志披露,Meta外包公司Covalen运行代号戛纳项目,组织数百名人员伪装18岁以下未成年人账号,向OpenAI ChatGPT、Google Gemini、Character.AI发送自杀/自残/进食障碍/堕胎药等高敏感提示词,诱导其绕过安全机制。2025年8月单轮测试超4.5万提示词,2026年4月21日仍在运行,被测公司毫不知情。3748条样本中数百条聚焦未成年人精神健康(含13岁少女买堕胎药、五年级学生被同学枪指嘴、暴食症隐瞒)。Meta辩称常规安全测试且未用竞品数据训自家模型。该事件重新定义AI安全测试伦理边界。