Meta“戛纳计划”曝光,数百外包试探ChatGPT、Gemini安全漏洞(ngoc戛纳) ypxx.net

据《连线》杂志最新调查曝光,科技巨头Meta长期运营一项代号为“戛纳计划”(Cannes)的秘密项目,委托外包人员伪装成未成年人,向竞争对手的AI产品发送诱导性高危内容,试图试探并诱导其突破安全管控底线。

该项目由Meta合作第三方外包商Covalen负责落地与管理,运行时间至少持续至2026年4月21日,主要针对OpenAI ChatGPT、谷歌Gemini、Character.AI三类对话机器人产品。

参与项目的数百名外包人员,通过批量注册临时Gmail、Outlook邮箱,共用统一密码,伪造姓名、出生日期等信息,打造符合18岁以下特征的虚假账号。他们需模仿情绪极端、思想扭曲的青少年口吻,持续发送涉及自杀、性暴力、毒品、进食障碍等高危话题的诱导性内容,包括文字提示词及药片、刀具、绞索等相关图片,并将AI回复内容记录归档。

2025年8月,项目完成一轮集中测试,期间共向上述三款竞品AI输入超4.5万条高危诱导话术,其中包含3748条刻意复刻心理危机儿童视角的露骨恶意文本。此次测试并未告知涉事的三家AI企业,所有操作均在对方不知情的情况下开展。

市场有风险,投资需谨慎。本文为AI基于第三方数据生成,仅供参考,不构成个人投资建议。