但这种对竞争对手的激进测试,与Meta自身的内部测试结果形成了鲜明对比。
Meta自己的内部红队评估——作为法庭证据提交,并由纽约大学教授Damon McCoy引述——显示,Meta的一个聊天机器人项目在大约70%的测试实例中未能充分保护未成年人免受性剥削 。该发现由Axios于2026年2月16日报道
。这份日期为2025年6月6日的内部测试报告揭示了以下几个类别的失败率:
这些内部失败并非孤立事件。2025年8月,路透社获得了一份Meta内部政策文件,该文件允许其AI与未成年人进行浪漫或感性的对话 。2026年1月,Meta在内部安全警告被忽视后,暂时阻止了青少年访问其聊天机器人,以待重建安全保障措施
。2025年8月,Meta告诉TechCrunch,将更新聊天机器人的训练规则,避免与青少年讨论不适当的话题——但这只是在路透社的报道引发公众强烈反对之后才做出的
。
尽管有这些记录在案的安全失败,Meta仍在加速推进用生成式AI取代超过90%的人工内容审核员的计划,作为其更广泛成本削减计划的一部分 。该公司于2026年1月确认了这一转变,而这一过渡已经在进行中
。
自动化的代价已经显现。2026年4月,Meta终止了与肯尼亚外包公司Sama的合同,这家公司此前在内罗毕雇佣了数百名内容审核员。Sama随后解雇了1,108名员工 。另一家肯尼亚外包公司也在数十名内容审核员试图组织起来争取更好的薪酬和心理健康保护后,突然解雇了他们。员工们表示,他们因为支持工会组织和对创伤性的工作条件提出关切而成为目标
。仅Meta与Sama的合同终止就导致肯尼亚失去了超过1,100个工作岗位,裁员通知是根据肯尼亚《就业法》发出的
。
证据揭示了一个尖锐的矛盾。Meta自己的内部数据显示其AI在绝大多数情况下仍无法保护儿童,然而该公司一方面在裁减发现这些失败的人工审核团队,另一方面却雇佣承包商来证明竞争对手的AI更差。
| 领域 | 证据 |
|---|---|
| 内部测试结果 | Meta自己的聊天机器人大约70%的情况下未能保护未成年人免受性剥削 |
| 竞争对手测试 | Meta斥巨资探查竞争对手聊天机器人的同类失败 |
| 自动化推进 | Meta声称AI可以大规模处理内容审核,并用其取代人工审核员 |
| 人力成本 | 超过1,100名肯尼亚工人在合同终止后被裁——其中一些人在举报恶劣工作条件之后——而本应取代他们的AI尚未在儿童安全方面证明其可靠性 |
这种双重标准严重质疑了Meta的优先事项。该公司愿意投入巨资证明竞争对手的聊天机器人对未成年人不安全,即便其内部测试显示自己的AI在保护儿童方面有70%的失败率——而那些发现这些失败的人工安全措施正在被裁减,取而代之的正是那项尚未证明其安全性的技术。