調査によれば、Metaの自動モデレーションシステム(現在、最初の対応の約95%を処理)は、深刻な誤検知(偽陽性)を生み出している。
NYTの問い合わせを受け、Metaは一部のケースで誤りを認め、停止された特定のアカウントを復旧した。しかし同社は、新しいAIモデレーションツールは人間のモデレーターよりもミスが13%少なく、違反検出率は10%向上していると主張している。
この立場は、Metaの広範な戦略転換の一部だ。同社は2025年1月に、自動システムがFacebook、Instagram、WhatsApp全体でポリシー違反コンテンツを特定・削除する主要な責任を負うと確認していた。2026年半ばまでに、この移行の一環として数千人もの請負モデレーター職が削減された。
Meta自身の独立した監視委員会(Oversight Board)は、2026年6月にこの広範なアカウント無効化問題に関する見解を発表し、その内容は厳しいものだった。
委員会の見解は、ハンソン氏のようなユーザーの不満を直接的に裏付けるものだ。すなわち、システムはAIが下した決定に異議を唱えるための意味のある道筋を提供していない。
この誤った削除は、単なるシステムの不具合ではない。Metaの人材戦略の当然の帰結である。
解雇された人間のモデレーターやリスクレビュー担当者はまさに、AIシステムが体系的に失敗するような微妙な判断を必要とするレビューを処理するために必要な人員だった。Metaが拡大しているのと同じAIシステムが、大規模で訂正不能なエラーを生み出し、正当なアカウントにフラグを立てて削除しているのだ。そして、それに対する実質的な異議申し立ての手段はほとんどない。
NYTの調査、監視委員会の見解、そして記録された人員削減の事実を総合すると、鮮明な絵が浮かび上がる。MetaのAI主導のモデレーションシステムは広範な誤検知を生み出しており、異議申し立てプロセスは実質的に機能不全に陥っている。そして同社は、それを修正できるまさにその人材を解雇した。しかもMetaは、この技術が、解雇した人間よりもミスが少ないという理由で擁護しているのだ。