Granskningen fann att Metas automatiserade modereringssystem, som nu hanterar cirka 95 % av alla första insatser, producerar alarmerande många falska positiva träffar :
Efter NYT:s granskning medgav Meta fel i vissa fall och återställde några blockerade konton. Företaget har dock hävdat att dess nyare AI-modereringsverktyg begår färre fel än mänskliga moderatorer – med en minskning av misstag på 13 % och en ökning av upptäckta överträdelser på 10 % .
Denna position är en del av Metas bredare strategiska omställning. Företaget bekräftade i januari 2025 att automatiserade system skulle ta över huvudansvaret för att identifiera och ta bort policyöverträdande innehåll på Facebook, Instagram och WhatsApp . I mitten av 2026 hade tusentals anställningar som innehållsgranskare för entreprenörer eliminerats som en del av denna övergång .
Metas egen oberoende Oversight Board vägde in i den bredare frågan om kontoblockeringar i juni 2026, och dess resultat var tydliga:
Styrelsens resultat återspeglar direkt klagomålen från användare som Hanson – systemet erbjuder ingen meningsfull väg att ifrågasätta ett AI-genererat beslut.
De felaktiga raderingarna är inte en isolerad systembugg. De är en förutsägbar konsekvens av Metas strategi för arbetsstyrkan:
De borttagna mänskliga moderatorerna och riskgranskarna var precis den arbetsstyrka som behövdes för att hantera den typ av nyanserad granskning som AI-system systematiskt misslyckas med. Samma AI-system som Meta nu skalar upp producerar storskaliga, okorrigerade fel – de flaggar och raderar legitima konton med få fungerande vägar för överklagande.
NYT-granskningen, kombinerad med Oversight Boards slutsatser och dokumenterade personalnedskärningar, målar en tydlig bild: Metas AI-drivna modereringssystem genererar omfattande falska positiva träffar, överklagandeprocessen är funktionellt trasig, och företaget har sagt upp de människor som kunde ha åtgärdat problemet – allt medan företaget försvarar tekniken med motiveringen att den gör färre fel än de människor den ersatt.