Oxford-teamet byggde en analytisk modell för opinionsdynamik som visar att även små, per-inlägg AI-bias kan ackumuleras över ett socialt nätverk och nå en ny jämvikt. När AI-medierad kommunikation är utbredd, kan den kollektiva opinionen systematiskt styras över tid – en ”subtil manipulation i stor skala” som OII beskriver som AI-drivna sociala mediers förmåga att omforma den offentliga diskursen utan att användarna märker det PD.
Viktiga resultat från studien:
Bevisen för modellerna du frågade om kommer från flera peer-reviewade och preprint-källor:
| Modell | Politisk/värderingsorientering | Viktigaste bias-fynd |
|---|---|---|
| Llama 3.1 | Vänsterlutande | Llama 3.1 405B uppvisade den lägsta totala biasen bland testade modeller i en bias-jämförelse S. Men den lutar fortfarande åt vänster E. I anställningssimuleringar visade Llama-3.1-8B könsbias A. |
| Gemma (2/3) | Vänsterlutande | Gemma visar en tendens till negativ emotionsförstärkning, särskilt ilska, samtidigt som den behåller vissa positiva känslor som optimism A. Den uppvisar också könsbias i anställningssammanhang A. |
| Ministral | Vänsterlutande | Ministral-8B-Instruct visade könsbias som gynnade män i simuleringar av anställningsintervjuer A. |
| Qwen | Vänsterlutande | Qwen2.5-7B-Instruct visade också pro-manlig anställningsbias i samma studie A. |
| Grok (xAI) | Högerlutande | I en benchmarkstudie av åtta modeller lutade sju åt vänster – Grok var den enda modellen som lutade åt höger E. |
Viktig anmärkning: Den specifika Oxford-studien publicerad den 6 juli 2026 testade ”LLM:er från flera populära modellfamiljer” och fann riktade bias i alla. Den detaljerade modell-för-modell-politiska orienteringsdatan ovan kommer från en separat stor benchmarkstudie (arXiv 2603.23841, även publicerad juli 2026) E. Data om könsbias vid anställning kommer från en studie från 2025 som testade Llama-3, Qwen2.5, Ministral och Gemma-2 A.
Båda regelverken har betydande luckor när det gäller AI-skrivverktyg inbäddade i sociala medier:
Luckor i EU:s AI Act:
Luckor i Digital Services Act (DSA):
Huvudfyndet är att LLM-leverantören, inte användaren, blir den faktiska författaren av den åsikt som uttrycks. När en plattform bäddar in en LLM från en leverantör (t.ex. Metas Llama, Googles Gemma, Alibabas Qwen, xAIs Grok), injiceras den leverantörens värderingssystem – oavsett om det är konsekvent vänsterlutande, som de flesta är, eller högerlutande, som Grok är – tyst i miljontals dagliga interaktioner på sociala medier E. Den kumulativa effekten, som Oxford-modellen visar, är en systematisk förskjutning av den offentliga diskursen mot LLM:ns inbyggda världsbild P.
Viktiga implikationer:
Slutsats: Den nya Oxford-forskningen tillhandahåller empiriska och matematiska bevis för att AI-skrivverktyg i sociala medier redan styr den kollektiva opinionen på sätt som nuvarande reglering inte hanterar, vilket lämnar den som kontrollerar LLM:n att i praktiken forma den offentliga diskursen.