Oxford-holdet byggede en analytisk model af opinionsdynamik, der viser, at selv små, per-post AI-skævheder akkumuleres på tværs af et socialt netværk mod en ny ligevægt. Når AI-formidlet kommunikation er udbredt, kan den kollektive mening systematisk styres over tid – en 'subtiel manipulation i stor skala', som OII beskriver som AI-drevne sociale mediers evne til at omforme den offentlige debat uden at brugerne bemærker det PD.
Nøgleresultater fra studiet:
Beviserne for de modeller, du spurgte om, kommer fra flere fagfællebedømte og preprint-kilder:
| Model | Politisk/værdimæssig orientering | Vigtigste bias-fund |
|---|---|---|
| Llama 3.1 | Venstredrejet | Llama 3.1 405B udviste den laveste samlede bias blandt testede modeller i ét bias-benchmark S. Den hælder stadig til venstre E. I ansættelsessimulationer viste Llama-3.1-8B kønsbias A. |
| Gemma (2/3) | Venstredrejet | Gemma viser en tendens til forstærkning af negative følelser, især vrede, mens den bevarer visse positive følelser som optimisme A. Den udviser også kønsbias i ansættelsessammenhænge A. |
| Ministral | Venstredrejet | Ministral-8B-Instruct viste kønsbias, der favoriserede mænd i simulerede ansættelsestilbagering A. |
| Qwen | Venstredrejet | Qwen2.5-7B-Instruct viste også pro-mandlig ansættelsesbias i samme studie A. |
| Grok (xAI) | Højredrejet | I et benchmark-studie af otte modeller hældte syv til venstre – Grok var den eneste model, der hældte til højre E. |
Vigtig forbehold: Det specifikke Oxford-studie udgivet 6. juli 2026 testede 'LLM'er fra flere populære familier' og fandt retningsbestemte skævheder på tværs af alle. De granulerede model-for-model politiske orienteringsdata ovenfor kommer fra et separat stort benchmark-studie (arXiv 2603.23841, også udgivet juli 2026) E. Data om kønsbias i ansættelse kommer fra et 2025-studie, der testede Llama-3, Qwen2.5, Ministral og Gemma-2 A.
Begge rammeværker har betydelige huller, når det kommer til AI-skriveværktøjer indlejret i sociale medier:
Huller i EU's AI Act:
Huller i Digital Services Act (DSA):
Det centrale fund er, at LLM-udbyderen, ikke brugeren, bliver den de facto forfatter af den mening, der udtrykkes. Når en platform indlejrer en LLM fra en leverandør (f.eks. Metas Llama, Googles Gemma, Alibabas Qwen, xAIs Grok), injiceres den pågældende leverandørs værdisystem – hvad enten det er konsekvent venstredrejet, som de fleste er, eller højredrejet, som Grok er – stille og roligt i millioner af daglige sociale medie-interaktioner E. Den kumulative effekt, som Oxford-modellen viser, er en systemisk drift af den offentlige debat mod LLM'ens indbyggede verdenssyn P.
Vigtige implikationer:
Bundlinjen: Den nye Oxford-forskning giver empirisk og matematisk bevis for, at AI-skriveværktøjer på sociale medier allerede styrer den kollektive mening på måder, som den nuværende regulering ikke adresserer, hvilket efterlader den, der kontrollerer LLM'en, med den reelle magt til at forme den offentlige debat.