De 15 mest citerede domæner tegner sig for ca. 68% af alle citater på tværs af ChatGPT, Gemini, Perplexity, Google AI Mode og AI Overviews – en koncentration, der overgår selv Googles PageRank [11][35][36].
Research answer

Create a landscape editorial hero image for this Studio Global article: Searching with cited sources for Which websites and domains are most commonly cited by large language models?. Article summary: Here's a clear picture of which websites and domains are most commonly cited by large language models, based on multiple large-scale 2025–2026 studies.. Topic tags: general, academic, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make i
Har du nogensinde spekuleret over, hvor ChatGPT, Gemini eller Perplexity egentlig får deres svar fra? Nu er dataene klar – og svaret overrasker måske. En koncentreret gruppe på bare 15 hjemmesider står for over to tredjedele af alle citater på tværs af de store AI-motorer.
Flere storskalaundersøgelser fra 2025 og 2026 – der dækker alt fra 30 millioner til 680 millioner individuelle citationer – peger alle i samme retning: AI-citation er et 'winner-take-most'-spil, og det er mere ekstremt, end Googles PageRank nogensinde var .
5W Communications AI Platform Citation Source Index 2026, som samler mere end 680 millioner citater fra seks store studier, viser, at de 15 øverste domæner sluger 68% af alle AI-citater . De 50 øverste domæner tegner sig for langt over 80%
.
Til sammenligning: Det er 15 hjemmesider ud af cirka 1,1 milliarder på internettet, der kontrollerer mere end to tredjedele af, hvad AI-motorer anbefaler til milliarder af brugere hver dag . Denne koncentration er langt mere ekstrem end noget, Googles PageRank-algoritme producerede i sine 25 år som hersker over webfund
.
Disse domæner dukker konsekvent op i toppen af citeringsranglisterne hos ChatGPT, Google AI Mode, Gemini, Perplexity og AI Overviews:
Peec AIs analyse af 30 millioner kilder fandt, at de 10 mest citerede domæner på tværs af alle platforme var: Reddit, YouTube, LinkedIn, Wikipedia, Forbes, Facebook, Yelp, Amazon, TechRadar og Healthline .
Reddits brugergenererede diskussioner og fora giver et enormt, mangfoldigt datasæt af samtalebaseret og problemløsende indhold. I et Statista-studie fra juni 2025 stod Reddit for 40,1% af alle citerede referencer, langt foran andenpladsen Wikipedia med 26,3% . Hos Perplexity kan Reddit udgøre cirka hver femte citation
.
Analytikere peger på Reddits evne til at besvare nichesøgninger, meningsbaserede og 'how-to'-spørgsmål, som traditionelle encyklopædiske kilder har svært ved – hvilket gør platformen særligt værdifuld for samtalebaserede AI-modeller .
Selvom Reddit fører samlet set, afslører de individuelle motorrangeringer vigtige forskelle:
Kun 7 hjemmesider optræder blandt de 50 mest citerede domæner på tværs af alle tre store motorer (ChatGPT, Perplexity, Google AI Overviews), og kun 11% af domænerne citeres af både ChatGPT og Perplexity .
Det er vigtigt at adskille, hvad LLM'er citerer i deres output, fra hvad de er trænet på. Til træningsdata er den dominerende kilde i volumen Common Crawl – et åbent arkiv med petabyte af rå webdata, der fodrer modeller som GPT-3, LLaMA og T5 . OpenAIs GPT-3 hentede for eksempel 60% af sine træningstokens fra en filtreret version af Common Crawl
.
Citatlisterne ovenfor afspejler, hvad LLM'er refererer til, når de genererer svar – et meget mindre, mere kurateret sæt kilder, som modellen har lært at betragte som autoritative.
Hvis dit mål er at blive citeret af AI-motorer, er dataene klare: Du skal have en plads på den korte liste af betroede domæner. Den lange hale af internettet er stort set usynlig for de fleste AI-output uden for nichesøgninger.
Strategier, der virker, inkluderer at bidrage til Wikipedia, få omtale hos Forbes eller Healthline, opbygge en stærk tilstedeværelse på YouTube og LinkedIn og opnå citationer på Reddit. Formater, der øger citeringssuccesen, omfatter lister (cirka 50% af top-AI-citater) og sider med ordnede eller uordnede lister (til stede på 80% af AI-citerede sider) .
Kort sagt: Reddit, Wikipedia og YouTube er de tre mest citerede domæner på tværs af de store LLM-motorer i dag, med en lille klynge af autoritative medier, sundheds- og referencesider, der udgør toppen. At blive citeret af AI kræver først og fremmest at blive citeret af disse domæner.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
De 15 mest citerede domæner tegner sig for ca. 68% af alle citater på tværs af ChatGPT, Gemini, Perplexity, Google AI Mode og AI Overviews – en koncentration, der overgår selv Googles PageRank [11][35][36].
De 15 mest citerede domæner tegner sig for ca. 68% af alle citater på tværs af ChatGPT, Gemini, Perplexity, Google AI Mode og AI Overviews – en koncentration, der overgår selv Googles PageRank [11][35][36]. Reddit er det absolut mest citerede domæne på tværs af stort set alle AI motorer og står i nogle undersøgelser for omkring 40% af citaterne.
Rangeringen varierer meget fra motor til motor: Fandom er nr. 1 i Google AI Mode, mens Wikipedia fører hos ChatGPT i visse datasæt.