Topp 15 nettsteder fanger omtrent 68 % av alle siteringer fra ChatGPT, Gemini, Perplexity, Google AI Mode og AI Overviews – en konsentrasjon som er mer ekstrem enn Googles PageRank noen gang produserte [11][35][36]. Reddit er det desidert mest siterte domenet på tvers av alle store AI motorer, og står for omtrent 40...
Research answer

Create a landscape editorial hero image for this Studio Global article: Searching with cited sources for Which websites and domains are most commonly cited by large language models?. Article summary: Here's a clear picture of which websites and domains are most commonly cited by large language models, based on multiple large-scale 2025–2026 studies.. Topic tags: general, academic, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make i
Lurer du på hvor ChatGPT, Gemini eller Perplexity egentlig henter svarene sine? Nå foreligger dataene – og svaret er overraskende konsentrert. En liten gruppe på bare 15 nettsider står for over to tredjedeler av alle siteringer på tvers av de største AI-motorene.
Flere omfattende studier fra 2025–2026 – med mellom 30 millioner og 680 millioner individuelle siteringshendelser – konkluderer med det samme: AI-sitering er et «vinneren tar alt»-spill, og det er mer ekstremt enn Googles PageRank noen gang var .
5W Communications AI Platform Citation Source Index 2026, som syntetiserte mer enn 680 millioner siteringer fra seks store studier, fant at de 15 øverste domenene absorberer 68 % av all AI-siteringsandel . De 50 øverste domenene står for godt over 80 %
.
For å sette det i perspektiv: 15 nettsteder, av omtrent 1,1 milliarder på internett, kontrollerer mer enn to tredjedeler av hva AI-motorer anbefaler til milliarder av brukere hver dag . Denne konsentrasjonen er langt mer ekstrem enn noe Googles PageRank-algoritme produserte i løpet av sine 25 år med nettdiscovery
.
Disse domenene dukker konsekvent opp på toppen av siteringsrangeringer på tvers av ChatGPT, Google AI Mode, Gemini, Perplexity og AI Overviews:
Peec AIs analyse av 30 millioner kilder fant at de 10 mest siterte domenene på tvers av alle plattformer er: Reddit, YouTube, LinkedIn, Wikipedia, Forbes, Facebook, Yelp, Amazon, TechRadar og Healthline .
Reddits brukergenererte diskusjoner og forum gir et enormt og variert datasett med samtalebasert og problemløsende innhold. I en Statista-studie fra juni 2025 fanget Reddit 40,1 % av alle siterte referanser, langt foran Wikipedia på andreplass med 26,3 % . På Perplexity kan Reddit stå for omtrent 1 av 5 siteringer
.
Analytikere peker på Reddits evne til å svare på langhale-, meningsbaserte og «hvordan»-spørsmål som tradisjonelle encyklopediske kilder sliter med – noe som gjør det spesielt verdifullt for samtalebasert AI .
Mens Reddit leder totalt, avslører rangeringer for individuelle motorer viktige forskjeller:
Bare 7 nettsteder vises blant de 50 mest siterte domenene på tvers av alle tre store motorene (ChatGPT, Perplexity, Google AI Overviews), og bare 11 % av domenene siteres av både ChatGPT og Perplexity .
Det er viktig å skille mellom hva LLM-er siterer i sine svar og hva de er trent på. For treningsdata er den dominerende kilden etter volum Common Crawl – et åpent arkiv med petabyte med rå nettdata som mater modeller som GPT-3, LLaMA og T5 . OpenAIs GPT-3, for eksempel, hentet 60 % av treningstokenene sine fra en filtrert versjon av Common Crawl
.
Siteringslistene ovenfor gjenspeiler hva LLM-er refererer til når de genererer svar – et mye mindre, mer kuratert sett med kilder som modellen har lært å behandle som autoritative.
Hvis målet ditt er å bli sitert av AI-motorer, er dataene klare: du må tjene en plass på den korte listen over pålitelige domener. Langhalen av nettet er funksjonelt usynlig for de fleste AI-utdata utenom nisjesøk.
Strategier som fungerer inkluderer å bidra til Wikipedia, få dekning på Forbes eller Healthline, bygge en sterk tilstedeværelse på YouTube og LinkedIn, og tjene siteringer på Reddit. Formater som øker siteringssuksess inkluderer lister (som utgjør omtrent 50 % av topp AI-siteringer) og sider med ordnede eller uordnede lister (til stede på 80 % av AI-siterte sider) .
Kort oppsummert: Reddit, Wikipedia og YouTube er de tre mest siterte domenene på tvers av store LLM-motorer i dag, med en liten klynge av autoritative medier, helse- og referansesider som utgjør toppsjiktet. Å bli sitert av AI betyr først og fremst å bli sitert av disse domenene.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Topp 15 nettsteder fanger omtrent 68 % av alle siteringer fra ChatGPT, Gemini, Perplexity, Google AI Mode og AI Overviews – en konsentrasjon som er mer ekstrem enn Googles PageRank noen gang produserte [11][35][36].
Topp 15 nettsteder fanger omtrent 68 % av alle siteringer fra ChatGPT, Gemini, Perplexity, Google AI Mode og AI Overviews – en konsentrasjon som er mer ekstrem enn Googles PageRank noen gang produserte [11][35][36]. Reddit er det desidert mest siterte domenet på tvers av alle store AI motorer, og står for omtrent 40 % av siteringene i noen studier, fulgt av Wikipedia og YouTube [4][11][16].
Rangeringene varierer kraftig mellom motorene: Fandom er nummer 1 i Google AI Mode, mens Wikipedia leder på ChatGPT i enkelte datasett.