頭15個網站攞走大約68%嘅AI引用份額,包括ChatGPT、Gemini、Perplexity同Google AI Overviews在內嘅主流引擎都係咁——集中程度比Google PageRank年代仲要誇張[11][35][36] Reddit係幾乎每個主要AI引擎嘅引用冠軍,有研究顯示佢佔咗成40%嘅引用份額,Wikipedia同YouTube分別排第二同第三[4][11][16] 唔同引擎嘅排名有好大差異:Google AI Mode嘅第一名係Fandom(遊戲同流行文化維基),而ChatGPT喺某啲數據集入面就以Wikipedia領先[14]
研究答案

Create a landscape editorial hero image for this Studio Global article: Searching with cited sources for Which websites and domains are most commonly cited by large language models?. Article summary: Here's a clear picture of which websites and domains are most commonly cited by large language models, based on multiple large-scale 2025–2026 studies.. Topic tags: general, academic, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make i
你有冇諗過ChatGPT、Gemini或者Perplexity回答問題嘅時候,啲資料係從邊度嚟㗎?而家數據已經好清楚——答案可能會令你嚇一跳。得15個網站,就佔晒所有主要AI引擎超過三分之二嘅引用來源。
多個2025至2026年嘅大規模研究——涵蓋咗3000萬到6.8億次獨立引用事件——都得出同一個結論:AI引用係一個贏家通吃嘅遊戲,而且比當年Google PageRank仲要極端。
5W Communications嘅《AI平台引用來源指數2026》整合咗超過6.8億次引用數據,發現頭15個網站霸佔咗68%嘅AI引用份額。頭50個網站加埋更超過八成
。
你諗下:互聯網有大約11億個網站,但係得15個就控制咗AI引擎每日向幾十億用戶推薦嘅內容超過三分之二。呢種集中程度,比Google PageRank統治網絡搜尋25年嚟嘅任何時候都更加極端
。
以下呢啲網站喺ChatGPT、Google AI Mode、Gemini、Perplexity同AI Overviews嘅引用排名入面 consistently 排喺最前:
Peec AI分析3000萬個來源後,總結出跨平台嘅頭10個最常引用網站係:Reddit、YouTube、LinkedIn、Wikipedia、Forbes、Facebook、Yelp、Amazon、TechRadar同Healthline。
Reddit嘅用戶生成討論同論壇內容,提供咗一個大量、多元化嘅對話同解決問題嘅數據庫。喺2025年6月Statista嘅研究中,Reddit食咗40.1%嘅引用參考,遠遠拋離第二位Wikipedia嘅26.3%。喺Perplexity,Reddit大約佔咗五分之一嘅引用
。
分析師指出,Reddit擅長回答一啲好偏門、基於意見同「點樣做」嘅問題——呢啲正正係傳統百科全書式嘅來源搞唔掂嘅——所以對對話式AI嚟講特別有價值。
雖然Reddit整體領先,但每個引擎嘅個別排名反映出重要差異:
只有7個網站同時出現喺ChatGPT、Perplexity同Google AI Overviews三個引擎嘅頭50名最多引用網站入面,而同時被ChatGPT同Perplexity引用嘅網站比例只得11%。
大家要搞清楚:大型語言模型輸出時引用嘅網站,同佢哋訓練時用嘅數據係兩回事。
訓練數據方面,份額最大嘅來源係Common Crawl——一個開放嘅網絡數據倉庫,儲存咗PB級別嘅原始網頁數據,用嚟訓練GPT-3、LLaMA、T5等模型。OpenAI嘅GPT-3,佢嘅訓練 tokens 有60%嚟自經過篩選嘅Common Crawl版本
。
上面講嘅引用排名,反映嘅係大型語言模型生成回答時會參考嘅來源——呢個係一個細好多、經過篩選,而且模型認為權威性高嘅網站清單。
如果你嘅目標係想俾AI引擎引用,數據講得好清楚:你一定要打入呢個短名單。網絡嘅長尾部分,除咗好冷門嘅查詢之外,對大部分AI輸出嚟講基本上係隱形嘅。
有效嘅策略包括:投稿去Wikipedia、爭取喺Forbes或Healthline呢類網站嘅報導、建立強大嘅YouTube同LinkedIn存在感,同埋喺Reddit上獲得引用。另外,容易提高引用成功率嘅內容格式包括清單式文章(listicles,大約佔頂級AI引用嘅50%)同埋包含有序或無序列表嘅頁面(呢類頁面喺被AI引用嘅網頁中佔咗80%)。
簡單講:Reddit、Wikipedia同YouTube係目前各大主要大型語言模型引擎最常引用嘅三個網站,加上一小群權威媒體、健康同參考網站,組成咗頂級嘅引用階層。想被AI引用,首先要被呢啲網站引用。
Studio Global AI
此頁麵包含一個有來源支援的答案,您可以在 Studio Global 內繼續。
頭15個網站攞走大約68%嘅AI引用份額,包括ChatGPT、Gemini、Perplexity同Google AI Overviews在內嘅主流引擎都係咁——集中程度比Google PageRank年代仲要誇張[11][35][36]
頭15個網站攞走大約68%嘅AI引用份額,包括ChatGPT、Gemini、Perplexity同Google AI Overviews在內嘅主流引擎都係咁——集中程度比Google PageRank年代仲要誇張[11][35][36] Reddit係幾乎每個主要AI引擎嘅引用冠軍,有研究顯示佢佔咗成40%嘅引用份額,Wikipedia同YouTube分別排第二同第三[4][11][16]
唔同引擎嘅排名有好大差異:Google AI Mode嘅第一名係Fandom(遊戲同流行文化維基),而ChatGPT喺某啲數據集入面就以Wikipedia領先[14]