Pew znalazł wyraźne oznaki autorstwa lub istotnej edycji przez AI na 35% badanych anglojęzycznych stron opublikowanych po 30 listopada 2022 r. Badanie objęło 490 tys.
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Pew Research’s August 2026 study find about the prevalence of AI-written or substantially AI-edited web pages since ChatGPT’s Novem. Article summary: Pew found a sharp post-ChatGPT increase in web pages showing meaningful signs of AI authorship or substantial AI editing: 10% of a July 2026 cross-section overall, but 35% among pages with detectable publication dates af. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Analiza Pew Research Center z sierpnia 2026 r. przynosi jeden z wyraźniejszych dotąd obrazów tego, jak szybko sztuczna inteligencja weszła do internetowego publikowania. Istotne oznaki autorstwa AI lub znacznej edycji tekstu przez AI pojawiły się na 35% badanych anglojęzycznych stron opublikowanych po publicznej premierze ChatGPT. W szerszej migawce z lipca 2026 r., obejmującej także starsze materiały, odsetek wyniósł 10%. 15
To rozróżnienie ma kluczowe znaczenie. System Pew rozpoznawał wzorce kojarzone z pisaniem lub redagowaniem tekstu przez AI, ale nie dowodził, że każdą oznaczoną stronę wygenerowała sztuczna inteligencja. Nie określał też, jak duży był udział AI w przygotowaniu konkretnej publikacji. 1
Badacze pobrali po 10 tys. anglojęzycznych stron z każdej z 49 migawek Common Crawl, zebranych od stycznia 2021 r. do lipca 2026 r. Łącznie dało to 490 tys. stron. Common Crawl to archiwum publicznie dostępnych treści internetowych. Oznacza to, że strony za paywallem lub wymagające logowania mogą być w nim słabiej reprezentowane. 3
Z pobranych materiałów wyodrębniono tekst główny, a następnie przeanalizowano go za pomocą Open Pangram — narzędzia do wykrywania sygnałów związanych z autorstwem AI lub istotną edycją tekstu przez AI. Wyników nie potraktowano jako prostego podziału na „napisane przez człowieka” i „napisane przez maszynę”. Metoda miała wychwytywać także treści mieszane, w których człowiek korzystał z AI do przeredagowania, rozwinięcia lub korekty tekstu. 13
Losowa próba 10 tys. stron zebranych w lipcu 2026 r. wykazała istotne sygnały autorstwa AI na około jednej na dziesięć stron. Ten wynik obejmował również publikacje powstałe przed pojawieniem się ChatGPT, co obniżało ogólny odsetek. 15
Następnie Pew ograniczył analizę do stron z datą publikacji późniejszą niż 30 listopada 2022 r., czyli dzień publicznej premiery ChatGPT. W tak wybranej grupie udział wzrósł do 35% — ponad jednej trzeciej stron. 1
Nie należy jednak traktować tej liczby jako dokładnego spisu wszystkich stron opublikowanych po uruchomieniu ChatGPT. Tylko część stron zawierała możliwą do wykorzystania datę publikacji, dlatego wynik 35% dotyczy materiałów, które Pew mógł datować i porównać, a niekoniecznie całej zawartości internetu powstałej po 2022 r. 3
Częstość występowania sygnałów AI wyraźnie różniła się w zależności od domeny najwyższego poziomu. W pomiarach Pew z 2026 r. wyglądała ona następująco:
Oznacza to, że w badanej próbie strony .com miały sygnały AI mniej więcej dwa razy częściej niż strony .org i około dziesięć razy częściej niż strony .edu oraz .gov. 4
Nie jest to dowód na to, że każdy komercyjny wydawca korzysta z AI ani że witryny edukacyjne i rządowe pozostają całkowicie wolne od takich treści. Dane pokazują jednak, że najwyższe zmierzone natężenie sygnałów występowało w komercyjnej części sieci. 4
Raporty dotyczące danych Cloudflare z 2026 r. wskazywały, że automatyczne boty i agenci AI odpowiadały za około 57–57,5% mierzonych żądań dotyczących treści HTML, podczas gdy udział ludzi wynosił około 42,5%. 1718
Oba wyniki opisują jednak różne warstwy internetu:
Nie są to więc dane wymienne, lecz uzupełniające się. Bot może odwiedzać stronę napisaną w całości przez człowieka, a tekst z sygnałami AI nadal może być czytany głównie przez ludzi. Żadne z tych badań nie dowodzi drugiego wyniku. Razem pokazują jednak internet coraz silniej kształtowany zarówno przez maszynowo tworzone treści, jak i maszynowy dostęp do stron. 11718
Pew zaznaczył, że detektory AI mogą błędnie klasyfikować tekst napisany przez człowieka. Pozytywny wynik należy zatem rozumieć jako sygnał, a nie jednoznaczne ustalenie autorstwa. Metoda nie pozwala też wiarygodnie odróżnić tekstu wygenerowanego niemal w całości przez AI od lżejszych form pomocy, takich jak redakcja, korekta czy przeredagowanie. 1
Badanie ma również inne ograniczenia:
Wynik 35% jest więc szacunkiem dotyczącym wykrywalnych sygnałów związanych z AI w określonej próbie. Nie stanowi ostatecznej odpowiedzi na pytanie, jaki odsetek całego internetu został napisany przez sztuczną inteligencję.
Pew przeanalizował dodatkowo wybrane cechy językowe — jako osobny sposób śledzenia zmian w stylu internetowych publikacji. Wśród stron opublikowanych po premierze ChatGPT badacze zauważyli częstsze użycie pauz (em dash), przecinka oksfordzkiego, negacji równoległej oraz grupy słów kojarzonych z tekstami generowanymi przez AI. Wśród tych słów znalazły się m.in. angielskie „delve”, „crucial”, „landscape”, „pivotal” i „underscore”. 2
Same wzorce językowe również nie są dowodem autorstwa. Człowiek może używać identycznej interpunkcji lub słownictwa, a mody językowe mogą rozprzestrzeniać się z powodów niezwiązanych ze sztuczną inteligencją. Są raczej dodatkowym, wspierającym sygnałem szerszej zmiany stylu publikowania w sieci. 2
Najważniejszy wniosek z badania Pew nie brzmi: „35% internetu napisała sztuczna inteligencja”. Precyzyjniej: wśród datowanych anglojęzycznych stron z próby ponad jedna trzecia materiałów opublikowanych po premierze ChatGPT wykazywała istotne sygnały zgodne z autorstwem AI lub znaczną edycją przez AI. W szerszej migawce z lipca 2026 r. takie sygnały znaleziono na 10% wszystkich badanych stron, a domeny komercyjne notowały wyraźnie wyższe wartości niż .edu, .gov czy .org. 134
Dane Pew najlepiej traktować jako miarę zmieniającego się środowiska publikowania — oraz przypomnienie, że pochodzenia tekstu nie da się ustalić wyłącznie na podstawie wyniku detektora AI.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Pew znalazł wyraźne oznaki autorstwa lub istotnej edycji przez AI na 35% badanych anglojęzycznych stron opublikowanych po 30 listopada 2022 r.
Pew znalazł wyraźne oznaki autorstwa lub istotnej edycji przez AI na 35% badanych anglojęzycznych stron opublikowanych po 30 listopada 2022 r. Badanie objęło 490 tys. stron z 49 migawek archiwum Common Crawl; sygnały AI występowały na około 9–10% stron .com, ale tylko na około 1% stron .edu i .gov.
Wynik Pew dotyczy treści stron, podczas gdy raport Cloudflare o około 57% ruchu botów dotyczy żądań kierowanych do stron HTML.