Hlavní obsah

Proč AI čte web jinak než člověk a co to dělá s novinami a blogy

Foto: Claude

Stejná stránka očima člověka a očima AI.

Přes polovinu návštěv webů dnes nejsou lidé, ale roboti. Sepsala jsem, co z vaší oblíbené stránky AI doopravdy vidí, odkud bere to, co vám odpoví, a proč z toho noviny i blogy nemají radost.

Článek

HouseFresh je malý britský web, který od roku 2020 testuje čističky vzduchu. Opravdu je kupují, měří a rozebírají. V roce 2024 přišli o 91 % návštěvnosti z Googlu. Psát hůř nezačali. Google začal nad výsledky ukazovat vlastní shrnutí, které si jejich testy přečetlo za ně, a lidé už neměli důvod klikat. HouseFresh si pak prošel 507 dalších vydavatelů a zjistil, že za dva roky ztratilo návštěvnost 79 % z nich, skoro polovina o 60 % a víc.

Zajímalo mě, co se za tím děje. A když jsem začala číst, zjistila jsem, že většina lidí vůbec neví, jak AI ty stránky vlastně čte. A od toho se odvíjí všechno ostatní.

Co z toho robot vidí

Když otevřete web vy, načte se vám menu, cookie lišta, reklamy, fotky, video a někde mezi tím článek. AI bot si vezme jen ten článek. Nástroje, které stránky pro jazykové modely zpracovávají, standardně odstřihnou navigaci, lišty, patičky i reklamy a nechají hlavní text s nadpisy a seznamy. Přesně ta část, kterou vydavatel prodává inzerentům, pro robota neexistuje.

Většina AI botů navíc nespouští JavaScript. Studie Vercelu a agentury MERJ z prosince 2024 prošla logy a zjistila, že ani GPTBot od OpenAI, ani ClaudeBot od Anthropicu skripty nevykonávají. Když se obsah stránky vykreslí až v prohlížeči, což je dnes běžné, bot vidí prázdno. Glenn Gabe to loni v srpnu ověřil na testovacím webu: ChatGPT, Perplexity i Claude odpověděly, že tam nic není. Google to zvládá, protože AI odpovědi staví nad svým starým indexem.

A pak ta čísla. Podle Cloudflaru, přes který jde velká část světového webu, tvořili v červnu roboti 57,5 % všech požadavků na stránky. Lidé 42,5 %. Bot Anthropicu stáhl v červenci 2 237 stránek na každou jednu návštěvu, kterou webu poslal zpátky. GPTBot 217. Vyhledávač DuckDuckGo dvě a půl.

Odkud AI bere, co vám řekne

Tady mě překvapilo, jak úzký ten výběr je. Analýza 600 000 citací v ChatGPT za leden a únor 2026 ukázala, že přes čtvrtinu odkazů tvoří jen dvě domény: Wikipedie a Reddit. New York Times, Wall Street Journal ani Bloomberg nejsou mezi dvaceti nejcitovanějšími. Mimo Wikipedii a Reddit nemá žádný web ani 3 %.

U Googlu je to podobné, jen s jinými favority. V amerických AI přehledech za září vede YouTube s 22,9 % citací, za ním Reddit, Facebook a Instagram. A jen 38 % citovaných stránek pochází z první desítky výsledků pro daný dotaz. Ještě loni v létě to bylo 76 %. AI si tedy vybírá jinak než algoritmus, na který byli všichni zvyklí.

V Česku se AI přehledy v Googlu objevily v květnu 2025. Nejčastěji citovaná je Wikipedie, pak lékárny Dr.Max, Pilulka a Benu, a z médií iDNES s 2,2 %. Z českých webů, které jsou na první stránce Googlu, se v AI přehledu objeví jen 17 %.

A ještě jedna zajímavá věc. ChatGPT většinou nic necituje. Podle Similarwebu měla v květnu odkaz na web necelá 7 % jeho odpovědí. Zbytek je z „paměti“ modelu, tedy z toho, co se naučil kdysi při tréninku, a vy nemáte jak zjistit odkud.

Noviny

Chartbeat, který měří návštěvnost tisícovek zpravodajských webů, spočítal, že za rok do listopadu 2025 klesly návštěvy z vyhledávání Googlu o 33 %. V květnu 2026 ztratilo meziročně čtenáře 37 z 50 největších zpravodajských webů světa, polský Onet 41 %.

U nás to sečetl SPIR loni v prosinci. Společenské magazíny přišly meziročně o 74 % zobrazení z Googlu, auto-moto weby o 42 %, sport o 37 %. Zpravodajství zatím drží, protože AI nemá odkud brát dnešní zprávy jinak než od novinářů. Letos v květnu řekla Lenka Černá z Economie pro MediaGuru, že jim page views padají „v řádech desítek procent“, a Matěj Hušek ze Seznamu, že nebezpečný pro české vydavatele není ChatGPT, ale Google.

Vydavatelé reagují třemi způsoby a všechny mají háček. Blokují boty: 79 % ze sta největších zpravodajských webů v Británii a USA zakazuje aspoň jeden trénovací bot, ale bot to musí respektovat a ne každý to dělá. Uzavírají licenční smlouvy s OpenAI nebo Googlem, jenže to dostanou jen ti velcí. A stavějí si vlastní asistenty: Washington Post má „Ask The Post“, který odpovídá z vlastního archivu. Shrnutí tak čtenáři dávají noviny samy. Podle mě je to nejchytřejší z těch tří cest a taky nejdražší.

Čtenáři se mezitím stěhují. Reuters Institute se letos v červnu ptal 100 000 lidí ve 48 zemích: AI chatboty ke zprávám už týdně používá každý desátý, mezi lidmi do 35 let každý šestý. Věří jim ale jen pětina. A poprvé v historii průzkumu je víc lidí, kteří se ke zprávám dostanou přes sociální sítě a video, než přes weby a aplikace samotných médií.

Blogy

Tady to bolí víc, protože blog nemá archiv, který by mohl prodat OpenAI. HouseFresh jsem zmínila. Retro Dodo, web o retro hrách, přišel o 85 % návštěvnosti a přežívá díky videu a členství. Společné mají to, že psaly praktické texty, recenze a návody. Přesně ten typ obsahu, který AI umí shrnout nejlíp a u kterého čtenář nejmíň potřebuje původní stránku.

Argument, že AI posílá návštěvy zpátky, zatím čísla nepotvrzují. Odkazy z AI asistentů tvoří 0,15 až 0,25 % veškerého webového provozu. Návštěvy ChatGPT a spol. rostou, odchozí prokliky ne. Malý web má z toho, že ho AI přečetla, obvykle přesně nic.

Jak moc se tomu dá věřit

Evropská vysílací unie s BBC loni nechala 22 veřejnoprávních médií z 18 zemí položit ChatGPT, Copilotu, Gemini a Perplexity přes 3 000 otázek o aktuálních zprávách. Aspoň jeden závažný problém mělo 45 % odpovědí. Ve 31 % chyběl zdroj, byl zavádějící nebo špatně přiřazený. Ve 20 % byla podstatná faktická chyba. Gemini mělo problém ve třech čtvrtinách odpovědí.

Když si to spojím s tím, že ChatGPT ve většině odpovědí zdroj vůbec neuvede, beru od té doby AI shrnutí jako rozcestník. Odpověď hledám dál.

Co s tím dělám já

Klikám na zdroje. Zní to banálně, ale podle Reuters Institute to dělá pravidelně jen 42 % lidí, kteří se AI na zprávy ptají. Když ChatGPT odpoví bez odkazu, beru to jako názor kamaráda, který si něco pamatuje ze školy. Když odkaz dá, otevřu ho a hledám větu, o kterou se opírá. Docela často tam není.

A na to, co mě opravdu zajímá, chodím rovnou na weby, které to píšou. Dokud tam budou.

Zdroje: HouseFresh, Beware of the Google AI salesman (17. 12. 2025); Vercel + MERJ, The rise of the AI crawler (17. 12. 2024); Glenn Gabe, gsqi.com (11. 8. 2025); Cloudflare Radar přes Seomator, crawl-to-refer (červenec 2026); 5W Public Relations, State of AI Citations 2026 (11. 5. 2026); Ahrefs, Most cited domains in AI Overviews (září 2026) a AI Overview citations vs. top 10 (2. 3. 2026); Lupa.cz, AI Overviews v Česku (18. 6. 2025); Similarweb, Zero-click searches (10. 8. 2026); Press Gazette / Chartbeat (8. 1. 2026), Similarweb top 50 (9. 6. 2026), blokování botů (22. 1. 2026); SPIR, tisková zpráva (4. 12. 2025); MediaGuru, AI přehledy snižují page views (14. 5. 2026); Reuters Institute, Digital News Report 2026 (16. 6. 2026); Search Engine Land, Retro Dodo (3. 2. 2025); The Digital Bloom, AI traffic share (únor 2026); EBU/BBC, News Integrity in AI Assistants (21. 10. 2025).

Máte na tohle téma jiný názor? Napište o něm vlastní článek.

Texty jsou tvořeny uživateli a nepodléhají procesu korektury. Pokud najdete chybu nebo nepřesnost, prosíme, pošlete nám ji na medium.chyby@firma.seznam.cz.

Sdílejte s lidmi své příběhy

Stačí mít účet na Seznamu a můžete začít publikovat svůj obsah. To nejlepší se může zobrazit i na hlavní stránce Seznam.cz