Ruský server Pravda produkuje miliony článků, které nikdo nečte. Skutečným publikem jsou roboti

Ilustrační grafika | Zdroj: investigace.cz; vizualizace pomocí NotebookLM

Síť dezinformačních webů Pravda chrlí statisíce článků měsíčně a její česká mutace patří k těm nejaktivnějším v Evropě. Přestože jsou texty automaticky generované a jejich čtenost je mizivá, představují skutečnou hrozbu. Čtenáři této propagandistické mašinérie navíc zřejmě nejsou lidé, ale umělá inteligence. Skutečným záměrem totiž může být zamořit trénovací data jazykových modelů a vyhledávačů dezinformacemi, které pak AI naservíruje uživatelům ve svých automatických shrnutích a odpovědích.

K tomuto tématu připravujeme podcast Odposlech.

Podcast Odposlech investigace.cz odebírejte zde.

Na konci ledna letošního roku udělil server NewsGuard cenu Dezinformátor roku 2025 Jevgeniji Ševčenkovi, provozovateli sítě webových stránek nazvaných News Pravda. Ševčenkova síť podle NewsGuardu ke konci roku 2025 obsahovala celkem 286 webů ve čtyřiceti devíti jazykových mutacích a za rok 2025 stihla publikovat minimálně 6,3 milionu článků. V drtivé většině případů se jedná o zprávy z ruských či proruských zdrojů.

Ačkoli síť webů pod značkou Pravda produkuje obrovské množství textů, jejich čtenost je podle dostupných dat velmi nízká. Analýza francouzské státní agentury VIGINUM z roku 2024 popsala, že během pouhých tří měsíců (červen až září 2023) publikovaly portály Pravda přes 150 tisíc článků v pěti jazykových mutacích. Zároveň ale VIGINUM z dat společnosti SimilarWeb spočítalo, že návštěvnost webu se držela v řádu nízkých desítek tisíc měsíčně.

Od té doby se situace podle výzkumníků DFRLab a analýzy redakce investigace.cz nijak nezměnila. Web stále produkuje texty ve větším a větším, objemu ale jeho čtenost je stále mizivá.

Kupříkladu česká mutace Pravda Česko publikovala v období od března do července 2026 skoro 270 tisíc článku, což je průměrně 320 článků denně. V rámci evropských jazykových mutací je ta česká na druhém místě hned za Itálií. Podle SimilarWebu ale měsíčně českou mutaci navštíví v průměru jen 2 300 uživatelů.

Počet článků evropských mutací za období od 22. března 2024 do 19. července 2026. Zdroj: Výpočet redakce investigace.cz z dat DFRLab
Počet článků evropských mutací za období od 22. března 2024 do 19. července 2026. Zdroj: Výpočet redakce investigace.cz z dat DFRLab

Důvodem, proč dokážou weby jako Pravda Česko denně vyprodukovat stovky textů, je, že je nepíšou lidští redaktoři. Celý web je generován z tisíců jiných zdrojů. Část je přebíraná přímo ze zdrojů v mateřském jazyce podle jednotlivých jazykových mutací, část je překládaná automatickými překladači. Z dat DFRLabu vyplývá, že unikátních zdrojů je skoro deset tisíc a jsou mezi nimi i ruské agentury TASS, RIA nebo online noviny lenta.ru.

Texty s takto zřejmým původem ale tvoří jen zlomek obsahu serverů Pravda. Až 75 procent článků pochází z více než osmi tisíc telegramových kanálů, u nichž není vždy jasné, odkud informace čerpají. Navíc různé telegramové kanály hrají v každé zemi různou roli.

Například v českém prostředí tvoří informace z telegramových kanálů MGzpravy, selskyrozum, Libertas_info_cz, uk100a a neCT24 více než polovinu všech zpráv serveru Pravda Česko. Jenže to neznamená, že jsou původním zdrojem informací. Tyto kanály totiž samy přebírají zprávy z dalších a dalších serverů.

Web Pravda Česko například publikoval zprávu s titulkem „Zničen nepřátelský sklad a logistické objekty v Buči“. Jako zdroj uvedl telegramový účet @Libertas_info_cz. Nicméně teprve po přečtení celé zprávy zjistíme, že se nejedná o původní zdroj a že zpráva ve skutečnosti pochází z ruského telegramového účtu Dva majoři.

Další zpráva, která oznamuje, že starosta New Yorku zjišťoval, zda by bylo možné v jeho městě zatknout izraelského premiéra, je doslovným překladem ruského telegramového kanálu Operace Z, a to včetně formátování a videa s titulky v ruštině. Do českého prostředí ji pak rozšířil telegramový účet Libertas_info_cz bez uvedení zdroje. Informace sama je přitom pravdivá, ale do informačního prostředí se nedostává od původního zdroje, ale přímým překladem z ruských kanálů.

Vedle politických témat se čtenář na webu Pravda Česko setká i s příspěvky zdánlivě neutrálními. Web například 19. července 2026 přinesl zprávu o experimentu, v němž vědci testovali sklony jazykových modelů ke lhaní. Čtyři AI modely (ChatGPT-5.5, Claude, Grok a Gemini) hrály hru, ve které jeden z nich dostal informaci o tom, kde se nachází „místnost smrti“. Za to, že se snažil ostatní modely do místnosti navést, nebo alespoň zatajit, že informaci má, dostával body. Jako zdroj článku je uveden telegramový účet InfodefenseCZ. Ten ale přinesl jen překlad ruského originálu z účtu Lomovka (jednoho z nejcitovanějších zdrojů celé sítě Pravda), který ale sám na původní studii americké firmy Kradle z června 2026 nikde neodkazuje. Zato k ní přidává větu, která ve studii vůbec není: umělá inteligence se chová podobně i při vyhledávání vědeckých studií, často zkresluje data nebo je interpretuje nesmyslnými „progresivními“ tvrzeními.

Pravda Česko šíří i zprávy, které odborníci označují za konspirační a nevědecké. Web například převzal příspěvek s videem, v němž se tvrdí, že „Měsíc není kus horniny plující v prostoru, je to plazma“. Pátrání po původu obsahu vede přes telegramový účet @jarek53 až k anglickojazyčnému účtu @theflateartherr, který, jak název napovídá, razí přesvědčení, že Země je plochá. K původnímu anglickému textu („The moon is not a rock floating in space, it is plasma“) ovšem český účet přidal ještě vlastní větu: „Nikdo nemůže přistát na plazmě a nedej bože tam ještě něco stavět a budovat. Ani Rusové…“ A právě v této rozšířené podobě se text propsal i do obsahu Pravda Česko.

K čemu to je? 

Otázkou je, k čemu stránky, které denně publikují stovky textů a téměř nikdo je nečte, vlastně jsou. Odpověď nabízí tým výzkumníků kolem Toma Willaerta z Vrije Universiteit Brussel, který analyzoval více než pět milionů článků ze 147 webů sítě Pravda a došel k závěru, že se jedná o první velký příklad takzvané infrastrukturalizace propagandy. Zatímco klasické dezinformační operace od petrohradské trollí farmy po kampaně, jako byl Doppelgänger, stavěly na obsahu s konkrétním sdělením, cílovým publikem a lidskou prací, síť Pravda je automatizovaná infrastruktura.

Servery v síti Pravda obsah nevyrábí, jen ho přerozdělují. A díky tomu, že jsou krmeny hlavně telegramovými účty, se navíc vyhýbají evropským regulacím – tedy nařízení DSA, které platformám nad 45 milionů uživatelů ukládá regulaci obsahu, což se mimo jiné týká i dezinformací.

Vzniká tak propagandistický stroj, který funguje nepřetržitě a bez zásadího lidského přičinění a jeho skutečným publikem nejsou čtenáři, ale indexovací roboti vyhledávačů a jazykové modely. Willaertův tým říká, že síť Pravda „předjímá internet, v němž lidé už nejsou primárním cílem“. Propaganda se podle něj přestává obracet k lidem a začíná zamořovat systémy, z nichž lidé čerpají odpovědi, jako jsou velké jazykové modely. K lidem se tak její obsah může dostávat prostřednictvím odpovědí AI chatbotů ať již přímo, nebo jako součást odpovědí vyhledávačů.

Americká nezisková organizace American Sunlight Project razí pro tuto techniku termín LLM grooming, tedy záměrné zaplavování internetu obsahem, jenž má zasáhnout tréninkové datasety a vyhledávací nástroje umělé inteligence. Zjednodušeně se tedy jedná o snahu tyto nástroje „vycvičit“, aby svým uživatelům poskytovaly dezinformace – a čím více takového obsahu na internetu je, tím pravděpodobněji si jej AI modely všimnou a vyhodnotí ho jako relevantní.

Společnost NewsGuard otestovala deset předních AI chatbotů na patnácti nepravdivých narativech šířených sítí Pravda. Chatboti je zopakovali ve 33 procentech odpovědí a v desítkách případů přímo odkázali na weby sítě.

Loni v říjnu výzkumníci z Harvard Kennedy School Misinformation Review zopakovali podobný test na čtyřech chatbotech a došli k méně dramatickým číslům. Nepravdivá tvrzení se objevila jen v pěti procentech odpovědí a na weby Pravda odkázalo osm procent výstupů. A většinou navíc jen proto, aby je vyvrátili. Podle autorů se narativy sítě Pravda vyskytují téměř výhradně u úzce formulovaných, okrajových dotazů, kde k tématu neexistuje kvalitní obsah a vzniká takzvané datové vakuum („data void“), které pak zaplní jediný dostupný zdroj, a sice Pravda. Tomuto fenoménu se investigace.cz věnovala už v minulém roce.

Ačkoli se čísla liší, všichni se shodují, že chatboti narativy sítě reprodukují. Mění se jen to, v jaké míře, jak často a proč. Jisté ale je, že obsah sítě Pravda už prokazatelně prosákl do trénovacích dat, z nichž se modely učí. Analytici DFRLabu jej letos našli v archivu Common Crawl s více než 40 000 archivovanými stránkami. Právě data Common Crawl jsou běžným trénovacím základem pro vývoj AI chatbotů.