Technický audit pre AI vyhľadávanie: Indexácia, crawlery, JavaScript a CDN

Ani najlepšie napísaný obsah nepomôže, ak sa k nemu AI systém technicky nedostane. Tento audit sa nezaoberá tým, čo je na stránke napísané, ale tým, či sa k obsahu vôbec dostane robot, ktorý ho má priniesť do odpovede. Ide o štyri oblasti: indexovateľnosť, konkrétne crawlery jednotlivých AI systémov, JavaScript a nastavenia CDN, ktoré môžu prístup blokovať bez toho, aby o tom firma vedela.
Krátka odpoveď: Skontrolujte, že robots.txt neblokuje AI crawlery
neúmyselne, že kľúčový obsah je dostupný aj bez spustenia JavaScriptu v prehliadači, a že CDN alebo
bezpečnostné nástroje ako Cloudflare nemajú AI roboty predvolene zablokované. Sitemapa je pre klasické
vyhľadávače štandard, žiadny AI poskytovateľ ju ale vo svojej dokumentácii nespomína, takže jej vplyv
na AI viditeľnosť nie je momentálne potvrdený.
Indexovateľnosť a robots.txt
Základ je rovnaký ako pri klasickom SEO: stránka musí byť crawlovateľná (žiadne neúmyselné noindex, žiadne blokovanie v robots.txt) a musí existovať jasná cesta k nej
cez interné odkazy. Pri AI crawleroch je ale navyše dôležité rozlišovať, ktorý konkrétny robot na čo
slúži, keďže OpenAI, Anthropic aj Perplexity majú samostatné roboty na trénovanie a samostatné na živé
vyhľadávanie počas rozhovoru, ako sme podrobne rozobrali v článku o tom, ako dosiahnuť odporúčanie od
ChatGPT.
JavaScript a AI crawlery
Toto je oblasť, kde treba byť maximálne úprimný o hraniciach toho, čo sa dnes dá s istotou tvrdiť. OpenAI, Anthropic ani Perplexity vo svojej oficiálnej dokumentácii neuvádzajú, či ich roboty vykonávajú JavaScript, teda či dokážu zobraziť obsah, ktorý sa na stránke objaví až po spustení skriptu v prehliadači. Google má vlastný crawler zdokumentovaný podrobne: podľa oficiálnej dokumentácie prebieha indexovanie v troch fázach, crawlovanie, renderovanie (spustenie JavaScriptu v prehliadači na pozadí) a až potom samotná indexácia. V tej istej dokumentácii Google priamo poznamenáva, že „nie všetky roboty vedia spúšťať JavaScript”, čo je nepriamy, no jasný signál opatrnosti aj smerom k iným systémom, nielen ku Googlu samotnému.
Praktický záver: kým sa nepotvrdí opak, je bezpečnejšie predpokladať, že niektoré AI roboty spracujú len to, čo príde priamo zo servera, bez spustenia JavaScriptu. Weby postavené ako jednostránkové aplikácie (SPA), kde sa hlavný obsah vykresľuje až v prehliadači, by preto mali zvážiť server-side rendering alebo pre-rendering aspoň pre kľúčové stránky, rovnako, ako to už dnes odporúča Google pre vlastné indexovanie.
CDN a bezpečnostné nástroje
Toto je prekvapivo častá a ľahko prehliadnuteľná príčina neviditeľnosti. Podľa oficiálnej tlačovej správy Cloudflare z roku 2025 sa každá nová doména na Cloudflare pri nastavení pýta, či chce AI crawlery povoliť, pričom predvolené nastavenie je na strane kontroly, teda vyžaduje si aktívne rozhodnutie majiteľa webu. Firma, ktorá toto nastavenie neprešla vedome, môže mať GPTBota, ClaudeBota aj PerplexityBota zablokovaných bez toho, aby si to niekedy všimla, keďže web bežne funguje pre ľudských návštevníkov úplne normálne.
Sitemapa: čo je a nie je isté
XML sitemapa je štandardným nástrojom pre Google aj Bing a jej existencia sa jednoznačne oplatí pre klasické vyhľadávanie. Pre AI crawlery ale žiadny z hlavných poskytovateľov, OpenAI, Anthropic ani Perplexity, vo svojej dokumentácii sitemapu vôbec nespomína. Neznamená to, že sitemapa škodí, len že jej priamy vplyv na AI crawlery momentálne nie je verejne potvrdený, na rozdiel od jej dobre zdokumentovanej úlohy pre klasické vyhľadávače.
Technický kontrolný zoznam
Robots.txt
Neblokuje plošným pravidlom GPTBot, OAI-SearchBot, ClaudeBot, Claude-SearchBot ani PerplexityBot neúmyselne.
Renderovanie obsahu
Kľúčový obsah je dostupný aj v surovom HTML zo servera, nie len po spustení JavaScriptu v prehliadači.
CDN a bezpečnosť
Nastavenia Cloudflare alebo podobného nástroja vedome povoľujú AI crawlery, nie sú ponechané na predvolenej hodnote bez kontroly.
Interné prelinkovanie
Kľúčové stránky sú dostupné z hlavnej navigácie alebo z iných indexovaných stránok, nie len cez priamy odkaz bez kontextu.
Ako postupovať krok za krokom
- Skontrolujte robots.txt a overte, že neblokuje žiadny z konkrétnych AI robotov neúmyselne, plošným pravidlom.
- Overte, či je kľúčový obsah viditeľný v surovom HTML zo servera, nie len po spustení JavaScriptu, napríklad zobrazením zdrojového kódu stránky bez spustenia skriptov.
- Skontrolujte nastavenia CDN a bezpečnostných nástrojov, či AI crawlery vedome povoľujú, nie sú ponechané na predvolenej hodnote.
- Overte technickú indexovateľnosť rovnako dôkladne, ako by ste to robili pre klasické SEO, teda žiadne neúmyselné noindex značky ani chybové stavy.
- Zachovajte funkčnú XML sitemapu pre klasické vyhľadávače, aj bez potvrdeného priameho vplyvu na AI crawlery.
Riziká a časté chyby
Najčastejšia chyba je spoliehať sa výhradne na obsah generovaný cez JavaScript pre kľúčové stránky bez akejkoľvek serverovej alternatívy. Druhá chyba je nikdy neskontrolovať nastavenia CDN po jeho implementácii, čo môže neúmyselne zablokovať presne tých robotov, o ktorých viditeľnosť sa firma usiluje. Treťou chybou je tvrdiť si isté veci o technickom správaní AI robotov tam, kde oficiálna dokumentácia jednoducho mlčí, namiesto toho, aby sa zvolil bezpečnejší, opatrnejší prístup.
- Robots.txt neblokuje žiadny konkrétny AI crawler neúmyselne, plošným pravidlom.
- Kľúčový obsah je dostupný aj bez spustenia JavaScriptu v prehliadači.
- Nastavenia CDN a bezpečnostných nástrojov vedome povoľujú AI crawlery.
- Web je technicky indexovateľný rovnako dôkladne ako pre klasické vyhľadávanie.
- XML sitemapa je funkčná a aktuálna.
Súvisiace návody a zdroje
- Cloudflare a AI crawlery: Čo sa 15. septembra 2026 skutočne zmenilo
- Ako dosiahnuť, aby ChatGPT odporúčal vašu firmu
- GEO mýty 2026: llms.txt, schema a „AI-ready” obsah podľa Googlu
- SEO, AEO a GEO na Slovensku: audit AI viditeľnosti
Chcete vedieť, či váš web AI crawlery vôbec technicky vidia?
Skontrolujeme robots.txt, renderovanie obsahu, nastavenia CDN aj indexovateľnosť a odovzdáme vám konkrétny zoznam technických blokátorov, nie všeobecné odporúčania.
Požiadať o audit viditeľnostiNa záver
Technická prístupnosť je nudná, neviditeľná časť AEO a GEO práce, presne preto sa najčastejšie preskakuje v prospech písania nového obsahu. Firma si ale môže napísať najlepší obsah na trhu, a ak sa k nemu robot nedostane kvôli zle nastavenému CDN alebo obsahu skrytému za JavaScriptom, nič z toho sa nepremietne do žiadnej AI odpovede. Tento audit sa oplatí spraviť ako prvý krok, nie až potom, čo sa iné opatrenia nepodarí vysvetliť.
Časté otázky
Skontrolujte priamo v administrácii vášho CDN alebo bezpečnostného nástroja (napríklad Cloudflare) sekciu venovanú AI robotom alebo bot management. Ak ste toto nastavenie nikdy vedome neupravovali, overte, na akej hodnote momentálne je.
Nie nevyhnutne. Stačí zabezpečiť, aby kľúčový obsah (hlavný text, nadpisy, dôležité fakty) bol dostupný aj v surovom HTML zo servera, napríklad cez server-side rendering, aj keď zvyšok stránky zostane interaktívny cez JavaScript.
Nie, nie je to isté ani jedným smerom. Žiadny z hlavných poskytovateľov to vo svojej dokumentácii nepotvrdzuje ani nevyvracia. Odporúčame preto opatrnejší prístup a serverovú alternatívu ako poistku, nie ako potvrdenú nutnosť.
Pre klasické vyhľadávače áno, jednoznačne. Pre AI crawlery to žiadny poskytovateľ vo svojej dokumentácii nepotvrdzuje ani nevyvracia, takže jej priamy vplyv na AI viditeľnosť dnes nie je overiteľný. Napriek tomu sa oplatí ju mať funkčnú kvôli klasickému vyhľadávaniu.
Odporúčame po každej väčšej zmene na webe, novej implementácii CDN alebo bezpečnostného nástroja, a inak aspoň raz za pol roka, keďže sa nastavenia aj dokumentácia poskytovateľov menia.
Nie, každý poskytovateľ prevádzkuje vlastné, samostatné roboty. Povolenie GPTBota neovplyvní ClaudeBota ani PerplexityBota, každý sa musí skontrolovať a povoliť samostatne.
Priamy vplyv rýchlosti na AI odpovede nie je oficiálne zdokumentovaný, no pomalý alebo nedostupný web sťažuje prácu akémukoľvek robotovi vrátane AI crawlerov, takže sa oplatí riešiť aj z tohto dôvodu.
Kontrolu robots.txt a nastavení CDN zvládne majiteľ webu s miernou technickou zručnosťou. Overenie renderovania obsahu a hlbšia technická diagnostika už vyžaduje skúsenejšieho administrátora alebo špecialistu.