Skip to content

Access log – súbor, ktorý máte zadarmo a nikdy ste ho neotvorili

Obsah článku

O autorovi článku

RNDr. Milan Fraňo, PhD. – SEO špecialista a web editor wooacademy

O autorovi článku

RNDr. Milan Fraňo, PhD. – SEO špecialista a web editor wooacademy

☕Páčil sa vám článok? Podporte nás likom na YouTube kanál alebo kúpou kávy.

V článku o GEO a viditeľnosti v AI vyhľadávaní som napísal, že logy servera sú jediné miesto, kde spoľahlivo uvidíte, či vás GPTBot a ClaudeBot naozaj navštevujú a čo si sťahujú. Toto je ten sľúbený návod.

Každý hosting ten súbor zapisuje. Každú sekundu, každú požiadavku, bez pluginu a bez cookie lišty. A takmer nikto sa doň nepozrie.

Google Analytics vám ukáže ľudí, ktorí odsúhlasili cookies a ktorým sa načítal JavaScript. Search Console ukáže, čo si Google myslí o vašom webe. Ani jeden z nich neukáže AI crawlery – tie JavaScript nespúšťajú a cookies neodsúhlasia. Access log ukáže, čo sa na serveri naozaj stalo: roboty, chyby servera, útoky, AI crawlery a to, kto vám v pondelok o deviatej ráno zhodil web.

Na vlastnom webe wooacademy.sk som si za jeden bežný deň v logu našiel 21 452 požiadaviek. Ľudia z toho tvorili 36 %. Zvyšok boli roboty – a časť z nich spôsobila, že server 809-krát odmietol požiadavku chybou 429. Vrátane 31 požiadaviek od ClaudeBota, crawlera Anthropicu. Inak povedané: v ten deň Claude 31-krát skúsil prečítať môj web a 31-krát dostal namiesto obsahu chybu. V Analytics ani v Search Console o tom nebola ani stopa.

Tento článok je návod, ako sa na ten súbor pozrieť očami GEO. Kde je, čo v ňom je, ktoré AI modely v ňom nájdete, čo z toho vyčítať o svojej viditeľnosti v AI odpovediach – a čo z neho vyčítať nejde. Na konci je nástroj, do ktorého log vložíte cez Ctrl+V a dostanete výsledok bez terminálu.

 

Čo je access log

Access log je textový súbor, do ktorého webový server zapíše jeden riadok za každú požiadavku, ktorú dostal. Každé načítanie stránky, každý obrázok, každý CSS súbor, každý pokus o prihlásenie, každý bot – všetko, bez výnimky, bez ohľadu na cookies a JavaScript.

Pri malom webe má za deň 20 000 až 50 000 riadkov. Pri e-shope násobne viac. Je to surová pravda o prevádzke webu, bez interpretácie a bez vzorkovania.

Vedľa neho býva error log – ten zapisuje chyby PHP a servera. Je užitočný pri hľadaní príčiny bielej obrazovky, ale o návštevnosti nehovorí nič. V tomto článku riešime access log.

 

Prečo je access log základ GEO: tri brány, cez ktoré musí AI prejsť

Než vás ChatGPT, Claude alebo Perplexity môžu v odpovedi spomenúť, musí sa ich systém k vášmu obsahu dostať. Na tej ceste stoja tri brány a každá vie zastaviť všetko:

Brána Otázka Kde to overíte
1. robots.txt Smie crawler na web? V súbore robots.txt – viditeľné na vasadomena.sk/robots.txt
2. server Mohol crawler stránku stiahnuť? Dostal 200, alebo 429, 403, 503? Len v access logu
3. HTML Dostal obsah, alebo prázdnu šablónu, ktorú dorenderuje až JavaScript? Zdrojový kód stránky (Ctrl+U) + veľkosť odpovede v logu

Väčšina návodov na GEO rieši bránu 1 (povoľte GPTBot) a bránu 3 (obsah musí byť v HTML). Brána 2 sa preskakuje, lebo ju nevidno – a pritom je to tá, na ktorej padol môj web. Robots.txt hovoril áno, HTML bolo v poriadku, a server aj tak 31-krát povedal ClaudeBotovi nie.

Access log je jediný nástroj, ktorý bránu 2 ukáže. A cez veľkosť odpovede čiastočne aj bránu 3: odpoveď 200 s veľkosťou 166 bajtov nie je stránka, to je chybová hláška.

 

Kde access log nájdete

WebSupport

Dve cesty k tomu istému súboru:

  1. Webadmin → vaša doména → Web → Serverové logy. Vyberiete deň a stiahnete access_log alebo error_log.
  2. FTP alebo SFTP: v koreni účtu je priečinok logs. V ňom je access_log (dnešný deň, priebežne dopisovaný) a podpriečinok hist/ s históriou: access_log-2026-09-14.gz a podobne, každý deň jeden komprimovaný súbor.

WebSupport históriu drží 14 dní. Ak chcete porovnávať mesiace, sťahujte si logy pravidelne – po dvoch týždňoch sú preč.

Iné hostingy

  • cPanel: Metrics → Raw Access, prípadne priečinok logs alebo access-logs cez FTP.
  • Plesk: Websites & Domains → Logs, s možnosťou stiahnuť access_ssl_log.
  • Vlastný server (nginx / Apache): /var/log/nginx/access.log alebo /var/log/apache2/access.log, staršie dni ako .gz.
  • Cloudflare a podobné CDN: logy proxy nie sú to isté ako log servera. Cloudflare v bezplatnom pláne logy nedáva; log hostingu za ním funguje ďalej, len uvidíte IP adresy Cloudflaru namiesto návštevníkov, pokiaľ hosting nemá nastavené obnovenie pôvodnej IP.

Ak neviete, kde ho hosting má, napíšte podpore jednu vetu: „Kde si stiahnem access log webservera?“ Každý hosting ho má.

 

Ako vyzerá jeden riadok

Toto je skutočný riadok z logu wooacademy.sk (IP adresa je zmenená):

wooacademy.sk 203.0.113.42 - - [21/Sep/2026:00:01:29 +0200] "GET /core-web-vitals-google-search-console/ HTTP/1.1" 200 91483 "-" "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/148.0.0.0 Safari/537.36" 0.142 MISS 10.31.39.16:80 0.140 (WC)

Vyzerá to hrozivo, ale je to len dvanásť polí za sebou (dve pomlčky za IP adresou sú prázdne polia pre meno používateľa, ktoré sa dnes nepoužívajú):

Pole Hodnota v ukážke Čo znamená
Doména wooacademy.sk Ktorý web z účtu požiadavku dostal. WebSupport loguje všetky domény účtu do jedného súboru – pozor pri subdoménach.
IP adresa 203.0.113.42 Odkiaľ požiadavka prišla. Jeden človek = jedna IP; jedna IP s tisíckami požiadaviek = robot.
Čas 21/Sep/2026:00:01:29 +0200 Kedy, v čase servera.
Požiadavka GET /core-web-vitals-google-search-console/ HTTP/1.1 Metóda (GET = čítanie, POST = odoslanie formulára, prihlásenie), URL a verzia protokolu.
Stavový kód 200 Ako to dopadlo. Najdôležitejšie číslo v riadku – viac nižšie.
Veľkosť 91483 Koľko bajtov server poslal. Pre GEO druhé najdôležitejšie číslo: stránka má desiatky kilobajtov, chyba má stovky bajtov.
Referer - Odkiaľ návštevník prišiel (odkaz). Pomlčka = priamo alebo bez odkazu. Keď človek klikne na váš web v odpovedi ChatGPT, je tu https://chatgpt.com/.
User-agent Mozilla/5.0 (Windows NT 10.0…) Chrome/148… Ako sa klient predstavil. Prehliadač, Googlebot, ClaudeBot, skript. Dá sa sfalšovať, ale väčšina robotov sa predstaví pravdivo.
Čas odpovede 0.142 Sekundy od prijatia požiadavky po odoslanie odpovede.
Cache MISS Špecialita WebSupportu: HIT = stránku vrátila cache hostingu bez PHP, MISS = generovalo ju PHP, - = necachovateľné (POST, prihlásený používateľ).
Backend a jeho čas 10.31.39.16:80 0.140 Ktorý server stránku vygeneroval a ako dlho mu to trvalo. Toto je čas, ktorý míňa limit PHP procesov.
Značka (WC) Interná značka hostingu, pri analýze ju ignorujte.

Od IP adresy po user-agent je to štandard, ktorý má každý Apache a nginx na svete (formát combined). Doménu na začiatku a štyri polia na konci pridáva WebSupport – a práve tie sú najcennejšie, lebo hovoria, čo stálo server čas.

A pre porovnanie riadok, ktorý som v ten deň dostal 31-krát:

wooacademy.sk 203.0.113.99 - - [21/Sep/2026:02:00:12 +0200] "GET / HTTP/2.0" 429 166 "-" "Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; ClaudeBot/1.0; +claudebot@anthropic.com)" 0.000 - - - (WC)

ClaudeBot, úvodná stránka, odpoveď 429, veľkosť 166 bajtov, čas backendu žiadny – lebo backend sa k tomu ani nedostal. Toto je presne ten riadok, ktorý GEO návody neriešia.

 

Čo v logu vidieť a čo to ovplyvňuje

Nasledujúce čísla sú z jedného bežného dňa na wooacademy.sk, 14. septembra 2026, 24 hodín, hlavná doména.

1. Koľko z návštevnosti sú ľudia

Kto Požiadavky Podiel
Ľudia (prehliadače) 7 624 36 %
Vlastné služby webu (preload cache, WP-Cron, merania) 5 392 25 %
Požiadavky bez user-agenta alebo s poškodeným 3 354 16 %
Scrapery a skripty 1 341 6 %
Vyhľadávače 1 208 6 %
Sociálne siete, náhľady odkazov 893 4 %
SEO nástroje (Ahrefs, Semrush, Majestic) 585 3 %
AI crawlery 560 3 %
Ostatné boty a skenery 495 2 %

Čo to ovplyvňuje: kapacitu servera. Zdieľaný hosting má limit súbežných PHP procesov (na WebSupporte 25, na vyššom programe 35). Každý robot, ktorý si vypýta stránku mimo cache, zaberie jeden proces na desatiny sekundy až sekundy. Keď sa ich zíde priveľa naraz, server začne odmietať požiadavky – a odmietne aj zákazníka v pokladni, aj AI crawler, ktorý mal práve prečítať vašu stránku služieb. Analytics vám ukáže 36 % reality a vy podľa toho odhadujete, či hosting stačí.

 

2. Stavové kódy: čo server odpovedal

Kód Význam Čo s ním
200 V poriadku Nič.
301 / 302 Presmerovanie Pár je normálne. Stovky od Googlebota = odkazy vedú na staré URL, opravte ich pri zdroji. Google berie 301 ako silný signál, 302 ako slabý.
304 Nezmenené Prehliadač alebo bot použil svoju cache. Dobrá správa.
404 Nenájdené Ak ich dostávajú ľudia, máte rozbitý odkaz. Ak Googlebot, presmerujte na najbližšiu živú stránku.
403 Zakázané Firewall, Wordfence alebo .htaccess niekoho zablokovali. Skontrolujte, či nie ste to vy – a či to nie je AI crawler, ktorého ste chceli.
429 Príliš veľa požiadaviek Server bol na limite. Najdôležitejší kód v logu.
499 Klient zatvoril spojenie Návštevník (alebo bot) to vzdal skôr, než server odpovedal. Príznak pomalého servera.
500 / 503 / 509 Chyba PHP, nedostupná služba, prekročený limit hostingu Pozrite error log; 509 riešte s hostingom.

V tom jednom dni bolo na wooacademy.sk 809 odpovedí 429. Google k tomu hovorí jasne: 5xx a 429 prinútia crawlery Googlu dočasne spomaliť crawlovanie a URL, ktoré chyby servera vracajú dlhodobo, indexovací systém z indexu odstráni. AI crawlery to nikde tak explicitne nepíšu, ale správajú sa rovnako – bot, ktorý dostane 429, stránku preskočí a vráti sa neskôr, alebo nevráti. V Search Console sa to prejaví až o týždne neskôr ako pokles v štatistikách prehľadávania. V logu to vidíte v ten deň.

 

3. Čo robí Googlebot – a prečo je to aj GEO

Googlebot v ten deň prišiel 134-krát, dostal 122× 200, 12× presmerovanie a ani jednu chybu. To je dobrý výsledok. Zaujímavejšie je, kam chodil: 149 požiadaviek vyhľadávačov išlo na úvodnú stránku a ďalšie na URL s parametrami – /?p=1234, /?wc-ajax=…, /wp-json/oembed/…. Z požiadaviek vyhľadávačov a AI botov na stránky išlo 26 % na URL bez obsahu.

Googlebot je zároveň jediná cesta do AI Overviews a AI Mode. Google výslovne píše, že na zobrazenie v týchto funkciách nie sú žiadne ďalšie požiadavky, žiadne špeciálne súbory ani značkovanie – platí to isté, čo pre bežné vyhľadávanie. Osobitný crawler pre AI Overviews neexistuje a v logu ho nenájdete. To, čo v logu vidíte pre Googlebota, platí aj pre vašu prítomnosť v AI odpovediach Googlu. Rovnako Bingbot: index Bingu je to, z čoho odpovedá Copilot.

Čo to ovplyvňuje: crawl budget. Google má na váš web vyhradený limit požiadaviek. Každá minutá na ?wc-ajax= je jedna, ktorá nešla na nový článok alebo zmenený produkt. Rieši sa to v robots.txt, nie pluginom:

Disallow: /*?wc-ajax=
Disallow: /*add-to-cart=
Disallow: /wp-json/
Disallow: /*/feed/

Pozor na statické súbory: CSS, JavaScript a obrázky vyhľadávače potrebujú na vykreslenie stránky. Tie neblokujte.

 

4. AI crawlery: ktoré modely vás čítajú a čo naozaj dostali

Toto je časť, ktorú Google Analytics nezachytí nikdy, lebo AI boty nespúšťajú JavaScript. Najprv kto je kto – lebo názvy sú mätúce a jeden prevádzkovateľ má často tri rôzne boty s tromi rôznymi úlohami:

User-agent v logu Prevádzkovateľ Načo slúži Čo ovplyvní, keď ho zablokujete robots.txt
GPTBot OpenAI Zber obsahu na trénovanie modelov Váš budúci obsah nepôjde do trénovania; na odpovede ChatGPT dnes priamo nevplýva rešpektuje
OAI-SearchBot OpenAI Index pre vyhľadávanie v ChatGPT Podľa OpenAI sa web „nebude zobrazovať v odpovediach ChatGPT search“ – toto je bot, na ktorom GEO stojí rešpektuje
ChatGPT-User OpenAI Stiahnutie stránky, keď sa na ňu používateľ práve pýta Používateľ si vás cez ChatGPT neotvorí nemusí – požiadavku spustil človek
ClaudeBot Anthropic Zber obsahu na trénovanie Budúci obsah mimo trénovania rešpektuje, aj Crawl-delay
Claude-SearchBot Anthropic Index pre vyhľadávanie v Claude Podľa Anthropicu „môže znížiť viditeľnosť a presnosť vo výsledkoch vyhľadávania“ rešpektuje
Claude-User Anthropic Stiahnutie stránky na otázku používateľa Claude vám obsah neprečíta, keď sa naň niekto pýta rešpektuje
PerplexityBot Perplexity Index pre výsledky Perplexity Web sa neobjaví vo výsledkoch Perplexity rešpektuje
Perplexity-User Perplexity Stiahnutie na otázku používateľa Perplexity nevie odpovedať z vášho obsahu podľa Perplexity „vo všeobecnosti ignoruje“
Googlebot Google Index Googlu → aj AI Overviews, AI Mode Vypadnete z Googlu aj z AI Overviews rešpektuje
Google-Extended Google Iba token v robots.txt – v logu sa neobjaví Zakáže trénovanie Gemini; „neovplyvňuje zaradenie do vyhľadávania Google“
Bingbot Microsoft Index Bingu → Copilot Vypadnete z Bingu aj z Copilotu rešpektuje
Applebot / Applebot-Extended Apple Siri, Spotlight / trénovanie Apple Intelligence Applebot-Extended je opäť len token, crawluje Applebot rešpektuje
Meta-ExternalAgent / Meta-WebIndexer / Meta-ExternalFetcher Meta Trénovanie / index Meta AI / na podnet používateľa Meta AI vás nebude vedieť citovať rešpektuje
Amazonbot Amazon Alexa a ďalšie služby Amazonu Alexa vás nebude poznať rešpektuje
Bytespider ByteDance Trénovanie (Doubao, TikTok) historicky slabo
CCBot Common Crawl Verejný dataset, z ktorého trénuje veľa modelov Váš obsah nepôjde do tohto datasetu rešpektuje

 

Dve veci z tej tabuľky rozhodujú o GEO:

Po prvé, trénovací bot a vyhľadávací bot nie sú to isté. GPTBot a ClaudeBot zbierajú obsah na trénovanie budúcich modelov – to je dlhodobé a nepriame. OAI-SearchBot, Claude-SearchBot a PerplexityBot stavajú index, z ktorého AI vyhľadávač odpovedá dnes. Ak chcete byť citovaní, sledujte v logu tie druhé. Ak ste v roku 2024 „zablokovali AI“ jedným pravidlom pre všetko, zablokovali ste si aj citácie.

Po druhé, Google nemá „AI crawler“. AI Overviews čerpajú z bežného indexu, ktorý stavia Googlebot. Google-Extended je len prepínač v robots.txt pre trénovanie Gemini a v logu ho nikdy neuvidíte. Kto chce byť v AI Overviews, potrebuje to, čo vždy: aby Googlebot dostával 200 a obsah v HTML.

Teraz čo z toho bolo v mojom logu za 24 hodín:

Bot Požiadavky Z toho stránky s obsahom Chyby Čo čítal
ClaudeBot 229 104 (45 %) 31× 429 29× presmerovanie z úvodnej stránky, 18× robots.txt, 11× sitemap; obsah = články a slovník: stavové kódy, ROI, normostrana, SEO pre e-shop
Amazonbot 138 30 (22 %) 0 prevažne technické súbory a presmerovania
OAI-SearchBot 78 62 (79 %) 0 62× úvodná stránka, 6× robots.txt, sitemapy. Ani jedna stránka služieb.
Meta-WebIndexer + Meta-ExternalAgent 89 13 0 prevažne technické súbory
Claude-User, ChatGPT-User 17 11 0 konkrétne články na podnet používateľa
ExaSearchBot, Bytespider 9 8 0

„Stránky s obsahom“ sú odpovede 200 väčšie než 5 kB bez robots.txt, sitemáp a statických súborov. Zvyšok sú presmerovania, chyby a technické súbory – z tých sa model nič nedozvie. A tu je celé GEO v troch riadkoch:

  • ClaudeBot urobil 229 požiadaviek, ale obsah dostal len v 104. Tretina išla na presmerovania a technické súbory, 31 skončilo chybou 429 – vrátane piatich pokusov o robots.txt a piatich o sitemap. Bot, ktorý nedostane ani robots.txt, nevie, čo smie, a odíde.
  • OAI-SearchBot – ten, ktorý rozhoduje o vyhľadávaní v ChatGPT – prišiel 78-krát a 62-krát si vypýtal úvodnú stránku. Nie stránku služieb, nie články. Overuje, či web žije, ale hlbšie nejde. To znamená, že ChatGPT má z mojich služieb v indexe len to, čo sa zmestí na úvodnú stránku – a to je problém, ktorý som bez logu nemal ako vidieť.
  • Claude-User a ChatGPT-User stiahli 17 konkrétnych článkov na podnet používateľa. To je najbližšie k dôkazu, že AI niekomu môj obsah ukázala. S jednou výhradou, ktorú si musíte priznať: môžete to byť aj vy, keď si s ChatGPT overujete vlastný web. Log nerozlíši majiteľa od cudzieho človeka. Ja som si to overil podľa času – jedna várka Claude-User požiadaviek sedela na minútu s tým, keď som s Claude riešil vlastné veci.

Čo to ovplyvňuje: viditeľnosť v AI odpovediach. Bot, ktorý dostane chybu, si stránku neprečíta – a čo si neprečítal, to Claude nikomu neodporučí. Bot, ktorý číta len úvodnú stránku, nemá z čoho citovať vaše služby. Robots.txt povie, či boty smú; log povie, či mohli a čo naozaj dostali.

 

5. Ľudia, ktorí prišli z AI odpovedí

Ešte jedna GEO vec, ktorú log vidí: pole referer. Keď človek klikne na váš web v odpovedi ChatGPT, Perplexity, Gemini alebo Claude, príde s refererom https://chatgpt.com/, https://www.perplexity.ai/, https://gemini.google.com/ alebo https://claude.ai/. GA4 to vidí tiež – ale len u ľudí, ktorí odsúhlasili cookies. Log to vidí u všetkých.

V mojom logu za 14. september bola presne jedna takáto návšteva, z Gemini. Jedna. Pri 229 požiadavkách ClaudeBota a 78 od OAI-SearchBota. To nie je zlyhanie merania, to je realita AI vyhľadávania: väčšina odpovedí končí bez kliknutia. Preto sa v GEO meria zmienka, nie návšteva – a preto je dôležitejšie, čo si crawler stiahol, než koľko ľudí potom kliklo.

 

6. Scrapery a útoky: kto vám berie server – a tým aj AI crawlery

Tu je odpoveď na otázku, prečo tých 809 chýb 429 vzniklo a prečo ich dostal aj ClaudeBot. V minútach, keď server odmietal požiadavky, tvorili záťaž:

Kto Podiel požiadaviek v čase preťaženia
Požiadavky bez user-agenta alebo s poškodeným 47 %
Ľudia 18 %
Vlastné služby webu (preload cache) 13 %
Vyhľadávače 9 %
AI crawlery 5 %
Ostatné 8 %

AI crawlery tvorili päť percent záťaže a dostali tretinu chýb. Nezhodili server – boli tam len v nesprávnu chvíľu, spolu s tými, čo ho zhodili. Konkrétne:

  • 1 035 požiadaviek bez user-agenta z piatich cloudových IP adries, 761× na úvodnú stránku. Žiadny prehliadač neposiela prázdny user-agent.
  • 2 319 požiadaviek s user-agentom zabaleným v úvodzovkách ("Mozilla/5.0 (Macintosh…)" aj s úvodzovkami) z 33 IP adries výstupných uzlov siete Tor. O týždeň neskôr ten istý bot 47-krát odoslal kontaktný formulár. Je to spam bot, ktorý sa vydáva za prehliadač.
  • 276× POST na wp-login.php – hádanie hesiel. Redaktori sa toľkokrát za deň neprihlasujú.
  • Desiatky požiadaviek na /?author=1, /.env, /.git/config, wp-config.php.bak – automatické sondy, či na webe neležia citlivé súbory. Dejú sa každému; dôležité je, aby dostali 404, nie 200.

Čo to ovplyvňuje: dostupnosť webu pre ľudí, pre Googlebota aj pre AI crawlery, bezpečnosť a – ak by ste to riešili drahším hostingom – vašu peňaženku. Väčšina týchto požiadaviek sa dá zastaviť v .htaccess skôr, než sa vôbec spustí PHP:

<IfModule mod_setenvif.c>
    SetEnvIfNoCase User-Agent "^-?$"   wa_blok
    SetEnvIfNoCase User-Agent "^\x22"  wa_blok
</IfModule>
<IfModule mod_authz_core.c>
    <RequireAll>
        Require all granted
        Require not env wa_blok
    </RequireAll>
</IfModule>

Prvé pravidlo blokuje prázdny user-agent, druhé user-agent začínajúci úvodzovkou. Apache odpovie 403 a PHP proces sa vôbec nespustí. Pred nasadením si v logu overte, že žiadna vaša služba (platobná brána, monitoring) nechodí bez user-agenta – Stripe, WP-Cron aj WP Rocket sa predstavujú, takže sa ich to netýka. A nikdy neblokujte podľa toho, že sa niečo volá „bot“ – zablokovali by ste si aj OAI-SearchBot.

 

7. Cache a vaše vlastné služby

Posledná vec, ktorú v logu uvidíte a inde nie: koľko servera míňate sami na seba. WP Rocket preload – funkcia, ktorá po vymazaní cache prejde celý web a nanovo ju vygeneruje – tvoril v ten deň 32 % celého času PHP. Nie preto, že by bol zlý, ale preto, že sa cache mazala priveľakrát (každé uloženie produktu, každá zmena menu) a preload ju stále dokola staval.

Podiel HIT bol len 14 %. Inak povedané: šesť zo siedmich cachovateľných požiadaviek generovalo PHP.

Čo to ovplyvňuje: rýchlosť pre ľudí a kapacitu pre všetko ostatné – vrátane AI crawlerov, ktoré prídu práve vtedy, keď preload beží. Riešenie nestojí nič: vypnúť automatické mazanie cache tam, kde nie je nutné, a nechať preload bežať v noci. Podrobnejšie v článku ako zrýchliť WordPress a WooCommerce.

 

Čo z logu o výsledkoch v AI vyčítať – a čo nie

Aby bolo jasné, čo od logu čakať. Log je dôkaz o prístupe, nie o odpovedi.

Otázka Vie log odpovedať? Kde inde hľadať
Číta môj web ChatGPT / Claude / Perplexity? Áno – user-agent, dátum, URL nikde inde
Dostali obsah, alebo chybu? Áno – stavový kód a veľkosť odpovede nikde inde
Ktoré stránky majú v indexe čerstvé? Áno – čo a kedy si stiahli nikde inde
Čítajú stránky služieb, alebo len úvodnú? Áno – zoznam URL po botoch nikde inde
Pýtal sa niekto AI na konkrétnu moju stránku? Čiastočne – ChatGPT-User, Claude-User; nerozlíši vás od cudzieho
Klikol niekto z AI odpovede na web? Áno – referer GA4 (len s cookies)
Citovala ma AI v odpovedi? Nie ručný test 20–30 otázok, Rank Math AI Visibility, Peec.ai, Profound
Čo o mne AI hovorí a koho odporúča namiesto mňa? Nie ručný test
Som v AI Overviews? Nie priamo – ale ak Googlebot dostáva chyby, nie ste Search Console, ručný test

Log teda nenahrádza test odpovedí. Ale bez logu ten test nemáte ako interpretovať: keď vás ChatGPT necituje, je to preto, že váš obsah nie je dobrý – alebo preto, že OAI-SearchBot videl len úvodnú stránku? To sú dva úplne iné problémy s dvoma úplne inými riešeniami, a rozlíši ich len log.

 

Ako log prečítať bez programovania

Nemusíte otvárať terminál. Nižšie je nástroj, ktorý som na to napísal: vložíte doň obsah access logu (Ctrl+V) alebo pretiahnete stiahnutý súbor – aj .gz – a dostanete všetko, o čom bol tento článok: kto chodí, čo dostal Googlebot, ktoré AI crawlery vás čítajú a koľko z ich požiadaviek skončilo obsahom, ktoré stránky si AI stiahla, kto prišiel z AI odpovede, kto vás preťažuje, ktoré URL sú rozbité a čo s tým. Všetko sa počíta vo vašom prehliadači, log sa nikam neodosiela.

Ak ste zvyknutí na terminál, štyri príkazy, ktoré odpovedia na najčastejšie GEO otázky:

# ktoré AI crawlery chodia a koľkokrát
grep -iE "GPTBot|OAI-SearchBot|ChatGPT-User|ClaudeBot|Claude-SearchBot|Claude-User|PerplexityBot|Perplexity-User|Amazonbot|meta-external|Bytespider|CCBot" access_log \
  | grep -oiE "GPTBot|OAI-SearchBot|ChatGPT-User|ClaudeBot|Claude-SearchBot|Claude-User|PerplexityBot|Perplexity-User|Amazonbot|meta-external[a-z]*|Bytespider|CCBot" | sort | uniq -c | sort -rn

# čo dostal OAI-SearchBot (stavový kód, veľkosť, URL)
grep -i "OAI-SearchBot" access_log | awk -F'"' '{split($3,s," "); split($2,r," "); print s[1], s[2], r[2]}' | sort | uniq -c | sort -rn | head -20

# koľko a komu server odpovedal 429
grep '" 429 ' access_log | awk -F'"' '{print $6}' | sort | uniq -c | sort -rn

# kto prišiel z AI odpovede
grep -iE '"https://(chatgpt\.com|www\.perplexity\.ai|gemini\.google\.com|claude\.ai|copilot\.microsoft\.com)' access_log | awk -F'"' '{print $4}' | sort | uniq -c

A pre pravidelnú analýzu je tu GoAccess – bezplatný nástroj, ktorý z logu urobí interaktívny report. Pre formát WebSupportu použite log-format %v %h %^[%d:%t %^] "%r" %s %b "%R" "%u" %^.

 

Čo s tým urobiť: sedem krokov v správnom poradí

  1. Stiahnite si log za jeden bežný deň a spustite ho cez nástroj vyššie. Päť minút.
  2. Pozrite sa na 429 a 5xx. Ak sú tam, zistite, kto tvoril záťaž v tých minútach. Toho zablokujte. Kým to neurobíte, nemá zmysel riešiť nič iné – ani GEO, ani obsah.
  3. Zablokujte scrapery v .htaccess – prázdny user-agent, poškodený user-agent, konkrétne skripty, ktoré sa v logu opakujú. Nie podľa IP: tie sa menia, reťazec v user-agente nie. A nie podľa slova „bot“.
  4. Skontrolujte, ktoré AI crawlery chodia a čo dostali. Chýba OAI-SearchBot alebo PerplexityBot? Pozrite robots.txt a firewall. Dostávajú 429 alebo 403? Oprava je bod 2. Nič z toho? Pre boty, ktoré rešpektujú Crawl-delay (ClaudeBot áno), ho môžete v robots.txt nastaviť, aby prichádzali pomalšie a nezrážali sa so špičkou.
  5. Pozrite sa, ktoré stránky si AI stiahla. Ak vyhľadávací bot číta len úvodnú stránku, dajte na ňu priame HTML odkazy na kľúčové stránky služieb, overte sitemap v robots.txt a to, že tie stránky vracajú 200 bez presmerovania.
  6. Presmerujte 404, na ktoré chodí Googlebot, a opravte odkazy, na ktoré klikajú ľudia. Googlebot je zároveň vaša cesta do AI Overviews.
  7. Zopakujte to o mesiac a porovnajte: viac stránok s obsahom pre OAI-SearchBot, menej 429, viac Claude-User a ChatGPT-User požiadaviek z rôznych IP adries. To je GEO metrika, ktorú máte zadarmo a ktorú nikto iný nemá.

Log je jediný nástroj, ktorý vám ukáže, či to pomohlo – nie preto, že by bol lepší než ostatné, ale preto, že ako jediný vidí všetko.

 

GEO služby Milan Fraňo

Volám sa Milan Fraňo a vo WooAcademy mám na starosti SEO, GEO a technickú stránku webov. Logy čítam pri každom audite ako prvé, ešte pred Search Console – lebo Search Console hovorí o tom, čo Google zistil minulý týždeň, a log o tom, čo sa deje dnes. A o AI crawleroch nehovorí Search Console vôbec nič.

Väčšina problémov, ktoré klienti prídu riešiť ako „pomalý web“, „klesajú nám pozície“ alebo „ChatGPT nás neodporúča“, má koreň v niečom, čo v logu vidno na prvý pohľad: preťažený server, robot, ktorý ho preťažuje, alebo crawler, ktorý dostáva chyby a preto vás prestal čítať. Analytics to nevidí a plugin to nespraví.

Čo konkrétne robím pre klientov:

  • GEO audit z logov – ktoré AI crawlery vás čítajú, koľko z ich požiadaviek skončilo obsahom, ktoré stránky videli a ktoré nie, či dostávajú chyby; spolu s testom 20–30 reálnych otázok vášho zákazníka v ChatGPT, Perplexity a Gemini
  • Audit servera z logov – kto vám berie kapacitu, čo dostáva Googlebot, kde plytváte crawl budgetom; s konkrétnym zoznamom, čo kde zmeniť
  • Nastavenie ochrany.htaccess, robots.txt s rozlíšením trénovacích a vyhľadávacích botov, Wordfence, prípadne Cloudflare pred webom
  • Zrýchlenie webu – cache, preload, databáza, skripty tretích strán; meriam v logu aj v Core Web Vitals
  • GEO a SEO školenia – vo WooAcademy učíme to, čo sami robíme; čítanie logov je súčasť našich technických SEO a GEO tréningov

Ak chcete vedieť, čo je vo vašom logu: pošlite mi doménu a log za jeden bežný deň. Pošlem vám späť, ktoré AI modely vás čítajú, čo naozaj dostali, kto vám berie server a čo kde zmeniť. Zadarmo.

👉 Nezáväzná konzultácia SEO a GEO

 

Často kladené otázky

Čo je access log?

Access log je textový súbor, do ktorého webový server zapisuje jeden riadok za každú prijatú požiadavku: IP adresu, čas, URL, stavový kód, veľkosť odpovede, referer a user-agent. Zachytí všetko vrátane robotov a požiadaviek bez JavaScriptu, ktoré Google Analytics nevidí.

Ako zistím, či ChatGPT číta môj web?

V access logu hľadajte user-agenty OAI-SearchBot (index pre vyhľadávanie v ChatGPT), GPTBot (trénovanie) a ChatGPT-User (stiahnutie stránky na podnet používateľa). Pri každom riadku si pozrite stavový kód a veľkosť odpovede – 200 s desiatkami kilobajtov je obsah, 429 alebo 403 znamená, že bot obsah nedostal.

Aký je rozdiel medzi GPTBot a OAI-SearchBot?

GPTBot zbiera obsah na trénovanie modelov OpenAI. OAI-SearchBot stavia index, z ktorého odpovedá vyhľadávanie v ChatGPT – podľa OpenAI sa web, ktorý ho zablokuje, v odpovediach ChatGPT search nezobrazí. Pre viditeľnosť v AI odpovediach je rozhodujúci OAI-SearchBot.

Vidím v logu, či som v AI Overviews Googlu?

Nie priamo. AI Overviews a AI Mode čerpajú z bežného indexu Googlu, ktorý stavia Googlebot – osobitný crawler neexistuje. Google-Extended je len token v robots.txt pre trénovanie Gemini, v logu sa neobjaví a zaradenie do vyhľadávania neovplyvňuje. Ak Googlebot v logu dostáva 200 a obsah, splnili ste technickú podmienku.

Kde nájdem access log na WebSupporte?

Vo Webadmine pod doménou v sekcii Web → Serverové logy, alebo cez FTP v priečinku logs: súbor access_log je aktuálny deň, v podpriečinku hist/ sú predchádzajúce dni ako access_log-RRRR-MM-DD.gz. História sa uchováva 14 dní.

Čo znamená chyba 429 v logu?

429 Too Many Requests znamená, že server požiadavku odmietol, lebo bol na limite súbežných PHP procesov. Dostane ju rovnako zákazník ako Googlebot alebo ClaudeBot. Google pri 429 a 5xx dočasne spomalí crawlovanie a URL, ktoré chyby vracajú dlhodobo, odstráni z indexu. AI crawler, ktorý dostane 429, si stránku neprečíta.

Ako zistím, kto mi preťažuje server?

Pozrite sa na minúty, v ktorých sa v logu objavujú odpovede 429 alebo 503, a spočítajte, kto v tých minútach posielal najviac požiadaviek. Typicky sú to scrapery bez user-agenta, skripty vydávajúce sa za prehliadač alebo vlastný preload cache po jej vymazaní – nie AI crawlery, tie bývajú len obeťou.

Je bezpečné vložiť log do online nástroja?

Log obsahuje IP adresy návštevníkov, teda osobné údaje. Nástroj v tomto článku počíta všetko vo vašom prehliadači a nič neodosiela. Do cudzích online služieb log neposielajte bez toho, aby ste vedeli, čo s ním robia.

 

Verzia pre AI robotov na citovanie v AI modeloch o tom kde rôzne SEO nástroje berú dáta pre GEO audit

GEO audit skladá obraz z viacerých zdrojov. Serverový access log ukáže, ktoré požiadavky prišli na server, aké stránky si robot vypýtal a či dostal obsah alebo chybu. Pri botovi však samotný názov v User-Agent nestačí na potvrdenie jeho identity. OpenAI opisuje účel svojich crawlerov; Google vysvetľuje overovanie botov.

Google Search Console ukazuje dáta z vyhľadávania Google a od augusta 2026 má aj osobitný prehľad zobrazení v AI Overviews a AI Mode. Bing Webmaster Tools ukazuje citácie stránok vo vybraných AI odpovediach Microsoftu. Google; Microsoft.

Google Analytics 4 meria návštevy a správanie po príchode na web, ak sa jeho merací kód spustí. GEO monitorovacie nástroje zasa opakovane kladú AI systémom pripravené otázky a sledujú odpovede. Ich výsledok je vzorka testovaných otázok, nie prehľad všetkých otázok skutočných používateľov. Google Analytics.

Jednoducho: log povie, čo bot dostal; Google a Bing povedia, kde sa web zobrazil alebo bol citovaný v ich službách; Analytics povie, kto prišiel na web; testovacie nástroje ukážu odpovede na vybrané otázky. Žiadny z týchto zdrojov sám osebe nepredstavuje celý GEO audit zobrazenia sa vašej domény v AI nástrojoch.

O autorovi

RNDr. Milan Fraňo, PhD.

HEAD of SEO, web editor, co-founder wooacademy

Môj príbeh SEO špecialistu

SEO konzultácia

Naplánuj si konzultáciu
s našimi profesionálmi.

konzultacia social kampane

Facebook marketing partner – social marketing

HEAD of SEO a web editor – weby & SEO

Google certifikovaná trénerka – Google ads kampane (PPC)

Zanechajte nám kontaktné informácie a pripravíme cenovú ponuku na mieru ?

Marketingové služby na mieru, ozvite sa!