V článku o GEO a viditeľnosti v AI vyhľadávaní som napísal, že logy servera sú jediné miesto, kde spoľahlivo uvidíte, či vás GPTBot a ClaudeBot naozaj navštevujú a čo si sťahujú. Toto je ten sľúbený návod.
Každý hosting ten súbor zapisuje. Každú sekundu, každú požiadavku, bez pluginu a bez cookie lišty. A takmer nikto sa doň nepozrie.
Google Analytics vám ukáže ľudí, ktorí odsúhlasili cookies a ktorým sa načítal JavaScript. Search Console ukáže, čo si Google myslí o vašom webe. Ani jeden z nich neukáže AI crawlery – tie JavaScript nespúšťajú a cookies neodsúhlasia. Access log ukáže, čo sa na serveri naozaj stalo: roboty, chyby servera, útoky, AI crawlery a to, kto vám v pondelok o deviatej ráno zhodil web.
Na vlastnom webe wooacademy.sk som si za jeden bežný deň v logu našiel 21 452 požiadaviek. Ľudia z toho tvorili 36 %. Zvyšok boli roboty – a časť z nich spôsobila, že server 809-krát odmietol požiadavku chybou 429. Vrátane 31 požiadaviek od ClaudeBota, crawlera Anthropicu. Inak povedané: v ten deň Claude 31-krát skúsil prečítať môj web a 31-krát dostal namiesto obsahu chybu. V Analytics ani v Search Console o tom nebola ani stopa.
Tento článok je návod, ako sa na ten súbor pozrieť očami GEO. Kde je, čo v ňom je, ktoré AI modely v ňom nájdete, čo z toho vyčítať o svojej viditeľnosti v AI odpovediach – a čo z neho vyčítať nejde. Na konci je nástroj, do ktorého log vložíte cez Ctrl+V a dostanete výsledok bez terminálu.
Čo je access log
Access log je textový súbor, do ktorého webový server zapíše jeden riadok za každú požiadavku, ktorú dostal. Každé načítanie stránky, každý obrázok, každý CSS súbor, každý pokus o prihlásenie, každý bot – všetko, bez výnimky, bez ohľadu na cookies a JavaScript.
Pri malom webe má za deň 20 000 až 50 000 riadkov. Pri e-shope násobne viac. Je to surová pravda o prevádzke webu, bez interpretácie a bez vzorkovania.
Vedľa neho býva error log – ten zapisuje chyby PHP a servera. Je užitočný pri hľadaní príčiny bielej obrazovky, ale o návštevnosti nehovorí nič. V tomto článku riešime access log.
Prečo je access log základ GEO: tri brány, cez ktoré musí AI prejsť
Než vás ChatGPT, Claude alebo Perplexity môžu v odpovedi spomenúť, musí sa ich systém k vášmu obsahu dostať. Na tej ceste stoja tri brány a každá vie zastaviť všetko:
| Brána | Otázka | Kde to overíte |
|---|---|---|
| 1. robots.txt | Smie crawler na web? | V súbore robots.txt – viditeľné na vasadomena.sk/robots.txt |
| 2. server | Mohol crawler stránku stiahnuť? Dostal 200, alebo 429, 403, 503? | Len v access logu |
| 3. HTML | Dostal obsah, alebo prázdnu šablónu, ktorú dorenderuje až JavaScript? | Zdrojový kód stránky (Ctrl+U) + veľkosť odpovede v logu |
Väčšina návodov na GEO rieši bránu 1 (povoľte GPTBot) a bránu 3 (obsah musí byť v HTML). Brána 2 sa preskakuje, lebo ju nevidno – a pritom je to tá, na ktorej padol môj web. Robots.txt hovoril áno, HTML bolo v poriadku, a server aj tak 31-krát povedal ClaudeBotovi nie.
Access log je jediný nástroj, ktorý bránu 2 ukáže. A cez veľkosť odpovede čiastočne aj bránu 3: odpoveď 200 s veľkosťou 166 bajtov nie je stránka, to je chybová hláška.
Kde access log nájdete
WebSupport
Dve cesty k tomu istému súboru:
- Webadmin → vaša doména → Web → Serverové logy. Vyberiete deň a stiahnete
access_logaleboerror_log. - FTP alebo SFTP: v koreni účtu je priečinok
logs. V ňom jeaccess_log(dnešný deň, priebežne dopisovaný) a podpriečinokhist/s históriou:access_log-2026-09-14.gza podobne, každý deň jeden komprimovaný súbor.
WebSupport históriu drží 14 dní. Ak chcete porovnávať mesiace, sťahujte si logy pravidelne – po dvoch týždňoch sú preč.
Iné hostingy
- cPanel: Metrics → Raw Access, prípadne priečinok
logsaleboaccess-logscez FTP. - Plesk: Websites & Domains → Logs, s možnosťou stiahnuť
access_ssl_log. - Vlastný server (nginx / Apache):
/var/log/nginx/access.logalebo/var/log/apache2/access.log, staršie dni ako.gz. - Cloudflare a podobné CDN: logy proxy nie sú to isté ako log servera. Cloudflare v bezplatnom pláne logy nedáva; log hostingu za ním funguje ďalej, len uvidíte IP adresy Cloudflaru namiesto návštevníkov, pokiaľ hosting nemá nastavené obnovenie pôvodnej IP.
Ak neviete, kde ho hosting má, napíšte podpore jednu vetu: „Kde si stiahnem access log webservera?“ Každý hosting ho má.
Ako vyzerá jeden riadok
Toto je skutočný riadok z logu wooacademy.sk (IP adresa je zmenená):
wooacademy.sk 203.0.113.42 - - [21/Sep/2026:00:01:29 +0200] "GET /core-web-vitals-google-search-console/ HTTP/1.1" 200 91483 "-" "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/148.0.0.0 Safari/537.36" 0.142 MISS 10.31.39.16:80 0.140 (WC)
Vyzerá to hrozivo, ale je to len dvanásť polí za sebou (dve pomlčky za IP adresou sú prázdne polia pre meno používateľa, ktoré sa dnes nepoužívajú):
| Pole | Hodnota v ukážke | Čo znamená |
|---|---|---|
| Doména | wooacademy.sk |
Ktorý web z účtu požiadavku dostal. WebSupport loguje všetky domény účtu do jedného súboru – pozor pri subdoménach. |
| IP adresa | 203.0.113.42 |
Odkiaľ požiadavka prišla. Jeden človek = jedna IP; jedna IP s tisíckami požiadaviek = robot. |
| Čas | 21/Sep/2026:00:01:29 +0200 |
Kedy, v čase servera. |
| Požiadavka | GET /core-web-vitals-google-search-console/ HTTP/1.1 |
Metóda (GET = čítanie, POST = odoslanie formulára, prihlásenie), URL a verzia protokolu. |
| Stavový kód | 200 |
Ako to dopadlo. Najdôležitejšie číslo v riadku – viac nižšie. |
| Veľkosť | 91483 |
Koľko bajtov server poslal. Pre GEO druhé najdôležitejšie číslo: stránka má desiatky kilobajtov, chyba má stovky bajtov. |
| Referer | - |
Odkiaľ návštevník prišiel (odkaz). Pomlčka = priamo alebo bez odkazu. Keď človek klikne na váš web v odpovedi ChatGPT, je tu https://chatgpt.com/. |
| User-agent | Mozilla/5.0 (Windows NT 10.0…) Chrome/148… |
Ako sa klient predstavil. Prehliadač, Googlebot, ClaudeBot, skript. Dá sa sfalšovať, ale väčšina robotov sa predstaví pravdivo. |
| Čas odpovede | 0.142 |
Sekundy od prijatia požiadavky po odoslanie odpovede. |
| Cache | MISS |
Špecialita WebSupportu: HIT = stránku vrátila cache hostingu bez PHP, MISS = generovalo ju PHP, - = necachovateľné (POST, prihlásený používateľ). |
| Backend a jeho čas | 10.31.39.16:80 0.140 |
Ktorý server stránku vygeneroval a ako dlho mu to trvalo. Toto je čas, ktorý míňa limit PHP procesov. |
| Značka | (WC) |
Interná značka hostingu, pri analýze ju ignorujte. |
Od IP adresy po user-agent je to štandard, ktorý má každý Apache a nginx na svete (formát combined). Doménu na začiatku a štyri polia na konci pridáva WebSupport – a práve tie sú najcennejšie, lebo hovoria, čo stálo server čas.
A pre porovnanie riadok, ktorý som v ten deň dostal 31-krát:
wooacademy.sk 203.0.113.99 - - [21/Sep/2026:02:00:12 +0200] "GET / HTTP/2.0" 429 166 "-" "Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; ClaudeBot/1.0; +claudebot@anthropic.com)" 0.000 - - - (WC)
ClaudeBot, úvodná stránka, odpoveď 429, veľkosť 166 bajtov, čas backendu žiadny – lebo backend sa k tomu ani nedostal. Toto je presne ten riadok, ktorý GEO návody neriešia.
Čo v logu vidieť a čo to ovplyvňuje
Nasledujúce čísla sú z jedného bežného dňa na wooacademy.sk, 14. septembra 2026, 24 hodín, hlavná doména.
1. Koľko z návštevnosti sú ľudia
| Kto | Požiadavky | Podiel |
|---|---|---|
| Ľudia (prehliadače) | 7 624 | 36 % |
| Vlastné služby webu (preload cache, WP-Cron, merania) | 5 392 | 25 % |
| Požiadavky bez user-agenta alebo s poškodeným | 3 354 | 16 % |
| Scrapery a skripty | 1 341 | 6 % |
| Vyhľadávače | 1 208 | 6 % |
| Sociálne siete, náhľady odkazov | 893 | 4 % |
| SEO nástroje (Ahrefs, Semrush, Majestic) | 585 | 3 % |
| AI crawlery | 560 | 3 % |
| Ostatné boty a skenery | 495 | 2 % |
Čo to ovplyvňuje: kapacitu servera. Zdieľaný hosting má limit súbežných PHP procesov (na WebSupporte 25, na vyššom programe 35). Každý robot, ktorý si vypýta stránku mimo cache, zaberie jeden proces na desatiny sekundy až sekundy. Keď sa ich zíde priveľa naraz, server začne odmietať požiadavky – a odmietne aj zákazníka v pokladni, aj AI crawler, ktorý mal práve prečítať vašu stránku služieb. Analytics vám ukáže 36 % reality a vy podľa toho odhadujete, či hosting stačí.
2. Stavové kódy: čo server odpovedal
| Kód | Význam | Čo s ním |
|---|---|---|
| 200 | V poriadku | Nič. |
| 301 / 302 | Presmerovanie | Pár je normálne. Stovky od Googlebota = odkazy vedú na staré URL, opravte ich pri zdroji. Google berie 301 ako silný signál, 302 ako slabý. |
| 304 | Nezmenené | Prehliadač alebo bot použil svoju cache. Dobrá správa. |
| 404 | Nenájdené | Ak ich dostávajú ľudia, máte rozbitý odkaz. Ak Googlebot, presmerujte na najbližšiu živú stránku. |
| 403 | Zakázané | Firewall, Wordfence alebo .htaccess niekoho zablokovali. Skontrolujte, či nie ste to vy – a či to nie je AI crawler, ktorého ste chceli. |
| 429 | Príliš veľa požiadaviek | Server bol na limite. Najdôležitejší kód v logu. |
| 499 | Klient zatvoril spojenie | Návštevník (alebo bot) to vzdal skôr, než server odpovedal. Príznak pomalého servera. |
| 500 / 503 / 509 | Chyba PHP, nedostupná služba, prekročený limit hostingu | Pozrite error log; 509 riešte s hostingom. |
V tom jednom dni bolo na wooacademy.sk 809 odpovedí 429. Google k tomu hovorí jasne: 5xx a 429 prinútia crawlery Googlu dočasne spomaliť crawlovanie a URL, ktoré chyby servera vracajú dlhodobo, indexovací systém z indexu odstráni. AI crawlery to nikde tak explicitne nepíšu, ale správajú sa rovnako – bot, ktorý dostane 429, stránku preskočí a vráti sa neskôr, alebo nevráti. V Search Console sa to prejaví až o týždne neskôr ako pokles v štatistikách prehľadávania. V logu to vidíte v ten deň.
3. Čo robí Googlebot – a prečo je to aj GEO
Googlebot v ten deň prišiel 134-krát, dostal 122× 200, 12× presmerovanie a ani jednu chybu. To je dobrý výsledok. Zaujímavejšie je, kam chodil: 149 požiadaviek vyhľadávačov išlo na úvodnú stránku a ďalšie na URL s parametrami – /?p=1234, /?wc-ajax=…, /wp-json/oembed/…. Z požiadaviek vyhľadávačov a AI botov na stránky išlo 26 % na URL bez obsahu.
Googlebot je zároveň jediná cesta do AI Overviews a AI Mode. Google výslovne píše, že na zobrazenie v týchto funkciách nie sú žiadne ďalšie požiadavky, žiadne špeciálne súbory ani značkovanie – platí to isté, čo pre bežné vyhľadávanie. Osobitný crawler pre AI Overviews neexistuje a v logu ho nenájdete. To, čo v logu vidíte pre Googlebota, platí aj pre vašu prítomnosť v AI odpovediach Googlu. Rovnako Bingbot: index Bingu je to, z čoho odpovedá Copilot.
Čo to ovplyvňuje: crawl budget. Google má na váš web vyhradený limit požiadaviek. Každá minutá na ?wc-ajax= je jedna, ktorá nešla na nový článok alebo zmenený produkt. Rieši sa to v robots.txt, nie pluginom:
Disallow: /*?wc-ajax=
Disallow: /*add-to-cart=
Disallow: /wp-json/
Disallow: /*/feed/
Pozor na statické súbory: CSS, JavaScript a obrázky vyhľadávače potrebujú na vykreslenie stránky. Tie neblokujte.
4. AI crawlery: ktoré modely vás čítajú a čo naozaj dostali
Toto je časť, ktorú Google Analytics nezachytí nikdy, lebo AI boty nespúšťajú JavaScript. Najprv kto je kto – lebo názvy sú mätúce a jeden prevádzkovateľ má často tri rôzne boty s tromi rôznymi úlohami:
| User-agent v logu | Prevádzkovateľ | Načo slúži | Čo ovplyvní, keď ho zablokujete | robots.txt |
|---|---|---|---|---|
| GPTBot | OpenAI | Zber obsahu na trénovanie modelov | Váš budúci obsah nepôjde do trénovania; na odpovede ChatGPT dnes priamo nevplýva | rešpektuje |
| OAI-SearchBot | OpenAI | Index pre vyhľadávanie v ChatGPT | Podľa OpenAI sa web „nebude zobrazovať v odpovediach ChatGPT search“ – toto je bot, na ktorom GEO stojí | rešpektuje |
| ChatGPT-User | OpenAI | Stiahnutie stránky, keď sa na ňu používateľ práve pýta | Používateľ si vás cez ChatGPT neotvorí | nemusí – požiadavku spustil človek |
| ClaudeBot | Anthropic | Zber obsahu na trénovanie | Budúci obsah mimo trénovania | rešpektuje, aj Crawl-delay |
| Claude-SearchBot | Anthropic | Index pre vyhľadávanie v Claude | Podľa Anthropicu „môže znížiť viditeľnosť a presnosť vo výsledkoch vyhľadávania“ | rešpektuje |
| Claude-User | Anthropic | Stiahnutie stránky na otázku používateľa | Claude vám obsah neprečíta, keď sa naň niekto pýta | rešpektuje |
| PerplexityBot | Perplexity | Index pre výsledky Perplexity | Web sa neobjaví vo výsledkoch Perplexity | rešpektuje |
| Perplexity-User | Perplexity | Stiahnutie na otázku používateľa | Perplexity nevie odpovedať z vášho obsahu | podľa Perplexity „vo všeobecnosti ignoruje“ |
| Googlebot | Index Googlu → aj AI Overviews, AI Mode | Vypadnete z Googlu aj z AI Overviews | rešpektuje | |
| Google-Extended | Iba token v robots.txt – v logu sa neobjaví | Zakáže trénovanie Gemini; „neovplyvňuje zaradenie do vyhľadávania Google“ | – | |
| Bingbot | Microsoft | Index Bingu → Copilot | Vypadnete z Bingu aj z Copilotu | rešpektuje |
| Applebot / Applebot-Extended | Apple | Siri, Spotlight / trénovanie Apple Intelligence | Applebot-Extended je opäť len token, crawluje Applebot | rešpektuje |
| Meta-ExternalAgent / Meta-WebIndexer / Meta-ExternalFetcher | Meta | Trénovanie / index Meta AI / na podnet používateľa | Meta AI vás nebude vedieť citovať | rešpektuje |
| Amazonbot | Amazon | Alexa a ďalšie služby Amazonu | Alexa vás nebude poznať | rešpektuje |
| Bytespider | ByteDance | Trénovanie (Doubao, TikTok) | – | historicky slabo |
| CCBot | Common Crawl | Verejný dataset, z ktorého trénuje veľa modelov | Váš obsah nepôjde do tohto datasetu | rešpektuje |
Dve veci z tej tabuľky rozhodujú o GEO:
Po prvé, trénovací bot a vyhľadávací bot nie sú to isté. GPTBot a ClaudeBot zbierajú obsah na trénovanie budúcich modelov – to je dlhodobé a nepriame. OAI-SearchBot, Claude-SearchBot a PerplexityBot stavajú index, z ktorého AI vyhľadávač odpovedá dnes. Ak chcete byť citovaní, sledujte v logu tie druhé. Ak ste v roku 2024 „zablokovali AI“ jedným pravidlom pre všetko, zablokovali ste si aj citácie.
Po druhé, Google nemá „AI crawler“. AI Overviews čerpajú z bežného indexu, ktorý stavia Googlebot. Google-Extended je len prepínač v robots.txt pre trénovanie Gemini a v logu ho nikdy neuvidíte. Kto chce byť v AI Overviews, potrebuje to, čo vždy: aby Googlebot dostával 200 a obsah v HTML.
Teraz čo z toho bolo v mojom logu za 24 hodín:
| Bot | Požiadavky | Z toho stránky s obsahom | Chyby | Čo čítal |
|---|---|---|---|---|
| ClaudeBot | 229 | 104 (45 %) | 31× 429 | 29× presmerovanie z úvodnej stránky, 18× robots.txt, 11× sitemap; obsah = články a slovník: stavové kódy, ROI, normostrana, SEO pre e-shop |
| Amazonbot | 138 | 30 (22 %) | 0 | prevažne technické súbory a presmerovania |
| OAI-SearchBot | 78 | 62 (79 %) | 0 | 62× úvodná stránka, 6× robots.txt, sitemapy. Ani jedna stránka služieb. |
| Meta-WebIndexer + Meta-ExternalAgent | 89 | 13 | 0 | prevažne technické súbory |
| Claude-User, ChatGPT-User | 17 | 11 | 0 | konkrétne články na podnet používateľa |
| ExaSearchBot, Bytespider | 9 | 8 | 0 | – |
„Stránky s obsahom“ sú odpovede 200 väčšie než 5 kB bez robots.txt, sitemáp a statických súborov. Zvyšok sú presmerovania, chyby a technické súbory – z tých sa model nič nedozvie. A tu je celé GEO v troch riadkoch:
- ClaudeBot urobil 229 požiadaviek, ale obsah dostal len v 104. Tretina išla na presmerovania a technické súbory, 31 skončilo chybou 429 – vrátane piatich pokusov o robots.txt a piatich o sitemap. Bot, ktorý nedostane ani robots.txt, nevie, čo smie, a odíde.
- OAI-SearchBot – ten, ktorý rozhoduje o vyhľadávaní v ChatGPT – prišiel 78-krát a 62-krát si vypýtal úvodnú stránku. Nie stránku služieb, nie články. Overuje, či web žije, ale hlbšie nejde. To znamená, že ChatGPT má z mojich služieb v indexe len to, čo sa zmestí na úvodnú stránku – a to je problém, ktorý som bez logu nemal ako vidieť.
- Claude-User a ChatGPT-User stiahli 17 konkrétnych článkov na podnet používateľa. To je najbližšie k dôkazu, že AI niekomu môj obsah ukázala. S jednou výhradou, ktorú si musíte priznať: môžete to byť aj vy, keď si s ChatGPT overujete vlastný web. Log nerozlíši majiteľa od cudzieho človeka. Ja som si to overil podľa času – jedna várka Claude-User požiadaviek sedela na minútu s tým, keď som s Claude riešil vlastné veci.
Čo to ovplyvňuje: viditeľnosť v AI odpovediach. Bot, ktorý dostane chybu, si stránku neprečíta – a čo si neprečítal, to Claude nikomu neodporučí. Bot, ktorý číta len úvodnú stránku, nemá z čoho citovať vaše služby. Robots.txt povie, či boty smú; log povie, či mohli a čo naozaj dostali.
5. Ľudia, ktorí prišli z AI odpovedí
Ešte jedna GEO vec, ktorú log vidí: pole referer. Keď človek klikne na váš web v odpovedi ChatGPT, Perplexity, Gemini alebo Claude, príde s refererom https://chatgpt.com/, https://www.perplexity.ai/, https://gemini.google.com/ alebo https://claude.ai/. GA4 to vidí tiež – ale len u ľudí, ktorí odsúhlasili cookies. Log to vidí u všetkých.
V mojom logu za 14. september bola presne jedna takáto návšteva, z Gemini. Jedna. Pri 229 požiadavkách ClaudeBota a 78 od OAI-SearchBota. To nie je zlyhanie merania, to je realita AI vyhľadávania: väčšina odpovedí končí bez kliknutia. Preto sa v GEO meria zmienka, nie návšteva – a preto je dôležitejšie, čo si crawler stiahol, než koľko ľudí potom kliklo.
6. Scrapery a útoky: kto vám berie server – a tým aj AI crawlery
Tu je odpoveď na otázku, prečo tých 809 chýb 429 vzniklo a prečo ich dostal aj ClaudeBot. V minútach, keď server odmietal požiadavky, tvorili záťaž:
| Kto | Podiel požiadaviek v čase preťaženia |
|---|---|
| Požiadavky bez user-agenta alebo s poškodeným | 47 % |
| Ľudia | 18 % |
| Vlastné služby webu (preload cache) | 13 % |
| Vyhľadávače | 9 % |
| AI crawlery | 5 % |
| Ostatné | 8 % |
AI crawlery tvorili päť percent záťaže a dostali tretinu chýb. Nezhodili server – boli tam len v nesprávnu chvíľu, spolu s tými, čo ho zhodili. Konkrétne:
- 1 035 požiadaviek bez user-agenta z piatich cloudových IP adries, 761× na úvodnú stránku. Žiadny prehliadač neposiela prázdny user-agent.
- 2 319 požiadaviek s user-agentom zabaleným v úvodzovkách (
"Mozilla/5.0 (Macintosh…)"aj s úvodzovkami) z 33 IP adries výstupných uzlov siete Tor. O týždeň neskôr ten istý bot 47-krát odoslal kontaktný formulár. Je to spam bot, ktorý sa vydáva za prehliadač. - 276× POST na wp-login.php – hádanie hesiel. Redaktori sa toľkokrát za deň neprihlasujú.
- Desiatky požiadaviek na
/?author=1,/.env,/.git/config,wp-config.php.bak– automatické sondy, či na webe neležia citlivé súbory. Dejú sa každému; dôležité je, aby dostali 404, nie 200.
Čo to ovplyvňuje: dostupnosť webu pre ľudí, pre Googlebota aj pre AI crawlery, bezpečnosť a – ak by ste to riešili drahším hostingom – vašu peňaženku. Väčšina týchto požiadaviek sa dá zastaviť v .htaccess skôr, než sa vôbec spustí PHP:
<IfModule mod_setenvif.c>
SetEnvIfNoCase User-Agent "^-?$" wa_blok
SetEnvIfNoCase User-Agent "^\x22" wa_blok
</IfModule>
<IfModule mod_authz_core.c>
<RequireAll>
Require all granted
Require not env wa_blok
</RequireAll>
</IfModule>
Prvé pravidlo blokuje prázdny user-agent, druhé user-agent začínajúci úvodzovkou. Apache odpovie 403 a PHP proces sa vôbec nespustí. Pred nasadením si v logu overte, že žiadna vaša služba (platobná brána, monitoring) nechodí bez user-agenta – Stripe, WP-Cron aj WP Rocket sa predstavujú, takže sa ich to netýka. A nikdy neblokujte podľa toho, že sa niečo volá „bot“ – zablokovali by ste si aj OAI-SearchBot.
7. Cache a vaše vlastné služby
Posledná vec, ktorú v logu uvidíte a inde nie: koľko servera míňate sami na seba. WP Rocket preload – funkcia, ktorá po vymazaní cache prejde celý web a nanovo ju vygeneruje – tvoril v ten deň 32 % celého času PHP. Nie preto, že by bol zlý, ale preto, že sa cache mazala priveľakrát (každé uloženie produktu, každá zmena menu) a preload ju stále dokola staval.
Podiel HIT bol len 14 %. Inak povedané: šesť zo siedmich cachovateľných požiadaviek generovalo PHP.
Čo to ovplyvňuje: rýchlosť pre ľudí a kapacitu pre všetko ostatné – vrátane AI crawlerov, ktoré prídu práve vtedy, keď preload beží. Riešenie nestojí nič: vypnúť automatické mazanie cache tam, kde nie je nutné, a nechať preload bežať v noci. Podrobnejšie v článku ako zrýchliť WordPress a WooCommerce.
Čo z logu o výsledkoch v AI vyčítať – a čo nie
Aby bolo jasné, čo od logu čakať. Log je dôkaz o prístupe, nie o odpovedi.
| Otázka | Vie log odpovedať? | Kde inde hľadať |
|---|---|---|
| Číta môj web ChatGPT / Claude / Perplexity? | Áno – user-agent, dátum, URL | nikde inde |
| Dostali obsah, alebo chybu? | Áno – stavový kód a veľkosť odpovede | nikde inde |
| Ktoré stránky majú v indexe čerstvé? | Áno – čo a kedy si stiahli | nikde inde |
| Čítajú stránky služieb, alebo len úvodnú? | Áno – zoznam URL po botoch | nikde inde |
| Pýtal sa niekto AI na konkrétnu moju stránku? | Čiastočne – ChatGPT-User, Claude-User; nerozlíši vás od cudzieho | – |
| Klikol niekto z AI odpovede na web? | Áno – referer | GA4 (len s cookies) |
| Citovala ma AI v odpovedi? | Nie | ručný test 20–30 otázok, Rank Math AI Visibility, Peec.ai, Profound |
| Čo o mne AI hovorí a koho odporúča namiesto mňa? | Nie | ručný test |
| Som v AI Overviews? | Nie priamo – ale ak Googlebot dostáva chyby, nie ste | Search Console, ručný test |
Log teda nenahrádza test odpovedí. Ale bez logu ten test nemáte ako interpretovať: keď vás ChatGPT necituje, je to preto, že váš obsah nie je dobrý – alebo preto, že OAI-SearchBot videl len úvodnú stránku? To sú dva úplne iné problémy s dvoma úplne inými riešeniami, a rozlíši ich len log.
Ako log prečítať bez programovania
Nemusíte otvárať terminál. Nižšie je nástroj, ktorý som na to napísal: vložíte doň obsah access logu (Ctrl+V) alebo pretiahnete stiahnutý súbor – aj .gz – a dostanete všetko, o čom bol tento článok: kto chodí, čo dostal Googlebot, ktoré AI crawlery vás čítajú a koľko z ich požiadaviek skončilo obsahom, ktoré stránky si AI stiahla, kto prišiel z AI odpovede, kto vás preťažuje, ktoré URL sú rozbité a čo s tým. Všetko sa počíta vo vašom prehliadači, log sa nikam neodosiela.
Ak ste zvyknutí na terminál, štyri príkazy, ktoré odpovedia na najčastejšie GEO otázky:
# ktoré AI crawlery chodia a koľkokrát
grep -iE "GPTBot|OAI-SearchBot|ChatGPT-User|ClaudeBot|Claude-SearchBot|Claude-User|PerplexityBot|Perplexity-User|Amazonbot|meta-external|Bytespider|CCBot" access_log \
| grep -oiE "GPTBot|OAI-SearchBot|ChatGPT-User|ClaudeBot|Claude-SearchBot|Claude-User|PerplexityBot|Perplexity-User|Amazonbot|meta-external[a-z]*|Bytespider|CCBot" | sort | uniq -c | sort -rn
# čo dostal OAI-SearchBot (stavový kód, veľkosť, URL)
grep -i "OAI-SearchBot" access_log | awk -F'"' '{split($3,s," "); split($2,r," "); print s[1], s[2], r[2]}' | sort | uniq -c | sort -rn | head -20
# koľko a komu server odpovedal 429
grep '" 429 ' access_log | awk -F'"' '{print $6}' | sort | uniq -c | sort -rn
# kto prišiel z AI odpovede
grep -iE '"https://(chatgpt\.com|www\.perplexity\.ai|gemini\.google\.com|claude\.ai|copilot\.microsoft\.com)' access_log | awk -F'"' '{print $4}' | sort | uniq -c
A pre pravidelnú analýzu je tu GoAccess – bezplatný nástroj, ktorý z logu urobí interaktívny report. Pre formát WebSupportu použite log-format %v %h %^[%d:%t %^] "%r" %s %b "%R" "%u" %^.
Čo s tým urobiť: sedem krokov v správnom poradí
- Stiahnite si log za jeden bežný deň a spustite ho cez nástroj vyššie. Päť minút.
- Pozrite sa na 429 a 5xx. Ak sú tam, zistite, kto tvoril záťaž v tých minútach. Toho zablokujte. Kým to neurobíte, nemá zmysel riešiť nič iné – ani GEO, ani obsah.
- Zablokujte scrapery v
.htaccess– prázdny user-agent, poškodený user-agent, konkrétne skripty, ktoré sa v logu opakujú. Nie podľa IP: tie sa menia, reťazec v user-agente nie. A nie podľa slova „bot“. - Skontrolujte, ktoré AI crawlery chodia a čo dostali. Chýba OAI-SearchBot alebo PerplexityBot? Pozrite robots.txt a firewall. Dostávajú 429 alebo 403? Oprava je bod 2. Nič z toho? Pre boty, ktoré rešpektujú
Crawl-delay(ClaudeBot áno), ho môžete v robots.txt nastaviť, aby prichádzali pomalšie a nezrážali sa so špičkou. - Pozrite sa, ktoré stránky si AI stiahla. Ak vyhľadávací bot číta len úvodnú stránku, dajte na ňu priame HTML odkazy na kľúčové stránky služieb, overte sitemap v robots.txt a to, že tie stránky vracajú 200 bez presmerovania.
- Presmerujte 404, na ktoré chodí Googlebot, a opravte odkazy, na ktoré klikajú ľudia. Googlebot je zároveň vaša cesta do AI Overviews.
- Zopakujte to o mesiac a porovnajte: viac stránok s obsahom pre OAI-SearchBot, menej 429, viac Claude-User a ChatGPT-User požiadaviek z rôznych IP adries. To je GEO metrika, ktorú máte zadarmo a ktorú nikto iný nemá.
Log je jediný nástroj, ktorý vám ukáže, či to pomohlo – nie preto, že by bol lepší než ostatné, ale preto, že ako jediný vidí všetko.
GEO služby Milan Fraňo
Volám sa Milan Fraňo a vo WooAcademy mám na starosti SEO, GEO a technickú stránku webov. Logy čítam pri každom audite ako prvé, ešte pred Search Console – lebo Search Console hovorí o tom, čo Google zistil minulý týždeň, a log o tom, čo sa deje dnes. A o AI crawleroch nehovorí Search Console vôbec nič.
Väčšina problémov, ktoré klienti prídu riešiť ako „pomalý web“, „klesajú nám pozície“ alebo „ChatGPT nás neodporúča“, má koreň v niečom, čo v logu vidno na prvý pohľad: preťažený server, robot, ktorý ho preťažuje, alebo crawler, ktorý dostáva chyby a preto vás prestal čítať. Analytics to nevidí a plugin to nespraví.
Čo konkrétne robím pre klientov:
- GEO audit z logov – ktoré AI crawlery vás čítajú, koľko z ich požiadaviek skončilo obsahom, ktoré stránky videli a ktoré nie, či dostávajú chyby; spolu s testom 20–30 reálnych otázok vášho zákazníka v ChatGPT, Perplexity a Gemini
- Audit servera z logov – kto vám berie kapacitu, čo dostáva Googlebot, kde plytváte crawl budgetom; s konkrétnym zoznamom, čo kde zmeniť
- Nastavenie ochrany –
.htaccess, robots.txt s rozlíšením trénovacích a vyhľadávacích botov, Wordfence, prípadne Cloudflare pred webom - Zrýchlenie webu – cache, preload, databáza, skripty tretích strán; meriam v logu aj v Core Web Vitals
- GEO a SEO školenia – vo WooAcademy učíme to, čo sami robíme; čítanie logov je súčasť našich technických SEO a GEO tréningov
Ak chcete vedieť, čo je vo vašom logu: pošlite mi doménu a log za jeden bežný deň. Pošlem vám späť, ktoré AI modely vás čítajú, čo naozaj dostali, kto vám berie server a čo kde zmeniť. Zadarmo.
👉 Nezáväzná konzultácia SEO a GEO
Často kladené otázky
Čo je access log?
Access log je textový súbor, do ktorého webový server zapisuje jeden riadok za každú prijatú požiadavku: IP adresu, čas, URL, stavový kód, veľkosť odpovede, referer a user-agent. Zachytí všetko vrátane robotov a požiadaviek bez JavaScriptu, ktoré Google Analytics nevidí.
Ako zistím, či ChatGPT číta môj web?
V access logu hľadajte user-agenty OAI-SearchBot (index pre vyhľadávanie v ChatGPT), GPTBot (trénovanie) a ChatGPT-User (stiahnutie stránky na podnet používateľa). Pri každom riadku si pozrite stavový kód a veľkosť odpovede – 200 s desiatkami kilobajtov je obsah, 429 alebo 403 znamená, že bot obsah nedostal.
Aký je rozdiel medzi GPTBot a OAI-SearchBot?
GPTBot zbiera obsah na trénovanie modelov OpenAI. OAI-SearchBot stavia index, z ktorého odpovedá vyhľadávanie v ChatGPT – podľa OpenAI sa web, ktorý ho zablokuje, v odpovediach ChatGPT search nezobrazí. Pre viditeľnosť v AI odpovediach je rozhodujúci OAI-SearchBot.
Vidím v logu, či som v AI Overviews Googlu?
Nie priamo. AI Overviews a AI Mode čerpajú z bežného indexu Googlu, ktorý stavia Googlebot – osobitný crawler neexistuje. Google-Extended je len token v robots.txt pre trénovanie Gemini, v logu sa neobjaví a zaradenie do vyhľadávania neovplyvňuje. Ak Googlebot v logu dostáva 200 a obsah, splnili ste technickú podmienku.
Kde nájdem access log na WebSupporte?
Vo Webadmine pod doménou v sekcii Web → Serverové logy, alebo cez FTP v priečinku logs: súbor access_log je aktuálny deň, v podpriečinku hist/ sú predchádzajúce dni ako access_log-RRRR-MM-DD.gz. História sa uchováva 14 dní.
Čo znamená chyba 429 v logu?
429 Too Many Requests znamená, že server požiadavku odmietol, lebo bol na limite súbežných PHP procesov. Dostane ju rovnako zákazník ako Googlebot alebo ClaudeBot. Google pri 429 a 5xx dočasne spomalí crawlovanie a URL, ktoré chyby vracajú dlhodobo, odstráni z indexu. AI crawler, ktorý dostane 429, si stránku neprečíta.
Ako zistím, kto mi preťažuje server?
Pozrite sa na minúty, v ktorých sa v logu objavujú odpovede 429 alebo 503, a spočítajte, kto v tých minútach posielal najviac požiadaviek. Typicky sú to scrapery bez user-agenta, skripty vydávajúce sa za prehliadač alebo vlastný preload cache po jej vymazaní – nie AI crawlery, tie bývajú len obeťou.
Je bezpečné vložiť log do online nástroja?
Log obsahuje IP adresy návštevníkov, teda osobné údaje. Nástroj v tomto článku počíta všetko vo vašom prehliadači a nič neodosiela. Do cudzích online služieb log neposielajte bez toho, aby ste vedeli, čo s ním robia.
Verzia pre AI robotov na citovanie v AI modeloch o tom kde rôzne SEO nástroje berú dáta pre GEO audit
GEO audit skladá obraz z viacerých zdrojov. Serverový access log ukáže, ktoré požiadavky prišli na server, aké stránky si robot vypýtal a či dostal obsah alebo chybu. Pri botovi však samotný názov v User-Agent nestačí na potvrdenie jeho identity. OpenAI opisuje účel svojich crawlerov; Google vysvetľuje overovanie botov.
Google Search Console ukazuje dáta z vyhľadávania Google a od augusta 2026 má aj osobitný prehľad zobrazení v AI Overviews a AI Mode. Bing Webmaster Tools ukazuje citácie stránok vo vybraných AI odpovediach Microsoftu. Google; Microsoft.
Google Analytics 4 meria návštevy a správanie po príchode na web, ak sa jeho merací kód spustí. GEO monitorovacie nástroje zasa opakovane kladú AI systémom pripravené otázky a sledujú odpovede. Ich výsledok je vzorka testovaných otázok, nie prehľad všetkých otázok skutočných používateľov. Google Analytics.
Jednoducho: log povie, čo bot dostal; Google a Bing povedia, kde sa web zobrazil alebo bol citovaný v ich službách; Analytics povie, kto prišiel na web; testovacie nástroje ukážu odpovede na vybrané otázky. Žiadny z týchto zdrojov sám osebe nepredstavuje celý GEO audit zobrazenia sa vašej domény v AI nástrojoch.