Takmer každý väčší web má vyhľadávacie políčko. Na e-shope, v magazíne aj na firemnom webe s blogom. Málokto však rieši, čo sa stane, keď sa stránky s výsledkami tohto vyhľadávania dostanú ku Googlebotu. V podcaste Search Off the Record sa tejto téme koncom júla 2026 (epizóda 113) venovali John Mueller a Martin Splitt z Google. Z ich rozhovoru vyplývajú tri vážne dôvody, prečo výsledky interného vyhľadávania pred Googlom zatvoriť, a jeden fakt, ktorý veľa ľudí prekvapí: Google to dnes nevyžaduje.
V článku nájdete, čo presne zaznelo, kde je háčik, ako si stav na svojom webe overíte a presný postup pre WordPress a WooCommerce.
Stručne: čo robiť s výsledkami interného vyhľadávania
| Otázka | Krátka odpoveď |
|---|---|
| Je indexovanie výsledkov vyhľadávania porušením pravidiel Google? | Nie. Google to v aktuálnych pravidlách neuvádza, ide o technickú neefektívnosť. |
| Prečo ich teda zatvoriť? | Nekonečný priestor pre Googlebot, záťaž servera a zneužitie spamermi. |
| Najjednoduchšie riešenie? | Zákaz v robots.txt jedným širokým pravidlom. |
| Najspoľahlivejšie proti zobrazeniu v Google? | Noindex, Mueller ho označil za takmer čistejšie riešenie, lebo zabráni zobrazeniu URL vo výsledkoch aj bez obsahu. |
| Čo nerobiť? | Nespoliehať sa na nástroj Odstránenia a nikdy nevracať chybu 500. |
| Kategórie tvorené vyhľadávaním? | Nahradiť ich skutočnými kategóriami alebo ich od vyhľadávania oddeliť. |
Prečo sú výsledky interného vyhľadávania problém
Nekonečný priestor pre Googlebot
Vyhľadávanie na webe dokáže vytvoriť výsledok pre akékoľvek slovo. Keď na takú stránku vedie odkaz, Googlebot ju nepozná ako vyhľadávanie. Vidí len ďalšiu URL adresu a skúsi ju prehľadať. Ak výsledky ďalej odkazujú na súvisiace hľadania, triedenie podľa dátumu či abecedy alebo filtre, počet adries rastie takmer donekonečna. Google tomu hovorí nekonečný priestor (infinite space).
Google sa takéto vzory snaží rozpoznať a prehľadávanie v nich obmedziť. Mueller však priznal, že to môže trvať a že vás o tom Search Console neinformuje. Vo svojej dokumentácii o správe rozpočtu na prehľadávanie Google odporúča nedôležité stránky blokovať v robots.txt, pretože zákaz v robots.txt zabráni ich prehľadávaniu (Google Search Central, Crawl budget management).
Záťaž servera
Výsledky vyhľadávania sa spravidla neukladajú do cache. Každá návšteva takej stránky znamená dotaz do databázy, zoradenie výsledkov a vytvorenie úryvkov. Keď Googlebot začne takých stránok žiadať tisíce, web sa môže spomaliť aj pre bežných návštevníkov. Presne to je dôvod, prečo pri e-shopoch s veľkou databázou produktov kontrolujem prístupový log ako jednu z prvých vecí. Ako ho čítať, vysvetľujem v článku Access log: súbor, ktorý máte zadarmo a nikdy ste ho neotvorili.
Spam cez vaše vlastné vyhľadávanie
Toto je podľa mňa najdôležitejšia časť celého rozhovoru. Spameri automaticky hľadajú weby, ktorých vyhľadávanie je indexovateľné, a vytvárajú na ne odkazy s dotazmi typu nelegálne lieky, kasíno alebo obsah pre dospelých spolu s telefónnym číslom či kontaktom na Telegram. Váš web potom poslušne zobrazí stránku, kde je tento text v nadpise, a ak je indexovateľná, môže sa objaviť vo výsledkoch Google pre spamové dotazy. Pod vašou doménou.
Mueller výslovne uviedol, že Google takéto prípady môže v Search Console označiť ako napadnutý web (hacked). Algoritmy časť tohto obsahu niekedy zachytia samy, no nie hneď a nie vždy úplne. Kým sa to stane, vaši zákazníci môžu pri hľadaní vašej značky vidieť spamové stránky s vaším menom. Kto chce pochopiť, prečo sa podobné triky vôbec objavujú, nájde kontext v článku čo je poctivé SEO a čo nepoctivé SEO.
Starý pokyn, nové riziko
Google pôvodne v starých pokynoch pre webmasterov odporúčal výsledky vyhľadávania blokovať ako automaticky generovaný obsah. V dnešných pravidlách to už nie je. Mueller preto zdôrazňuje, že nejde o trest za kvalitu, ale o neefektívnosť. Je to dobrý príklad toho, ako sa v SEO dlhé roky držia pravidlá, ktoré už neplatia. Podobné mýty rozoberám v článku SEO ranking faktory: fakty a mýty. V praxi je však rozdiel medzi neefektívnosťou a rizikom tenký. Web, ktorého vyhľadávanie spameri zneužijú, rieši presne ten istý problém ako napadnutý web, vrátane možného označenia ako napadnutý web v Search Console. Z pohľadu majiteľa webu je to teda bezpečnostná otázka, nie len otázka SEO.
Robots.txt, alebo noindex?
Google odporúča dve cesty. Každá má výhody aj nevýhody.
| Vlastnosť | Robots.txt (Disallow) | Noindex (meta tag alebo HTTP hlavička) |
|---|---|---|
| Zabráni prehľadávaniu | áno | nie, Googlebot stránku načíta, no ďalej ju neindexuje |
| Šetrí server a rozpočet na prehľadávanie | áno | čiastočne, Google sa postupne naučí takéto stránky vynechávať |
| Zaručí, že URL nebude vo výsledkoch Google | nie, zablokovaná URL sa môže zobraziť bez úryvku, ak na ňu vedú odkazy | áno |
| Náročnosť nastavenia | jeden riadok v robots.txt | zvyčajne nastavenie v SEO plugine alebo úprava šablóny |
Kľúčové je vedieť, že tieto dve metódy nekombinujte na tej istej URL naraz. Google výslovne uvádza, že aby noindex fungoval, stránka nesmie byť blokovaná v robots.txt. Inak ho Googlebot nikdy neuvidí (Google Search Central, Block indexing with noindex). Rovnako platí, že zákaz v robots.txt nie je spôsob, ako stránku odstrániť z Google. URL sa môže vo výsledkoch zobraziť aj bez obsahu, ak na ňu vedú odkazy (Google Search Central, Introduction to robots.txt).
Moje odporúčanie:
- Na novom alebo čistom webe stačí zákaz v robots.txt. Je to rýchle a spoľahlivé.
- Ak už máte vo výsledkoch Google spamové stránky vyhľadávania, postupujte v dvoch krokoch: najprv nastavte noindex a nechajte Googlebot stránky znova prehľadať, aby ich z indexu vyradil. Až potom pridajte zákaz v robots.txt. Keby ste ich zablokovali hneď, zostali by vo výsledkoch Google bez úryvku.
Jedno široké pravidlo namiesto labyrintu
Mueller odporúča mať pre vyhľadávanie jedno pravidlo, ktoré pokryje celý vzor, a nie desiatky špecifických riadkov. Také pravidlo sa ľahšie udržiava a pri kontrole hneď vidíte, prečo je daná URL blokovaná. Google v robots.txt podporuje zástupné znaky, hviezdičku pre ľubovoľný text a znak dolára pre koniec adresy.
Ak má vaše vyhľadávanie adresy v tvare /search?q=, Mueller navrhuje blokovať cestu /search? a nie celé /search. Tak nezablokujete nechtiac inú stránku, ktorej adresa sa začína rovnakým slovom.
Postup pre WordPress a WooCommerce
WordPress používa pre vyhľadávanie parameter s, teda adresy v tvare domena.sk/?s=hladany-vyraz. Pri zapnutých pekných trvalých odkazoch navyše samotné jadro WordPressu podporuje aj adresy v tvare domena.sk/search/hladany-vyraz/, a to bez ohľadu na šablónu. Spameri preto môžu odkazovať na oba tvary. Vyhľadávanie vo WooCommerce používa rovnaký parameter, len s doplnkom post_type=product.
Krok 1: zistite, ako vyzerajú adresy vyhľadávania na vašom webe
Vyhľadajte na svojom webe ľubovoľné slovo a pozrite sa na adresu v prehliadači. Vyskúšajte aj druhú stranu výsledkov a vyhľadávanie v produktoch, ak máte e-shop.
Krok 2: overte si, či Google už nejaké výsledky vyhľadávania nemá
- Do Google zadajte site:vasadomena.sk a za to inurl:s= alebo inurl:search a pozrite sa, čo sa zobrazí.
- V Search Console otvorte Stránky v časti Indexovanie a hľadajte adresy s parametrom vyhľadávania.
- V Search Console skontrolujte Bezpečnostné problémy.
- V prístupovom logu servera vyhľadajte požiadavky Googlebotu na adresy s ?s= alebo /search/.
Krok 3: nastavte noindex v SEO plugine
Rank Math má v časti Titulky a meta, Ostatné stránky prepínač noindex pre výsledky vyhľadávania, ktorý je predvolene zapnutý. Yoast SEO pridáva stránkam vyhľadávania noindex automaticky a v nastaveniach optimalizácie prehľadávania ponúka aj voliteľné funkcie na zákaz prehľadávania vyhľadávania a filtrovanie spamových hľadaných výrazov, ktoré sú predvolene vypnuté. Po aktualizáciách, migráciách či zmenách šablóny sa nastavenia môžu zmeniť alebo ich môže prepísať iný plugin, preto si nastavenie overte v plugine aj priamo v zdrojovom kóde stránky s výsledkami. Hľadajte v ňom meta tag robots s hodnotou noindex. Viac o nastaveniach Rank Math nájdete v článku WordPress SEO plugin Rank Math.
Krok 4: po vyčistení indexu pridajte pravidlá do robots.txt
Pre bežný WordPress stačia tieto riadky v sekcii User-agent: *
- Disallow: /?s=
- Disallow: /*?s=
- Disallow: /*&s=
- Disallow: /search/
Prvé pravidlo pokryje vyhľadávanie z úvodnej stránky, druhé aj adresy typu /page/2/?s=, tretie prípady, keď je parameter s až za iným parametrom, a posledné pekné adresy vyhľadávania. Pred uložením si ich otestujte. Pravidlo /search/ zablokuje každú adresu, ktorej cesta sa začína /search/, teda aj prípadnú skutočnú stránku s takouto adresou. Adresy ako /search-tipy/ neovplyvní.
Krok 5: overte výsledok
- Pomocou Kontroly URL v Search Console otestujte jednu adresu vyhľadávania a jednu bežnú stránku, aby ste mali istotu, že ste nezablokovali nič navyše.
- Po niekoľkých týždňoch znova skontrolujte dotaz site: a prehľad Stránky v Search Console.
Čo nerobiť
Nespoliehajte sa na nástroj Odstránenia v Search Console. Skryje adresy vo výsledkoch Google len približne na šesť mesiacov a nezabráni prehľadávaniu (Pomocník Search Console, Removals tool). Mueller upozornil, že práve toto riešenie môže vytvárať falošný pocit, že je problém vyriešený, hoci Googlebot ďalej preťažuje server.
Nikdy nevracajte chybu 500. Keby ste na adresy vyhľadávania odpovedali chybou servera, Google to vyhodnotí tak, že server nezvláda záťaž, a obmedzí prehľadávanie celého webu, nielen vyhľadávania. Google v dokumentácii potvrdzuje, že chyby 5xx a odpoveď 429 znižujú limit prehľadávania. Chybový kód 404 je možný, no Mueller ho nepovažuje za čisté riešenie.
Neblokujte naslepo. Niektoré systémy, napríklad Blogger, zobrazujú kategórie alebo štítky ako výsledky vyhľadávania. Keby ste zablokovali celé vyhľadávanie, zablokujete aj kategórie, ktoré sú pre SEO veľmi cenné. Najprv overte, či sa adresy kategórií a vyhľadávania dajú od seba odlíšiť.
Chcem mať niektoré výsledky vyhľadávania vo výsledkoch Google
Teoreticky môžete zakázať celé vyhľadávanie a povoliť len niekoľko vybraných dotazov, na ktoré odkážete z webu. Mueller však správne upozorňuje, že v takom prípade takmer vždy urobíte lepšiu prácu so skutočnou kategóriou alebo vstupnou stránkou. Tá môže vysvetliť, prečo je téma dôležitá, a vybrať najlepší obsah namiesto strojového zoznamu. Kategórie zároveň pomáhajú Googlu pochopiť štruktúru webu, čo je obzvlášť dôležité pri e-shopoch. Viac o tom píšem v článku SEO pre e-shop.
Zaujímavosť na záver: Mueller priznal, že na svojom osobnom webe to vyriešil najjednoduchšie, ako sa dá. Vyhľadávacie políčko návštevníka presmeruje na Google s dotazom obmedzeným na jeho web. Vlastné stránky s výsledkami tak vôbec nevznikajú.
Moje odporúčania v skratke
- Zistite, ako vyzerajú adresy vyhľadávania na vašom webe a či už nie sú v Google.
- Skontrolujte Bezpečnostné problémy v Search Console a dotazom site: overte, či sa neobjavuje spam s vašou doménou.
- Ak je index čistý, zablokujte vyhľadávanie jedným širokým pravidlom v robots.txt.
- Ak index čistý nie je, najprv noindex, a až po vyradení stránok robots.txt.
- Nerobte z vyhľadávania náhradu kategórií. Vytvorte skutočné kategórie a vstupné stránky.
- Pri správe viacerých webov pridajte zákaz vyhľadávania do robots.txt štandardne pri každom novom projekte.
Časté otázky
Mám blokovať výsledky interného vyhľadávania v robots.txt?
Vo väčšine prípadov áno. Google to podľa Johna Muellera dnes nevyžaduje ako pravidlo, ale z technických dôvodov to odporúča: výsledky vyhľadávania môžu vytvoriť nekonečný počet adries, zaťažiť server a spameri ich môžu zneužiť. Robots.txt je najjednoduchšie riešenie.
Je lepší robots.txt, alebo noindex?
Robots.txt zabráni prehľadávaniu a šetrí server, no zablokovaná URL sa môže zobraziť vo výsledkoch bez úryvku. Noindex spoľahlivo zabráni zobrazeniu vo výsledkoch, ale Googlebot stránku stále načíta. Na tej istej URL ich nekombinujte, lebo noindex by Googlebot za zákazom v robots.txt nevidel.
Uškodí indexované interné vyhľadávanie môjmu webu?
Samo osebe nie je trestom za kvalitu. Problém vzniká, keď ho zneužijú spameri a vo výsledkoch Google sa pod vašou doménou objavia stránky so spamovými výrazmi. Vtedy môže Google web v Search Console označiť ako napadnutý.
Ako zistím, či Google indexuje moje výsledky vyhľadávania?
Zadajte do Google site: a vašu doménu spolu s inurl:s= alebo inurl:search, prezrite si prehľad Stránky v Search Console a skontrolujte v prístupovom logu, či Googlebot navštevuje adresy vyhľadávania.
Ako zablokovať vyhľadávanie vo WordPresse?
Overte, či SEO plugin označuje stránky s výsledkami vyhľadávania ako noindex. Ak je index čistý, pridajte do robots.txt pravidlá pre parameter s, napríklad Disallow: /?s= a Disallow: /*?s=, a Disallow: /search/, pretože jadro WordPressu pri pekných trvalých odkazoch podporuje aj tento tvar adries vyhľadávania. Výnimkou je web, ktorý má pod /search/ skutočnú stránku.
Pomôže nástroj Odstránenia v Search Console?
Len dočasne. Skryje adresy vo výsledkoch Google približne na šesť mesiacov, ale nezabráni prehľadávaniu. Problém treba vyriešiť noindexom alebo zákazom v robots.txt.
Môžem na adresy vyhľadávania vracať chybu 500?
Nie. Google by chybu servera vyhodnotil ako preťaženie a obmedzil by prehľadávanie celého webu vrátane dôležitých stránok.
