Prečo Google neindexuje moje stránky a ako to napraviť
Publikovať stránku a byť vo vyhľadávaní sú dve rôzne veci. Google najprv musí adresu objaviť, potom ju stiahnuť a až nakoniec sa rozhodne, či ju do indexu vôbec zaradí. Ak sa niektorý z týchto krokov zasekne, stránka neexistuje pre nikoho, kto ju hľadá. Dobrá správa je, že Search Console pri každej adrese pomenuje konkrétny dôvod a takmer každý z nich má typické riešenie. Tento návod prechádza stavy z prehľadu indexovania jeden po druhom, vysvetľuje, čo za nimi býva, a končí postupom, ktorý sa dá odpracovať za jedno popoludnie.
1. Prehľadávanie a indexovanie nie sú to isté
Google v dokumente o tom, ako funguje vyhľadávanie, rozdeľuje celý proces na tri samostatné fázy. Každá z nich môže zlyhať nezávisle od ostatných, a preto má zmysel vedieť, ktorá to je:
- Prehľadávanie (crawling). Google objaví adresu (z odkazu na inej stránke, zo súboru sitemap alebo z už známej stránky) a stiahne jej obsah.
- Indexovanie (indexing). Stiahnutý obsah sa spracuje, vyhodnotí a môže sa uložiť do indexu. Google k tomu uvádza priamo: nie každá prehľadaná stránka sa indexuje.
- Zobrazovanie (serving). Až stránky v indexe sa môžu objaviť medzi výsledkami, keď niekto zadá dopyt.
Z toho vyplýva prvý dôležitý záver. Ak sa stránka nezobrazuje vo výsledkoch, ešte to neznamená, že je zle napísaná alebo že má slabé odkazy. Možno sa k nej Googlebot nikdy nedostal, možno ju stiahol a odmietol, možno ju zaradil, ale nepovažuje ju za dosť dobrú odpoveď na váš dopyt. Sú to tri úplne odlišné problémy s tromi odlišnými riešeniami a miešať ich dokopy znamená liečiť nesprávnu chorobu.
💡 Indexácia nie je nárok, je to rozhodnutie. Google nemá povinnosť zaradiť každú adresu, ktorú nájde na internete. Pri malých weboch býva príčinou technická prekážka. Pri väčších weboch a e-shopoch podľa mojej skúsenosti častejšie to, že stránka neprináša dosť samostatnej hodnoty na to, aby zaberala miesto v indexe. Trend to nie je merateľný, je to pozorovanie z auditov.
2. Ako zistiť, či je stránka naozaj v indexe
Existujú tri spôsoby, ako to overiť, a líšia sa spoľahlivosťou.
Nástroj na kontrolu adries URL v Search Console je jediný presný zdroj. Vložíte doň konkrétnu adresu a dostanete odpoveď v štýle „Adresa URL je v službe Google“ alebo „Adresa URL nie je v službe Google“, plus dôvod, dátum posledného prehľadania a to, ktorú adresu Google považuje za kanonickú. Ak potrebujete zistiť stav jednej konkrétnej stránky, začnite tu. Prácu s nástrojom podrobnejšie rozoberá článok o Google Search Console.
Prehľad indexovania stránok ukazuje ten istý údaj hromadne za celý web: koľko adries je indexovaných, koľko nie, a najmä zoznam dôvodov s počtom dotknutých adries. Toto je miesto, kde sa dá odhaliť systémový problém, napríklad že 400 z 500 adries e-shopu má rovnaký dôvod, čo takmer vždy znamená jednu zle nastavenú vec, nie 400 samostatných chýb.
Operátor site: vo vyhľadávaní je len orientačný. Google ho v príručke pre začiatočníkov odporúča na hrubú kontrolu toho, či je web vo výsledkoch, nie na inventúru. Počet výsledkov je odhad a dôvod nezaradenia sa z neho nedozviete. Na rýchlu kontrolu „je toho tam vôbec niečo?“ stačí, na diagnostiku nie.
Praktická rada k prehľadu indexovania: nepozerajte sa len na celkové čísla, ale na pomer. Ak má web 120 stránok a indexovaných je 110, je to v poriadku. Zvyšok sú spravidla presmerovania a stránky s noindex. Ak má web 120 stránok a indexovaných je 17, máte problém, ktorý žiadne písanie ďalšieho obsahu nevyrieši.
3. Technické príčiny: Google sa k stránke nedostane
Prvá skupina dôvodov je najpríjemnejšia, lebo je jednoznačná a opraviteľná. Ide o prípady, keď stránka Googlu buď nič nevrátila, alebo mu sama povedala, že ju indexovať nemá. Nasledujúca tabuľka zhŕňa stavy z prehľadu indexovania stránok tak, ako ich Google pomenúva, spolu s tým, čo za nimi v praxi býva.
| Stav v Search Console | Čo to znamená | Kde hľadať príčinu |
|---|---|---|
| Adresa URL označená ako noindex | Stránka obsahuje pokyn noindex, Google ju preto nezaradil | Meta značka robots v hlavičke, hlavička X-Robots-Tag, zaškrtnutá voľba v redakčnom systéme |
| Adresa URL blokovaná súborom robots.txt | Prehľadávač na stránku nesmie vstúpiť | Pravidlá Disallow v súbore robots.txt, často zdedené z testovacej verzie webu |
| Chyba servera (5xx) | Server pri žiadosti vrátil chybu | Preťažený hosting, chyba aplikácie, agresívna ochrana proti robotom |
| Nenájdené (404) | Adresa neexistuje | Zmazaný obsah, preklep v odkaze alebo v sitemape, zmenená štruktúra adries |
| Blokované z dôvodu zakázaného prístupu (403) | Server prístup odmietol | Ochrana WAF, prihlasovacia stena, geoblokovanie, blokovanie podľa user agenta |
| Chyba presmerovania | Presmerovanie sa zacyklilo alebo je príliš dlhé | Reťazec presmerovaní, slučka medzi verziou s www a bez www alebo medzi HTTP a HTTPS |
| Chyba typu soft 404 | Stránka sa tvári ako neexistujúca, ale vracia kód 200 | Prázdne výpisy kategórií, stránka s textom o nedostupnosti produktu, chybne riešená stránka „nenájdené“ |
Dva z týchto stavov si zaslúžia zvláštnu pozornosť, lebo sa najčastejšie mýlia navzájom. Robots.txt zakazuje prehľadávanie, nie indexovanie. Ak stránku zablokujete v robots.txt a zároveň na nej máte noindex, Google si ten pokyn nikdy neprečíta, pretože sa na stránku vôbec nepozrie. Práve preto existuje v prehľade samostatné varovanie Indexované, hoci blokované súborom robots.txt: adresa sa do indexu dostala napriek zákazu, typicky cez odkazy z iných webov. Google v návode o blokovaní indexovania uvádza, že aby pokyn noindex zabral, stránka nesmie byť blokovaná v robots.txt. Rozdiel medzi oboma nástrojmi rozoberá do detailu článok o robots.txt a sitemap.xml.
Druhý zradný prípad je soft 404. Nejde o chybu servera, ale o rozpor medzi kódom odpovede a obsahom. Typický scenár v e-shope: kategória sa vyprázdni, stránka zostane online s textom „V tejto kategórii momentálne nemáme žiadne produkty“ a vráti kód 200. Google takú stránku vyhodnotí ako neexistujúcu a vyradí ju. Riešením je buď kategóriu naplniť, alebo ju korektne presmerovať, alebo vrátiť skutočný kód 404 či 410. Ako to spraviť bez straty hodnoty ukazuje článok o presmerovaniach 301.
Osobitnou kategóriou sú weby, ktoré obsah vykresľujú až v prehliadači cez JavaScript. Ak sa v zdrojovom kóde nenachádza nič a všetko dopĺňa skript, indexácia sa odkladá alebo zlyháva na chybe, ktorú v bežnom prehliadači nevidíte. Diagnostiku takýchto prípadov popisuje článok o JavaScripte a SEO.
4. Duplicita a kanonizácia: Google uprednostnil inú adresu
Druhá skupina dôvodov znie znepokojivo, no často znamená, že systém funguje presne tak, ako má. Google pri viacerých veľmi podobných adresách vyberie jednu ako kanonickú (tú indexuje a zobrazuje) a ostatné označí za jej varianty. V prehľade sa to prejaví tromi stavmi:
- Alternatívna stránka so správnou kanonickou značkou. Stránka sama uvádza, že kanonickou verziou je iná adresa, a tá je indexovaná. Toto nie je chyba a netreba s tým nič robiť. Bežne sem patria verzie s parametrami, jazykové varianty alebo tlačové verzie.
- Duplicita bez kanonickej verzie zvolenej používateľom. Google našiel duplicitu, ale stránka žiadnu preferenciu neuviedla, takže si vybral sám. Tu treba zasiahnuť a preferenciu doplniť.
- Duplicita, Google zvolil inú kanonickú verziu než používateľ. Preferenciu ste uviedli, ale Google ju prehlasoval. Znamená to, že jeho signály hovoria niečo iné než vaša značka.
Kľúčové je pochopiť, čo prvok rel="canonical" vlastne je. Google v návode na zlúčenie duplicitných adries vysvetľuje, že kanonická značka je silný signál, nie príkaz. Ak jej odporujú ostatné signály (interné odkazy, sitemap, presmerovania, samotný obsah), Google si vyberie podľa nich.
Z toho plynie praktický postup pri stave „Google zvolil inú kanonickú verziu“: nesnažte sa značku vnútiť opakovaním, ale zosúlaďte s ňou zvyšok webu. Odkazujte interne na verziu, ktorú chcete indexovať. Dajte do sitemapy iba ju. Skontrolujte, či presmerovania nesmerujú inam. A hlavne overte, či sa obe stránky obsahovo naozaj líšia. Ak nie, otázka nie je, ktorú indexovať, ale prečo existujú obe. Túto tému rozvíja článok o duplicitnom obsahu.
V e-shopoch býva zdrojom masovej duplicity kombinovanie filtrov a triedení, ktoré generuje stovky takmer identických adries. To je samostatná disciplína a rieši ju článok o stránkovaní a filtroch.
5. Prehľadané a nezaradené: najnepríjemnejší stav
Zostávajú dva stavy, ktoré nemajú technickú príčinu a práve preto trápia najviac:
- Prehľadané – momentálne nezaradené do indexu. Google stránku stiahol, pozrel si ju a rozhodol sa ju neindexovať.
- Objavené – momentálne nezaradené do indexu. Google o adrese vie, ale zatiaľ ju ani nestiahol.
Pri prvom stave je odkaz pomerne čitateľný: stránka sa Googlu nezdala dosť hodnotná na to, aby zabrala miesto v indexe. Typickí kandidáti sú tenké stránky bez samostatného zmyslu, texty, ktoré len preformulúvajú to, čo je na webe už inde, generované varianty jednej šablóny a obsah, ktorý neprináša nič, čo by inde nebolo. Riešením nie je opakované žiadanie o indexáciu, ale zásah do obsahu: buď stránku výrazne zlepšiť a doplniť o niečo vlastné, alebo ju zlúčiť s inou, alebo priznať, že nemá existovať. Kritériá, podľa ktorých sa obsah posudzuje, zhŕňa Google v dokumente o tvorbe užitočného obsahu; ako ich premietnuť do textu, ukazuje článok o E-E-A-T a dôveryhodnosti.
Druhý stav („objavené, nezaradené“) býva otázkou priorít. Google v nápovede uvádza jedinú typickú príčinu: adresu chcel prejsť, ale hrozilo, že tým web preťaží, preto prehľadanie preložil na neskôr. Prakticky to smeruje k výkonu servera a k tomu, koľko nových adries pribudlo naraz. Slabé interné prelinkovanie ako príčinu tohto stavu Google neuvádza, z vlastnej skúsenosti ho však odporúčam skontrolovať tiež, pretože ovplyvňuje, ako sa Google k adrese vôbec dostane.
💡 Rozpočet na prehľadávanie sa väčšiny webov netýka. Google v návode pre veľké weby uvádza, že téma je určená predovšetkým webom s viac než miliónom adries so stredne často sa meniacim obsahom a webom s viac než 10 000 adresami s veľmi rýchlo sa meniacim obsahom, pričom čísla označuje za hrubý odhad, nie za presné hranice. Ak má váš web 80 stránok a neindexujú sa, príčina takmer isto nie je v rozpočte na prehľadávanie.
Čo pri týchto stavoch reálne pomáha: interné prelinkovanie zo stránok, ktoré už indexované sú, zaradenie adresy do súboru sitemap, stabilné a rýchle odpovede servera a zmenšenie počtu bezcenných adries, ktoré prehľadávaču zaberajú čas. Ako budovať prelinkovanie zmysluplne, popisuje článok o internom prelinkovaní. Ak potrebujete zistiť, čo Googlebot na webe skutočne robí, poslúži analýza logov servera.
6. Postup krok za krokom a čo nerobiť
Nasledujúce poradie je zvolené zámerne: každý krok má zmysel až vtedy, keď predchádzajúci nič neodhalil.
- Skontrolujte jednu konkrétnu adresu nástrojom na kontrolu adries URL. Zapíšte si presný dôvod, ktorý vypíše.
- Otvorte prehľad indexovania a pozrite sa, či rovnaký dôvod nemá aj množstvo ďalších adries. Ak áno, riešte príčinu, nie jednotlivé stránky.
- Vylúčte zákazy. Pozrite si zdrojový kód stránky, či neobsahuje
<meta name="robots" content="noindex">, a súbor robots.txt na koreni domény. Toto sú dve najčastejšie príčiny pri nových weboch, kde zákaz zostal z testovacej verzie. Kompletný zoznam vecí na kontrolu pri spustení má článok o SEO checkliste nového webu. - Overte odpoveď servera. Vracia adresa kód 200? Nepresmerúva sa? Nevracia obsah, ktorý sa tvári ako chýbajúci?
- Skontrolujte kanonickú adresu. Nástroj na kontrolu adries ukazuje aj to, ktorú verziu Google zvolil. Ak je iná než vaša, hľadajte, ktorý signál mu to napovedal.
- Až potom riešte obsah. Ak je technicky všetko v poriadku a stav znie „prehľadané, nezaradené“, problém je v hodnote stránky.
- Požiadajte o prehľadanie, ale až po oprave, nie pred ňou.
A teraz to, čo nerobiť. Google v návode, ako požiadať o opätovné prehľadanie, uvádza, že na odosielanie jednotlivých adries existuje kvóta a že opakované žiadosti o prehľadanie tej istej adresy ju prehľadanou skôr neurobia. Ďalej upozorňuje, že prehľadanie môže trvať od niekoľkých dní po niekoľko týždňov a že žiadosť nezaručuje zaradenie do výsledkov. Klikať na tlačidlo desaťkrát denne teda nie je stratégia, je to len strata času.
Rovnako nemá zmysel siahať po rozhraní Indexing API. Podľa jeho oficiálnej dokumentácie sa smie použiť len na stránky so štruktúrovanými údajmi typu JobPosting alebo BroadcastEvent vloženým vo VideoObject, teda pracovné ponuky a živé vysielania. Na bežný blog či e-shop určené nie je.
Posledná vec, ktorá sa opakovane vypláca: nepridávať nový obsah na web, ktorý sa neindexuje. Ak Google zo sto stránok zaradil sedemnásť, stoprvá stránka nič nezmení. Najprv treba odstrániť prekážku a overiť, že sa pomer indexovaných adries hýbe správnym smerom; až potom má publikovanie zmysel. Podobne sa oplatí najprv opraviť to, čo už existuje; postup ponúka článok o aktualizácii obsahu.
Súvisiace: Google Search Console · Robots.txt a sitemap.xml · Duplicitný obsah
Zdroje
- Google Search Console Help: Page Indexing report – úplný zoznam dôvodov, prečo stránky nie sú indexované, vrátane stavov soft 404, noindex, duplicity a varovania „Indexed, though blocked by robots.txt“ (overené 8/2026).
- Google Search Central: In-depth guide to how Google Search works – rozdelenie na prehľadávanie, indexovanie a zobrazovanie a konštatovanie, že nie každá prehľadaná stránka sa indexuje.
- Google Search Central: Block search indexing with noindex – podmienka, že stránka s pokynom noindex nesmie byť blokovaná v súbore robots.txt.
- Google Search Central: How to specify a canonical URL – kanonická značka ako silný signál, nie príkaz, a spôsoby, akými Google kanonickú verziu vyberá.
- Google Search Central: Large site owner's guide to managing crawl budget – orientačné hranice 1 000 000 a 10 000 adries, definícia limitu kapacity prehľadávania a dopytu po prehľadávaní.
- Google Search Central: Ask Google to recrawl your URLs – kvóta na odosielanie adries, neúčinnosť opakovaných žiadostí, čas prehľadania a absencia záruky zaradenia.
- Google Search Central: Indexing API Quickstart – obmedzenie rozhrania na stránky s údajmi typu JobPosting alebo BroadcastEvent vo VideoObject.
- Google Search Central: Creating helpful, reliable, people-first content – kritériá, podľa ktorých sa posudzuje hodnota obsahu.
Časté otázky
Ako dlho trvá, kým Google zaindexuje novú stránku?
Presný čas Google negarantuje. V návode na požiadanie o opätovné prehľadanie uvádza, že prehľadanie môže trvať od niekoľkých dní po niekoľko týždňov, a zároveň upozorňuje, že žiadosť o prehľadanie nezaručuje zaradenie do výsledkov vôbec. Pri zabehnutom webe s pravidelným publikovaním býva zaradenie rýchlejšie než pri novej doméne, ktorú Google ešte nepozná.
Čo znamená stav „Prehľadané – momentálne nezaradené do indexu“?
Že Google stránku stiahol, vyhodnotil a rozhodol sa ju do indexu nezaradiť. Nie je to technická chyba, takže sa nedá opraviť nastavením. Najčastejšou príčinou býva tenký obsah, obsah, ktorý duplikuje niečo iné na tom istom webe, alebo stránka bez samostatného zmyslu. Riešením je stránku podstatne zlepšiť, zlúčiť s inou alebo ju zrušiť.
Prečo je stránka indexovaná, hoci ju blokujem v robots.txt?
Pretože robots.txt zakazuje prehľadávanie, nie indexovanie. Ak na blokovanú adresu odkazujú iné weby, Google ju môže do indexu zaradiť aj bez toho, aby si ju stiahol, typicky bez popisu alebo s popisom prevzatým z odkazu. Ak stránka v indexe byť nemá, treba zákaz z robots.txt odstrániť a použiť pokyn noindex, aby si ho Google mohol prečítať.
Ako zistím, koľko stránok môjho webu je v indexe?
Spoľahlivo iba v prehľade indexovania stránok v Google Search Console, ktorý ukáže počet indexovaných aj neindexovaných adries a pri každej skupine aj dôvod. Operátor site: vo vyhľadávaní je len orientačný, jeho počet výsledkov je odhad a nepovie vám, prečo niečo v indexe chýba.
Pomôže, ak budem stránku opakovane odosielať cez nástroj na kontrolu adries URL?
Nie. Google výslovne uvádza, že na odosielanie jednotlivých adries platí kvóta a že opakované žiadosti o prehľadanie tej istej adresy ju prehľadanou skôr neurobia. Jedno odoslanie po vykonaní opravy stačí, zvyšok je čakanie a sledovanie prehľadu indexovania.
Môže za neindexáciu pomalý hosting?
Môže k nej prispieť. Ak server vracia chyby typu 5xx alebo odpovedá veľmi pomaly, prehľadávanie sa spomalí a časť adries môže zostať v stave „objavené, nezaradené“. Google zároveň upozorňuje, že rozpočet na prehľadávanie riešia predovšetkým veľmi veľké weby, takže pri malom webe hľadajte najprv zákaz v robots.txt, pokyn noindex alebo chybu servera.