Indexácia v Google: prečo web nie je vidieť a ako to opraviť
Web máte hotový, ale vo vyhľadávaní ho nenájdete? Než začnete riešiť pozície, musia byť stránky vôbec v indexe. Ukážeme, ako indexáciu overiť, prečo sa stránky neindexujú a ako to krok za krokom spraviť.
Čo je indexácia a prečo na nej všetko stojí
Kým sa stránka môže umiestniť vo výsledkoch vyhľadávania, musí prejsť dvoma krokmi: vyhľadávač ju najskôr musí nájsť a stiahnuť (crawl) a potom zaradiť do svojho registra (index). Až čo je v indexe, môže sa vôbec zobraziť používateľom. Riešiť pozície alebo kľúčové slová pri stránke, ktorá v indexe nie je, nemá zmysel - je pre vyhľadávač neviditeľná.
Časté nedorozumenie: „mám web online, tak je v Google“. Nie je to automatické. Google musí web objaviť, prejsť a rozhodnúť sa ho zaindexovať - av každom z tých krokov môže niečo zlyhať.
Ako zistiť, či je stránka v indexe
Rýchla orientačná kontrola: do Googlu zadajte `site:vasadomena.sk`. Uvidíte približný počet zaindexovaných stránok. Pozor – tento operátor je nepresný a vzorkovaný, takže ho berte len ako hrubý signál, nie ako pravdu.
Spoľahlivý zdroj je Google Search Console, sekcia „Indexovanie stránok“. Ukáže presne, ktoré stránky sú zaindexované, ktoré nie a hlavne prečo (dôvody vylúčenia). Konkrétne URL preveríte cez „Kontrolu URL", ktorá povie aktuálny stav a umožní požiadať o indexáciu.
Najčastejšie dôvody, prečo sa stránka neindexuje
- Blokácia v robots.txt — súbor zakazuje vyhľadávaču stránku prechádzať. Potom ju Google vôbec nestiahne.
- Značka noindex — v hlavičke stránky (meta robots) alebo v HTTP hlavičke X-Robots-Tag je pokyn „neindexovať“. Častá pasca po presune z testovacieho webu do ostrej prevádzky.
- Kanonizácia inam — canonical odkazuje na inú URL, takže Google indexuje ju namiesto tejto stránky (typicky sa všetko zlieva na homepage).
- Stránka nie je nikde prelinkovaná - vyhľadávač ju nemá ako objaviť (chýba odkaz aj záznam v sitemape).
- Tenký alebo duplicitný obsah — Google stránku prejde, ale vyhodnotí ju ako nedostatočne hodnotnú („Prešli – nezaindexované“).
- Chyby servera alebo pomalé odozvy — keď stránka vracia 5xx alebo sa dlho načíta, crawl sa nedokončí.
- Nová alebo slabá doména — pri mladých weboch s malou autoritou trvá zaindexovanie celého webu týždne; Google prechádza pomaly.
Ako indexáciu opraviť krok za krokom
Postupujte od najtvrdších blokácií k jemnejším príčinám - nemá zmysel riešiť obsah, kým stránku blokuje robots.txt.
- Skontrolujte robots.txt, že nezakazuje dôležité sekcie (riadky Disallow). Odblokujte, čo má byť verejné.
- Preverte, že stránka nemá noindex v meta robots ani v HTTP hlavičke. Pokiaľ tam zostal z vývoja, odstráňte ho.
- Overte canonical - mal by ukazovať sám na seba (self-referencing), nie na inú stránku, pokiaľ to nie je zámer.
- Vráťte HTTP status 200 pri stránkach, ktoré majú byť v indexe; neexistujúce riešte cez 404/410, presmerovanie cez 301.
- Doplňte stránku do XML sitemapy a prelinkujte ju z relevantných stránok, aby ju vyhľadávač objavil.
- Pri tenkom obsahu pridajte hodnotu — pôvodný text, odpovede na otázky používateľov, štruktúru s nadpismi.
- V Search Console požiadajte o indexáciu kľúčových URL a znovu odošlite sitemapu. Potom počkajte — recrawl trvá dni až týždne.
Ako Googlu pomôcť rýchlejšie
Vyhľadávač nasmerujete tromi vecami: aktuálnou XML sitemapou odoslanou v Search Console, kvalitným interným prelinkovaním (nové stránky odkazujte zo silných, už zaindexovaných stránok) a spätnými odkazmi z dôveryhodných webov, ktoré crawler privedú skôr.
Pri úplne novom webe buďte trpezliví - aj technicky bezchybný web sa u mladej domény indexuje postupne. Operátora `site:` neverte, riaďte sa reportom v Search Console.
Indexácia a AI vyhľadávače (GEO)
Rovnaká logika platí aj pre generatívne vyhľadávače ako ChatGPT, Perplexity alebo Google AI Overviews - pokiaľ váš obsah nemôžu prečítať a spracovať, nemôžu vás citovať. Prístup AI topánok riadi opäť robots.txt (a doplnkovo súbor llms.txt), takže ich zablokujte len vedome. Čitateľný, štruktúrovaný a prelinkovaný web sa ľahšie dostane ako do klasického indexu, tak do odpovedí AI.
Ako indexáciu a jej prekážky overiť
Po každej väčšej úprave webu sa oplatí kontrolu zopakovať. Náš nástroj indexovateľnosti prejde stránku a upozorní na noindex, blokáciu v robots.txt, chybný canonical aj chýbajúcu sitemapu - teda na všetky technické prekážky, ktoré bránia zaindexovaniu. Zvlášť potom skontrolujte samotný robots.txt a XML sitemapu, nech Google dostane správne pokyny.
Časté otázky
Ako dlho trvá, kým Google zaindexuje nový web?
Pri novej doméne s malou autoritou to bývajú dni až týždne, pri veľkých weboch aj dlhšie. Proces urýchlite odoslaním sitemapy v Search Console, žiadostí o indexáciu kľúčových URL a kvalitným interným prelinkovaním.
Prečo Search Console hlási „Prešli – nezaindexované“?
Google stránku stiahol, ale rozhodol sa ju (zatiaľ) nezaradiť - najčastejšie kvôli tenkému, duplicitnému alebo málo hodnotnému obsahu. Pridajte pôvodnú hodnotu a stránku prelinkujte.
Zaindexuje sa stránka, keď je v sitemape?
Sitemapa pomáha stránku objaviť, ale nie je zárukou indexácie. Stránka nesmie byť blokovaná (robots.txt/noindex), musí vracať 200, mať self-canonical a niesť dostatočne hodnotný obsah.
Je operátor site: spoľahlivý?
Nie. `site:vasadomena.sk` je len hrubá orientácia - je vzorkovaný a oneskorený. Presné čísla a dôvody vylúčenia nájdete v Google Search Console v reporte „Indexovanie stránok“.