Indexace v Googlu: proč web není vidět a jak to opravit
Web máte hotový, ale ve vyhledávání ho nenajdete? Než začnete řešit pozice, musí být stránky vůbec v indexu. Ukážeme, jak indexaci ověřit, proč se stránky neindexují a jak to krok za krokem spravit.
Co je indexace a proč na ní všechno stojí
Než se stránka může umístit ve výsledcích vyhledávání, musí projít dvěma kroky: vyhledávač ji nejdřív musí najít a stáhnout (crawl) a pak zařadit do svého rejstříku (index). Teprve co je v indexu, může se vůbec zobrazit uživatelům. Řešit pozice nebo klíčová slova u stránky, která v indexu není, nemá smysl — je pro vyhledávač neviditelná.
Časté nedorozumění: „mám web online, tak je v Googlu". Není to automatické. Google musí web objevit, projít a rozhodnout se ho zaindexovat — a v každém z těch kroků může něco selhat.
Jak zjistit, jestli je stránka v indexu
Rychlá orientační kontrola: do Googlu zadejte `site:vasedomena.cz`. Uvidíte přibližný počet zaindexovaných stránek. Pozor — tenhle operátor je nepřesný a vzorkovaný, takže ho berte jen jako hrubý signál, ne jako pravdu.
Spolehlivý zdroj je Google Search Console, sekce „Indexování stránek". Ukáže přesně, které stránky jsou zaindexované, které ne a hlavně proč (důvody vyloučení). Konkrétní URL prověříte přes „Kontrolu URL", která řekne aktuální stav a umožní požádat o indexaci.
Nejčastější důvody, proč se stránka neindexuje
- Blokace v robots.txt — soubor zakazuje vyhledávači stránku procházet. Pak ji Google vůbec nestáhne.
- Značka noindex — v hlavičce stránky (meta robots) nebo v HTTP hlavičce X-Robots-Tag je pokyn „neindexovat". Častá past po přesunu z testovacího webu do ostrého provozu.
- Kanonizace jinam — canonical odkazuje na jinou URL, takže Google indexuje ji místo této stránky (typicky se všechno slévá na homepage).
- Stránka není nikde prolinkovaná — vyhledávač ji nemá jak objevit (chybí odkaz i záznam v sitemapě).
- Tenký nebo duplicitní obsah — Google stránku projde, ale vyhodnotí ji jako nedostatečně hodnotnou („Prošly – nezaindexováno").
- Chyby serveru nebo pomalé odezvy — když stránka vrací 5xx nebo se dlouho načítá, crawl se nedokončí.
- Nová nebo slabá doména — u mladých webů s malou autoritou trvá zaindexování celého webu týdny; Google prochází pomalu.
Jak indexaci opravit krok za krokem
Postupujte od nejtvrdších blokací k jemnějším příčinám — nemá smysl řešit obsah, dokud stránku blokuje robots.txt.
- Zkontrolujte robots.txt, že nezakazuje důležité sekce (řádky Disallow). Odblokujte, co má být veřejné.
- Prověřte, že stránka nemá noindex v meta robots ani v HTTP hlavičce. Pokud tam zbyl z vývoje, odstraňte ho.
- Ověřte canonical — měl by ukazovat sám na sebe (self-referencing), ne na jinou stránku, pokud to není záměr.
- Vraťte HTTP status 200 u stránek, které mají být v indexu; neexistující řešte přes 404/410, přesměrování přes 301.
- Doplňte stránku do XML sitemapy a prolinkujte ji z relevantních stránek, aby ji vyhledávač objevil.
- U tenkého obsahu přidejte hodnotu — původní text, odpovědi na dotazy uživatelů, strukturu s nadpisy.
- V Search Console požádejte o indexaci klíčových URL a znovu odešlete sitemapu. Pak vyčkejte — recrawl trvá dny až týdny.
Jak Googlu pomoct rychleji
Vyhledávač nasměrujete třemi věcmi: aktuální XML sitemapou odeslanou v Search Console, kvalitním interním prolinkováním (nové stránky odkazujte ze silných, už zaindexovaných stránek) a zpětnými odkazy z důvěryhodných webů, které crawler přivedou dřív.
U zbrusu nového webu buďte trpěliví — i technicky bezchybný web se u mladé domény indexuje postupně. Operátoru `site:` nevěřte, řiďte se reportem v Search Console.
Indexace a AI vyhledávače (GEO)
Stejná logika platí i pro generativní vyhledávače jako ChatGPT, Perplexity nebo Google AI Overviews — pokud váš obsah nemohou přečíst a zpracovat, nemohou vás citovat. Přístup AI botů řídí opět robots.txt (a doplňkově soubor llms.txt), takže je zablokujte jen vědomě. Čitelný, strukturovaný a prolinkovaný web se snáz dostane jak do klasického indexu, tak do odpovědí AI.
Jak indexaci a její překážky ověřit
Po každé větší úpravě webu se vyplatí kontrolu zopakovat. Náš nástroj indexovatelnosti projde stránku a upozorní na noindex, blokaci v robots.txt, chybný canonical i chybějící sitemapu — tedy na všechny technické překážky, které brání zaindexování. Zvlášť pak zkontrolujte samotný robots.txt a XML sitemapu, ať Google dostane správné pokyny.
Časté dotazy
Jak dlouho trvá, než Google zaindexuje nový web?
U nové domény s malou autoritou to bývají dny až týdny, u velkých webů i déle. Proces urychlíte odesláním sitemapy v Search Console, žádostí o indexaci klíčových URL a kvalitním interním prolinkováním.
Proč Search Console hlásí „Prošly – nezaindexováno"?
Google stránku stáhl, ale rozhodl se ji (zatím) nezařadit — nejčastěji kvůli tenkému, duplicitnímu nebo málo hodnotnému obsahu. Přidejte původní hodnotu a stránku prolinkujte.
Zaindexuje se stránka, když je v sitemapě?
Sitemapa pomáhá stránku objevit, ale není zárukou indexace. Stránka nesmí být blokovaná (robots.txt/noindex), musí vracet 200, mít self-canonical a nést dostatečně hodnotný obsah.
Je operátor site: spolehlivý?
Ne. `site:vasedomena.cz` je jen hrubá orientace — je vzorkovaný a zpožděný. Přesná čísla a důvody vyloučení najdete v Google Search Console v reportu „Indexování stránek".