Indexelés a Google-ban: miért nem látható a webhely, és hogyan lehet javítani
Elkészült egy weboldala, de nem találja a keresőben? Az oldalaknak az indexben kell lenniük, mielőtt elkezdené a pozíciók címzését. Megmutatjuk, hogyan ellenőrizheti az indexelést, miért nincsenek indexelve az oldalak, és hogyan javíthatja ki lépésről lépésre.
Mi az indexelés és miért minden attól függ
Mielőtt egy oldal a keresési eredmények közé kerülhet, két lépésen kell keresztülmennie: a keresőmotornak először meg kell találnia és le kell töltenie (feltérképeznie), majd fel kell vennie az indexébe (index). Egyáltalán csak azt lehet megjeleníteni a felhasználóknak, ami az indexben van. Az indexben nem szereplő oldal pozícióinak vagy kulcsszavainak megszólítása értelmetlen – a keresőmotor számára láthatatlan.
Gyakori félreértés: "Van egy webhelyem az interneten, tehát a Google-ban van". Nem automatikus. A Google-nak fel kell fedeznie egy webhelyet, fel kell térképeznie, és el kell döntenie, hogy indexeli – és minden egyes lépésnél elromolhat valami.
Hogyan lehet megtudni, hogy egy oldal szerepel-e az indexben
Gyors tájékozódási ellenőrzés: írja be a `site:vasedomena.cz` címet a Google-ba. Látni fogja az indexelt oldalak hozzávetőleges számát. Legyen óvatos – ez az operátor pontatlan és mintavételezett, ezért csak durva jelnek tekintse, ne az igazságnak.
Megbízható forrás a Google Search Console „Oldalindexelés” része. Pontosan megmutatja, hogy mely oldalak vannak indexelve, melyek nem, és ami a legfontosabb, miért (kizárási okok). Egy adott URL-t az „URL-ellenőrzőn” keresztül ellenőrizhet, amely megmutatja az aktuális állapotot, és lehetővé teszi az indexelés kérését.
A leggyakoribb okok, amelyek miatt egy oldal nincs indexelve
- Blokkolás a robots.txt fájlban – a fájl megtiltja a keresőmotoroknak, hogy feltérképezzék az oldalt. Akkor a Google egyáltalán nem tölti le.
- A noindex címke – az oldal fejlécében (meta robots) vagy a HTTP fejlécben az X-Robots-Tag a „ne indexeljen” utasítás. Gyakori buktató a teszthelyről a termelésre való áttérés után.
- Kanonizálás máshol – a kanonikus egy másik URL-re utal, ezért a Google ezt az oldalt indexeli (általában minden összeolvad a kezdőlapon).
- Az oldal nincs sehol linkelve – a keresőmotor nem tudja megtalálni (hiányzik a hivatkozás és a bejegyzés az oldaltérképről).
- Vékony vagy ismétlődő tartalom – a Google feltérképezi az oldalt, de nem értékeli eléggé értékesnek ("Megfelelve – nincs indexelve").
- Szerverhibák vagy lassú válasz – ha az oldal 5xx-et tér vissza, vagy hosszú ideig tart a betöltése, a feltérképezés nem fejeződik be.
- Új vagy gyenge domain – a kis jogosultsággal rendelkező fiatal webhelyeknek hetekig tart a teljes webhely indexelése; A Google lassan feltérképez.
Az indexelés javítása lépésről lépésre
Dolgozzon a legnehezebb blokkoktól a finom okok felé – nincs értelme a tartalommal foglalkozni, ha az oldalt a robots.txt blokkolja.
- Ellenőrizze a robots.txt fájlt, hogy nem tiltja-e meg a fontos szakaszokat (Disallow sorok). Feloldja annak blokkolását, aminek nyilvánosnak kell lennie.
- Ellenőrizze, hogy az oldalon nincs-e noindex a metarobotokban vagy a HTTP-fejlécben. Ha megmaradt a fejlesztésből, töröld.
- Győződj meg a kanonikusról – önmagára kell mutatnia (önhivatkozás), nem pedig másik oldalra, hacsak nem ez a szándék.
- Az indexelendő oldalak HTTP-státusza 200; kezelés nem létezik 404/410-en keresztül, átirányítás 301-en keresztül.
- Töltse ki az oldalt egy XML-webhelytérképben, és kapcsolja össze a releváns oldalakról, hogy a keresőmotor megtalálja.
- A vékony tartalomhoz adjon értéket – eredeti szöveg, válaszok a felhasználói kérdésekre, szerkezet címsorokkal.
- A Search Console-ban kérje a kulcsfontosságú URL-ek indexelését, és küldje be újra a webhelytérképet. Ezután várjon – az újratérképezés napokig vagy hetekig tart.
Hogyan segíthet gyorsabban a Google-nak
Három dologgal irányítja a keresőt: a Search Console-ban elküldött naprakész XML-oldaltérképpel, jó minőségű belső linkekkel (erős, már indexelt oldalakról új oldalak linkelésével), valamint megbízható webhelyekről származó backlinkekkel, amelyek először a bejárót hozzák.
Legyen türelmes egy vadonatúj weboldallal – még a technikailag tökéletes webhely is fokozatosan indexelődik egy fiatal domainen. Ne bízzon a "site:" operátorban, kövesse a jelentést a Search Console-ban.
Indexelés és keresőmotor AI (GEO)
Ugyanez a logika vonatkozik az olyan generatív keresőmotorokra, mint a ChatGPT, a Perplexity vagy a Google AI Overviews – ha nem tudják elolvasni és feldolgozni a tartalmat, nem hivatkozhatnak rád. Az AI-botok hozzáférését ismét a robots.txt (és emellett az llms.txt fájl) szabályozza, ezért csak tudatosan blokkolja őket. Egy olvasható, strukturált és összekapcsolt webhelyen könnyebben be lehet jutni a klasszikus indexbe és a mesterséges intelligencia válaszaiba is.
Hogyan ellenőrizhető az indexelés és annak akadályai
A weboldal minden nagyobb módosítása után érdemes megismételni az ellenőrzést. Indexelhetőségi eszközünk végigmegy az oldalon, és rámutat a noindexre, a robots.txt-ben található blokkolásra, a hibás gyűjtő- és hiányzó webhelytérképre – vagyis az indexelést akadályozó összes technikai akadályra. Különösen ellenőrizze magát a robots.txt fájlt és az XML webhelytérképet, hogy a Google megkapja a megfelelő utasításokat.
Gyakori kérdések
Mennyi ideig tart, amíg a Google indexel egy új webhelyet?
Egy új, csekély jogosultsággal rendelkező domain esetében napokig vagy hetekig tarthat, nagy webhelyek esetén pedig még tovább. Felgyorsíthatja a folyamatot, ha elküld egy webhelytérképet a Search Console-ban, kéri a kulcsfontosságú URL-ek indexelését és jó minőségű belső linkelést.
Miért jelenti azt, hogy a Search Console „megfelelt – nincs indexelve”?
A Google lehúzta az oldalt, de úgy döntött, hogy (még) nem rangsorolja – leggyakrabban vékony, ismétlődő vagy alacsony értékű tartalom miatt. Adja hozzá az eredeti értéket, és kapcsolja be az oldalt.
Indexelve lesz az oldal, ha szerepel a webhelytérképen?
A webhelytérkép segít az oldal felfedezésében, de nem garancia az indexelésre. Az oldalt nem szabad letiltani (robots.txt/noindex), 200-at kell visszaadnia, önkanonikusnak kell lennie és kellően értékes tartalmat kell tartalmaznia.
Megbízható a site: operátor?
Nem. A "site:vasedomena.cz" csak hozzávetőleges tájolás – mintavételezés és késleltetés. A pontos számokat és a Google Search Console kizárásának okait az „Oldalindexelés” jelentésben találja meg.