Robots (indexelés és robots.txt)
Szabályozza, mit barangolhatnak be és indexelhetnek a keresőmotorok.
Mi ez
Az indexelést két dolog szabályozza: a robots.txt fájl (mit lehet bejárni) és a meta robots / X-Robots-Tag fejléc (indexelni kell-e az oldalt, pl. noindex). Könnyű összekeverni őket.
Miért foglalkozzon vele
A rossz beállítás az egyik legpusztítóbb SEO hiba: a véletlenül bent maradt „noindex” vagy „Disallow: /” az egész oldalt kidobhatja a Google-ból. Fordítva, a hiányzó szabályok engedik indexelni a felesleges oldalakat (kosár, szűrők) és pazarolják a crawl budgetet.
Hogyan csinálja
- 1Ellenőrizd, hogy az éles oldalakon NINCS noindex (gyakori maradvány a fejlesztési/teszt weboldalról).
- 2A robots.txt-ben ne blokkold a CSS/JS-t, sem azokat az oldalakat, amelyeket indexelni akarsz.
- 3Csak azt blokkold, aminek nem szabad az indexben lennie (admin, kosár, belső keresés).
- 4A sitemapra mutató hivatkozást tüntesd fel a robots.txt-ben.
- 5Ne feledd: a robots.txt megakadályozza a bejárást, de nem feltétlenül az indexelést, az indexből való kivételhez a meta noindex szolgál.
robots.txt
User-agent: *
Disallow: / ← blokkolja az EGÉSZ oldaltUser-agent: *
Disallow: /admin/
Disallow: /kosik/
Allow: /
Sitemap: https://www.example.cz/sitemap.xmlÖsszegzés
Az indexelés a láthatóság „főkapcsolója”, ezért tartozik a kritikus ellenőrzések közé. Minden telepítés után ellenőrizd, hogy sehol nem maradt noindex a tesztkörnyezetből, és hogy a robots.txt nem blokkol semmi fontosat. Egyetlen hiba itt az összes organikus forgalmadba kerülhet.
Kapcsolódó témák