Indexeren in Google: waarom de site niet zichtbaar is en hoe u dit kunt oplossen
U heeft een website klaar, maar u kunt deze niet vinden in de zoekopdracht? Pagina's moeten überhaupt in de index staan voordat u posities gaat adresseren. We laten u stap voor stap zien hoe u de indexering kunt controleren, waarom pagina's niet worden geïndexeerd en hoe u dit kunt oplossen.
Wat is indexeren en waarom alles ervan afhangt?
Voordat een pagina in de zoekresultaten kan worden geplaatst, moet deze twee stappen doorlopen: de zoekmachine moet deze eerst vinden en downloaden (crawlen) en vervolgens opnemen in de index (index). Alleen wat in de index staat, kan aan gebruikers worden weergegeven. Het heeft geen zin om posities of trefwoorden te adresseren voor een pagina die niet in de index staat; het is onzichtbaar voor de zoekmachine.
Een veelvoorkomend misverstand: ‘Ik heb een website online, dus die staat in Google’. Het is niet automatisch. Google moet een website ontdekken, crawlen en besluiten deze te indexeren – en bij elk van deze stappen kan er iets misgaan.
Hoe kom je erachter of een pagina in de index staat?
Snelle oriëntatiecontrole: voer `site:vasedomena.cz` in Google in. U ziet het geschatte aantal geïndexeerde pagina's. Wees voorzichtig: deze operator is onnauwkeurig en bemonsterd, dus beschouw hem alleen als een ruw signaal en niet als de waarheid.
Een betrouwbare bron is Google Search Console, sectie 'Pagina-indexering'. Het laat precies zien welke pagina's worden geïndexeerd, welke niet, en vooral waarom (uitsluitingsredenen). U kunt een specifieke URL controleren via de "URL Checker", die u de huidige status vertelt en u de mogelijkheid biedt om indexering aan te vragen.
De meest voorkomende redenen waarom een pagina niet wordt geïndexeerd
- Blokkeren in robots.txt: het bestand verhindert dat zoekmachines de pagina crawlen. Dan downloadt Google het helemaal niet.
- De noindex-tag — in de header van de pagina (meta-robots) of in de HTTP-header X-Robots-Tag staat de instructie "niet indexeren". Een veel voorkomende valkuil na de overstap van een testlocatie naar productie.
- Canonicalisatie elders: canoniek verwijst naar een andere URL, dus indexeert Google deze in plaats van deze pagina (doorgaans wordt alles samengevoegd op de startpagina).
- De pagina is nergens gelinkt; de zoekmachine kan deze niet ontdekken (de link en het record in de sitemap ontbreken).
- Dunne of dubbele inhoud: Google crawlt de pagina, maar beoordeelt deze als onvoldoende waardevol ("Geslaagd - niet geïndexeerd").
- Serverfouten of trage reactie: wanneer de pagina 5xx retourneert of het lang duurt om te laden, wordt de crawl niet voltooid.
- Nieuw of zwak domein: jonge sites met weinig autoriteit hebben weken nodig om de hele site te indexeren; Google crawlt langzaam.
Hoe u de indexering stap voor stap kunt oplossen
Werk je een weg van de moeilijkste blokkades naar de subtiele oorzaken. Het heeft geen zin om inhoud aan te pakken terwijl de pagina wordt geblokkeerd door robots.txt.
- Controleer of robots.txt belangrijke secties niet verbiedt (Disallow-regels). Deblokkeer wat openbaar moet zijn.
- Controleer of de pagina geen noindex heeft in de meta-robots of in de HTTP-header. Als het overblijft na de ontwikkeling, verwijder het dan.
- Controleer of het canoniek is: het moet naar zichzelf verwijzen (naar zichzelf verwijzend), niet naar een andere pagina, tenzij dat de bedoeling is.
- Retourneer HTTP-status 200 voor pagina's die moeten worden geïndexeerd; behandel niet-bestaand via 404/410, omleiding via 301.
- Vul de pagina aan in een XML-sitemap en koppel deze aan relevante pagina's, zodat de zoekmachine deze ontdekt.
- Voeg voor dunne inhoud waarde toe: originele tekst, antwoorden op vragen van gebruikers, structuur met kopjes.
- Vraag in Search Console indexering van belangrijke URL's aan en dien de sitemap opnieuw in. Wacht dan: het opnieuw crawlen duurt dagen tot weken.
Hoe u Google sneller kunt helpen
Je bestuurt de zoekmachine met drie dingen: een up-to-date XML-sitemap verzonden in de Search Console, hoogwaardige interne links (link nieuwe pagina's van sterke, reeds geïndexeerde pagina's) en backlinks van vertrouwde websites die de crawler op de eerste plaats brengen.
Wees geduldig met een gloednieuwe website; zelfs een technisch perfecte website wordt geleidelijk geïndexeerd op een jong domein. Vertrouw de operator `site:` niet, volg het rapport in Search Console.
Indexering en zoekmachine-AI (GEO)
Dezelfde logica is van toepassing op generatieve zoekmachines zoals ChatGPT, Perplexity of Google AI Overviews: als ze uw inhoud niet kunnen lezen en verwerken, kunnen ze u niet citeren. De toegang van AI-bots wordt opnieuw gecontroleerd door robots.txt (en daarnaast het bestand llms.txt), dus blokkeer ze alleen bewust. Een leesbare, gestructureerde en onderling verbonden website is gemakkelijker om in zowel de klassieke index als de AI-antwoorden te komen.
Hoe u indexering en de obstakels ervan kunt verifiëren
Na elke grote wijziging aan de website loont het de moeite om de controle te herhalen. Onze indexeerbaarheidstool doorloopt de pagina en wijst op noindex, blokkering in robots.txt, onjuiste canonieke en ontbrekende sitemap – dat wil zeggen alle technische obstakels die indexering verhinderen. Controleer vooral de robots.txt en XML-sitemap zelf, zodat Google de juiste instructies krijgt.
Veelgestelde vragen
Hoe lang duurt het voordat Google een nieuwe website indexeert?
Voor een nieuw domein met weinig autoriteit kan het dagen tot weken duren, voor grote sites zelfs langer. U kunt het proces versnellen door een sitemap in Search Console in te dienen, indexering van belangrijke URL's en hoogwaardige interne links aan te vragen.
Waarom rapporteert Search Console 'Geslaagd - Niet geïndexeerd'?
Google heeft de pagina verwijderd, maar heeft besloten deze (nog) niet te rangschikken – meestal vanwege dunne, dubbele of laagwaardige inhoud. Voeg de oorspronkelijke waarde toe en link de pagina.
Wordt de pagina geïndexeerd als deze in de sitemap staat?
Een sitemap helpt een pagina ontdekt te worden, maar is geen garantie voor indexatie. De pagina mag niet worden geblokkeerd (robots.txt/noindex), moet 200 retourneren, zelf-canoniek zijn en voldoende waardevolle inhoud bevatten.
Is site: operator betrouwbaar?
Nee. `site:vasedomena.cz` is slechts een ruwe oriëntatie: het is bemonsterd en vertraagd. De exacte cijfers en redenen voor uitsluiting in Google Search Console vindt u in het rapport 'Pagina-indexering'.