Ga naar de hoofdinhoud
← Alle gidsen

Waarom pagina's niet worden geïndexeerd

Een pagina kan om verschillende redenen buiten de index van Google blijven: toegang of richtlijnen, dubbele pagina- of canonieke afhandeling, een crawl die nog niet heeft plaatsgevonden, of een crawl die niet tot indexering heeft geleid. Search Console rapporteert de indexeringsstatus; de oplossing hangt af van welke status u daadwerkelijk heeft.

Begin met de status, niet met een diagnose

Het pagina-indexeringsrapport bevat zowel echte technische problemen als verwachte uitsluitingen. Een robots.txt-regel, noindex-richtlijn, authenticatievereiste of falende respons kunnen indexering verhinderen; dubbele en canonieke statussen werken mogelijk precies zoals bedoeld; en een ontdekte URL is misschien gewoon nog niet gecrawld.

De meest misleidende status is “Gecrawld – momenteel niet geïndexeerd”. Het bevestigt dat Google de pagina heeft opgehaald, maar deze op dat moment niet aan de index heeft toegevoegd. Google zegt expliciet dat de pagina later wel of niet kan worden geïndexeerd en dat het niet nodig is om deze alleen vanwege deze status opnieuw in te dienen.

De statussen die echt fouten zijn

Deze beschrijven iets aan uw kant dat het opslaan heeft verhinderd. Google labelt de bron van elke status als Website wanneer u het zelf kunt verhelpen, en als Google wanneer de oorzaak bij hen ligt. De onderliggende respons corrigeren is de volledige oplossing.

StatusWat het betekentBron
Serverfout (5xx)De server gaf een fout uit de 500-reeksGoogle
OmleidingsfoutEen redirectketen liep rond of mislukteWebsite
URL geblokkeerd door robots.txtrobots.txt onthield toestemming om op te halenWebsite
URL gemarkeerd met ‘noindex’De pagina serveerde een noindex-instructieWebsite
Soft 404 (zachte 404)Een niet-gevonden-bericht met statuscode 200Website
Geblokkeerd wegens ongeautoriseerd verzoek (401)De pagina eiste inloggegevensWebsite
Niet gevonden (404)De URL gaf een 404Website
Geblokkeerd wegens verboden toegang (403)De server gaf een 403Website
Geblokkeerd wegens ander 4xx-probleemEen andere 4xx-responsWebsite

Twee hiervan verdienen extra aandacht omdat ze zo vaak zelf veroorzaakt zijn. Een zachte 404 betekent dat u een vriendelijke „hier is niets”-pagina teruggeeft met status 200: de zoekmachine ziet succes en dunne inhoud in plaats van afwezigheid, dus spreek de waarheid met een 404 of 410. En een 401 of 403 op pagina's die publiek bedoeld waren betekent meestal dat een stagingregel of een firewall in productie is beland.

De statussen die op fouten lijken en het niet zijn

Deze veroorzaken het meeste verspilde werk. Elk ervan is Google die een eigen beslissing meldt, geen mankement dat u hebt geïntroduceerd. Erachteraan jagen verbruikt de aandacht die de echte problemen nodig hebben.

StatusWat het werkelijk betekent
Alternatieve pagina met correcte canonieke tagConsolidatie die precies werkt zoals bedoeld
Dubbel zonder door gebruiker geselecteerde canoniekU gaf geen canonical op, dus koos Google er een
Dubbel, Google koos andere canoniekU gaf er een op en Google was het oneens
Pagina met omleidingEen niet-canonieke URL die doorstuurt, zoals ontworpen
Gevonden – momenteel niet geïndexeerdBekend maar nog niet opgehaald
Gecrawld – momenteel niet geïndexeerdOpgehaald, beoordeeld en terzijde gelegd

De twee dubbel-statussen zijn het onderscheiden waard. „Zonder door gebruiker geselecteerde canoniek” betekent dat u er nooit een hebt opgegeven en Google voor u koos: meestal onschuldig, maar u hebt een beslissing weggegeven die u zelf kon nemen. „Google koos andere canoniek” betekent dat u er wél een opgaf en werd overruled, een teken dat de pagina die u aanwees niet degene is die de zoekmachine als hoofdversie ziet.

„Gecrawld, momenteel niet geïndexeerd” eerlijk lezen

Deze status betekent dat Google de pagina heeft gecrawld, maar deze op dat moment niet heeft geïndexeerd. Er wordt niet één universele oorzaak geïdentificeerd, en de live URL-inspectietest kan het indexeringssucces niet met zekerheid voorspellen. Het heeft geen zin om een technische fout te bedenken die niet in het rapport wordt genoemd.

Op templategestuurde sites is het nuttig om bijna-duplicaten, canonical-signalen, interne links en de unieke informatie van elke pagina te beoordelen. Dat zijn diagnostische controles, geen bewering dat elke URL met deze status onder een kwaliteitsdrempel is gezakt.

  1. Open de URL-inspectie en bevestig dat de pagina 200 teruggeeft, zelf-canoniek is en haar hoofdinhoud rendert.
  2. Vergelijk haar met de drie dichtstbijzijnde zusterpagina's. Kunt u de ingevulde waarden verwisselen en een gelijkwaardige pagina krijgen, dan ziet de zoekmachine dat ook.
  3. Controleer of iets intern naar haar linkt met beschrijvende ankertekst, of dat zij alleen in de sitemap bestaat.
  4. Vraag wat deze pagina beantwoordt dat geen zusterpagina beantwoordt. Is er geen antwoord, dan is dát de bevinding.
  5. Verander de pagina zodat het antwoord bestaat en vraag dan indexering aan — in die volgorde.

„Gevonden, momenteel niet geïndexeerd” is een ander signaal

Deze betekent dat de URL bekend is maar niet is opgehaald. Op een kleine site is dat meestal van korte duur. Op schaal is het het duidelijkste symptoom dat Google noemt van een echte crawlbudget-beperking: te veel URL's, te weinig vraag, en de wachtrij bereikt ze nooit.

Staat een groot deel van uw URL's hier, dan is het productieve werk het aantal laagwaardige URL's terugbrengen dat u de zoekmachine ter overweging voorlegt — duplicaten samenvoegen, nette 404's teruggeven voor wat weg is, redirectketens inkorten — in plaats van pagina's een voor een opnieuw in te dienen.

Het rapport afwerken in plaats van de symptomen

Het rapport is naar oorzaak geordend, wat verleidt om het van boven naar beneden op volume af te werken. Weersta dat. Duizend URL's onder „Pagina met omleiding” zijn meestal een werkende redirectkaart, terwijl veertig onder „Soft 404” een echt defect zijn dat echte pagina's treft.

  • Los eerst alles uit de fouttabel op — dat is ondubbelzinnig en mechanisch.
  • Leg de informatieve statussen terzijde, tenzij het volume uw bedoeling tegenspreekt, zoals canonieke consolidatie die u nooit hebt ontworpen.
  • Behandel „gecrawld, momenteel niet geïndexeerd” als een redactionele achterstand, niet als een technische.
  • Valideer pas opnieuw wanneer de onderliggende respons of inhoud daadwerkelijk is veranderd.

Probeer het op je eigen site

Vragen en antwoorden

Dwingt opnieuw indienen indexering af?

Nee. Indexering aanvragen zet een crawl opnieuw in de wachtrij; het overrulet de beslissing die op de vorige volgde niet. Dien opnieuw in nadat de pagina is veranderd, niet in plaats daarvan.

Waarom zijn sommige gelokaliseerde pagina's wel geïndexeerd en andere niet?

Sjabloonpagina's die alleen verschillen door een ingevulde naam lezen als bijna-duplicaten. Zoekmachines indexeren vaak een deel en laten de rest vallen, en welke overleven volgt marktvraag meer dan opmaak. De oplossing is de weggelaten talen iets eigens te geven, niet hun tags bijstellen.

Is „Alternatieve pagina met correcte canonieke tag” een probleem?

Nee. Het meldt canonieke consolidatie die werkt zoals ontworpen. Het verdient alleen aandacht als het volume veel groter is dan uw canonieke strategie verklaart, wat zou wijzen op URL's die u niet bedoelde te genereren.

Wat is het verschil tussen een zachte 404 en een 404?

Een 404 spreekt de waarheid: hier is niets. Een zachte 404 toont een niet-gevonden-bericht en geeft toch 200 terug, zodat de zoekmachine het geslaagde ophalen van een dunne pagina noteert. Geef een echte 404 of 410 voor alles wat werkelijk weg is.

Hoe lang wachten voor ik niet-indexeren als beslissing opvat?

Vergelijk binnen dezelfde site in plaats van met de klok. Werden vergelijkbare, gelijktijdig gepubliceerde pagina's binnen dagen geïndexeerd en ligt deze al weken, dan is zij beoordeeld en niet vertraagd.