Begin met de status, niet met een diagnose
Het pagina-indexeringsrapport bevat zowel echte technische problemen als verwachte uitsluitingen. Een robots.txt-regel, noindex-richtlijn, authenticatievereiste of falende respons kunnen indexering verhinderen; dubbele en canonieke statussen werken mogelijk precies zoals bedoeld; en een ontdekte URL is misschien gewoon nog niet gecrawld.
De meest misleidende status is “Gecrawld – momenteel niet geïndexeerd”. Het bevestigt dat Google de pagina heeft opgehaald, maar deze op dat moment niet aan de index heeft toegevoegd. Google zegt expliciet dat de pagina later wel of niet kan worden geïndexeerd en dat het niet nodig is om deze alleen vanwege deze status opnieuw in te dienen.
De statussen die echt fouten zijn
Deze beschrijven iets aan uw kant dat het opslaan heeft verhinderd. Google labelt de bron van elke status als Website wanneer u het zelf kunt verhelpen, en als Google wanneer de oorzaak bij hen ligt. De onderliggende respons corrigeren is de volledige oplossing.
| Status | Wat het betekent | Bron |
|---|---|---|
| Serverfout (5xx) | De server gaf een fout uit de 500-reeks | |
| Omleidingsfout | Een redirectketen liep rond of mislukte | Website |
| URL geblokkeerd door robots.txt | robots.txt onthield toestemming om op te halen | Website |
| URL gemarkeerd met ‘noindex’ | De pagina serveerde een noindex-instructie | Website |
| Soft 404 (zachte 404) | Een niet-gevonden-bericht met statuscode 200 | Website |
| Geblokkeerd wegens ongeautoriseerd verzoek (401) | De pagina eiste inloggegevens | Website |
| Niet gevonden (404) | De URL gaf een 404 | Website |
| Geblokkeerd wegens verboden toegang (403) | De server gaf een 403 | Website |
| Geblokkeerd wegens ander 4xx-probleem | Een andere 4xx-respons | Website |
Twee hiervan verdienen extra aandacht omdat ze zo vaak zelf veroorzaakt zijn. Een zachte 404 betekent dat u een vriendelijke „hier is niets”-pagina teruggeeft met status 200: de zoekmachine ziet succes en dunne inhoud in plaats van afwezigheid, dus spreek de waarheid met een 404 of 410. En een 401 of 403 op pagina's die publiek bedoeld waren betekent meestal dat een stagingregel of een firewall in productie is beland.
De statussen die op fouten lijken en het niet zijn
Deze veroorzaken het meeste verspilde werk. Elk ervan is Google die een eigen beslissing meldt, geen mankement dat u hebt geïntroduceerd. Erachteraan jagen verbruikt de aandacht die de echte problemen nodig hebben.
| Status | Wat het werkelijk betekent |
|---|---|
| Alternatieve pagina met correcte canonieke tag | Consolidatie die precies werkt zoals bedoeld |
| Dubbel zonder door gebruiker geselecteerde canoniek | U gaf geen canonical op, dus koos Google er een |
| Dubbel, Google koos andere canoniek | U gaf er een op en Google was het oneens |
| Pagina met omleiding | Een niet-canonieke URL die doorstuurt, zoals ontworpen |
| Gevonden – momenteel niet geïndexeerd | Bekend maar nog niet opgehaald |
| Gecrawld – momenteel niet geïndexeerd | Opgehaald, beoordeeld en terzijde gelegd |
De twee dubbel-statussen zijn het onderscheiden waard. „Zonder door gebruiker geselecteerde canoniek” betekent dat u er nooit een hebt opgegeven en Google voor u koos: meestal onschuldig, maar u hebt een beslissing weggegeven die u zelf kon nemen. „Google koos andere canoniek” betekent dat u er wél een opgaf en werd overruled, een teken dat de pagina die u aanwees niet degene is die de zoekmachine als hoofdversie ziet.
„Gecrawld, momenteel niet geïndexeerd” eerlijk lezen
Deze status betekent dat Google de pagina heeft gecrawld, maar deze op dat moment niet heeft geïndexeerd. Er wordt niet één universele oorzaak geïdentificeerd, en de live URL-inspectietest kan het indexeringssucces niet met zekerheid voorspellen. Het heeft geen zin om een technische fout te bedenken die niet in het rapport wordt genoemd.
Op templategestuurde sites is het nuttig om bijna-duplicaten, canonical-signalen, interne links en de unieke informatie van elke pagina te beoordelen. Dat zijn diagnostische controles, geen bewering dat elke URL met deze status onder een kwaliteitsdrempel is gezakt.
- Open de URL-inspectie en bevestig dat de pagina 200 teruggeeft, zelf-canoniek is en haar hoofdinhoud rendert.
- Vergelijk haar met de drie dichtstbijzijnde zusterpagina's. Kunt u de ingevulde waarden verwisselen en een gelijkwaardige pagina krijgen, dan ziet de zoekmachine dat ook.
- Controleer of iets intern naar haar linkt met beschrijvende ankertekst, of dat zij alleen in de sitemap bestaat.
- Vraag wat deze pagina beantwoordt dat geen zusterpagina beantwoordt. Is er geen antwoord, dan is dát de bevinding.
- Verander de pagina zodat het antwoord bestaat en vraag dan indexering aan — in die volgorde.
„Gevonden, momenteel niet geïndexeerd” is een ander signaal
Deze betekent dat de URL bekend is maar niet is opgehaald. Op een kleine site is dat meestal van korte duur. Op schaal is het het duidelijkste symptoom dat Google noemt van een echte crawlbudget-beperking: te veel URL's, te weinig vraag, en de wachtrij bereikt ze nooit.
Staat een groot deel van uw URL's hier, dan is het productieve werk het aantal laagwaardige URL's terugbrengen dat u de zoekmachine ter overweging voorlegt — duplicaten samenvoegen, nette 404's teruggeven voor wat weg is, redirectketens inkorten — in plaats van pagina's een voor een opnieuw in te dienen.
Het rapport afwerken in plaats van de symptomen
Het rapport is naar oorzaak geordend, wat verleidt om het van boven naar beneden op volume af te werken. Weersta dat. Duizend URL's onder „Pagina met omleiding” zijn meestal een werkende redirectkaart, terwijl veertig onder „Soft 404” een echt defect zijn dat echte pagina's treft.
- Los eerst alles uit de fouttabel op — dat is ondubbelzinnig en mechanisch.
- Leg de informatieve statussen terzijde, tenzij het volume uw bedoeling tegenspreekt, zoals canonieke consolidatie die u nooit hebt ontworpen.
- Behandel „gecrawld, momenteel niet geïndexeerd” als een redactionele achterstand, niet als een technische.
- Valideer pas opnieuw wanneer de onderliggende respons of inhoud daadwerkelijk is veranderd.