Zum Hauptinhalt springen
← Alle Guides

Warum Seiten nicht indexiert werden

Eine Seite kann aus mehreren Gründen außerhalb des Google-Index bleiben: Zugriffsbeschränkungen oder Anweisungen, Duplikate oder Canonical-Signale, ein noch nicht erfolgter Crawl oder ein Crawl, der nicht zur Indexierung geführt hat. Search Console meldet den Indexierungsstatus; die Lösung hängt vom tatsächlichen Status ab.

Beginnen Sie mit dem Status, nicht mit einer Diagnose

Der Bericht zur Seitenindexierung enthält sowohl echte technische Probleme als auch erwartete Ausschlüsse. Eine robots.txt-Regel, eine noindex-Anweisung, eine Authentifizierungsanforderung oder eine fehlerhafte Antwort können die Indexierung verhindern; Duplikat- und Canonical-Status können genau wie vorgesehen funktionieren, und eine entdeckte URL wurde möglicherweise einfach noch nicht gecrawlt.

Der irreführendste Status ist „Gecrawlt – derzeit nicht indiziert“. Es bestätigt, dass Google die Seite zu diesem Zeitpunkt abgerufen, aber nicht zum Index hinzugefügt hat. Google weist ausdrücklich darauf hin, dass die Seite möglicherweise später indiziert wird oder nicht und dass es aufgrund dieses Status nicht erforderlich ist, sie erneut einzureichen.

Die Status, die wirklich Fehler sind

Diese beschreiben etwas auf Ihrer Seite, das die Speicherung verhindert hat. Google kennzeichnet die Quelle jeweils als Website, wenn Sie es selbst beheben können, und als Google, wenn die Ursache dort liegt. Die Korrektur der zugrunde liegenden Antwort ist die vollständige Lösung.

StatusBedeutungQuelle
Serverfehler (5xx)Der Server antwortete mit einem 500er-FehlerGoogle
WeiterleitungsfehlerEine Weiterleitungskette lief im Kreis oder scheiterteWebsite
Durch robots.txt blockiertrobots.txt verweigerte die AbruferlaubnisWebsite
Mit „noindex“ gekennzeichnetDie Seite lieferte eine noindex-Anweisung ausWebsite
Soft-404Eine Nicht-gefunden-Meldung mit Statuscode 200Website
Wegen nicht autorisierter Anfrage blockiert (401)Die Seite verlangte ZugangsdatenWebsite
Nicht gefunden (404)Die URL antwortete mit 404Website
Wegen Zugriffsverbot blockiert (403)Der Server antwortete mit 403Website
Wegen anderem 4xx-Problem blockiertEine andere 4xx-AntwortWebsite

Zwei davon verdienen besondere Aufmerksamkeit, weil sie so oft selbst verschuldet sind. Ein Soft-404 heißt, Sie liefern eine freundliche „Hier ist nichts“-Seite mit Status 200 — die Suchmaschine sieht Erfolg und dünnen Inhalt statt Abwesenheit. Sagen Sie die Wahrheit mit 404 oder 410. Und ein 401 oder 403 auf öffentlich gedachten Seiten bedeutet meist, dass eine Staging-Regel oder eine Firewall in die Produktion gelangt ist.

Die Status, die wie Fehler aussehen und keine sind

Diese erzeugen die meiste vergebliche Arbeit. Jeder einzelne davon ist Google, das eine eigene Entscheidung meldet — kein von Ihnen verursachter Fehler. Ihnen nachzujagen verbraucht die Aufmerksamkeit, die die echten Probleme brauchen.

StatusWas er tatsächlich bedeutet
Alternative Seite mit richtigem kanonischen TagKonsolidierung, die genau wie vorgesehen funktioniert
Duplikat ohne vom Nutzer ausgewähltes CanonicalSie haben keines angegeben, also wählte Google eines
Duplikat, Google hat anderes Canonical gewähltSie haben eines angegeben, Google widersprach
Seite mit WeiterleitungEine nicht-kanonische URL leitet weiter, wie geplant
Gefunden – zurzeit nicht indexiertBekannt, aber noch nicht abgerufen
Gecrawlt – zurzeit nicht indexiertAbgerufen, bewertet und beiseitegelegt

Die beiden Duplikat-Status lohnen die Unterscheidung. „Duplikat ohne vom Nutzer ausgewähltes Canonical“ heißt, Sie haben nie eines angegeben und Google hat für Sie entschieden — meist harmlos, aber Sie haben eine Entscheidung abgegeben, die Sie selbst treffen könnten. „Google hat anderes Canonical gewählt“ heißt, Sie haben eines angegeben und wurden überstimmt: ein Signal, dass die von Ihnen benannte Seite nicht die ist, die die Suchmaschine für die primäre hält.

„Gecrawlt – zurzeit nicht indexiert“ ehrlich lesen

Dieser Status bedeutet, dass Google die Seite gecrawlt, aber zu diesem Zeitpunkt nicht indexiert hat. Er nennt keine universelle Ursache, und auch die Live-URL-Prüfung kann den späteren Indexierungserfolg nicht sicher vorhersagen. Es hat keinen Sinn, einen technischen Fehler zu erfinden, den der Bericht nicht nennt.

Auf vorlagengesteuerten Websites lohnt es sich unter anderem, Beinahe-Duplikate, Canonical-Signale, interne Links und den eigenständigen Informationswert jeder Seite zu prüfen. Das sind Diagnoseansätze, keine Behauptung, jede URL in diesem Status sei an einer Qualitätsschwelle gescheitert.

  1. Öffnen Sie die URL-Prüfung und bestätigen Sie: Status 200, selbstreferenzierendes Canonical, Hauptinhalt wird gerendert.
  2. Vergleichen Sie die Seite mit ihren drei nächsten Geschwistern. Wenn sich die eingesetzten Werte tauschen lassen und eine gleichwertige Seite entsteht, sieht die Suchmaschine das auch.
  3. Prüfen Sie, ob irgendetwas intern mit beschreibendem Ankertext darauf verlinkt — oder ob sie nur in der Sitemap existiert.
  4. Fragen Sie, was diese Seite beantwortet, das kein Geschwister beantwortet. Gibt es keine Antwort, ist genau das der Befund.
  5. Ändern Sie die Seite so, dass es die Antwort gibt, und fordern Sie dann die Indexierung an — in dieser Reihenfolge.

„Gefunden – zurzeit nicht indexiert“ ist ein anderes Signal

Dieser Status heißt, die URL ist bekannt, aber nicht abgerufen worden. Auf einer kleinen Website ist das meist ein kurzlebiger Zustand. Im großen Maßstab ist es das deutlichste von Google benannte Symptom einer echten Crawl-Budget-Grenze: zu viele URLs, zu wenig Nachfrage, und die Warteschlange erreicht sie nie.

Steht ein großer Anteil Ihrer URLs hier, ist die produktive Arbeit, die Zahl der geringwertigen URLs zu senken, die Sie der Suchmaschine zumuten — Duplikate zusammenführen, für Entferntes ordentliche 404 liefern, Weiterleitungsketten kürzen — statt einzelne Seiten erneut einzureichen.

Den Bericht abarbeiten statt der Symptome

Der Bericht ist nach Ursachen sortiert, was dazu verführt, von oben nach Menge zu arbeiten. Widerstehen Sie dem. Tausend URLs unter „Seite mit Weiterleitung“ sind meist eine funktionierende Weiterleitungskarte, während vierzig unter „Soft-404“ ein echter Defekt an echten Seiten sind.

  • Beheben Sie zuerst alles aus der Fehlertabelle — das ist eindeutig und mechanisch.
  • Legen Sie die informativen Status beiseite, sofern die Menge nicht Ihrer Absicht widerspricht, etwa bei einer Canonical-Konsolidierung, die Sie nie entworfen haben.
  • Behandeln Sie „Gecrawlt – zurzeit nicht indexiert“ als redaktionellen Rückstand, nicht als technischen.
  • Validieren Sie erst erneut, wenn sich die zugrunde liegende Antwort oder der Inhalt tatsächlich geändert hat.

Auf der eigenen Website testen

Fragen und Antworten

Erzwingt erneutes Einreichen die Indexierung?

Nein. Eine Indexierungsanfrage stellt einen neuen Crawl in die Warteschlange; sie hebt die Entscheidung danach nicht auf. Reichen Sie ein, nachdem die Seite sich geändert hat, nicht statt einer Änderung.

Warum sind manche lokalisierten Seiten indexiert und andere nicht?

Vorlagenseiten, die sich nur durch einen eingesetzten Namen unterscheiden, wirken wie Duplikate. Suchmaschinen indexieren häufig eine Teilmenge und lassen den Rest weg; welche übrig bleiben, folgt eher der Marktnachfrage als dem Markup. Die Lösung ist, den ausgelassenen Sprachen etwas Eigenes zu geben — nicht, ihre Tags zu justieren.

Ist „Alternative Seite mit richtigem kanonischen Tag“ ein Problem?

Nein. Der Status meldet Canonical-Konsolidierung, die wie vorgesehen arbeitet. Hinsehen lohnt nur, wenn die Menge weit größer ist, als Ihre Canonical-Strategie erklären würde — das hieße, es entstehen URLs, die Sie nicht beabsichtigt haben.

Was ist der Unterschied zwischen Soft-404 und 404?

Ein 404 sagt die Wahrheit: Hier ist nichts. Ein Soft-404 zeigt eine Nicht-gefunden-Meldung und liefert dabei 200, sodass die Suchmaschine den erfolgreichen Abruf einer dünnen Seite verbucht. Liefern Sie für endgültig Entferntes einen echten 404 oder 410.

Wie lange sollte ich warten, bevor ich Nicht-Indexierung als Entscheidung werte?

Vergleichen Sie mit derselben Website statt mit der Uhr. Wurden vergleichbare, gleichzeitig veröffentlichte Seiten binnen Tagen indexiert und diese liegt seit Wochen, wurde sie bewertet und nicht verzögert.