Zum Inhalt springen
Illustration: Viele Seitenkacheln laufen in einen Crawler-Scanner, nur wenige kommen rechts in der Trefferliste an; die übrigen liegen grau darunter.
SEO

Warum Google deine Seiten nicht indexiert: vier Ursachen

Von · · 10 Min. Lesezeit Zuletzt aktualisiert am

Steht im Bericht „Seitenindexierung" bei deiner Adresse „Gefunden" oder „Gecrawlt"? Das ist die Weiche. „Gefunden – zurzeit nicht indexiert" heißt: Google kennt die Adresse und hat sie noch nicht abgerufen; dagegen helfen Verweise, die Sitemap und ein Antrag. „Gecrawlt – zurzeit nicht indexiert" heißt: Google hat gelesen und sich dagegen entschieden; dagegen hilft nur eine Änderung an der Seite oder an der Domain, kein zweiter Antrag. Dazu kommen zwei Meldungen mit technischer Ursache, das falsche Canonical und das ungewollte noindex. Vier Meldungen, vier Probleme, und nur eines davon löst der Knopf „Indexierung beantragen".

MeldungWas Google getan hatWas hilftHilft der Antrag?
Gefunden – zurzeit nicht indexiertAdresse bekannt, nie abgerufenVerweise, Sitemapja
Gecrawlt – zurzeit nicht indexiertabgerufen, gelesen, abgelehntSeite oder Domain ändernnein
Duplikat, andere Seite kanonischzwei Adressen, Google wählt die andereCanonical, 301, interne Verweisenein
Durch noindex-Tag ausgeschlossendie Seite sagt selbst neindas noindex entfernennein

„Gefunden – zurzeit nicht indexiert"#

Google kennt die Adresse, hat die Seite aber nie abgerufen. Sie steht in der Warteschlange, und die Warteschlange ist lang. Woran das liegt: an der Priorität, die deine Domain hat. Google crawlt nicht alles, was es kennt, sondern das, wofür sich der Abruf lohnt. Bei jungen Domains ohne eingehende Verweise ist dieses Budget klein.

Was hilft, ist Auffindbarkeit: eine Sitemap, die tatsächlich eingereicht ist, und zwar die aktuelle; interne Verweise von den Seiten, die Google bereits regelmäßig besucht. Und hier wirkt „Indexierung beantragen", weil die Seite dadurch in eine bevorzugte Warteschlange rutscht. Den Text zu ändern bringt dagegen nichts. Google hat ihn nie gelesen.

Google erklärt den Status „Gefunden – zurzeit nicht indexiert“ und was man dagegen tun kann. Video: Google Search Central · 5:22 Min. · EnglischErst beim Abspielen lädt das Video von YouTube (Google, erweiterter Datenschutzmodus) – dabei geht deine IP-Adresse an Google. Mehr dazu

„Gecrawlt – zurzeit nicht indexiert"#

Google hat die Seite abgerufen, gelesen und sich dagegen entschieden. Das ist die unbequemste der vier Meldungen, weil sie ein Urteil ist und keine Warteschlange. Und sie ist die, bei der am häufigsten das Falsche getan wird: Wer hier erneut die Indexierung beantragt, schickt dieselbe Seite noch einmal an jemanden, der sie bereits abgelehnt hat.

Woran es liegt, in dieser Reihenfolge:

Die Domain steht für nichts Bestimmtes. Wenn ein Auftritt Beiträge über Programmiersprachen, WordPress-Umzüge, Growth Hacking und Datenschutz mischt, ist für Google nicht erkennbar, wofür er die verlässliche Quelle sein soll. Ein junger Auftritt bekommt kein Vertrauen für alles gleichzeitig.

Der Beitrag ist austauschbar. Ein Text über ein Standardthema, den es tausendfach gibt, muss einen Grund liefern, ausgerechnet diesen zu nehmen: eigene Messwerte, eigene Erfahrung, ein Werkzeug daneben.

Es fehlen externe Signale. Ohne einen einzigen Verweis von außen bewertet Google konservativ, und konservativ heißt: nicht aufnehmen.

Was hilft, ist eine echte Änderung. Dünne Beiträge zu einem starken zusammenlegen. Themen ausdünnen, die nicht zum Kern gehören; auf noindex setzen kostet nichts, solange die Seiten ohnehin nicht ranken. Und dem Rest etwas mitgeben, das nur bei dir steht.

„Duplikat – Google hat eine andere Seite als kanonisch bestimmt"#

Google hält eine andere Adresse für das Original. Meist steht dieselbe Seite unter mehreren Adressen: mit und ohne www, mit und ohne Schrägstrich, unter einer Subdomain und im Unterverzeichnis, mit Parametern für Filter oder Kampagnen. Besonders häufig nach einem Umzug: Der alte Auftritt läuft noch, der neue steht schon, beide sind erreichbar, und Google entscheidet sich für den mit der längeren Geschichte.

Was hilft, ist Eindeutigkeit. Ein canonical auf jeder Seite, das auf sich selbst zeigt. Eine 301-Weiterleitung von jeder Zweitadresse auf das Original. Interne Verweise ausschließlich auf die kanonische Fassung; es hilft wenig, per canonical auf www zu zeigen und dann in hundert Beiträgen die Subdomain zu verlinken. Der Prüfschritt, den fast alle auslassen: Ruf deine Startseite in allen vier Schreibweisen auf. Drei davon sollten mit 301 auf die vierte zeigen. Das SEO-Audit prüft das mit.

„Durch ‚noindex'-Tag ausgeschlossen"#

Die Seite sagt Google selbst, dass sie nicht in den Index soll. Entweder ist das gewollt, bei Dankeseiten, internen Übersichten, ausgedünnten Altbeständen. Oder es ist ein Unfall: Ein noindex, das aus der Entwicklungsphase stehen geblieben ist, kostet nichts an Sichtbarkeit, bis jemand nachsieht.

Der zweite Unfall ist die Kombination aus noindex und einer Sperre in der robots.txt. Was der Crawler nicht abrufen darf, kann er auch nicht lesen: Er sieht das noindex nie und nimmt die Adresse trotzdem auf, nur ohne Inhalt. Erst crawlen lassen, dann nicht indexieren, in dieser Reihenfolge.

Was ich an der eigenen Domain gemessen habe#

Illustration: Eine Sitemap-Rolle entrollt sich zu einer Reihe Seitenkacheln unter einem Scannerbogen mit Lupe; die meisten leuchten danach grün, einige bleiben grau.

In eigener Sache: cyberscale.io ist die Domain dieses Magazins. Am 06.09.2026 habe ich alle 134 Adressen der eigenen Sitemap einzeln über die URL-Inspection-API der Search Console abgefragt, vollständig und nicht als Stichprobe. Der Anlass war eine Vermutung, die sich als falsch herausstellte, und das ist der eigentliche Ertrag.

Vier Läufe an einem Nachmittag, dieselben 134 Adressen:

Gestapelte Balken für vier Abfragen am 06.09.2026: um 16:09 sind 104 Adressen unbekannt und 28 gecrawlt, aber nicht aufgenommen; um 16:42 steigen die gecrawlten, nicht aufgenommenen auf 107; um 19:29 und 19:50 sind 109 Adressen indexiert, 13 gecrawlt und nicht aufgenommen, 11 unbekannt.

Uhrzeitindexiertgecrawlt, nicht aufgenommenunbekannt
16:09128104
16:42310723
19:291091311
19:501091311

Drei Dinge stehen darin, die man aus einer einzelnen Abfrage nicht lernt.

Zwei Stichproben hatten mich in die falsche Richtung geschickt. Aus zwei geprüften Adressen hatte ich geschlossen, Google habe außer der Startseite nichts gecrawlt und die Sitemap sei schlicht zu jung. Über alle 134 gemessen stimmte beides nicht: Die Crawls reichten drei Wochen zurück, und 28 Seiten waren gelesen und abgelehnt worden. Das ist ein anderer Befund mit einer anderen Konsequenz, denn Warten hilft bei Abgelehnten nicht.

Die Antwort der API schwankt. Zwischen 16:09 und 16:42 sprang die Zahl der „gecrawlt, nicht aufgenommen" von 28 auf 107, um bis 19:29 auf 13 zu fallen. Wer um 16:42 gemessen hätte, hätte eine Katastrophe diagnostiziert; wer um 19:29 misst, sieht eine gesunde Domain. Eine einzelne Ablesung ist eine Momentaufnahme, kein Urteil, auch wenn die Meldung wie eines klingt. Erst zwei Läufe im Abstand von Wochen sagen etwas über eine Richtung.

Was den Sprung ausgelöst hat, weiß ich nicht. Zwischen den Läufen ist mehr als eine Änderung passiert, und die API nennt den Zustand, nicht den Grund; den gibt es bei Google nicht als Feld. Alles, was ich hier über Ursachen sagen könnte, wäre eine Vermutung mit einer Zahl davor.

Praktisch heißt das: Wenn du nur eine Handvoll Adressen prüfst und daraus auf die ganze Domain schließt, prüfst du zu wenig. Das Tageskontingent der API liegt bei 2.000 Abfragen je Property; ein vollständiger Lauf über einen mittleren Auftritt kostet einen Bruchteil davon.

Vier Wochen später#

Oben steht, dass erst zwei Läufe im Abstand von Wochen eine Richtung zeigen. Hier sind sie, dieselbe Domain, dieselbe API:

LaufAdressen in der Sitemapindexiertgecrawlt, nicht aufgenommenunbekannt
06.09.2026, 19:501331091311
01.10.2026, 05:26 UTC7315715
03.10.2026, 05:40 UTC391335
Anteil indexierter Adressen von cyberscale.io in drei vollständigen Läufen: 82 Prozent am 06.09.2026, 1 Prozent am 01.10., 3 Prozent am 03.10. Drei waagrechte Balken zu je 100 Prozent. 06.09.2026, 133 Adressen: 82 Prozent indexiert (109), 10 Prozent gecrawlt und nicht aufgenommen (13), 8 Prozent Google unbekannt (11). 01.10.2026, 73 Adressen: 1 Prozent indexiert (1), 78 Prozent gecrawlt und nicht aufgenommen (57), 21 Prozent unbekannt (15). 03.10.2026, 39 Adressen: 3 Prozent indexiert (1), 85 Prozent gecrawlt und nicht aufgenommen (33), 13 Prozent unbekannt (5). indexiert gecrawlt, nicht aufgenommen Google unbekannt 06.09. 133 Adr. 82 % · 109 indexiert 13 11 01.10. 73 Adr. 1 % · 1 indexiert, 57 gecrawlt und nicht aufgenommen 15 03.10. 39 Adr. 3 % · 1 indexiert, 33 gecrawlt und nicht aufgenommen 5 0 %50 %100 %
Drei vollständige Läufe im Abstand von Wochen: Der Anteil indexierter Adressen fiel von 82 % (109 von 133) auf 1 % (1 von 73) und 3 % (1 von 39); der Rest ist überwiegend „gecrawlt, zurzeit nicht indexiert“. Eigene Messung mit der URL-Inspection-API der Search Console, cyberscale.io, 06.09.2026 19:50, 01.10.2026 05:26 UTC, 03.10.2026 05:40 UTC. Je Lauf alle Adressen der damals gültigen Sitemap.

Die Sitemap ist zwischen den Läufen kleiner geworden, weil ich Beiträge bewusst auf noindex gesetzt habe; die Grafik rechnet deshalb in Anteilen. Am 06.09. waren 82 % der Adressen im Index, am 01.10. und 03.10. eine einzige, die Startseite. Alles andere steht unter „Gecrawlt – zurzeit nicht indexiert“. Das ist die Meldung aus dem zweiten Abschnitt dieses Beitrags, und sie trifft jetzt mich selbst: Google hat die Seiten gelesen und sich dagegen entschieden, und zwar bei denselben Texten, die vier Wochen vorher drin waren.

Was ich vermute, nicht weiß: Die Domain hat in neun Monaten dreimal ihr Thema gewechselt, zuletzt im September mit einem Austausch fast des gesamten Inhalts, und ich habe in 18 Tagen fünfmal die Richtung geändert, welche Adressen indexiert sein sollen. Dazu zeigt die Inspection, dass Google die alten, inzwischen umgeleiteten Adressen zuletzt am 06.09. und am 20.08. gecrawlt hat. Es bewertet die Domain also nach einem Stand, den es seit Wochen nicht mehr gibt. Keiner dieser Punkte steht als Grund in der API. Sie stehen hier, weil sie zeitlich passen, nicht weil Google sie bestätigt hätte.

Was ich daraus ableite, ist unspektakulär: nichts mehr umstellen, keine Adressen mehr einreichen, Google die Weiterleitungen und das noindex in seinem Tempo nachcrawlen lassen und Ende Oktober noch einmal vollständig messen. Nichts davon wirkt in Tagen. Eine neu eingereichte Sitemap wird verarbeitet, nicht sofort gelesen; ein noindex verschwindet erst aus dem Bericht, wenn Google die Seite wieder besucht; und eine Domain, die kein Vertrauen hat, bekommt es nicht durch einen Klick. Der nächste Lauf entscheidet, ob die Richtung stimmt.

Die Reihenfolge, in der man vorgeht#

  1. Zuerst technisch prüfen. Liefert die Seite eine 200? Steht ein ungewolltes noindex drin? Zeigt das canonical auf sich selbst? Ist die richtige Sitemap eingereicht, und antwortet sie überhaupt noch? Alte Sitemaps aus einer früheren Installation, die inzwischen 404 liefern, sind ein verbreiteter blinder Fleck.
  2. Dann die Meldung lesen und einordnen. Gefunden oder gecrawlt? Das ist die Weiche.
  3. Bei „gefunden" die Auffindbarkeit verbessern und einzeln beantragen, aber mit Maß. Das Tageskontingent für Einzelanträge ist klein und gilt für alle Properties eines Kontos zusammen, nicht je Domain.
  4. Bei „gecrawlt" die Substanz verbessern. Alles andere ist Beschäftigung.
  5. Vollständig messen, nicht stichprobenweise, und zweimal im Abstand von Wochen, sonst ist die zweite Zahl nicht vergleichbar. Gezählt wird, was indexiert ist, nicht, was veröffentlicht ist. Die erste Zahl steigt nur, wenn du etwas richtig machst, die zweite mit jedem Beitrag.

Wie du den Stand einzeln nachschlägst, steht in Die URL-Prüfung der Search Console lesen; wann sich ein Einzelantrag lohnt, in Wie lange dauert die Google-Indexierung?.

Häufige Fragen#

Was ist der Unterschied zwischen „Gefunden – zurzeit nicht indexiert“ und „Gecrawlt – zurzeit nicht indexiert“?

„Gefunden“ heißt, Google kennt die Adresse, hat die Seite aber nie abgerufen; dagegen helfen interne Verweise, eine eingereichte Sitemap und ein Antrag. „Gecrawlt“ heißt, Google hat die Seite gelesen und sich dagegen entschieden. Das ist ein Urteil über Seite oder Domain, kein Platz in einer Warteschlange.

Hilft „Indexierung beantragen“ bei „Gecrawlt – zurzeit nicht indexiert“?

Nein. Ein zweiter Antrag schickt dieselbe Seite noch einmal an jemanden, der sie bereits abgelehnt hat. Was hilft, ist eine echte Änderung: dünne Beiträge zu einem starken zusammenlegen, Themen außerhalb des Kerns ausdünnen und dem Rest etwas mitgeben, das nur dort steht, etwa eigene Messwerte.

Was passiert, wenn eine Seite noindex hat und in der robots.txt gesperrt ist?

Dann sieht Google das noindex nie, weil der Crawler die Seite nicht abrufen darf, und kann die Adresse trotzdem aufnehmen, nur ohne Inhalt. Wer eine Seite aus dem Index haben will, lässt sie crawlen und setzt noindex, ohne sie in der robots.txt zu sperren.

Wie zuverlässig ist eine einzelne Abfrage der URL-Inspection-API?

Wenig. Bei einer Messung über 134 Adressen am 06.09.2026 sprang die Zahl der gecrawlten, nicht aufgenommenen Seiten zwischen 16:09 und 16:42 von 28 auf 107 und fiel bis 19:29 auf 13. Eine einzelne Ablesung ist eine Momentaufnahme; erst zwei vollständige Läufe im Abstand von Wochen zeigen eine Richtung.

Wie viele Adressen kann man pro Tag mit der URL-Inspection-API prüfen?

Google erlaubt 2.000 Abfragen am Tag je Property. Ein vollständiger Lauf über einen mittleren Auftritt kostet davon nur einen Bruchteil, deshalb lohnt es sich, alle Adressen der Sitemap zu prüfen statt einer Stichprobe. Getrennt davon ist das Kontingent für Einzelanträge in der Oberfläche klein und gilt für alle Properties eines Kontos zusammen.

Stand 03.10.2026. Quellen abgerufen und die eigene Domain am selben Tag gemessen.

Quellen (4)

Weiterlesen