Allgemein

Gute Seiten, schlechte Seiten: Indexierbarkeit und Crawlability planen

Aktualisiert im Oktober 2026. Dieser Beitrag erschien ursprünglich 2015 und wurde für den heutigen Stand komplett neu geschrieben: mit einer aktualisierten Übersicht aller Seitentypen, der heutigen Empfehlung für Paginierung und Hinweisen zu JavaScript statt Flash und AJAX-Crawling.

Nicht jede URL, die dein CMS oder Shopsystem erzeugt, ist ein gutes Suchergebnis. Wer alles in den Index lässt, verteilt Crawling und Bewertung auf tausende Seiten, die niemand sucht. Wer zu viel aussperrt, verliert Rankings. Dieser Beitrag hilft dir, für jeden Seitentyp eine bewusste Entscheidung zu treffen.

Zwei Begriffe, die oft verwechselt werden

  • Crawlability beschreibt, ob und wie gut Suchmaschinen deine Seiten finden und abrufen können: über Links, Sitemaps, schnelle Serverantworten und ohne Sackgassen.
  • Indexierbarkeit beschreibt, ob eine abgerufene Seite in den Index aufgenommen werden darf und soll: gesteuert über noindex, Canonical-Tags und Statuscodes.

Eine Seite kann crawlbar, aber nicht indexierbar sein (etwa mit noindex). Umgekehrt kann eine per robots.txt gesperrte Seite trotzdem im Index auftauchen. Warum das so ist und wie du die beiden Mittel richtig einsetzt, steht in noindex, Disallow oder beides?.

Der Maßstab: Ist das ein gutes Suchergebnis?

Die Leitfrage für jeden Seitentyp lautet: Würde jemand, der bei Google sucht, auf genau dieser Seite glücklich landen? Eine Kategorieseite „Laufschuhe Damen“ erfüllt das. Die Trefferliste deiner internen Suche für „laufs“ nicht. Sie ist eine Liste von Links, keine Antwort.

Dazu kommt eine zweite Frage: Ist die Seite zwar kein gutes Suchziel, aber wichtig für die Erreichbarkeit anderer Seiten? Dann muss sie crawlbar bleiben, auch wenn sie selbst nicht ranken soll.

Standard-Empfehlungen nach Seitentyp

Seitentyp Index? Anmerkung
Startseite ja selbstverständlich
Kategorieseiten ja das Rückgrat vieler Shops und Portale; mit eigenem Einleitungstext
Detailseiten (Produkt, Artikel) ja Varianten ggf. per Canonical bündeln
Tag- und Themenseiten nur, wenn gepflegt mit eigenem Inhalt und genug Einträgen ja, sonst noindex oder abschaffen
Interne Suchergebnisse nein noindex; bei großen Mengen per robots.txt vom Crawling ausnehmen
Facettierte Navigation / Filter teilweise nur Kombinationen mit echtem Suchvolumen, siehe unten
Paginierung (Seite 2, 3 …) ja heute indexierbar mit selbstreferenzierendem Canonical
Sortier-Varianten nein Canonical auf die Standardsortierung oder vom Crawling ausnehmen
Impressum, Datenschutz, AGB ja kein Grund für noindex; sie stören nicht
HTML-Sitemap ja oder noindex Hauptzweck ist die Verlinkung, Ranking egal
Bildergalerien kommt drauf an eine Seite pro Bild ohne Text ist meist dünner Inhalt
Anhangseiten in WordPress nein auf die Datei oder den Beitrag weiterleiten
Agenturmeldungen, übernommene Texte meist nein ohne eigenen Mehrwert noindex
Ausverkaufte Produkte ja, solange wiederkommend endgültig weg: 404/410 oder 301 auf echten Ersatz
Warenkorb, Login, Konto, Danke-Seiten nein noindex; Login-Bereiche zusätzlich schützen

Die Tabelle ist ein Startpunkt, kein Gesetz. Ein Portal, dessen Tag-Seiten liebevoll gepflegte Themenseiten sind, behandelt diese anders als ein Blog mit 3.000 Tags, die je einen Beitrag enthalten.

Was sich seit 2015 geändert hat

  • Paginierung: Früher war noindex, follow für Folgeseiten die gängige Empfehlung. Heute rät Google dazu, sie indexierbar zu lassen, jede mit eigener Canonical-URL. Details stehen in Paginierung ohne rel=next/prev und in Paginierte Seiten: noindex,follow vs. Canonical-Tag.
  • AJAX-Zustände: Das alte AJAX-Crawling-Schema mit #! und _escaped_fragment_ hat Google längst aufgegeben. Google rendert JavaScript heute selbst. Wichtig bleibt: Inhalte, die indexiert werden sollen, brauchen eine eigene URL ohne #-Fragment und müssen über echte <a href>-Links erreichbar sein.
  • Flash: ist Geschichte. Google indexiert keine Flash-Inhalte mehr, Browser unterstützen Flash seit Anfang 2021 nicht mehr.
  • robots.txt: Wird heute vorsichtiger eingesetzt als früher. CSS- und JavaScript-Dateien müssen für das Rendering abrufbar sein; mehr dazu im Beitrag robots.txt für SEOs.

Problemfall facettierte Navigation

Am schwierigsten wird es in Shops und Portalen mit Filtern nach Farbe, Größe, Marke, Preis und Material. Jede Kombination erzeugt potenziell eine eigene URL. Schon wenige Filter mit je zehn Werten ergeben schnell Hunderttausende Varianten, die sich kaum unterscheiden. „Sneaker, weiß, Größe 42“ und „Sneaker, weiß, Größe 43“ zeigen fast dieselben Produkte. „Weiße Sneaker“ dagegen ist ein Begriff, nach dem Menschen tatsächlich suchen.

So gehst du vor:

  1. Suchrelevante Kombinationen identifizieren. Keyword-Recherche zeigt, welche Filter (meist Marke, Farbe, Typ) Suchvolumen haben. Diese Seiten werden wie Kategorien behandelt: indexierbar, mit sprechender URL, eigenem Title und eigener H1.
  2. Diese Seiten verlinken. Sie müssen über normale HTML-Links erreichbar sein, nicht nur über eine JavaScript-Filterauswahl. Sonst findet Google sie nicht oder nur zufällig.
  3. Den Rest eindämmen. Für alle übrigen Kombinationen gibt es mehrere Wege: Filter per JavaScript ohne crawlbare Links umsetzen, die Parameter in der robots.txt sperren oder ein Canonical auf die übergeordnete Kategorie setzen. Am effizientesten ist es, wenn unnötige Kombinationen gar nicht erst als crawlbare Links im HTML stehen.
  4. Eine Regel festlegen, wenn Handarbeit nicht skaliert. Viele große Shops arbeiten etwa mit: Ein Filter ist indexierbar, ab zwei kombinierten Filtern nicht mehr. Das ist grob, aber nachvollziehbar und leicht umzusetzen.

Das Ziel ist, dass der Crawler seine Zeit mit Seiten verbringt, die ranken können. Bei kleinen Websites ist das kein Thema; spürbar wird es ab einigen Zehntausend URLs.

Weniger ist oft mehr

Viele Websites gewinnen an Sichtbarkeit, wenn sie ihren Index aufräumen: dünne Tag-Seiten zusammenlegen, veraltete Beiträge aktualisieren oder entfernen, Parameter-Duplikate bündeln. Google bewertet die Qualität einer Website auch im Ganzen. Ein großer Anteil schwacher Seiten zieht das Gesamtbild nach unten, wie die Core Updates der letzten Jahre mehrfach gezeigt haben.

Aufräumen heißt aber nicht, wahllos noindex zu verteilen. Seiten, die Besucher und Links haben, verdienen eher eine Überarbeitung als ein Aussperren.

Widersprüchliche Signale vermeiden

Die meisten Indexierungsprobleme in Audits entstehen nicht durch eine falsche Einzelentscheidung, sondern durch Kombinationen, die sich widersprechen:

  • noindex plus Canonical auf eine andere URL
  • Canonical auf eine URL, die selbst weiterleitet oder noindex trägt
  • Seiten in der XML-Sitemap, die per robots.txt gesperrt sind oder noindex haben
  • interne Links, die überwiegend auf weitergeleitete URLs zeigen

Google muss dann raten, und das Ergebnis ist selten das gewünschte. Jede URL sollte ein klares, einheitliches Signal senden. Mehr zum Canonical-Tag steht im Canonical-Leitfaden.

Kontrolle in der Search Console

Der Seitenindexierungsbericht zeigt, welche URLs Google kennt, welche indexiert sind und aus welchem Grund andere fehlen. Lohnenswert ist ein regelmäßiger Blick auf:

  • „Gecrawlt – zurzeit nicht indexiert“ und „Gefunden – zurzeit nicht indexiert“: Google hält diese Seiten offenbar nicht für wichtig genug. Viele Einträge hier sind ein Hinweis auf zu viele schwache oder schlecht verlinkte URLs.
  • „Duplikat – vom Nutzer nicht als kanonisch festgelegt“: Hier fehlt ein Canonical oder Google ignoriert es.
  • Die Crawling-Statistik (unter Einstellungen): Wie viele Anfragen stellt Googlebot, und wofür?

Wenn eine wichtige Seite trotz allem nicht im Index ist, hilft der Beitrag Warum ist meine Seite nicht indexiert? weiter.

Fazit: erst planen, dann sperren

Lege für jeden Seitentyp deiner Website fest, ob er in den Index gehört, ob er crawlbar bleiben muss und mit welchem Mittel du ihn steuerst. Schreib das auf, bevor jemand im Template einzelne Tags setzt. Ein solcher Plan verhindert, dass du mehr aussperrst als nötig, und er ist beim nächsten Relaunch Gold wert. Welche Werkzeuge es dafür gibt, zeigt der Beitrag Werkzeuge für bessere Crawlability.

Autor

Christoph Baur ist Gründer und Geschäftsführer der Augsburger SEO Agentur Bits & Passion GmbH. Seine Leidenschaft für SEO und Online Marketing entwickelte sich bereits 2002. Damals startete er als Webentwickler und betrieb verschiedene, erfolgreiche Affiliate Websites. Seit 2010 berät er als SEO Consultant Kunden aller Größe von der Zahnarztpraxis bis zum Dax40-Konzern. Sein Wissen teilt er außerdem als Lehrbeauftragter an der Hochschule Augsburg und an der DHBW Ravensburg.

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert