Aktualisiert im Oktober 2026. Dieser Beitrag erschien ursprünglich 2015 und wurde für den heutigen Stand komplett neu geschrieben: mit einer aktualisierten Übersicht aller Seitentypen, der heutigen Empfehlung für Paginierung und Hinweisen zu JavaScript statt Flash und AJAX-Crawling.
Nicht jede URL, die dein CMS oder Shopsystem erzeugt, ist ein gutes Suchergebnis. Wer alles in den Index lässt, verteilt Crawling und Bewertung auf tausende Seiten, die niemand sucht. Wer zu viel aussperrt, verliert Rankings. Dieser Beitrag hilft dir, für jeden Seitentyp eine bewusste Entscheidung zu treffen.
Zwei Begriffe, die oft verwechselt werden
- Crawlability beschreibt, ob und wie gut Suchmaschinen deine Seiten finden und abrufen können: über Links, Sitemaps, schnelle Serverantworten und ohne Sackgassen.
- Indexierbarkeit beschreibt, ob eine abgerufene Seite in den Index aufgenommen werden darf und soll: gesteuert über
noindex, Canonical-Tags und Statuscodes.
Eine Seite kann crawlbar, aber nicht indexierbar sein (etwa mit noindex). Umgekehrt kann eine per robots.txt gesperrte Seite trotzdem im Index auftauchen. Warum das so ist und wie du die beiden Mittel richtig einsetzt, steht in noindex, Disallow oder beides?.
Der Maßstab: Ist das ein gutes Suchergebnis?
Die Leitfrage für jeden Seitentyp lautet: Würde jemand, der bei Google sucht, auf genau dieser Seite glücklich landen? Eine Kategorieseite „Laufschuhe Damen“ erfüllt das. Die Trefferliste deiner internen Suche für „laufs“ nicht. Sie ist eine Liste von Links, keine Antwort.
Dazu kommt eine zweite Frage: Ist die Seite zwar kein gutes Suchziel, aber wichtig für die Erreichbarkeit anderer Seiten? Dann muss sie crawlbar bleiben, auch wenn sie selbst nicht ranken soll.
Standard-Empfehlungen nach Seitentyp
| Seitentyp | Index? | Anmerkung |
|---|---|---|
| Startseite | ja | selbstverständlich |
| Kategorieseiten | ja | das Rückgrat vieler Shops und Portale; mit eigenem Einleitungstext |
| Detailseiten (Produkt, Artikel) | ja | Varianten ggf. per Canonical bündeln |
| Tag- und Themenseiten | nur, wenn gepflegt | mit eigenem Inhalt und genug Einträgen ja, sonst noindex oder abschaffen |
| Interne Suchergebnisse | nein | noindex; bei großen Mengen per robots.txt vom Crawling ausnehmen |
| Facettierte Navigation / Filter | teilweise | nur Kombinationen mit echtem Suchvolumen, siehe unten |
| Paginierung (Seite 2, 3 …) | ja | heute indexierbar mit selbstreferenzierendem Canonical |
| Sortier-Varianten | nein | Canonical auf die Standardsortierung oder vom Crawling ausnehmen |
| Impressum, Datenschutz, AGB | ja | kein Grund für noindex; sie stören nicht |
| HTML-Sitemap | ja oder noindex |
Hauptzweck ist die Verlinkung, Ranking egal |
| Bildergalerien | kommt drauf an | eine Seite pro Bild ohne Text ist meist dünner Inhalt |
| Anhangseiten in WordPress | nein | auf die Datei oder den Beitrag weiterleiten |
| Agenturmeldungen, übernommene Texte | meist nein | ohne eigenen Mehrwert noindex |
| Ausverkaufte Produkte | ja, solange wiederkommend | endgültig weg: 404/410 oder 301 auf echten Ersatz |
| Warenkorb, Login, Konto, Danke-Seiten | nein | noindex; Login-Bereiche zusätzlich schützen |
Die Tabelle ist ein Startpunkt, kein Gesetz. Ein Portal, dessen Tag-Seiten liebevoll gepflegte Themenseiten sind, behandelt diese anders als ein Blog mit 3.000 Tags, die je einen Beitrag enthalten.
Was sich seit 2015 geändert hat
- Paginierung: Früher war
noindex, followfür Folgeseiten die gängige Empfehlung. Heute rät Google dazu, sie indexierbar zu lassen, jede mit eigener Canonical-URL. Details stehen in Paginierung ohne rel=next/prev und in Paginierte Seiten: noindex,follow vs. Canonical-Tag. - AJAX-Zustände: Das alte AJAX-Crawling-Schema mit
#!und_escaped_fragment_hat Google längst aufgegeben. Google rendert JavaScript heute selbst. Wichtig bleibt: Inhalte, die indexiert werden sollen, brauchen eine eigene URL ohne#-Fragment und müssen über echte<a href>-Links erreichbar sein. - Flash: ist Geschichte. Google indexiert keine Flash-Inhalte mehr, Browser unterstützen Flash seit Anfang 2021 nicht mehr.
- robots.txt: Wird heute vorsichtiger eingesetzt als früher. CSS- und JavaScript-Dateien müssen für das Rendering abrufbar sein; mehr dazu im Beitrag robots.txt für SEOs.
Problemfall facettierte Navigation
Am schwierigsten wird es in Shops und Portalen mit Filtern nach Farbe, Größe, Marke, Preis und Material. Jede Kombination erzeugt potenziell eine eigene URL. Schon wenige Filter mit je zehn Werten ergeben schnell Hunderttausende Varianten, die sich kaum unterscheiden. „Sneaker, weiß, Größe 42“ und „Sneaker, weiß, Größe 43“ zeigen fast dieselben Produkte. „Weiße Sneaker“ dagegen ist ein Begriff, nach dem Menschen tatsächlich suchen.
So gehst du vor:
- Suchrelevante Kombinationen identifizieren. Keyword-Recherche zeigt, welche Filter (meist Marke, Farbe, Typ) Suchvolumen haben. Diese Seiten werden wie Kategorien behandelt: indexierbar, mit sprechender URL, eigenem Title und eigener H1.
- Diese Seiten verlinken. Sie müssen über normale HTML-Links erreichbar sein, nicht nur über eine JavaScript-Filterauswahl. Sonst findet Google sie nicht oder nur zufällig.
- Den Rest eindämmen. Für alle übrigen Kombinationen gibt es mehrere Wege: Filter per JavaScript ohne crawlbare Links umsetzen, die Parameter in der robots.txt sperren oder ein Canonical auf die übergeordnete Kategorie setzen. Am effizientesten ist es, wenn unnötige Kombinationen gar nicht erst als crawlbare Links im HTML stehen.
- Eine Regel festlegen, wenn Handarbeit nicht skaliert. Viele große Shops arbeiten etwa mit: Ein Filter ist indexierbar, ab zwei kombinierten Filtern nicht mehr. Das ist grob, aber nachvollziehbar und leicht umzusetzen.
Das Ziel ist, dass der Crawler seine Zeit mit Seiten verbringt, die ranken können. Bei kleinen Websites ist das kein Thema; spürbar wird es ab einigen Zehntausend URLs.
Weniger ist oft mehr
Viele Websites gewinnen an Sichtbarkeit, wenn sie ihren Index aufräumen: dünne Tag-Seiten zusammenlegen, veraltete Beiträge aktualisieren oder entfernen, Parameter-Duplikate bündeln. Google bewertet die Qualität einer Website auch im Ganzen. Ein großer Anteil schwacher Seiten zieht das Gesamtbild nach unten, wie die Core Updates der letzten Jahre mehrfach gezeigt haben.
Aufräumen heißt aber nicht, wahllos noindex zu verteilen. Seiten, die Besucher und Links haben, verdienen eher eine Überarbeitung als ein Aussperren.
Widersprüchliche Signale vermeiden
Die meisten Indexierungsprobleme in Audits entstehen nicht durch eine falsche Einzelentscheidung, sondern durch Kombinationen, die sich widersprechen:
noindexplus Canonical auf eine andere URL- Canonical auf eine URL, die selbst weiterleitet oder
noindexträgt - Seiten in der XML-Sitemap, die per robots.txt gesperrt sind oder
noindexhaben - interne Links, die überwiegend auf weitergeleitete URLs zeigen
Google muss dann raten, und das Ergebnis ist selten das gewünschte. Jede URL sollte ein klares, einheitliches Signal senden. Mehr zum Canonical-Tag steht im Canonical-Leitfaden.
Kontrolle in der Search Console
Der Seitenindexierungsbericht zeigt, welche URLs Google kennt, welche indexiert sind und aus welchem Grund andere fehlen. Lohnenswert ist ein regelmäßiger Blick auf:
- „Gecrawlt – zurzeit nicht indexiert“ und „Gefunden – zurzeit nicht indexiert“: Google hält diese Seiten offenbar nicht für wichtig genug. Viele Einträge hier sind ein Hinweis auf zu viele schwache oder schlecht verlinkte URLs.
- „Duplikat – vom Nutzer nicht als kanonisch festgelegt“: Hier fehlt ein Canonical oder Google ignoriert es.
- Die Crawling-Statistik (unter Einstellungen): Wie viele Anfragen stellt Googlebot, und wofür?
Wenn eine wichtige Seite trotz allem nicht im Index ist, hilft der Beitrag Warum ist meine Seite nicht indexiert? weiter.
Fazit: erst planen, dann sperren
Lege für jeden Seitentyp deiner Website fest, ob er in den Index gehört, ob er crawlbar bleiben muss und mit welchem Mittel du ihn steuerst. Schreib das auf, bevor jemand im Template einzelne Tags setzt. Ein solcher Plan verhindert, dass du mehr aussperrst als nötig, und er ist beim nächsten Relaunch Gold wert. Welche Werkzeuge es dafür gibt, zeigt der Beitrag Werkzeuge für bessere Crawlability.
