# SEO-Indexierungsstrategie für große Websites Summary: Indexierungsstrategie nach URL-Klasse: Zweck, Search Intent, einzigartiger Nutzen, Canonicals, Ownership, Lifecycle und Monitoring entscheiden. Canonical HTML version: https://marcdeboer.de/guides/indexierungsstrategie/ Markdown TXT version: https://marcdeboer.de/guides/indexierungsstrategie.md.txt Author: Marc de Boer Website: https://marcdeboer.de Language: de Published: 2026-09-02 Updated: 2026-09-02 ## Entscheidung vor regulärer Indexierbarkeit Leitprinzip Eine neue URL-Klasse darf technisch existieren, bevor alle Governance-Fragen gelöst sind. Regulär indexierbar sollte sie erst werden, wenn Zweck, Owner, Indexierungsziel, Qualitätskriterien, interne Einbindung, Monitoring und Exit-Regel geklärt sind. Indexierung ist keine Publikationsbestätigung. Google beschreibt Crawling, Indexierung und Auslieferung als getrennte Phasen und garantiert keine Aufnahme in den Index. Die Website kann aber kontrollieren, welche Zustände sie erzeugt, verlinkt, in Sitemaps nennt und über Directives anbietet. ## Technische Signale haben unterschiedliche Aufgaben Ein HTTP-Status beschreibt die Antwort der URL. Robots.txt begrenzt Crawling. `noindex` adressiert die Indexierbarkeit eines erreichbaren Dokuments. Ein Canonical signalisiert eine bevorzugte repräsentative URL für gleiche oder sehr ähnliche Inhalte. Die Sitemap nennt bevorzugte URLs, und interne Links machen Beziehungen und Discovery-Pfade sichtbar. Keines dieser Elemente ersetzt die übrigen. Widersprüche sind deshalb auf Ebene der URL-Klasse zu prüfen: Eine URL in der Sitemap, die intern nur über Redirects erreichbar ist, beschreibt keinen sauberen Sollzustand. Ebenso wenig eine indexierbare Landingpage, die durch robots.txt blockiert wird oder nur aus einer Suche ohne crawlbaren Link erreichbar ist. ## Entscheidungsmodell pro URL-Klasse ## Index, Noindex, Canonical, Merge oder Remove ### Index Candidate Der Seitentyp besitzt einen stabilen Search-Zweck, eigenständigen Wert, klare Ownership und eine tragfähige Einbindung. Das ist ein Kandidat für reguläre Indexierbarkeit, keine Garantie auf tatsächliche Indexierung oder Rankings. ### Noindex Candidate Die Seite muss für Nutzer oder Prozesse existieren, soll aber nicht als Suchergebnis dienen. `noindex` muss für den Crawler erreichbar sein, um verarbeitet zu werden. ### Canonical Review Mehrere URLs zeigen denselben oder sehr ähnlichen Hauptinhalt und eine repräsentative Version soll bevorzugt werden. Canonical ist ein Signal; Google kann eine andere URL auswählen. ### Merge Review Mehrere schwache Seiten bedienen denselben Zweck und könnten fachlich sauber in einer stärkeren Ressource zusammengeführt werden. Die Entscheidung braucht Content- und Redirect-Plan, nicht nur ein Tag. ### Remove Review Die URL besitzt keinen fortbestehenden Nutzer-, Business- oder Search-Zweck. Abhängig vom Nachfolger sind Entfernung, 404/410 oder eine passende Weiterleitung zu prüfen. Eine pauschale Weiterleitung auf die Homepage ist selten ein semantischer Nachfolger. Decision Matrix öffnen URL Policy verwenden ## Search Reality als Gegenprobe Die Policy beschreibt den Sollzustand. Crawls, gerendertes HTML, Serverlogs, Sitemaps und Search Console zeigen, was tatsächlich passiert. Eine Abweichung kann auf falsche Implementierung, neue URL-Produktion, unklare interne Links oder eine abweichende Canonical-Auswahl hinweisen. Die SEO-Panda-Diät (https://marcdeboer.de/blog/panda-diaet/) beschreibt die bewusste Reduktion eines historisch gewachsenen Bestands. Ohne URL-Class-Policy und Lifecycle entsteht nach einer Bereinigung jedoch derselbe Drift erneut. ## Vom Projekt in den Betrieb Eine Indexierungsstrategie bleibt nur wirksam, wenn neue Seitentypen und Änderungen dieselben Entscheidungen durchlaufen. Das betrifft vor allem neue URL-generierende Features, Template-Umbauten, Facetten, Migrationen und Decommissioning. Für freigegebene Klassen sollten automatisierte Tests die vereinbarten Invarianten prüfen, etwa Status, Robots, Canonical, interne Einbindung und Sitemap-Zugehörigkeit. Reviews brauchen keinen künstlichen monatlichen Standard für jede URL-Klasse. Der passende Takt ergibt sich aus Änderungsfrequenz, Risiko und Evidence. Eine temporäre Kampagne benötigt eine konkrete Exit-Regel. Eine stabile redaktionelle Klasse kann über Releases, Stichproben und Abweichungsalarme kontrolliert werden. ## Primärquellen - Google: How Search Works (https://developers.google.com/search/docs/fundamentals/how-search-works) - Google: Robots Meta Tags (https://developers.google.com/search/docs/crawling-indexing/robots-meta-tag) - Google: Canonicalization (https://developers.google.com/search/docs/crawling-indexing/canonicalization) ## Interne Referenzen - Decision Matrix öffnen: https://marcdeboer.de/tools/indexation-decision-matrix/ - URL Policy verwenden: https://marcdeboer.de/blog/url-ownership-indexation-policy/ - SEO-Panda-Diät: https://marcdeboer.de/blog/panda-diaet/