SEO

Indexierung

Indexierung bezeichnet die Aufnahme einer URL in den Suchmaschinen-Index – also in die Datenbank, aus der Google seine Ergebnisse zusammenstellt. Erst indexierte Seiten können in den Suchergebnissen erscheinen. Gesteuert wird sie unter anderem über noindex, Canonical-Tags, Sitemaps und die Server-Antworten deiner Website.

Zuletzt aktualisiert:

■ FÜR MARKEN · SPONSORING

Marketing-Entscheider:innen treffen.

2.000+ B2B-Marketer auf der OMKI 2027 — plus laufende Reichweite über das Magazin und Directory. Vier Touchpoints, eine Audience.

Sponsoring-Pakete ansehen

Definition & Erklärung

Definition

Indexierung bezeichnet die Aufnahme einer URL in den Suchmaschinen-Index – also in die Datenbank, aus der Google seine Ergebnisse zusammenstellt. Erst indexierte Seiten können in den Suchergebnissen erscheinen. Gesteuert wird sie unter anderem über noindex, Canonical-Tags, Sitemaps und die Server-Antworten deiner Website.

Was ist Indexierung?

Indexierung ist der Schritt, bei dem eine Suchmaschine eine zuvor gecrawlte Seite verarbeitet, bewertet und in ihren Index aufnimmt – eine riesige, strukturierte Datenbank aller bekannten Inhalte. Nur was im Index liegt, kann überhaupt in den Suchergebnissen (SERPs) ranken. Ohne Indexierung nützt dir der beste Text nichts: Er ist für die organische Suche schlicht nicht vorhanden.

Wichtig ist die Abgrenzung zum Crawling: Crawling heißt, dass der Googlebot deine URL abruft und den Inhalt liest. Indexierung heißt, dass Google diesen Inhalt danach speichert und für Suchanfragen berücksichtigt. Gecrawlt zu werden ist die Voraussetzung – eine Garantie für die Aufnahme in den Index ist es nicht. Google entscheidet selbst, ob eine URL den Index-Platz wert ist.

Wie funktioniert die Indexierung bei Google?

Vereinfacht laufen mehrere Schritte hintereinander ab:

  1. Entdeckung: Google findet die URL über interne Links, externe Verlinkungen, eine XML-Sitemap oder bereits bekannte Adressen.
  2. Crawling: Der Googlebot ruft die URL ab, sofern die robots.txt das erlaubt und der Server sauber antwortet.
  3. Rendering: Die Seite wird ähnlich wie in einem Browser aufgebaut, damit auch per JavaScript nachgeladene Inhalte erfasst werden können.
  4. Verarbeitung & Kanonisierung: Google analysiert Inhalt, Sprache, strukturierte Daten und Duplikate und wählt bei mehreren ähnlichen URLs eine kanonische Version aus.
  5. Aufnahme in den Index: Der Inhalt wird gespeichert und steht für Suchanfragen bereit.

Auf jeder Stufe kann eine URL aussortiert werden – etwa weil sie blockiert ist, ein noindex trägt, als Dublette gilt oder inhaltlich zu dünn ist. In der Google Search Console siehst du das im Bericht zur Seitenindexierung mit Status wie „Gecrawlt – zurzeit nicht indexiert" oder „Alternative Seite mit richtigem kanonischen Tag".

Warum ist Indexierung wichtig für SEO?

Indexierung ist die Eintrittskarte in die organische Suche. Sie entscheidet nicht über deine Position, aber über deine Teilnahme. Drei Gründe, warum du sie aktiv steuern solltest:

  • Sichtbarkeit: Nicht indexierte Landingpages, Produktseiten oder Ratgeber erzeugen keinen organischen Traffic.
  • Qualität statt Masse: Wenn viele dünne, doppelte oder technische URLs im Index landen, verwässert das dein Gesamtbild. Sinnvoller ist ein Index-Bestand aus Seiten, die eine echte Suchintention bedienen.
  • Effizienz: Große Websites haben ein begrenztes Crawl-Budget. Wer Filter-, Sortier- und Session-URLs unkontrolliert wachsen lässt, lenkt Ressourcen weg von den wichtigen Seiten.

Wie steuerst du, was indexiert wird?

Für die Steuerung gibt es unterschiedliche Werkzeuge – sie wirken nicht gleich und lassen sich nicht beliebig kombinieren.

MittelWirkungTypischer Einsatz
robots.txt DisallowVerhindert das Crawling, nicht zwingend die IndexierungTechnische Verzeichnisse, Endlos-Parameter
noindex (Meta-Tag oder HTTP-Header)Verhindert die Aufnahme in den Index; Seite muss crawlbar seinInterne Suchergebnisse, Danke-Seiten, Test-Seiten
Canonical-TagHinweis auf die bevorzugte Version bei DuplikatenParameter-URLs, ähnliche Produktvarianten
XML-SitemapMeldet gewünschte URLs an, ohne GarantieNeue oder tief liegende Seiten
Statuscode 404 / 410Entfernt Inhalte mittelfristig aus dem IndexEndgültig gelöschte Seiten

Ein klassischer Konflikt: Eine per robots.txt gesperrte URL kann Google nicht abrufen – und sieht deshalb das noindex auf der Seite gar nicht. Willst du eine Seite zuverlässig aus dem Index halten, lass sie crawlbar und setze noindex.

Häufige Fehler und wie du sie prüfst

  • noindex aus der Staging-Umgebung beim Livegang vergessen zu entfernen – ein Grund für plötzlich verschwundene Seiten.
  • Widersprüchliche Signale: Canonical zeigt auf URL A, die Sitemap listet URL B, die interne Verlinkung führt zu URL C.
  • Thin Content und Duplikate: Seiten ohne eigenständigen Mehrwert werden häufiger gecrawlt als indexiert.
  • Schwache interne Verlinkung: Seiten, die von nirgendwo verlinkt sind, werden schlechter entdeckt.
  • Server- und Ladeprobleme: Häufige 5xx-Fehler oder sehr lange Antwortzeiten bremsen Crawling und Indexierung.

Für die Einzelfallprüfung nutzt du die URL-Prüfung in der Google Search Console: Sie zeigt, ob eine URL im Index ist, welche kanonische Version Google gewählt hat, wann zuletzt gecrawlt wurde und wie die gerenderte Seite aussieht. Über die Live-Prüfung kannst du zusätzlich eine Indexierung anfordern – das ist ein Anstoß, keine Zusage und kein Rankingvorteil.

Praktischer Ansatz: Definiere pro Seitentyp bewusst, ob er in den Index gehört, halte Canonical, Sitemap und interne Links widerspruchsfrei und kontrolliere den Index-Bestand regelmäßig statt nur beim Relaunch.

FAQ

Häufige Fragen zu Indexierung

Wie lange dauert es, bis eine neue Seite indexiert wird?

Das ist sehr unterschiedlich und reicht von wenigen Stunden bis zu mehreren Wochen. Entscheidend sind unter anderem, wie oft deine Website generell gecrawlt wird, wie gut die neue URL intern verlinkt ist und ob der Inhalt eigenständigen Mehrwert bietet. Eine feste Frist gibt es nicht.

Was bedeutet „Gecrawlt – zurzeit nicht indexiert" in der Search Console?

Google hat die URL abgerufen, sich aber gegen die Aufnahme in den Index entschieden. Häufige Ursachen sind dünner oder sehr ähnlicher Inhalt, schwache interne Verlinkung oder eine Seite, die keine klare Suchintention bedient. Der Status kann sich ändern, wenn du Inhalt und Verlinkung verbesserst.

Reicht ein Eintrag in der robots.txt, um eine Seite aus dem Index zu halten?

Nein. Die robots.txt verhindert das Crawling, nicht die Indexierung. Eine gesperrte URL kann trotzdem – meist ohne Snippet – in den Suchergebnissen auftauchen, wenn sie verlinkt ist. Zuverlässiger ist ein noindex, das Google nur sieht, wenn die Seite crawlbar bleibt.

Wie prüfe ich, ob meine Seite im Google-Index ist?

Am genauesten über die URL-Prüfung in der Google Search Console: Dort siehst du den Indexierungsstatus, die von Google gewählte kanonische URL und das letzte Crawl-Datum. Eine schnelle Näherung liefert eine site:-Abfrage in der Google-Suche, sie ist aber ungenauer.

Sollten alle Seiten meiner Website indexiert werden?

Nein. Interne Suchergebnisse, Warenkorb- und Danke-Seiten, Filterkombinationen oder Duplikate gehören in der Regel nicht in den Index. Sinnvoll ist ein Index-Bestand aus Seiten, die eine eigenständige Suchanfrage beantworten – der Rest wird per noindex oder Canonical gesteuert.

Verwandte Begriffe

Das könnte dich auch interessieren

SEO

Crawling

Crawling bezeichnet das automatisierte Durchsuchen des Webs durch Programme wie den Googlebot. Diese Crawler rufen URLs ab, folgen Links und geben die Inhalte zur Auswertung weiter. Crawling ist die Voraussetzung für die Indexierung – nur was gecrawlt werden kann, hat überhaupt die Chance, in Suchergebnissen zu erscheinen.

SEO

Noindex

Noindex ist eine Anweisung an Suchmaschinen, eine URL nicht in den Suchindex aufzunehmen. Sie wird meist über das Meta-Robots-Tag im HTML-Head oder den HTTP-Header X-Robots-Tag ausgeliefert. Die Seite darf dafür weiterhin gecrawlt werden – sonst wird die Anweisung nicht gelesen.

SEO

Google Search Console

Die Google Search Console ist ein kostenloses Tool von Google, mit dem du siehst, wie deine Website in der Google-Suche gefunden, gecrawlt und indexiert wird. Sie liefert Daten zu Klicks, Impressionen, Rankings, Indexierungsproblemen und technischen Fehlern – direkt aus Googles eigener Datenbasis.

SEO

XML-Sitemap

Eine XML-Sitemap ist eine maschinenlesbare Datei (meist sitemap.xml), in der du Suchmaschinen die URLs deiner Website auflistest – ergänzt um Angaben wie das letzte Änderungsdatum (lastmod). Sie hilft Crawlern, Seiten zu finden, ersetzt aber keine gute interne Verlinkung.

SEO

robots.txt

robots.txt ist eine Textdatei im Wurzelverzeichnis einer Domain, die Crawlern per Robots Exclusion Protocol mitteilt, welche URL-Pfade sie abrufen dürfen und welche nicht. Sie steuert das Crawling, nicht die Indexierung – und wirkt nur bei Crawlern, die sich freiwillig an die Vorgaben halten.

SEO

Crawl Budget

Crawl Budget bezeichnet die Menge an URLs, die eine Suchmaschine auf einer Website in einem bestimmten Zeitraum abruft. Es ergibt sich aus der Crawl-Kapazität (was der Server und Google an Last zulassen) und dem Crawl-Bedarf (wie interessant und aktuell die URLs sind).

Expertise

Speaker:innen zu diesem Thema

Speaker:innen aus dem OMKI-Netzwerk mit diesem Themenschwerpunkt:

MT Mario Traeger

Mario Traeger

Webworks Agentur

Schwerpunkt: Technisches SEO-Monitoring
Alle Speaker:innen im Verzeichnis

Finde die besten Tools für
SEO

Entdecke Software-Bewertungen und Vergleiche für SEO-Tools in unserem umfangreichen Verzeichnis.