Noindex

Noindex ist eine Anweisung an Suchmaschinen, eine Seite nicht in den Index aufzunehmen. Sie steht entweder als Meta-Angabe im Kopfbereich der Seite oder als X-Robots-Tag im HTTP-Header und wird von allen großen Suchmaschinen befolgt.

Die Anweisung ist eindeutig und wirkt zuverlässig — anders als viele andere Signale, die eine Suchmaschine nur als Hinweis behandelt. Genau deshalb ist sie auch das schärfste Werkzeug im Bestand: Eine versehentlich gesetzte Angabe entfernt eine Seite vollständig aus den Ergebnissen.

Der Fehler, der immer wieder passiert

Noindex und ein Ausschluss in der robots.txt schließen einander aus. Wer beides gleichzeitig setzt, erreicht das Gegenteil des Gewünschten: Die gesperrte Seite wird nicht abgerufen, die Anweisung im Quelltext also nie gelesen — und die Seite kann trotzdem in den Ergebnissen erscheinen, dann ohne Beschreibung.

Die Regel lautet deshalb: Wer eine Seite aus dem Index halten will, muss den Zugriff erlauben. Erst wenn die Seite dauerhaft nicht mehr indexiert ist, kann ein zusätzlicher Ausschluss sinnvoll werden — meist ist er dann überflüssig.

Wann Noindex richtig ist

  • Interne Suchergebnisseiten. Sie erzeugen beliebig viele Adressen mit zusammengesetztem Inhalt.
  • Dankeseiten und Bestätigungen. Ohne eigenen Wert und oft mit personenbezogenen Parametern in der Adresse.
  • Filter- und Sortiervarianten, sofern kein Canonical Tag die passendere Lösung ist.
  • Leere oder sehr dünne Übersichten wie Kategorien ohne Beiträge.
  • Testumgebungen — hier ist zusätzlich ein Passwortschutz angebracht, weil eine Anweisung allein nichts vor Zugriffen schützt.

Noindex oder Canonical?

Beide Anweisungen lösen unterschiedliche Probleme und werden regelmäßig verwechselt. Noindex sagt: Diese Seite gehört nicht in den Index. Ein Canonical Tag sagt: Diese Seite ist eine Variante einer anderen; bewerte die andere.

Bei mehreren fast gleichen Adressen desselben Inhalts ist der Canonical die richtige Wahl, weil Signale zusammengeführt statt verworfen werden. Bei Seiten ohne eigenständigen Wert ist Noindex richtig. Beides gleichzeitig auf derselben Seite ist widersprüchlich.

Nachwirkung

Die Anweisung wirkt erst, wenn die Seite erneut abgerufen wurde. Je nach Erfassungshäufigkeit vergehen Tage bis Wochen. Wer schneller aus dem Index will, kombiniert sie mit der Entfernungsfunktion der Search Console — die allerdings nur befristet ausblendet und die eigentliche Anweisung nicht ersetzt. Dauerhaft entfernt wird eine Seite über die Serverantwort, wie unter Deindexierung beschrieben.

Wichtig ist außerdem: Eine Seite mit Noindex wird weiterhin abgerufen und ihre Verweise werden weiterhin verfolgt. Sie verbraucht also weiterhin Crawl-Budget. Wer viele solcher Seiten hat, sollte prüfen, ob sie überhaupt existieren müssen.

Setzen, prüfen, dokumentieren

Technisch gibt es zwei gleichwertige Wege. Die Meta-Angabe im Kopfbereich der Seite ist die verbreitete; der X-Robots-Tag im HTTP-Header ist die mächtigere, weil er auch für Dateien ohne HTML gilt — PDF-Dokumente, Bilder, Downloads. Die technischen Einzelheiten beider Verfahren beschreibt Google in der Dokumentation zum Ausschluss von der Indexierung.

Der Header wird bei Fehlersuchen regelmäßig übersehen, weil er im Quelltext nicht sichtbar ist. Wer nicht erklären kann, warum eine Seite aus dem Index verschwunden ist, sollte ihn als Erstes prüfen — eine Serverkonfiguration oder eine Erweiterung kann ihn gesetzt haben, ohne dass es jemand beabsichtigt hätte.

Sinnvoll ist außerdem, festzuhalten, welche Bereiche bewusst ausgeschlossen sind und warum. Nach einem Jahr weiß sonst niemand mehr, ob eine Angabe eine Entscheidung war oder ein Überbleibsel — und im Zweifel wird sie stehen gelassen.

Häufige Fragen

Wie prüft man, ob Noindex gesetzt ist?

Über die URL-Prüfung der Search Console, die die Anweisung ausdrücklich ausweist, oder durch einen Blick in den Quelltext und die HTTP-Header. Der Header wird dabei häufig übersehen — eine Anweisung dort wirkt genauso, ist aber im Quelltext nicht sichtbar.

Verliert eine Seite mit Noindex ihre Linkkraft?

Verweise auf ihr werden weiterhin verfolgt, solange die Seite erreichbar ist. Über längere Zeit behandelt Google eine dauerhaft nicht indexierte Seite jedoch zunehmend nachrangig. Als Mittel zur Steuerung interner Verlinkung ist Noindex deshalb ungeeignet.

Sollten Seiten mit Noindex in der Sitemap stehen?

Nein. Die Sitemap meldet Adressen, die indexiert werden sollen. Ein Widerspruch zwischen beidem erzeugt in der Search Console Meldungen, die echte Probleme überdecken.

Gilt Noindex auch für KI-Systeme?

Nicht zwangsläufig. Die Anweisung richtet sich an Suchmaschinenindizes. Ob ein KI-System sie berücksichtigt, hängt vom Anbieter ab; wer den Zugriff durch AI Crawler regeln will, muss diese eigens benennen.

Verwandte Begriffe