Was ist noindex?
noindex hält eine Seite aus dem Google-Index. Wie Meta-Tag und X-Robots-Tag wirken, was sie von robots.txt unterscheidet und welche Seiten raus sollten.
Oleksandr Grygoriev · Aktualisiert:
- Crawlen
- Rendern
- Indexierennoindex
- Ranken
- Anzeigen
Inhaltsverzeichnis
noindex ist eine Anweisung an Suchmaschinen, eine bestimmte Seite nicht in den Suchindex aufzunehmen. Sie ist damit das Gegenstück zur Indexierung. Die Seite bleibt für Besucher erreichbar, erscheint aber nicht in den Suchergebnissen.
Die Anweisung steht entweder als Meta-Tag im Quelltext der Seite oder als HTTP-Header in der Serverantwort. Damit sie wirkt, muss der Crawler die Seite abrufen dürfen — an diesem Punkt entstehen die meisten Fehler.
So funktioniert noindex
Ein Crawler ruft die Seite ab, liest die Anweisung und verzichtet auf die Aufnahme in den Index. Ist die Seite bereits indexiert, fällt sie beim nächsten Abruf heraus. Wie schnell das geht, hängt davon ab, wie oft Google die Adresse besucht — bei wichtigen Seiten sind es Tage, bei selten besuchten Wochen.
Es gibt zwei Wege, die Anweisung zu setzen:
- Meta-Robots-Tag im
<head>der Seite:<meta name="robots" content="noindex">. Das ist der übliche Weg für HTML-Seiten und in den meisten Redaktionssystemen per Häkchen einstellbar. Welche weiteren Angaben im Kopf einer Seite stehen, erklärt der Artikel zu Meta-Tags. - X-Robots-Tag im HTTP-Header:
X-Robots-Tag: noindex. Er funktioniert auch für Dateien ohne HTML-Kopf, etwa PDFs, Bilder oder Downloads, und lässt sich auf Serverebene für ganze Verzeichnisse setzen.
Soll nur ein bestimmter Crawler angesprochen werden, ersetzt man robots durch dessen Namen, zum Beispiel googlebot.
noindex und robots.txt: der entscheidende Unterschied
Beide Werkzeuge werden oft verwechselt, dabei steuern sie verschiedene Schritte. Die robots.txt regelt den Abruf, noindex die Aufnahme in den Index.
| robots.txt (Disallow) | noindex | |
|---|---|---|
| Wirkt auf | den Abruf durch den Crawler | die Aufnahme in den Index |
| Seite erscheint in der Suche? | möglich, wenn andere darauf verlinken — dann ohne Beschreibung | nein, sobald Google die Anweisung gelesen hat |
| Spart Crawl-Aufrufe? | ja | nein, die Seite muss abgerufen werden |
| Geeignet für | Bereiche ohne Suchwert: Verwaltung, Filter, interne Suche | Seiten, die nicht in den Ergebnissen erscheinen sollen |
Der klassische Fehler: Eine Seite wird in der robots.txt gesperrt und mit noindex versehen. Der Crawler darf die Seite nicht abrufen, liest das noindex also nie, und die Seite bleibt im Index. Die richtige Reihenfolge ist: noindex setzen, Abruf erlauben, warten, bis die Seite aus dem Index verschwunden ist, und erst danach — falls überhaupt nötig — sperren. Eine noindex-Zeile in der robots.txt selbst wertet Google seit 2019 nicht mehr aus.
noindex, nofollow und follow
Häufig steht noindex zusammen mit einer zweiten Angabe:
noindex, follow— Seite nicht indexieren, den Links darauf aber folgen. Das war lange die Standardempfehlung für Übersichtsseiten. Google hat allerdings erklärt, dass Seiten, die dauerhaft auf noindex stehen, mit der Zeit seltener abgerufen werden und ihre Links dann kaum noch Wirkung haben.noindex, nofollow— weder indexieren noch den Links folgen. Sinnvoll für Seiten, deren Links nirgendwohin führen sollen, etwa interne Testseiten.
Da index und follow ohnehin der Normalfall sind, muss man sie nicht ausdrücklich angeben.
Welche Seiten auf noindex gehören
- Danke-Seiten nach einem Formular oder einer Bestellung
- interne Suchergebnisseiten
- Warenkorb, Kundenkonto, Anmeldeseiten
- Test- und Vorschauumgebungen (zusätzlich mit Passwortschutz)
- Seiten mit sehr dünnem Inhalt, die für Besucher nützlich sind, in der Suche aber nichts beitragen, etwa automatisch erzeugte Schlagwortseiten
Nicht auf noindex gehören Impressum und Datenschutzerklärung — sie schaden nicht und werden gesucht. Auch doppelte Varianten einer Seite löst man besser mit einem Canonical-Tag, weil dann die Signale der Varianten auf die Hauptseite gebündelt werden.
Typische Fehler aus der Praxis
- noindex aus der Testumgebung geht mit live. Die neue Website ist fertig, die Vorschau war zu Recht gesperrt, und beim Umzug wandert die Einstellung mit. Innerhalb weniger Wochen verschwindet die ganze Website aus Google. Das ist der teuerste Einzelfehler bei einem Relaunch und lässt sich in einer Minute prüfen — er steht deshalb auch in unserer Website-Relaunch-Checkliste.
- Häkchen im Redaktionssystem. In WordPress etwa gibt es die Option „Suchmaschinen davon abhalten, diese Website zu indexieren“. Einmal gesetzt, wird sie leicht vergessen.
- Widersprüchliche Signale. Eine Seite trägt noindex und gleichzeitig einen Canonical auf eine andere Seite oder steht in der Sitemap. Google muss raten, was gemeint ist.
- noindex per JavaScript. Wird die Anweisung erst nachträglich per Skript eingefügt oder entfernt, erkennt Google das womöglich zu spät oder gar nicht.
noindex prüfen
In der Google Search Console zeigt der Bericht „Seiten“ unter „Durch ‚noindex‘-Tag ausgeschlossen“ alle betroffenen Adressen. Die URL-Prüfung verrät für eine einzelne Seite, ob Google ein noindex gefunden hat. Den HTTP-Header sehen Sie in den Entwicklerwerkzeugen des Browsers, wenn Sie die Anfrage der Seite anklicken und die Antwort-Header öffnen. Ein Blick in diese Liste nach jeder größeren Änderung an der Website erspart böse Überraschungen.
In der Praxis: Was SEODACH übernimmt
Wenn Firmen uns fragen, warum wichtige Seiten plötzlich nicht mehr bei Google auftauchen, ist ein falsch gesetztes noindex eine der ersten Ursachen, die wir ausschließen. Wir gleichen Indexierungsbericht, Quelltext, Header und Sitemap ab und sorgen dafür, dass jede Seite ein eindeutiges Signal sendet: Leistungsseiten stehen im Index, Danke-Seiten und Kundenbereiche nicht. Das ist Teil unserer Suchmaschinenoptimierung und bei jedem Relaunch, den wir begleiten, ein fester Prüfschritt vor dem Livegang.
Häufige Fragen
Wie lange dauert es, bis eine Seite mit noindex aus Google verschwindet?
Bis Google die Seite das nächste Mal abruft. Das kann ein paar Tage oder mehrere Wochen dauern. Eilige Fälle beschleunigen Sie mit dem Tool „Entfernen“ in der Search Console, das die Seite vorübergehend ausblendet.
Schadet noindex dem Ranking der übrigen Website?
Nein. noindex betrifft nur die Seite, auf der es steht. Gezielt eingesetzt, hilft es sogar, weil in den Ergebnissen nur die Seiten auftauchen, die Besuchern wirklich etwas bieten.
Kann ich PDFs auf noindex setzen?
Ja, über den HTTP-Header X-Robots-Tag: noindex. Ein Meta-Tag ist bei PDFs nicht möglich, weil sie keinen HTML-Kopf haben.
Brauchen Sie Unterstützung?
Unsere Experten helfen Ihnen, die richtigen SEO- und Digitalstrategien für Ihr Unternehmen umzusetzen.
Erstgespräch vereinbarenWeitere Artikel im Wiki-Lexikon
Was ist das Crawl-Budget?
Das Crawl-Budget ist die Zahl der Seiten, die Google in einem Zeitraum abruft. Wann es zählt, was es verschwendet und wie Sie es optimieren.
Begriff öffnenWas ist hreflang?
hreflang zeigt Google, welche Sprachversion einer Seite für welches Land gilt. Syntax, x-default und typische Fehler mehrsprachiger Websites erklärt.
Begriff öffnenWas ist Indexierung bei Google?
Wie Google Seiten indexiert, was „Gecrawlt – zurzeit nicht indexiert“ bedeutet und wie Sie die Indexierung Ihrer Website prüfen und verbessern.
Begriff öffnenWas ist Robots.txt?
Die robots.txt steuert, was Crawler lesen dürfen. Syntax, fertige Beispiele für gängige Systeme, typische Fehler, Unterschied zu noindex und KI-Crawler.
Begriff öffnen