Neu: PultOS — Ihr Unternehmen auf einem Bildschirm • 71 fertige Integrationen • Server in Deutschland

Was ist noindex?

noindex hält eine Seite aus dem Google-Index. Wie Meta-Tag und X-Robots-Tag wirken, was sie von robots.txt unterscheidet und welche Seiten raus sollten.

· Aktualisiert:

Technisches SEOVom Crawler bis zum Suchergebnis
  1. Crawlen
  2. Rendern
  3. Indexierennoindex
  4. Ranken
  5. Anzeigen
Einordnung: noindex gehört zum Schritt „Indexieren“. Schema zur Einordnung, keine Messwerte.
Inhaltsverzeichnis

noindex ist eine Anweisung an Suchmaschinen, eine bestimmte Seite nicht in den Suchindex aufzunehmen. Sie ist damit das Gegenstück zur Indexierung. Die Seite bleibt für Besucher erreichbar, erscheint aber nicht in den Suchergebnissen.

Die Anweisung steht entweder als Meta-Tag im Quelltext der Seite oder als HTTP-Header in der Serverantwort. Damit sie wirkt, muss der Crawler die Seite abrufen dürfen — an diesem Punkt entstehen die meisten Fehler.

So funktioniert noindex

Ein Crawler ruft die Seite ab, liest die Anweisung und verzichtet auf die Aufnahme in den Index. Ist die Seite bereits indexiert, fällt sie beim nächsten Abruf heraus. Wie schnell das geht, hängt davon ab, wie oft Google die Adresse besucht — bei wichtigen Seiten sind es Tage, bei selten besuchten Wochen.

Es gibt zwei Wege, die Anweisung zu setzen:

  • Meta-Robots-Tag im <head> der Seite: <meta name="robots" content="noindex">. Das ist der übliche Weg für HTML-Seiten und in den meisten Redaktionssystemen per Häkchen einstellbar. Welche weiteren Angaben im Kopf einer Seite stehen, erklärt der Artikel zu Meta-Tags.
  • X-Robots-Tag im HTTP-Header: X-Robots-Tag: noindex. Er funktioniert auch für Dateien ohne HTML-Kopf, etwa PDFs, Bilder oder Downloads, und lässt sich auf Serverebene für ganze Verzeichnisse setzen.

Soll nur ein bestimmter Crawler angesprochen werden, ersetzt man robots durch dessen Namen, zum Beispiel googlebot.

noindex und robots.txt: der entscheidende Unterschied

Beide Werkzeuge werden oft verwechselt, dabei steuern sie verschiedene Schritte. Die robots.txt regelt den Abruf, noindex die Aufnahme in den Index.

robots.txt (Disallow)noindex
Wirkt aufden Abruf durch den Crawlerdie Aufnahme in den Index
Seite erscheint in der Suche?möglich, wenn andere darauf verlinken — dann ohne Beschreibungnein, sobald Google die Anweisung gelesen hat
Spart Crawl-Aufrufe?janein, die Seite muss abgerufen werden
Geeignet fürBereiche ohne Suchwert: Verwaltung, Filter, interne SucheSeiten, die nicht in den Ergebnissen erscheinen sollen

Der klassische Fehler: Eine Seite wird in der robots.txt gesperrt und mit noindex versehen. Der Crawler darf die Seite nicht abrufen, liest das noindex also nie, und die Seite bleibt im Index. Die richtige Reihenfolge ist: noindex setzen, Abruf erlauben, warten, bis die Seite aus dem Index verschwunden ist, und erst danach — falls überhaupt nötig — sperren. Eine noindex-Zeile in der robots.txt selbst wertet Google seit 2019 nicht mehr aus.

noindex, nofollow und follow

Häufig steht noindex zusammen mit einer zweiten Angabe:

  • noindex, follow — Seite nicht indexieren, den Links darauf aber folgen. Das war lange die Standardempfehlung für Übersichtsseiten. Google hat allerdings erklärt, dass Seiten, die dauerhaft auf noindex stehen, mit der Zeit seltener abgerufen werden und ihre Links dann kaum noch Wirkung haben.
  • noindex, nofollow — weder indexieren noch den Links folgen. Sinnvoll für Seiten, deren Links nirgendwohin führen sollen, etwa interne Testseiten.

Da index und follow ohnehin der Normalfall sind, muss man sie nicht ausdrücklich angeben.

Welche Seiten auf noindex gehören

  • Danke-Seiten nach einem Formular oder einer Bestellung
  • interne Suchergebnisseiten
  • Warenkorb, Kundenkonto, Anmeldeseiten
  • Test- und Vorschauumgebungen (zusätzlich mit Passwortschutz)
  • Seiten mit sehr dünnem Inhalt, die für Besucher nützlich sind, in der Suche aber nichts beitragen, etwa automatisch erzeugte Schlagwortseiten

Nicht auf noindex gehören Impressum und Datenschutzerklärung — sie schaden nicht und werden gesucht. Auch doppelte Varianten einer Seite löst man besser mit einem Canonical-Tag, weil dann die Signale der Varianten auf die Hauptseite gebündelt werden.

Typische Fehler aus der Praxis

  • noindex aus der Testumgebung geht mit live. Die neue Website ist fertig, die Vorschau war zu Recht gesperrt, und beim Umzug wandert die Einstellung mit. Innerhalb weniger Wochen verschwindet die ganze Website aus Google. Das ist der teuerste Einzelfehler bei einem Relaunch und lässt sich in einer Minute prüfen — er steht deshalb auch in unserer Website-Relaunch-Checkliste.
  • Häkchen im Redaktionssystem. In WordPress etwa gibt es die Option „Suchmaschinen davon abhalten, diese Website zu indexieren“. Einmal gesetzt, wird sie leicht vergessen.
  • Widersprüchliche Signale. Eine Seite trägt noindex und gleichzeitig einen Canonical auf eine andere Seite oder steht in der Sitemap. Google muss raten, was gemeint ist.
  • noindex per JavaScript. Wird die Anweisung erst nachträglich per Skript eingefügt oder entfernt, erkennt Google das womöglich zu spät oder gar nicht.

noindex prüfen

In der Google Search Console zeigt der Bericht „Seiten“ unter „Durch ‚noindex‘-Tag ausgeschlossen“ alle betroffenen Adressen. Die URL-Prüfung verrät für eine einzelne Seite, ob Google ein noindex gefunden hat. Den HTTP-Header sehen Sie in den Entwicklerwerkzeugen des Browsers, wenn Sie die Anfrage der Seite anklicken und die Antwort-Header öffnen. Ein Blick in diese Liste nach jeder größeren Änderung an der Website erspart böse Überraschungen.

In der Praxis: Was SEODACH übernimmt

Wenn Firmen uns fragen, warum wichtige Seiten plötzlich nicht mehr bei Google auftauchen, ist ein falsch gesetztes noindex eine der ersten Ursachen, die wir ausschließen. Wir gleichen Indexierungsbericht, Quelltext, Header und Sitemap ab und sorgen dafür, dass jede Seite ein eindeutiges Signal sendet: Leistungsseiten stehen im Index, Danke-Seiten und Kundenbereiche nicht. Das ist Teil unserer Suchmaschinenoptimierung und bei jedem Relaunch, den wir begleiten, ein fester Prüfschritt vor dem Livegang.

Häufige Fragen

Wie lange dauert es, bis eine Seite mit noindex aus Google verschwindet?

Bis Google die Seite das nächste Mal abruft. Das kann ein paar Tage oder mehrere Wochen dauern. Eilige Fälle beschleunigen Sie mit dem Tool „Entfernen“ in der Search Console, das die Seite vorübergehend ausblendet.

Schadet noindex dem Ranking der übrigen Website?

Nein. noindex betrifft nur die Seite, auf der es steht. Gezielt eingesetzt, hilft es sogar, weil in den Ergebnissen nur die Seiten auftauchen, die Besuchern wirklich etwas bieten.

Kann ich PDFs auf noindex setzen?

Ja, über den HTTP-Header X-Robots-Tag: noindex. Ein Meta-Tag ist bei PDFs nicht möglich, weil sie keinen HTML-Kopf haben.

Brauchen Sie Unterstützung?

Unsere Experten helfen Ihnen, die richtigen SEO- und Digitalstrategien für Ihr Unternehmen umzusetzen.

Erstgespräch vereinbaren
Schreiben Sie uns per WhatsApp