SEO-Manager Glossar

X‑robots-tag einfach und verständlich erklärt – SEO Bedeutung

Das X-Robots-Tag steuert die Indexierung – aber im Gegensatz zum Meta-Robots-Tag funktioniert es für jede Datei, auch für PDFs, Bilder und Videos. Dieser Leitfaden erklärt verständlich, was das X-Robots-Tag ist, wie es sich von Meta Robots und robots.txt unterscheidet, wann man es einsetzt, welche Direktiven es gibt, wie man es in Apache und Nginx korrekt implementiert (mit kopierfähigem Code) und welche Fehler man vermeiden sollte.

X-Robots-Tag auf einen Blick

HTTP-Header
wirkt serverseitig, nicht im HTML
PDF · Bild · Video
auch für Nicht-HTML-Dateien
noindex & Co.
dieselben Direktiven wie Meta Robots
Apache · Nginx
per Serverkonfiguration gesetzt

Was ist das X-Robots-Tag?

Das X-Robots-Tag ist ein HTTP-Response-Header, der Suchmaschinen mitteilt, wie sie eine URL indexieren und ausliefern sollen. Es trägt dieselben Direktiven wie das Meta-Robots-Tag – etwa noindex oder nofollow –, funktioniert aber für jede Ressource und nicht nur für HTML-Seiten.

Statt im HTML-Quelltext steht das X-Robots-Tag im Kopf der Server-Antwort. Ruft ein Crawler eine Datei ab, liest er die Anweisung direkt aus dem HTTP-Header:

Crawler (Googlebot & Co.) Webserver Apache / Nginx 1. ruft Datei ab (z. B. PDF) 2. HTTP-Antwort mit Header HTTP/1.1 200 OK X-Robots-Tag: noindex, nofollow

Abb. 1: Das X-Robots-Tag reist im HTTP-Header mit – der Crawler liest die Anweisung beim Abruf der Datei.

Genau hier liegt der Vorteil: Weil die Anweisung serverseitig gesetzt wird, lässt sie sich auch Dateien mitgeben, die gar keinen HTML-Head haben – wie PDFs, Bildern oder Videos.

X-Robots-Tag vs. Meta Robots vs. robots.txt

Drei Werkzeuge steuern Crawling und Indexierung – und werden ständig verwechselt. Der entscheidende Unterschied: Die robots.txt steuert das Crawling, die beiden Robots-Tags steuern die Indexierung.

robots.txt steuert das CRAWLING darf der Crawler die Datei abrufen? eine Datei im Root, ganze Verzeichnisse blockt Crawling, nicht Index Meta Robots steuert die INDEXIERUNG im HTML-Head einer Seite nur HTML-Seiten, seitenspezifisch eine Seite nach der anderen X-Robots-Tag steuert die INDEXIERUNG im HTTP-Header jeder Datei alle Dateitypen, auch global PDF, Bild, Video, HTML

Abb. 2: robots.txt regelt den Zugang, die beiden Robots-Tags die Indexierung – das X-Robots-Tag dabei für jede Datei.

Crawling ist nicht Indexierung

Eine per robots.txt gesperrte Seite kann trotzdem im Index landen (etwa über externe Links) – nur eben ohne Snippet. Wer eine Seite sicher aus dem Index halten will, braucht noindex, also Meta Robots oder das X-Robots-Tag – nicht die robots.txt.

Wann sollte man es verwenden?

Das Meta-Robots-Tag reicht für normale HTML-Seiten völlig aus. Zum X-Robots-Tag greift man in zwei Situationen:

Fall 1

Nicht-HTML-Dateien

PDFs, Bilder, Videos und andere Dateien haben keinen HTML-Head, in den ein Meta-Tag passt. Hier ist das X-Robots-Tag der einzige Weg, etwa um ein PDF auf noindex zu setzen.

Fall 2

Globale Steuerung

Wenn Sie Regeln für viele Dateien oder ganze Dateitypen auf einmal setzen wollen, ohne jede Seite einzeln zu bearbeiten – das spart bei großen Websites enorm viel Arbeit.

Wichtig: noindex gibt es in der robots.txt nicht

Google unterstützt die noindex-Anweisung in der robots.txt seit September 2019 nicht mehr. Um eine PDF-Datei zuverlässig aus dem Index zu halten, führt deshalb kein Weg am X-Robots-Tag vorbei – es ist der Standardweg zum Deindexieren von Nicht-HTML-Dateien.

Die wichtigsten Direktiven

Das X-Robots-Tag kennt dieselben Direktiven wie das Meta-Robots-Tag. Einige werden von allen großen Suchmaschinen unterstützt, andere nur von Google:

DirektiveWirkungSupport
noindexSeite/Datei nicht in den Suchergebnissen anzeigenuniversell
nofollowden Links auf der Seite nicht folgenuniversell
noneKurzform für noindex, nofollowuniversell
noarchivekeine zwischengespeicherte Version anzeigenuniversell
nosnippetkein Text-Snippet in den Ergebnissen zeigenuniversell
max-snippet:[n]Snippet auf n Zeichen begrenzen (0 = keins, -1 = frei)nur Google
max-image-preview:[s]Größe der Bildvorschau (none/standard/large)nur Google
max-video-preview:[n]Länge der Videovorschau in Sekundennur Google
noimageindexBilder der Seite nicht indexierennur Google
notranslatekeine Übersetzung in den Ergebnissen anbietennur Google
unavailable_afterSeite nach einem Datum nicht mehr anzeigennur Google

Bei Widerspruch gewinnt die strengere Regel

Stehen sich Direktiven im Weg, gilt immer die restriktivere. Treffen nosnippet und max-snippet:50 aufeinander, gewinnt nosnippet. Und noindex schlägt immer index.

Implementierung in Apache und Nginx

Das X-Robots-Tag wird in der Server-Konfiguration gesetzt. Wichtig: Im Code müssen gerade Anführungszeichen stehen ("), keine typografischen – sonst funktioniert die Konfiguration nicht.

Apache (.htaccess oder httpd.conf)

Bei Apache muss das Modul mod_headers aktiv sein. Mit einem Files– oder FilesMatch-Block weist man bestimmten Dateitypen einen Header zu. Alle PDF-Dateien auf noindex setzen:

# alle PDF-Dateien nicht indexieren
<FilesMatch "\.pdf$">
  Header set X-Robots-Tag "noindex, nofollow"
</FilesMatch>

Beispiel für Bilddateien

<FilesMatch "\.(png|jpe?g|gif)$">
  Header set X-Robots-Tag "noindex"
</FilesMatch>

Nginx (.conf)

Bei Nginx setzt man den Header in einem location-Block der Server-Konfiguration:

# alle PDF-Dateien nicht indexieren
location ~* "\.pdf$" {
  add_header X-Robots-Tag "noindex, nofollow";
}

Einzelne Crawler ansprechen

Optional lässt sich ein User-Agent vor die Regeln setzen. Regeln ohne User-Agent gelten für alle Crawler; Groß- und Kleinschreibung spielt keine Rolle:

HTTP/1.1 200 OK
X-Robots-Tag: googlebot: noindex
X-Robots-Tag: bingbot: noarchive

Prüfen und häufige Fehler

Ob ein X-Robots-Tag greift, sehen Sie in den Entwicklertools des Browsers: F12 drücken, in den Tab „Netzwerk“ / „Network“ wechseln, die Seite neu laden, die Hauptdatei anklicken und unter „Response Headers“ nach dem Eintrag suchen. Auch die Google Search Console zeigt mit dem URL-Prüf-Tool, warum eine Seite nicht indexiert wird.

Der mit Abstand häufigste Fehler: Die Seite ist per robots.txt gesperrt – und der Crawler sieht das noindex deshalb nie.

Crawler will abrufen robots.txt Disallow blockt den Abruf Seite mit noindex wird nie gelesen → bleibt indexierbar Regel: erst crawlen lassen, dann per noindex deindexieren – nie beides blocken.

Abb. 3: noindex wirkt nur, wenn der Crawler die Seite auch abrufen darf – sonst bleibt sie im Index.

Weitere typische Stolperfallen:

  • mod_headers fehlt: Ohne das aktive Apache-Modul greift kein Header set.
  • Meta Robots und X-Robots-Tag auf derselben Datei: Beides gleichzeitig erzeugt leicht Widersprüche. Faustregel: Meta Robots für HTML-Seiten, X-Robots-Tag für Dateien.
  • noindex zusammen mit Canonical: Ein Canonical sagt „indexiere die andere Version“, noindex sagt „indexiere gar nicht“ – widersprüchliche Signale, die man vermeiden sollte.
  • Typografische Anführungszeichen im Code: Nur gerade ASCII-Quotes funktionieren in der Konfiguration.

X-Robots-Tag 2026: Snippets und KI

Mit dem Aufkommen der KI-Suche bekommen einige Direktiven neue Bedeutung. Die Snippet-Steuerung über nosnippet, max-snippet und das HTML-Attribut data-nosnippet beeinflusst nicht nur klassische Snippets, sondern auch, welche Inhalte Google für Featured Snippets und KI-Übersichten (AI Overviews) heranzieht.

data-nosnippet für feine Kontrolle

Für einzelne Abschnitte statt ganzer Seiten gibt es das Attribut data-nosnippet, das man auf <span>, <div> oder <section> setzt. So lässt sich gezielt verhindern, dass ein bestimmter Textteil als Snippet erscheint – nützlich etwa für Preise oder interne Hinweise.

Ein ehrliches Wort zur Einordnung: Wer in den klassischen Ergebnissen und in KI-Antworten sichtbar sein will, sollte mit Snippet-Sperren sparsam umgehen. Das X-Robots-Tag ist dafür da, gezielt das Richtige aus dem Index herauszuhalten – nicht, um wertvolle Seiten versehentlich unsichtbar zu machen. Die Technik bleibt dieselbe; nur die strategische Frage, was man sperrt, wird in der KI-Suche wichtiger.

Fazit

Das X-Robots-Tag ist der serverseitige Hebel zur Indexierungssteuerung: ein HTTP-Header mit denselben Direktiven wie das Meta-Robots-Tag, aber für jede Datei – auch PDFs, Bilder und Videos. Es ist der Standardweg, um Nicht-HTML-Dateien per noindex aus dem Index zu halten, denn die robots.txt kann das nicht. Wichtig ist, die drei Werkzeuge sauber zu trennen, im Code gerade Anführungszeichen zu verwenden und nie eine Seite gleichzeitig zu sperren und auf noindex zu setzen. Richtig eingesetzt, gibt es Ihnen die präzise Kontrolle, die Meta-Tags allein nicht bieten.

Häufige Fragen zum X-Robots-Tag

Was ist das X-Robots-Tag einfach erklärt?

Das X-Robots-Tag ist ein HTTP-Response-Header, der Suchmaschinen mitteilt, wie sie eine URL indexieren und ausliefern sollen. Es trägt dieselben Direktiven wie das Meta-Robots-Tag, etwa noindex oder nofollow, funktioniert aber für jede Datei und nicht nur für HTML-Seiten. Damit lassen sich auch PDFs, Bilder oder Videos steuern, die keinen HTML-Head haben. Gesetzt wird es serverseitig in der Konfiguration von Apache oder Nginx.

Was ist der Unterschied zwischen X-Robots-Tag und Meta Robots Tag?

Beide steuern die Indexierung mit denselben Direktiven, sitzen aber an unterschiedlichen Stellen. Das Meta-Robots-Tag steht im HTML-Head einer Seite und funktioniert nur für HTML-Seiten. Das X-Robots-Tag steht im HTTP-Header und funktioniert für jeden Dateityp, auch für PDFs, Bilder und Videos, und ermöglicht eine globale Steuerung über die Serverkonfiguration. Faustregel: Meta Robots für HTML-Seiten, X-Robots-Tag für Dateien.

Was ist der Unterschied zwischen X-Robots-Tag und robots.txt?

Die robots.txt steuert das Crawling, also ob ein Crawler eine Datei überhaupt abrufen darf. Das X-Robots-Tag steuert die Indexierung, also ob eine abgerufene Datei in den Suchergebnissen erscheint. Wichtig: Eine per robots.txt gesperrte Seite kann trotzdem im Index landen, nur eben ohne Snippet. Wer eine Seite sicher aus dem Index halten will, braucht noindex per X-Robots-Tag oder Meta Robots, nicht die robots.txt.

Wann sollte ich das X-Robots-Tag verwenden?

In zwei Fällen. Erstens für Nicht-HTML-Dateien wie PDFs, Bilder oder Videos, denen man kein Meta-Tag mitgeben kann. Zweitens für die globale Steuerung, wenn Sie Indexierungsregeln für viele Dateien oder ganze Dateitypen auf einmal setzen wollen, ohne jede Seite einzeln zu bearbeiten. Für normale einzelne HTML-Seiten reicht dagegen das Meta-Robots-Tag völlig aus.

Welche Direktiven gibt es beim X-Robots-Tag?

Universell von Google, Bing und Yandex unterstützt werden noindex, nofollow, none (Kurzform für beides), noarchive und nosnippet. Nur von Google unterstützt werden max-snippet, max-image-preview, max-video-preview, noimageindex, notranslate und unavailable_after. Bei widersprüchlichen Regeln gilt immer die restriktivere: nosnippet schlägt max-snippet, und noindex schlägt index.

Wie implementiere ich das X-Robots-Tag auf einem Apache-Server?

Sie fügen den Code in die .htaccess- oder httpd.conf-Datei ein, das Modul mod_headers muss aktiv sein. Beispiel für PDF-Dateien: <FilesMatch "\.pdf$"> Header set X-Robots-Tag "noindex, nofollow" </FilesMatch>. Wichtig sind gerade Anführungszeichen, keine typografischen, sonst funktioniert die Konfiguration nicht. Bei Nginx setzt man den Header stattdessen mit add_header in einem location-Block.

Kann ich das X-Robots-Tag für bestimmte Crawler konfigurieren?

Ja. Sie können vor die Regeln einen User-Agent setzen. X-Robots-Tag: googlebot: noindex gilt dann nur für Google, X-Robots-Tag: bingbot: noarchive nur für Bing. Regeln ohne Angabe eines User-Agents gelten für alle Crawler. Groß- und Kleinschreibung spielt dabei keine Rolle, weder beim Header noch beim Namen des Crawlers oder bei den Werten.

Kann ich noindex in der robots.txt verwenden?

Nein. Google unterstützt die noindex-Anweisung in der robots.txt seit September 2019 nicht mehr. Um eine Seite oder Datei zuverlässig aus dem Index zu halten, nutzen Sie das X-Robots-Tag oder das Meta-Robots-Tag mit noindex. Gerade für Nicht-HTML-Dateien wie PDFs ist das X-Robots-Tag deshalb der Standardweg zum Deindexieren.

Funktioniert noindex, wenn die Seite per robots.txt gesperrt ist?

Nein, und das ist ein häufiger Fehler. Ist eine Seite in der robots.txt per Disallow gesperrt, darf der Crawler sie nicht abrufen und sieht das noindex im Header oder Meta-Tag deshalb nie. Die Seite kann dann trotzdem im Index bleiben. Die Regel lautet: Erst das Crawling erlauben, dann per noindex deindexieren, niemals beides gleichzeitig blockieren.

Wie überprüfe ich, ob mein X-Robots-Tag funktioniert?

Am schnellsten über die Entwicklertools des Browsers: F12 drücken, in den Netzwerk-Tab wechseln, die Seite neu laden, die Hauptdatei anklicken und unter Response Headers nach dem X-Robots-Tag-Eintrag suchen. Alternativ zeigt das URL-Prüf-Tool der Google Search Console, ob und warum eine Seite von der Indexierung ausgeschlossen ist. Auch SEO-Browser-Erweiterungen lesen die HTTP-Header aus.

Letzte Bearbeitung am Samstag, 13. Juni 2026 – 10:18 Uhr von Alex, Webmaster für Google und Bing SEO .

SEO Agentur für professionelle Suchmaschinenoptimierung

Gerne optimieren wir als SEO Agentur auch Ihre Seite im Ranking für mehr Traffic, Kunden und Umsatz. Wir verstehen uns als White Hat Suchmaschinenoptimierung-(SEO)-Agentur.

Kontakt Übrigens: SEO NW - Alexander Müller hat 4,92 von 5 Sternen | 31 Bewertungen auf ProvenExpert.com

Leichtverständliches SEO Lexikon

In unserem SEO Lexikon finden Sie die wichtigsten Themen zum Thema Suchmaschinenoptimierung sowie Online, Digital & Internet Marketing. Das Online-Marketing Glossar wird laufend aktualisiert und auf den Stand der Technik gebracht. Ein guter Einstieg auch, um Suchmaschinenoptimierung leicht und verständlich zu erlernen - und die Arbeit des SEOs zu verstehen.

Ähnliche Beiträge