Was das X-Robots-Tag ist
Das X-Robots-Tag ist ein Feld der HTTP-Antwort, mit dem ein Server den Suchmaschinen sagt, was sie mit der eben angeforderten Datei tun dürfen: indexieren oder nicht, ihren Verweisen folgen oder nicht, eine Kopie behalten oder nicht. Es ist dasselbe Gespräch wie bei der Angabe Meta-Robots, nur an einem anderen Ort.
Dieser andere Ort macht den ganzen Unterschied. Die Meta-Angabe steht im HTML, es gibt sie also nur, wenn es HTML gibt. Der Header reist der Datei voraus, gleich welcher Art sie ist, und ist damit der einzige Weg zu einem PDF, einem Bild oder einer Datei zum Herunterladen.
Von der anderen Anweisung, mit der es verwechselt wird, trennt man es am besten sofort. Die robots.txt regelt, ob der Crawler die Datei anfordern darf; das X-Robots-Tag regelt, was er danach damit macht. Zwei verschiedene Zeitpunkte, und diese Unterscheidung erklärt fast alle Fehler weiter unten.
Das X- im Namen erinnert daran, dass es als Vorschlag außerhalb des Standards entstand, wie so vieles aus den frühen Jahren des Web. Heute halten sich die großen Suchmaschinen daran, es bleibt aber eine Bitte und keine Anordnung: Ein beliebiges Programm darf sie ignorieren, ohne gegen etwas zu verstoßen.
Daraus folgt etwas, das man vor dem Weiterlesen klar haben sollte. Alles, was dieser Header bewirkt, geschieht auf der Seite des Lesenden, nicht auf der der Datei. Er verschlüsselt sie nicht, verschiebt sie nicht, löscht sie nicht: Er ändert nur, was eine Suchmaschine mit einer Kopie tut, die sie ohnehin schon vor sich hat.
