Qué es el X-Robots-Tag
El X-Robots-Tag es una cabecera de la respuesta HTTP con la que un servidor le dice a los buscadores qué pueden hacer con el archivo que acaban de pedir: indexarlo o no, seguir sus enlaces o no, guardar una copia o no. Es la misma conversación que ocurre con la etiqueta meta robots, solo que en otro sitio.
Ese «otro sitio» es toda la diferencia. La etiqueta meta vive dentro del HTML, así que solo existe si hay HTML. La cabecera viaja por delante del archivo, sea del tipo que sea, y por eso es el único camino para un PDF, una imagen o un fichero descargable.
Conviene separarlo desde el principio de la otra instrucción con la que se confunde. El robots.txt regula si el rastreador puede pedir el archivo; el X-Robots-Tag regula qué hace con él después de recibirlo. Son dos momentos distintos, y esa distinción explica casi todos los fallos que aparecen más abajo.
El prefijo X- del nombre recuerda que nació como una cabecera propuesta fuera del estándar, igual que tantas otras de los primeros años de la web. Hoy la respetan los buscadores grandes, pero sigue siendo una petición, no una orden: un cliente cualquiera puede ignorarla sin incumplir nada.
De ahí una consecuencia que conviene tener clara antes de seguir. Todo lo que hace esta cabecera ocurre del lado de quien lee, no del lado del archivo. No lo cifra, no lo mueve, no lo borra: solo cambia lo que un buscador decide hacer con una copia que ya tiene delante.
