¿Qué es noindex?
Noindex es una directiva dirigida a los rastreadores que indica que una URL concreta no debe entrar en el índice del buscador. La página sigue existiendo, sigue siendo accesible para quien tenga el enlace y el servidor sigue sirviéndola con normalidad, pero deja de aparecer en los resultados de búsqueda porque Google, Bing o cualquier otro motor la excluye de su base de datos consultable.
La directiva se expresa de dos formas técnicas con el mismo efecto pero distinto alcance: la etiqueta meta robots dentro del <head> del documento HTML, o la cabecera HTTP X-Robots-Tag que envía el servidor junto con la respuesta. Ambas aceptan valores combinables: noindex,follow excluye la página del índice pero deja que el rastreador siga sus enlaces internos, mientras que noindex,nofollow bloquea las dos cosas a la vez.
Un matiz que se pasa por alto con frecuencia: noindex no borra una página ni impide que se cargue en el navegador. Solo instruye al buscador para que la retire de los resultados o no la añada nunca. Si la página ya estaba indexada cuando se añade la directiva, Google necesita rastrearla de nuevo para leer la etiqueta y aplicar la exclusión, un proceso que puede tardar desde unos días hasta varias semanas según la frecuencia de rastreo del sitio.
Aunque Google es el motor de referencia en la mayoría de auditorías, noindex forma parte del protocolo estándar de exclusión de robots y funciona de forma equivalente en Bing, Yandex o cualquier buscador que respete esas convenciones. No es una función propietaria de un solo motor, sino un acuerdo del sector sobre cómo comunicar qué contenido no debe aparecer en resultados de búsqueda.
Otro punto que genera confusión en la práctica: noindex no protege frente a un enlazado interno descuidado. Si una página lleva noindex pero sigue enlazada de forma visible desde el menú de navegación o desde otras páginas, usuarios y rastreadores seguirán encontrándola con normalidad; la etiqueta solo la saca del índice de búsqueda, no del resto del sitio.
