XML frente a HTML: dos herramientas con el mismo nombre
El término sitemap agrupa dos herramientas distintas que comparten nombre pero no público. El sitemap XML es un archivo con extensión .xml que lista las URLs del sitio en un formato legible por máquinas, pensado para que los rastreadores de los motores de búsqueda, Googlebot entre ellos, descubran las páginas sin depender solo de los enlaces internos. Cada URL puede llevar metadatos adicionales, sobre todo la fecha de última modificación, que ayudan al rastreador a decidir qué revisar primero.
El sitemap HTML es justo lo contrario: una página normal del sitio, visible para cualquier visitante, que enlaza a las secciones o URLs más relevantes. Durante años fue habitual colocarlo en el pie de página como red de seguridad para la navegación, sobre todo en sitios con una arquitectura de menús pobre. Ningún rastreador lo trata de forma especial; para Google es una página más, con los mismos enlaces internos que cualquier otra.
Hoy el sitemap HTML ha perdido buena parte de su razón de ser. Un menú bien diseñado, un buscador interno funcional y un enlazado interno cuidado cubren la misma necesidad de navegación sin necesitar una página dedicada. Sigue teniendo sentido en sitios muy grandes con cientos de secciones, o en proyectos donde la accesibilidad exige una vía clara para llegar a cualquier página en pocos clics.
Cuando alguien en SEO dice simplemente sitemap, casi siempre se refiere al XML. Es el que se envía a Search Console, el que aparece en robots.txt y el que tiene reglas técnicas propias: límites de tamaño, formatos alternativos y un informe de seguimiento dedicado. El resto de este artículo se centra en ese formato y señala las diferencias con el HTML solo cuando son relevantes.
