Qué es el index bloat
Se llama index bloat a la situación en la que Google tiene indexadas muchas más URLs de un sitio de las que ese sitio necesita. No es un error concreto que se pueda señalar en una página, sino un desequilibrio: el índice se llena de direcciones que no aportan nada y el contenido que sí importa queda diluido entre ellas.
La cifra por sí sola no dice nada. Un periódico con doscientas mil URLs indexadas está bien; una tienda de trescientos productos con veinte mil, no. Lo que cuenta no es cuántas hay, sino qué proporción de ellas alguien busca alguna vez.
Y conviene desmontar de entrada la idea contraria, que sigue circulando: tener más páginas indexadas no mejora nada por sí mismo. Google no reparte visibilidad por volumen, y una URL indexada que nadie visita no es un activo, es un gasto de rastreo.
El nombre viene del inglés y describe bien lo que ocurre: algo que se hincha sin ganar sustancia. No hay un umbral a partir del cual empieza, ni un aviso en ninguna herramienta; se reconoce comparando dos cifras que casi nadie mira juntas, la de páginas que uno cree tener y la de URLs que Google dice tener.
Conviene además separarlo de un problema vecino con el que se confunde. Que una página esté indexada y no reciba visitas puede ser normal: hay contenido estacional, páginas legales, fichas de productos raros. El index bloat no es eso, es el caso en el que esas URLs se cuentan por miles y ninguna estaba prevista.
