En breve Es un programa que un usuario activa para completar una tarea concreta y que visita páginas web en tiempo real durante esa tarea.
Qué significa un agente de IA
Cuando una persona le pide a ChatGPT, a Claude o a un producto de Google que compare precios, reserve algo o rellene un formulario, el asistente puede visitar una o varias páginas web en ese mismo momento para completar la tarea. Esa visita la hace un componente con nombre propio: OpenAI la identifica como ChatGPT-User, Anthropic como Claude-User y Google como Google-Agent. Los tres están documentados oficialmente por sus proveedores, con su propia cadena de user-agent.
Esto es distinto de un rastreador de IA como GPTBot, ClaudeBot o PerplexityBot. Un rastreador recorre el sitio de forma automática y continua, sin que haya una persona esperando el resultado en ese instante, y el material recogido sirve para entrenar un modelo o para construir un índice de búsqueda. Un agente hace justo lo contrario: actúa una sola vez, a petición explícita de un usuario concreto, y el resultado de esa visita vuelve directamente a la conversación de esa persona.
La frontera importa para quien administra un sitio web. Bloquear un rastreador de entrenamiento afecta a si el contenido aparece citado en el futuro. Bloquear un agente afecta a si un cliente real puede terminar ahora mismo una compra o una reserva que ya había empezado. Los rastreadores de entrenamiento e indexación ya tenían sus propias políticas de bloqueo antes de que existieran los agentes; estos añaden una tercera categoría, la de la acción en tiempo real por encargo de una persona concreta, que no existía cuando se escribieron esas primeras políticas.
Cómo funciona
El flujo empieza siempre con una persona: pide al asistente que compare productos, consulte disponibilidad o complete un trámite. El modelo decide que necesita datos actuales de una URL concreta, y el servidor del proveedor hace una petición HTTP a esa página, identificada con el user-agent correspondiente. Esa petición no forma parte de una cola de rastreo programada, existe porque un usuario concreto la disparó en ese instante.
Los tres proveedores documentan el comportamiento de forma distinta frente a robots.txt. OpenAI dice explícitamente sobre ChatGPT-User: "ChatGPT-User is not used for crawling the web in an automatic fashion. Because these actions are initiated by a user, robots.txt rules may not apply". Anthropic, en cambio, describe a Claude-User como un agente que se puede bloquear igual que sus otros robots, con la misma regla de robots.txt que usaría un rastreador. Google clasifica a Google-Agent como un "fetcher activado por el usuario" (user-triggered fetcher), una categoría separada de Googlebot, y su documentación no precisa con el mismo detalle que la de Anthropic si esa categoría respeta robots.txt de forma idéntica a sus rastreadores habituales.
Esta diferencia entre proveedores es la razón por la que no conviene tratar a "los agentes de IA" como un bloque uniforme. Una regla de robots.txt que funciona para bloquear a Claude-User puede no tener el mismo efecto sobre ChatGPT-User, según la propia documentación de OpenAI. En la práctica, esto significa revisar la documentación de cada proveedor por separado, en vez de asumir que una sola regla o un solo plugin de bloqueo cubre a los tres agentes por igual.
Por qué importa
La decisión que depende de esto es si conviene bloquear estos agentes en el firewall o en el gestor de bots, y con qué criterio. Bloquear "todo lo que suene a IA" de forma indiscriminada tiene un coste que no siempre se ve: si un agente actúa en nombre de un cliente real que está intentando comprar o reservar algo en tu web, ese bloqueo no impide el entrenamiento de un modelo, impide una venta que ya estaba en marcha.
También afecta a la medición. Un servidor que no distingue las sesiones de agente de las sesiones de un navegador normal puede contar esas visitas como tráfico humano corriente, o perderlas del todo si el agente no ejecuta JavaScript igual que un navegador. Ninguna de las dos cosas da una imagen correcta de cuántas visitas y cuántas conversiones vienen realmente de un agente actuando por encargo de un usuario.
Un ejemplo concreto: una agencia de viajes que bloquea de forma genérica cualquier user-agent con "GPT" o "Claude" en el nombre puede estar bloqueando, sin saberlo, a un cliente que le pidió a su asistente que terminara de reservar una habitación que ya había elegido. La reserva no se completa, y en los logs del hotel esa visita queda registrada como una petición bloqueada más, sin ningún aviso de que detrás había una venta real en curso. Nadie en la agencia recibe una alerta de que se ha perdido una reserva, porque una petición bloqueada se ve en el log igual que cualquier otra petición bloqueada.
Buenas prácticas
- Distingue en el robots.txt y en el gestor de bots los rastreadores de entrenamiento (GPTBot, ClaudeBot) de los agentes de usuario (ChatGPT-User, Claude-User, Google-Agent).
- No bloquees por defecto los agentes de usuario si una parte de tu negocio depende de que un cliente complete una compra o una reserva a través de ellos.
- Verifica la cadena de user-agent contra la documentación oficial de cada proveedor antes de tomar una decisión de bloqueo, porque existe tráfico que se hace pasar por un agente sin serlo.
- Revisa los logs del servidor para saber cuántas visitas de agentes recibe tu web y en qué páginas concretas.
- Comprueba que el checkout y los formularios funcionan sin depender de JavaScript complejo, porque no todos los agentes lo ejecutan igual que un navegador.
- Actualiza la lista de agentes permitidos cada pocos meses: el número de proveedores con un agente propio sigue creciendo.
Errores frecuentes
- Bloquear todo el tráfico que suene a IA en el firewall y perder ventas que un agente estaba completando en nombre de un cliente real.
- Confundir un agente de usuario con un rastreador de entrenamiento y aplicarle la misma política de bloqueo.
- Dar por hecho que todos los agentes respetan robots.txt de la misma manera, cuando OpenAI dice explícitamente que puede no aplicarse a ChatGPT-User.
- No verificar la cadena de user-agent, lo que permite que tráfico falso se haga pasar por un agente legítimo.
- Medir las conversiones sin separar las sesiones de agente del resto, lo que infla o esconde su impacto real.
Manuel Riveiro Rodriguez CEO & Digital Strategist
Una auditoría técnica revisa esto y el resto en un solo paso.
Solicitar auditoría Preguntas frecuentes
¿Un agente de IA es lo mismo que un chatbot?
No exactamente. Un chatbot conversa dentro de su propia interfaz y no necesita salir a ningún sitio para responder. Un agente de IA, además de conversar, sale a visitar páginas web reales en tiempo real para completar una tarea concreta que le ha pedido un usuario, como comparar precios, rellenar un formulario de reserva o revisar el estado de un pedido.
¿Los agentes de IA respetan robots.txt?
Depende del proveedor. Anthropic describe a Claude-User como bloqueable igual que sus otros robots. OpenAI dice explícitamente que las reglas de robots.txt pueden no aplicarse a ChatGPT-User, porque la acción la inicia un usuario en ese momento y no es un rastreo automático. Esta distinción puede cambiar con futuras versiones de la documentación de cada proveedor, así que conviene revisarla de vez en cuando en vez de darla por fija.
¿Cómo sé si una visita viene de un agente y no de una persona con un navegador normal?
Por la cadena de user-agent que envía la petición, verificada contra la documentación oficial del proveedor: OpenAI, Anthropic y Google publican el token exacto que usan sus agentes, junto con una URL de referencia sobre el propio agente. Un user-agent que no aparece en esa documentación no debería tratarse como agente legítimo sin más comprobación.
¿Debo bloquear los agentes de IA en mi tienda online?
No por defecto. Si parte de tus ventas puede completarse a través de un agente actuando en nombre de un cliente, bloquearlo de forma indiscriminada cierra una vía de compra real, no solo un rastreo de entrenamiento. Conviene revisar los logs antes de decidir, en vez de bloquear por sospecha.
¿Qué diferencia hay entre ChatGPT-User y GPTBot?
ChatGPT-User visita una página en el momento en que un usuario concreto se lo pide dentro de una conversación. GPTBot recorre la web de forma automática y continua para reunir contenido de entrenamiento, sin que haya un usuario esperando esa visita en tiempo real.
Fuentes
- OpenAI, documentación de bots (ChatGPT-User, GPTBot, OAI-SearchBot)
- Anthropic, Claude-User (Centro de ayuda)
- Google, Google-Agent (user-triggered fetcher)