Skip to main content
Blog
Blog Attacks

Cómo Bloquear ClaudeBot en Tu Sitio Web

ClaudeBot rastrea tu sitio para entrenar los modelos Claude de Anthropic. Aquí te explicamos cómo bloquearlo con robots.txt y rangos de IP, y qué se le sigue escapando al bloqueo.

Jun 16, 2026 Actualizado Jul 20, 2026 8 min read
Cómo Bloquear ClaudeBot en Tu Sitio Web
Tabla de Contenidos

Resumen: bloquear ClaudeBot sin detener a los agentes Claude que navegan tu sitio

  • Crawler frente a agente: Los equipos bloquean ClaudeBot esperando que Claude desaparezca de su sitio, y al día siguiente Claude Computer Use entra caminando. ClaudeBot es el rastreador de entrenamiento de Anthropic; los agentes impulsados por Claude que navegan la web usan infraestructura y user-agents distintos.
  • El bloqueo por robots.txt: ClaudeBot se identifica como Claude-Web/1.0, está documentado en las páginas de crawler de Anthropic y respeta robots.txt de forma fiable; un Disallow: / más los rangos de IP publicados de Anthropic en el firewall cubre en una sola capa de aplicación tanto la lectura de robots.txt como el comportamiento no conforme.
  • La decisión: Si quieres salir de los datos de entrenamiento de Claude, este cambio de un archivo lo hace. Si además quieres mantener a Claude Computer Use fuera de tu checkout, ese es un problema de detección separado que requiere señales de capa de navegador.

¿Poco tiempo? Consulta la detección de agentes de IA de cside. Cubre todo lo de abajo en un solo despliegue.

ClaudeBot es el rastreador web operado por Anthropic para recopilar datos de entrenamiento para Claude. Es un rastreador declarado y basado en HTTP: se identifica, opera desde rangos de IP publicados y está diseñado para respetar las directivas de robots.txt. Bloquearlo es técnicamente sencillo.

El contexto más importante: bloquear ClaudeBot aborda el flujo de datos de entrenamiento de Anthropic. No tiene ningún efecto sobre los agentes, herramientas o productos impulsados por Claude que navegan por la web en nombre de los usuarios. Esos son sistemas independientes que requieren detección en la capa del navegador. Para conocer el patrón más amplio en los scrapers de IA, consulta nuestra guía para bloquear bots de IA que hacen scraping de contenido.


¿Qué Es ClaudeBot?

Respuesta rápida: ClaudeBot es el rastreador de entrenamiento de Anthropic. Recopila contenido web de acceso público para entrenar y mejorar los modelos Claude. Utiliza una cadena de agente de usuario declarada y aparece listado en la documentación pública de Anthropic junto con sus rangos de IP. Es un rastreador HTTP, no un agente de navegador interactivo.

El identificador principal de agente de usuario de ClaudeBot es Claude-Web/1.0, con una referencia a la página de documentación del rastreador de Anthropic. Anthropic mantiene documentación que describe el propósito, el comportamiento y la forma de bloquear el rastreador.

Al igual que GPTBot, ClaudeBot no ejecuta JavaScript ni interactúa con las interfaces de aplicaciones web. Realiza solicitudes HTTP GET a URLs de acceso público, lee la respuesta y sigue adelante. No inicia sesión, no rellena formularios ni navega por elementos interactivos.


Cómo Bloquear ClaudeBot con robots.txt

Respuesta rápida: Añade ClaudeBot a tu robots.txt para bloquear el rastreador por completo. La documentación de Anthropic indica que ClaudeBot respeta estas directivas. Usa reglas a nivel de ruta si quieres restringir solo las secciones sensibles mientras permites el rastreador en el contenido público.

Para bloquear ClaudeBot en todo tu sitio:

User-agent: ClaudeBot
Disallow: /

Para permitir el rastreador en el contenido público pero restringir las rutas sensibles:

User-agent: ClaudeBot
Disallow: /account/
Disallow: /checkout/
Disallow: /admin/
Allow: /blog/
Allow: /products/

Anthropic tiene buena reputación de cumplimiento en cuanto a que sus rastreadores respetan las reglas de robots.txt. Este es el enfoque más sencillo y de mayor alcance para controlar el acceso de ClaudeBot sin cambios a nivel de infraestructura. El mismo enfoque de robots.txt funciona para otros rastreadores declarados, incluidos CCBot y Bytespider.


Bloqueo a Nivel de IP para ClaudeBot

Respuesta rápida: Anthropic publica los rangos de IP de ClaudeBot en la documentación de su rastreador. Denegar estos rangos en tu firewall o CDN proporciona una aplicación que no depende de que el rastreador lea el robots.txt. Revisa la documentación periódicamente, ya que los rangos de IP pueden ampliarse cuando Anthropic escala su infraestructura de rastreo.

El bloqueo a nivel de IP es la opción de aplicación más robusta:

  1. Captura cualquier versión del rastreador que pueda no gestionar correctamente el robots.txt
  2. Crea un registro a nivel de servidor de las solicitudes bloqueadas que puedes auditar
  3. No depende de la autoidentificación a través de la cadena de agente de usuario

El inconveniente: los rangos de IP publicados por Anthropic requieren mantenimiento. Si los bloqueas a nivel de firewall, configura un recordatorio para comprobar las actualizaciones de los rangos trimestralmente o cuando Anthropic publique entradas de changelog en la documentación de su rastreador.


ClaudeBot vs. Agentes Impulsados por Claude: La Brecha que Importa

Respuesta rápida: ClaudeBot es el rastreador de Anthropic. Claude, el asistente, es un producto diferente. Cuando Claude ayuda a un usuario a navegar por la web, investigar un tema o completar una tarea, utiliza una infraestructura diferente a la de ClaudeBot. Bloquear ClaudeBot no impide que los agentes impulsados por Claude visiten tu sitio.

Esta es la misma brecha estructural que se aplica a GPTBot y a OpenAI Operator. El rastreador de entrenamiento y el agente interactivo son sistemas independientes.

Cuando un usuario le pide a Claude que investigue un producto, compare precios o complete una tarea basada en la web, Claude utiliza una sesión de navegador o una herramienta de búsqueda web que no es ClaudeBot. Esa sesión puede no tener ninguna cabecera identificativa que la vincule con Anthropic. Desde la perspectiva de tu servidor, parece una solicitud de navegador estándar.

El modelo mental correcto: robots.txt y el bloqueo de IP gestionan tu relación con el flujo de recopilación de datos de Anthropic. No gestionan tu relación con Claude como producto utilizado por usuarios reales para interactuar con tu sitio.


Qué Sucede Después de Bloquear ClaudeBot

Respuesta rápida: Bloquear ClaudeBot impide que tu contenido entre en el flujo de datos de entrenamiento de Anthropic. No impide que Claude haga referencia a tu sitio en sus respuestas basándose en contenido previamente indexado. No impide que los sistemas agénticos impulsados por Claude naveguen por tu sitio en nombre de los usuarios.

Después de un bloqueo de ClaudeBot:

  • Los futuros entrenamientos no incluirán tu contenido nuevo
  • El contenido recopilado previamente permanece en los pesos de los modelos Claude existentes
  • Los usuarios de Claude que le piden que navegue por tu sitio no se ven afectados
  • Cualquier agente impulsado por Claude (uso de ordenador de Claude.ai, agentes de la API de Claude) que visite tu sitio no se ve afectado

El alcance de un bloqueo de robots.txt es más reducido de lo que la mayoría de los propietarios de sitios espera. Es una declaración sobre un rastreador específico, no una política que se aplique a toda la cartera de productos de una empresa de IA.


Detección en la Capa del Navegador Más Allá de ClaudeBot

Respuesta rápida: Bloquear ClaudeBot es sencillo. El problema más difícil es detectar agentes impulsados por Claude que navegan por tu sitio en sesiones de navegador reales en nombre de los usuarios, sesiones que en la capa de red parecen idénticas al tráfico humano. Eso requiere observación en la capa del navegador.

Piensa en lo que hace realmente un agente de uso de ordenador impulsado por Claude cuando un usuario le pide que investigue un producto SaaS. Abre una sesión real de Chromium, carga la página de precios y se desplaza por la tabla de funciones. En la capa de red, la solicitud parece idéntica a una visita humana: un agente de usuario estándar de Chrome, una IP residencial, una huella digital TLS dentro del rango. Sin cabecera de ClaudeBot. Sin rango de IP de Anthropic. El agente navega por cuatro páginas en 11 segundos sin una sola variación en el movimiento del ratón, nunca retrocede en el desplazamiento y nunca se detiene en un campo de formulario a menos que la tarea requiera entrada de datos. Esas señales de tiempo y patrones de interacción solo son detectables dentro de la sesión del navegador. La instrumentación de cside los captura en la capa de ejecución de JavaScript antes de que cualquier herramienta a nivel de red pueda verlos. En las pruebas controladas de cside, las herramientas tradicionales pasaron por alto agentes de IA que operaban dentro de sesiones de navegador reales en 81 de cada 100 escenarios: las herramientas de red simplemente no están vigilando la capa correcta.

Panel de detección de agentes de IA de cside

cside opera dentro de la sesión del navegador y saca a la luz las señales de comportamiento que distinguen la navegación ejecutada por un agente del comportamiento humano. El tiempo de interacción, los patrones de navegación, la consistencia de la huella digital y las características de ejecución de JavaScript son todos observables dentro de una sesión de navegador, pero invisibles para las herramientas de la capa de red. El propio ClaudeBot no entra en esa categoría: es fácil de bloquear. Los agentes que operan a través de sesiones de navegador son exactamente lo que esas pruebas identificaron como la amenaza invisible.

Mike Kutlu
Client-Side Security Consultant

Client-side security consultant at cside. 10+ years of experience implementing technology solutions for enterprises (previously at Oracle, Cloudflare, and Splunk). Now helping teams use client-side intelligence to catch & reduce fraud.

FAQ

Frequently Asked Questions

ClaudeBot es el rastreador web de Anthropic, utilizado para recopilar datos de entrenamiento para los modelos Claude. Realiza solicitudes HTTP GET a URLs de acceso público, se identifica con una cadena de agente de usuario declarada y opera desde rangos de IP publicados. Es un rastreador HTTP que no ejecuta JavaScript ni interactúa con aplicaciones web dinámicas.

Añade `User-agent: ClaudeBot` seguido de `Disallow: /` a tu archivo `robots.txt`. La documentación de Anthropic indica que ClaudeBot respeta estas directivas. Para un control a nivel de ruta, usa reglas `Disallow` específicas para restringir el acceso a secciones sensibles mientras permites el rastreador en el contenido público.

No. ClaudeBot es el rastreador de entrenamiento de Anthropic. Claude, el asistente, es un producto independiente. Cuando los usuarios de Claude le piden que navegue por la web o complete tareas basadas en la web, esas sesiones utilizan una infraestructura diferente. Bloquear ClaudeBot no impide que los agentes impulsados por Claude visiten tu sitio.

Sí. Anthropic publica los rangos de IP de ClaudeBot en la documentación de su rastreador. Denegar estos rangos en tu firewall o CDN proporciona una aplicación que no depende de que el rastreador lea el `robots.txt`. Los rangos de IP requieren actualizaciones periódicas a medida que Anthropic amplía su infraestructura de rastreo.

Depende de si quieres que tu contenido esté en los datos de entrenamiento de Anthropic. Bloquearlo impide que el contenido nuevo entre en futuros entrenamientos, pero no elimina el contenido recopilado previamente de los modelos Claude existentes. Considera el equilibrio entre la protección de datos y el posible beneficio de estar bien representado en la base de conocimiento de Claude.

ClaudeBot se identifica como Claude-Web/1.0, junto con una referencia a la página de documentación del rastreador de Anthropic. Es un rastreador declarado que opera desde rangos de IP publicados y realiza solicitudes HTTP GET simples, así que puedes reconocerlo en los registros del servidor, en robots.txt o en reglas de firewall por ese user-agent. No ejecuta JavaScript ni interactúa con formularios, por lo que basta con una coincidencia de user-agent para identificarlo.

Bloquear robots.txt y rangos de IP solo detiene a ClaudeBot, el rastreador de entrenamiento. El tráfico de Claude que realmente preocupa a la mayoría de los equipos proviene de agentes impulsados por Claude que navegan en sesiones reales de Chromium, con un user-agent normal de Chrome y una IP residencial. Detenerlos requiere detección en la capa del navegador que lea la sincronización de interacciones, los patrones de navegación y la consistencia de la huella dentro de la sesión, no otra regla de red. cside está diseñado para esa capa.

Las herramientas de la capa de red, como firewalls, WAF y listas de bloqueo de IP, no pueden, porque una sesión de agente parece idéntica a una visita humana: user-agent estándar de Chrome, IP residencial, huella TLS dentro del rango y sin encabezado de Anthropic. La detección debe ocurrir dentro de la sesión del navegador, donde la sincronización de interacciones y la ejecución de JavaScript delatan al agente. En las pruebas controladas de cside, las herramientas tradicionales no detectaron agentes de IA en 81 de 100 escenarios; cside observa la capa del navegador que ellas no pueden ver.

Adapta el método al objetivo. Usa robots.txt para excluirte de forma cortés de los datos de entrenamiento de Anthropic, y el bloqueo de IP en el firewall cuando quieras una aplicación que no dependa de que el rastreador lea robots.txt. Ambos solo abordan ClaudeBot. Elige la detección en la capa del navegador cuando tu preocupación sean los agentes de Claude que completan tareas en tu sitio en vivo, como el pago o las páginas de cuenta, ya que esas sesiones nunca tocan el user-agent ni los rangos de IP de ClaudeBot.

cside se ejecuta dentro de la sesión del navegador y lee señales que la red nunca ve. Un agente de Claude Computer Use podría navegar por cuatro páginas en once segundos sin variación en el movimiento del ratón, nunca desplazarse hacia atrás y detenerse solo donde una tarea requiere entrada. cside captura esas señales de sincronización de interacción, navegación y consistencia de huella en la capa de ejecución de JavaScript, recopilando más de 250 señales por sesión para separar la navegación ejecutada por agentes del comportamiento humano.

Sí. La navegación humana presenta una variación natural en el movimiento del ratón, el desplazamiento y el tiempo de permanencia; una sesión de agente es mecánicamente consistente y está impulsada por tareas. cside evalúa más de 250 señales por sesión dentro del navegador, incluidas la sincronización de interacciones y la consistencia de la huella, para marcar las sesiones ejecutadas por agentes. En las pruebas controladas de cside, las herramientas de la capa de red no detectaron agentes de IA en 81 de 100 escenarios, precisamente las sesiones que no llevan encabezado ni IP de ClaudeBot.

cside se despliega como una sola etiqueta de script JavaScript de origen propio, sin cambios de DNS y sin enrutar el tráfico de tu sitio. Una vez en ejecución, observa cada sesión del navegador y expone las señales de comportamiento que distinguen a los agentes impulsados por Claude de los visitantes humanos, la capa que robots.txt y las reglas de firewall no pueden alcanzar. También hay disponible un Scan Method sin agente. Mantén el bloqueo de ClaudeBot en robots.txt para la exclusión del entrenamiento y añade cside para la detección de agentes en vivo.

Monitoriza y protege tus scripts de terceros

Gain full visibility and control over every script delivered to your users to enhance site security and performance.

Empieza gratis o prueba Business con una versión de prueba de 14 días.

Interfaz del panel de cside que muestra la monitorización de scripts y el análisis de seguridad
Related Articles
Reservar una demo

¿Quieres verlo en detalle con un ingeniero?

Treinta minutos, sobre tu propio sitio. Nada de diapositivas.

Reserva una demo personalizada para ver:

Cómo cumplir los requisitos 6.4.3 y 11.6.1 de PCI DSS en 1 día
Por qué los scripts de terceros son un riesgo de seguridad para ti y tus visitantes
Cómo monitorizar fugas de privacidad y consentimiento (RGPD, CCPA) en cada tercero
Cómo frenar el abuso de registros, el uso compartido de cuentas y el fraude de contracargos con device intelligence
Cómo detectar y controlar agentes de IA y bots que llegan a tu sitio en tiempo real

¿Prefieres mandarnos una pregunta?

Buscando huecos libres…

Solo humanos de verdad. Nos daríamos cuenta.

¿Problemas para reservar? Abrir el calendario en una pestaña nueva

¿Qué quieres resolver?

Cuéntanoslo en una línea y te responderemos con algo útil, no con un discurso genérico.

Solemos ayudar con:

Ver qué scripts de terceros se ejecutan en tu sitio
Evidencias para PCI DSS 6.4.3 y 11.6.1
Bots, agentes de IA y robo de cuentas

¿Prefieres reservar una hora? Elegir un hueco