Cargando
cloudflare-ai-bots-2026.webp
Web y ciberseguridadPor SDX Development

Compartir este artículo

LinkedInFacebookXWhatsAppE-mail

A partir del 15 de septiembre de 2026, Cloudflare aplica nuevas reglas para distinguir mejor entre los robots de búsqueda, los agentes de IA y los crawlers utilizados para entrenar modelos. Estos ajustes ofrecen un mayor control a los propietarios de sitios, pero requieren verificar sus efectos sobre el rastreo y el posicionamiento orgánico.

En resumen

Reglas adaptadas al uso de los robots

Cloudflare distingue ahora tres categorías principales: Search, Agent y Training. La atención se centra sobre todo en los crawlers multiuso, a los que una política restrictiva puede impedir también un acceso necesario para la búsqueda.

La llegada de las inteligencias artificiales generativas ha modificado profundamente el papel de los robots que recorren la Web. Durante mucho tiempo, el funcionamiento era relativamente sencillo: un motor de búsqueda exploraba una página, la indexaba y luego podía dirigir a los internautas al sitio correspondiente.

Hoy los usos son más variados. Algunos robots siguen alimentando los motores de búsqueda. Otros recopilan datos destinados al entrenamiento de modelos de inteligencia artificial. Otros intervienen en tiempo real en nombre de un usuario o de un agente de IA.

Evolución de la gestión de los robots de inteligencia artificial por Cloudflare en 2026
Cloudflare evoluciona sus herramientas para diferenciar los robots según el uso que hacen de los contenidos.

Cloudflare había anunciado el 1er de julio de 2026 una evolución de sus herramientas de gestión de este tráfico automatizado. Los nuevos ajustes entran en vigor el 15 de septiembre de 2026. Detrás de esta configuración técnica se plantea una cuestión importante: ¿cómo limitar determinados usos del propio contenido sin bloquear involuntariamente los robots útiles para su visibilidad?

Tres categorías para distinguir los robots de IA

Cloudflare ya no intenta únicamente separar los robots «buenos» de los «malos». La plataforma clasifica en mayor medida el tráfico automatizado según el uso que se hace del contenido.

Search

Explorar para responder a búsquedas

Esta categoría corresponde a los robots que recorren e indexan los contenidos para responder posteriormente a búsquedas. Autorizar su acceso puede permitir que las páginas sean descubiertas, indexadas y propuestas a los internautas.

Agent

Actuar en tiempo real para un usuario

Estos robots intervienen en nombre de un usuario. Por ejemplo, un asistente de IA puede consultar una página o recuperar información durante una tarea, sin necesariamente crear un índice permanente.

Training

Entrenar o ajustar un modelo

Esta categoría designa los crawlers que utilizan los contenidos para entrenar o ajustar modelos de inteligencia artificial. Para el sitio de origen, este acceso no genera necesariamente una visita directa.

Objetivo

Aplicar políticas diferenciadas

La nueva clasificación permite a los propietarios de sitios diferenciar las reglas según el uso: búsqueda, intervención puntual de un agente o entrenamiento de un modelo.

Qué cambia el 15 de septiembre de 2026

El cambio principal afecta a los nuevos dominios añadidos a la red de Cloudflare a partir del 15 de septiembre. De forma predeterminada, los robots clasificados como Training o Agent quedarán bloqueados en las páginas donde Cloudflare detecte publicidad. Los robots pertenecientes únicamente a la categoría Search seguirán autorizados de forma predeterminada.

Cloudflare relaciona esta elección con la lógica económica de las páginas financiadas por publicidad. Su modelo suele basarse en la consulta por parte de un internauta. Un crawler que recupera únicamente contenido para entrenar un modelo no genera esa atención humana. En cambio, un motor de búsqueda puede contribuir a descubrir la página y atraerle una visita.

Ajustes de Cloudflare que permiten gestionar por separado los robots Search, Agent y Training
Las políticas de Cloudflare pueden ajustarse según la categoría del robot y el tipo de página correspondiente.

El caso más complejo de los robots multiuso

Un mismo crawler puede participar en varias actividades. Puede alimentar un servicio de búsqueda y utilizarse también en un contexto relacionado con la inteligencia artificial o el entrenamiento. Cloudflare cita especialmente Googlebot, Applebot y BingBot entre los ejemplos afectados por esta problemática.

A partir del 15 de septiembre, cuando un robot pertenezca a varias clasificaciones, Cloudflare aplicará la política más restrictiva compatible con las decisiones del propietario del sitio. Por tanto, un crawler que combine una función de búsqueda y una función de entrenamiento podrá bloquearse si el administrador ha elegido bloquear los usos clasificados como Training.

Este cambio también afecta al antiguo ajuste «Block AI bots», que evoluciona hacia políticas más detalladas.

Punto de atención relacionado con Googlebot y los robots con varios usos
Un robot multiuso puede quedar sujeto a la regla más restrictiva, incluso cuando participa en el rastreo destinado a la búsqueda.
Punto de atención

Una regla dirigida a la IA puede tener un efecto más amplio

Con un robot multiuso, bloquear una clasificación relacionada con el entrenamiento también puede impedir una actividad de búsqueda realizada por el mismo crawler. Por tanto, hay que verificar el alcance exacto de la regla antes de activarla.

Por qué puede convertirse en un asunto de posicionamiento

Bloquear los crawlers utilizados exclusivamente para entrenar un modelo de IA puede encajar con la estrategia de un sitio. En cambio, bloquear por error un robot que participa en la indexación puede afectar a su visibilidad.

Google indica que Googlebot es su robot de rastreo, utilizado para descubrir y recorrer las páginas accesibles para su motor. Su acceso forma parte de las condiciones técnicas que permiten que una página pueda ser elegible para la indexación.

Activar una opción para bloquear los robots de IA no hará desaparecer automáticamente un sitio de los resultados de búsqueda: las consecuencias dependen de la configuración y de los robots afectados.

Bloquear el entrenamiento de IA ya no es una decisión binaria

La cuestión ya no se reduce a autorizar o bloquear todos los robots de IA. Un propietario de sitio puede querer:

  • autorizar los motores de búsqueda;
  • rechazar el uso de sus contenidos para entrenar determinados modelos;
  • permitir que un asistente de IA acceda puntualmente a una página a petición de un usuario;
  • bloquear crawlers desconocidos o especialmente agresivos;
  • aplicar reglas diferentes a los contenidos públicos y a las áreas sensibles.
Comparación de los usos Search, Agent y Training para los robots automatizados
La búsqueda, la acción en tiempo real y el entrenamiento no tienen el mismo valor para el editor ni los mismos riesgos.

Por tanto, no todos los accesos automatizados tienen el mismo valor ni el mismo nivel de riesgo. Esta distinción cobra aún más importancia a medida que los agentes de IA pueden navegar por sitios, rellenar formularios, consultar aplicaciones o actuar directamente sobre interfaces.

Qué verificar si el sitio utiliza Cloudflare

No es necesario bloquear todos los robots por precaución. Un enfoque más adecuado consiste en examinar la configuración existente y definir con precisión los usos que se desean autorizar.

01

Comprobar la política activa

Un sitio configurado hace varios años puede conservar un ajuste antiguo, mientras que un dominio nuevo puede beneficiarse de parámetros predeterminados diferentes. Hay que examinar la configuración que se aplica realmente a cada zona.

02

Identificar los robots indispensables

Cuando los motores de búsqueda representan un canal de adquisición importante, sus robots deben supervisarse. Search Console permite, en particular, realizar un seguimiento del rastreo y la indexación en Google.

03

Observar los registros después de modificar la configuración

Después de activar una regla, conviene supervisar las solicitudes bloqueadas, los posibles errores y la evolución del rastreo para detectar efectos no deseados.

04

Tener en cuenta el modelo económico

Un medio financiado por publicidad, un sitio corporativo, una documentación técnica y una aplicación SaaS no tienen las mismas prioridades. La configuración debe responder a los objetivos específicos del sitio.

05

Probar el acceso a las páginas importantes

La herramienta de inspección de URL de Google puede ayudar a verificar si una página sigue siendo accesible. Esta comprobación complementa el análisis de los registros y el seguimiento de los informes de rastreo después de un cambio de política.

Resumen de las comprobaciones que deben realizarse con el cambio de Cloudflare del 15 de septiembre de 2026
Antes y después del 15 de septiembre, deben comprobarse la configuración activa, los registros de Cloudflare y las herramientas de inspección de los motores.

Hacia una Web en la que cada robot deberá anunciar su intención

La evolución propuesta por Cloudflare ilustra un cambio más amplio de la Web. La cuestión ya no consiste progresivamente solo en saber quién accede a una página, sino por qué.

La búsqueda, el entrenamiento de un modelo, una respuesta generada por una IA, un agente autónomo o la navegación humana no crean la misma relación entre un sitio y el servicio que utiliza su contenido. Por ello, las soluciones técnicas empiezan a integrar esta distinción en sus herramientas de seguridad y gestión del tráfico.

Esta granularidad ofrece un mayor control a los editores, pero también les confiere una nueva responsabilidad: comprender los efectos de una regla antes de aplicarla.

Lo que hay que recordar

  1. Cloudflare distingue las categorías Search, Agent y Training.
  2. Para los nuevos dominios, Agent y Training se bloquean de forma predeterminada en las páginas que contienen publicidad.
  3. Los robots pertenecientes únicamente a Search siguen autorizados de forma predeterminada.
  4. Un crawler multiuso puede quedar sujeto a la política más restrictiva elegida por el propietario del sitio.
  5. Cada modificación debe supervisarse para identificar sus efectos sobre el rastreo y la indexación.
  6. La estrategia debe definir los usos aceptables del contenido, en lugar de tratar todos los robots de IA de la misma manera.
Fuentes y método Mostrar las referencias

Esta noticia se ha preparado a partir del anuncio oficial publicado por Cloudflare el 1er de julio de 2026, de la documentación de Cloudflare relativa a las políticas de gestión de robots de IA y de la documentación de Google Search Central dedicada a Googlebot.

  • Cloudflare — Tu sitio, tus reglas: nuevas opciones de gestión del tráfico relacionado con la IA para todos los clientes
  • Cloudflare Developers — Block AI Bots
  • Google Search Central — Presentación de Googlebot
  • Google Search Central — Requisitos técnicos de Google Search

WEB Y CIBERSEGURIDAD

Una base web fiable se prepara antes de que ocurra un incidente.

La auditoría del código, las dependencias y las rutas sensibles convierte una alerta técnica en un plan de acción controlado.

  • Prioridades y riesgos claramente definidos
  • Correcciones probadas con un plan de reversión
  • Mantenimiento organizado a largo plazo