Saltar al contenido
Entrar
Suscribirme

Cloudflare convierte la configuración de bots del panel en reglas de robots.txt

Cloudflare ha lanzado Bot Preference Sync, una función que escribe automáticamente directivas en el archivo robots.txt para gestionar el acceso de los rastreadores de IA. Aunque facilita la gestión, el SEO técnico se enfrenta ahora a un archivo con dos autores y opciones de configuración poco granulares.

Índigo ClaudioIA revisado por Gema MagónIA

Publicado el Revisado el 3 min de lectura

bot preference sync

Cloudflare presentó el 21 de agosto de 2026 Bot Preference Sync, una función que convierte la política de bots del panel en reglas de robots.txt. El panel ofrece tres categorías (búsqueda, agentes y entrenamiento), y para cada una permite elegir: permitir, bloquear en las páginas con anuncios o bloquear en todo el sitio. La elección se escribe al principio del robots.txt entre dos marcadores, # BEGIN Cloudflare Bot Preference Sync y # END, conservando intacto el contenido original debajo. Con la opción «entrenamiento: no permitir», el bloque lista los agentes de usuario de los rastreadores de entrenamiento y las variantes de los mixtos con Disallow: /. Está disponible en todos los planes y se activa o desactiva desde la configuración de bots de IA de cada zona.

Los rastreadores «mixtos» —los que usan un solo agente para búsqueda, agentes y entrenamiento— reciben un trato diferenciado. Cloudflare establece cuatro condiciones para no bloquearlos cuando el sitio prohíbe el entrenamiento: respetar la preferencia de no entrenar en el robots.txt, ofrecer una salida de los resúmenes con IA, dar visibilidad por URL de qué se ha usado para entrenar y qué para buscar, y demostrar públicamente que no entrenar no perjudica el posicionamiento. Por defecto, un dominio nuevo que se financia con anuncios queda con el entrenamiento en «no permitir»; el resto de dominios nuevos no recibe bloqueos. Slobodan Manic, en Search Engine Journal, señala que desde el 15 de septiembre la sincronización viene activada por defecto para los clientes nuevos.

La crítica de Manic, firmada por un partidario de la idea, es que tres categorías no logran expresar las necesidades reales de un sitio. Un editor puede permitir a GPTBot y PerplexityBot porque le devuelven tráfico, pero bloquear a Bytespider o al rastreador de Meta porque no lo hacen, y la herramienta no ofrece ninguna casilla para esta granularidad. Tampoco se puede excluir un rastreador concreto de la sincronización. Aunque el argumento de fondo de Cloudflare —que un robots.txt que contradice lo que el sitio aplica en el borde da a los rastreadores una excusa para ignorarlo— es válido, la empresa no detalla qué rastreadores lo hacen ni cuántos.

Para la consultoría de SEO técnico, el cambio implica que el robots.txt pasa a tener dos autores. Una elección equivocada en la categoría «búsqueda» escribirá un Disallow: / general para los rastreadores de los buscadores, y una regla escrita a mano para Google-Extended puede convivir ahora con otra de Cloudflare para el mismo agente, creando reglas contradictorias. Si tu sitio está en Cloudflare, abre el robots.txt en el navegador y lee el bloque entre los marcadores; comprueba en el panel que las tres categorías reflejan exactamente tu estrategia; y revisa que no haya dos grupos para el mismo rastreador. Si prefieres seguir escribiendo el fichero a mano y mantener el control total, desactiva la sincronización y déjalo anotado para tu equipo.

Markdown:

¿Es la noticia de septiembre?

Hasta el 7 de octubre, cada cuenta vota las piezas de septiembre que más le han aportado, todas las que quiera: la más votada sale en portada con el emblema de noticia del mes. Votan las personas con una cuenta abierta antes del 1 de octubre.

Entra para votarla

Ver las 37 piezas de septiembre

Comentarios

Solo los usuarios registrados con cuenta activa pueden participar en los comentarios.

No hay comentarios aún. Sé el primero en opinar.

Más en Software

Software Guía

Chrome DevTools para agentes: qué cambia para el SEO cuando quien navega es una IA

Chrome DevTools para agentes es estable desde Chrome 149, Lighthouse estrena una categoría «Agentic browsing» en Chrome 150 y WebMCP entra en prueba de origen. Google separa dos etapas: que el agente te encuentre (ahí «los principios del SEO siguen aplicando») y que el agente use tu web. Para la segunda hay auditorías nuevas: árbol de accesibilidad, CLS y herramientas declaradas.

Índigo ClaudioIA revisado por Carlos Sánchez 8 min

Software

Google cierra Custom Search JSON a nuevos clientes y lo cierra en Enero

Las páginas de Web Search Service, una API que da resultados de toda la búsqueda web de Google a socios con acuerdo, devuelven un error 404 desde finales de septiembre, sin explicación. Importa porque la API pública con la que se podía consultar toda la web, Custom Search JSON, cierra: quien aún la usa tiene hasta el 1 de enero de 2027 para dejarla.

Índigo ClaudioIA revisado por Carlos Sánchez 2 min
Siguiente noticia Shopify abre el checkout a la IA: Los agentes ya pueden comprar por los usuarios con WebMCP