Table of Contents
Resumen
Cloudflare anuncia controles independientes para gestionar el rastreo destinado a búsquedas, entrenamiento de modelos y agentes de inteligencia artificial. Disallow AI Training busca permitir que los editores rechacen el entrenamiento conservando el acceso para búsquedas de rastreadores compatibles. La clasificación Accountable contempla capacidades disponibles y compromisos pendientes de implementación. El artículo explica las diferencias entre entrenamiento, resúmenes y visitas automatizadas, así como sus implicaciones para la sostenibilidad de los medios. Las medidas no garantizan compensación económica ni eliminan usos anteriores del contenido.
Los nuevos controles separan las preferencias de búsqueda, entrenamiento y agentes de IA. Para los medios digitales, abren una discusión sobre visibilidad, autonomía editorial y sostenibilidad económica. Los medios necesitan que sus contenidos sean encontrados, pero también decidir cómo se utilizan. Esa tensión se intensifica cuando un mismo rastreador recopila páginas para alimentar un buscador y entrenar modelos de inteligencia artificial. Cloudflare anunció nuevos controles para separar esas preferencias y una clasificación denominada Accountable, que reconoce tanto capacidades disponibles como compromisos de implementación de los operadores. La propuesta permite gestionar con mayor precisión el acceso automatizado, aunque no resuelve por sí sola la remuneración del contenido ni garantiza que todos los controles estén plenamente implementados.
Aspectos clave
- Tres controles independientes: búsqueda, entrenamiento de modelos y agentes de IA.
- Exclusión del entrenamiento: Disallow AI Training busca conservar el acceso para búsquedas de rastreadores compatibles.
- Clasificación con compromisos: Accountable incluye funciones operativas y otras pendientes de implementación.
- Configuraciones según el negocio: Cloudflare propone restricciones mayores para nuevos sitios financiados con publicidad.
- Resúmenes de IA: su exclusión constituye una decisión distinta del entrenamiento.
- Alcance limitado: los controles anunciados no implican pagos automáticos a los creadores ni eliminación de usos anteriores.
La visibilidad ya no garantiza el mismo intercambio
San Francisco, California, EE. UU., 18 de septiembre de 2026.— Publicar una investigación, entrevistar a un especialista o elaborar una explicación técnica requiere tiempo, experiencia y recursos. El buscador ha sido una vía para conectar ese trabajo con lectores que visitan el medio.
La IA introduce nuevas formas de intermediación. Un sistema puede utilizar contenido durante el entrenamiento de un modelo, consultarlo para responder una pregunta o recuperarlo mediante un agente que actúa por encargo de una persona.
Cada uso plantea una relación diferente con el editor. Una cita puede aportar reconocimiento; una visita permite que el lector conozca la publicación, encuentre otros artículos o se suscriba. Ninguno de esos resultados debe darse por supuesto.
En este contexto, Cloudflare (NET) anunció el pasado 15 de septiembre de 2026 controles destinados a separar las decisiones sobre búsqueda, entrenamiento y agentes.
El problema que busca resolver es concreto: que rechazar el entrenamiento no obligue a bloquear también un rastreador necesario para aparecer en búsquedas.
Cuatro usos del contenido que conviene distinguir
| Uso | Qué ocurre | Pregunta para el editor |
|---|---|---|
| Búsqueda tradicional | Un rastreador recopila información para construir o actualizar un índice. | ¿Quiero que estas páginas puedan encontrarse en el buscador? |
| Entrenamiento de IA | El contenido se utiliza para desarrollar o ajustar un modelo. | ¿Autorizo este uso de mi trabajo? |
| Respuestas y resúmenes de IA | El sistema utiliza información para elaborar una respuesta, sin que ello implique necesariamente entrenar el modelo. | ¿Cómo aparece mi contenido y qué retorno recibo? |
| Agentes de IA | Un sistema visita páginas o realiza tareas por encargo de un usuario. | ¿Qué accesos y acciones quiero permitir? |
Esta separación también importa para interpretar los resultados. Bloquear entrenamiento no equivale automáticamente a desaparecer de las respuestas de IA, y permitir búsquedas no significa aceptar cualquier reutilización del contenido.
Qué propone Cloudflare
Según el comunicado, Cloudflare sustituirá su interruptor general Block AI Bots por controles independientes para búsquedas, entrenamiento y agentes.
También anuncia Bot Preference Sync, que reemplaza a Managed Robots.txt y permite expresar las preferencias una vez y sincronizarlas con los rastreadores compatibles.
La propuesta combina dos mecanismos: comunicar preferencias y controlar el acceso. Un archivo robots.txt expresa instrucciones para los operadores; el bloqueo técnico permite impedir determinadas solicitudes que llegan al sitio.
La diferencia entre opciones resulta decisiva. La documentación de Cloudflare explica que Disallow AI Training mantiene el acceso de los rastreadores mixtos Accountable para búsquedas, mientras que seleccionar Block puede detener también esos rastreadores. No son configuraciones equivalentes. Fuente: explicación técnica de Cloudflare.
Matthew Prince, cofundador y director ejecutivo de Cloudflare, plantea así el objetivo:
Así es como mejoramos Internet: mantenemos la apertura que hace que las búsquedas sean útiles y ofrecemos a las personas y empresas que crean contenidos en la web un mayor control sobre el uso de su trabajo», afirmó Matthew Prince, cofundador y director ejecutivo de Cloudflare. «Queremos seguir colaborando con empresas como Apple, Google y Microsoft para contribuir a crear un ecosistema saludable».
Accountable: requisitos y compromisos pendientes
Cloudflare establece cuatro criterios para su clasificación:
- Ofrecer un mecanismo claro para excluir contenido del entrenamiento mediante robots.txt o un estándar equivalente.
- Permitir la exclusión de los resúmenes de búsqueda generados por IA.
- Proporcionar información por URL sobre los usos del contenido.
- Confirmar públicamente que excluirse del entrenamiento no perjudica el posicionamiento en búsquedas tradicionales.
El comunicado sitúa a Apple, Google y Microsoft dentro de esta clasificación. Sin embargo, Accountable no significa que todas las capacidades estén terminadas: también admite compromisos con plazos definidos.
Un ejemplo relevante es Bing. Cloudflare reconoce que Disallow AI Training todavía no comunica automáticamente a Bing la preferencia de exclusión mediante robots.txt. Su documentación sitúa el soporte previsto para comienzos de 2027 e identifica mecanismos adicionales disponibles mientras tanto. Fuente: alcance y limitaciones por operador.
Por tanto, el editor necesita revisar el comportamiento de cada operador, incluso cuando figure dentro de la clasificación.
Google: entrenamiento y respuestas generativas tienen controles diferentes
Google documenta que Google-Extended permite gestionar determinados usos del contenido para entrenar futuros modelos Gemini y para fundamentar respuestas en Gemini Apps y ciertos servicios de Vertex AI. No afecta la inclusión ni actúa como señal de posicionamiento en Google Search. No es un rastreador independiente: funciona como un identificador de control dentro de robots.txt. Fuente: documentación de Google-Extended.
Por separado, Google describe un control en Search Console para decidir la participación en funciones generativas de búsqueda, como AI Overviews y AI Mode. La página oficial indica que su despliegue mundial se completó el 31 de agosto de 2026. Excluirse de esas funciones elimina las impresiones y el tráfico procedentes de ellas; Google afirma que esa elección no se utiliza como señal de ranking fuera de las funciones generativas. Fuente: controles para propietarios de sitios.
La consecuencia práctica es importante: la política sobre entrenamiento y la política sobre distribución mediante respuestas generativas deben evaluarse por separado.
Qué recomiendan para sitios financiados con publicidad
El comunicado presenta dos configuraciones recomendadas para nuevos sitios incorporados a Cloudflare:
| Modelo del sitio | Búsquedas | Entrenamiento de IA | Agentes de IA |
|---|---|---|---|
| Con ingresos publicitarios | Permitidas | Exclusión del entrenamiento | Bloqueados en páginas con publicidad |
| Resto de sitios | Permitidas | Permitido | Permitidos |
Son recomendaciones modificables, no una obligación editorial.
Para un medio, el criterio económico es comprensible: la publicidad suele requerir que una persona visite la página. Pero también existen objetivos de reconocimiento, distribución y relación con nuevas audiencias.
La decisión merece seguimiento. Conviene observar visitas referidas, interacción, suscripciones y oportunidades comerciales, además del volumen de solicitudes automatizadas. El número de accesos de un bot, por sí solo, no mide el valor que recibe el editor.
Qué dicen las cifras y cuál es su alcance
Cloudflare reporta que los rastreadores que combinan búsqueda y entrenamiento representan el 36,6 % del tráfico de rastreadores verificado en su red.
El comunicado también señala que menos del 1 % de los propietarios de sitios bloquea rastreadores de búsqueda, mientras que el 17 % limita el uso de sus contenidos para entrenamiento.
Estas cifras describen el universo observado y reportado por Cloudflare. No representan automáticamente a todos los sitios de Internet, ni permiten calcular cuánto ingreso pierde un medio por la IA. La nota tampoco desarrolla la metodología completa ni el período de observación de esos porcentajes.
Los límites: control de acceso, reconocimiento y remuneración
La propuesta ofrece herramientas para expresar decisiones y aplicarlas a determinados accesos. No anuncia una remuneración automática para quienes permiten el entrenamiento ni un mecanismo para retirar contenidos de modelos ya entrenados.
Tampoco puede interpretarse como una garantía de que desaparecerá toda extracción no autorizada. La efectividad depende de los accesos que se puedan identificar y controlar, de la configuración del sitio y del comportamiento de los operadores.
Para el periodismo, quedan preguntas de fondo: cómo se identifica la fuente original, cómo se preserva el contexto y qué condiciones permiten financiar nuevas investigaciones. Son asuntos relacionados con el acceso, pero no quedan resueltos mediante un interruptor técnico.
Cloudflare plantea, además, centralizar controles más detallados sobre resúmenes a comienzos de 2027. Es un objetivo futuro anunciado, no una capacidad que deba darse por disponible hoy.
¿Por qué es importante?
Para un medio digital, una visita puede convertirse en ingresos publicitarios, suscripciones o una relación duradera con el lector. Cuando el contenido alimenta sistemas de IA sin ese retorno, cambia la economía de producir información. Separar permisos ayuda a decidir cómo participar, aunque no garantiza compensación ni recuperación de tráfico.
Datos citables
Según el comunicado proporcionado:
- Fecha del anuncio: 15 de septiembre de 2026.
- Rastreadores de uso mixto: 36,6 % del tráfico de rastreadores verificado en la red de Cloudflare.
- Bloqueo de búsquedas: menos del 1 % de los propietarios de sitios, según las cifras reportadas.
- Restricciones al entrenamiento: 17 %, dentro del universo descrito por la compañía.
- Controles diferenciados: tres categorías —búsqueda, entrenamiento y agentes—.
- Criterios Accountable: cuatro requisitos, que pueden incluir compromisos de implementación.
- Próxima etapa anunciada: gestión centralizada más granular de resúmenes a comienzos de 2027.
Knowledge Layer | Glosario
- Rastreador o crawler: programa que visita páginas de forma automatizada para recopilar información.
- Indexación: organización del contenido en un índice que permite recuperarlo mediante búsquedas.
- Entrenamiento de IA: proceso que ajusta un modelo a partir de datos.
- Fundamentación o grounding: consulta de información para apoyar una respuesta del modelo durante su uso.
- Rastreador de uso mixto: sistema que recopila contenido para más de una finalidad, como búsqueda y entrenamiento.
- robots.txt: archivo que comunica instrucciones de rastreo; no constituye por sí solo una barrera de acceso.
- Agente de IA: sistema que utiliza herramientas para realizar tareas por encargo de una persona.
- Tráfico referido: visitas que llegan a un sitio a través de enlaces en otros servicios o páginas.
Preguntas y respuestas
¿Puedo rechazar el entrenamiento y seguir apareciendo en búsquedas?
Existen mecanismos para separar ambas decisiones. Su alcance depende del operador y de la configuración elegida. Disallow AI Training y el bloqueo completo de un rastreador no producen el mismo resultado.
¿Bloquear entrenamiento impide que mi artículo aparezca en un resumen de IA?
No necesariamente. El entrenamiento y la elaboración de respuestas con contenido consultado son procesos distintos y pueden tener controles separados.
¿Accountable significa que todas las funciones ya están disponibles?
No. La clasificación de Cloudflare también reconoce compromisos de implementación. Es necesario revisar las capacidades y limitaciones de cada operador.
¿La medida garantiza pagos a los medios?
No. El anuncio trata sobre preferencias y controles de acceso. No establece una compensación automática por utilizar los contenidos.
¿Estas herramientas borran lo que un modelo ya aprendió?
El comunicado no anuncia esa capacidad. Limitar accesos o usos posteriores no equivale a retirar información de un modelo previamente entrenado.
Visión Estratégica
Para los medios peruanos y latinoamericanos, la oportunidad consiste en convertir una discusión abstracta sobre IA en una política editorial y comercial explícita. Cada publicación puede definir qué usos acepta, qué retorno espera y cómo medirá los resultados. Esa decisión necesita participación de la dirección, la redacción y el equipo técnico: está en juego tanto la distribución como la capacidad de seguir produciendo información original. Desde nuestra perspectiva, una relación sostenible requiere consentimiento comprensible, atribución y condiciones que reconozcan el trabajo periodístico. Los controles anunciados aportan herramientas, pero el equilibrio dependerá de su cumplimiento y de acuerdos que permitan que la innovación también sostenga a quienes alimentan el conocimiento público.
Tu Opinión Nos Importa ツ
¿Aceptarías que tus artículos entrenen modelos de IA? ¿Qué condiciones considerarías indispensables: autorización, atribución, visitas, remuneración o una combinación de ellas?
Me interesa conocer tu posición como lector, creador o responsable de un medio. Comparte tu opinión con los hashtags #itusersawards2026 y #superfan.
Apoya al Periodismo Independiente

¿Te sirvió en algo este contenido?, ayúdanos a combatir la Desinformación, dona desde S/ 1.00 a nuestro PLIN 943-438-457

