Por Canuto  

Los bots y agentes de inteligencia artificial ya generan cerca del 57,5% de las solicitudes que pasan por la red de Cloudflare, según reportes sobre los datos de la compañía. Su CEO, Matthew Prince, quiere que las compañías de IA paguen por el contenido que alimenta sus modelos y propone mecanismos para distinguir entre indexar una página y entrenarse con ella.
***

  • Cloudflare reportó que cerca del 57,5% de las solicitudes a sitios web provino de bots en mayo.
  • Matthew Prince advierte que el tráfico automatizado podría multiplicar por 1.000 al humano en cinco años, según la cobertura citada.
  • La configuración “Disallow AI Training” permite mantener la indexación para búsquedas mientras bloquea el entrenamiento con contenido.


El tráfico automatizado dejó de ser una fracción secundaria de internet y ya supera al generado por personas en la red administrada por Cloudflare. Reportes sobre los datos de la compañía sitúan en cerca del 57,5% la proporción de solicitudes dirigidas a sitios web que provino de bots en mayo, un cambio que llegó antes de lo previsto por su CEO, Matthew Prince, quien esperaba que el cruce ocurriera a finales del próximo año.

El crecimiento está impulsado en buena medida por rastreadores de inteligencia artificial que recopilan textos, imágenes y otros materiales para entrenar modelos. Prince sostiene que muchas de esas visitas no se convierten en lectores ni generan ingresos para los sitios que producen el contenido, por lo que plantea modificar la relación económica entre las plataformas de IA y los editores de internet.

Una web cada vez más automatizada

Cloudflare gestiona aproximadamente una quinta parte del tráfico web, lo que convierte sus mediciones en una referencia relevante para observar el comportamiento de bots y usuarios. En declaraciones recogidas por Fortune, Prince afirmó que, si la tendencia continúa, el tráfico automatizado podría alcanzar un volumen 1.000 veces superior al humano dentro de cinco años.

La proyección no describe únicamente una mayor presencia de buscadores o herramientas de seguridad, sino una transformación del funcionamiento cotidiano de internet. Los agentes de IA pueden recorrer grandes cantidades de páginas en poco tiempo, extraer información y alimentar sistemas capaces de responder preguntas sin que el usuario visite la fuente original.

Ese modelo altera la economía que durante décadas sostuvo a medios, blogs, bases de datos y otros servicios digitales. Un sitio puede recibir solicitudes, asumir los costos de servidores y producir información útil, pero perder la oportunidad de convertir esa atención en publicidad, suscripciones, registros o reconocimiento para sus autores.

Prince resumió el problema al señalar que las empresas de internet necesitan recibir pagos de las compañías de IA por el material que sirve como combustible para esos sistemas. La discusión combina una preocupación comercial con otra relacionada con los derechos de autor, porque el contenido puede ser absorbido por modelos que luego ofrecen respuestas sin mostrar claramente quién hizo el trabajo original.

La nueva separación entre búsqueda y entrenamiento

Como respuesta, Cloudflare anunció una configuración llamada “Disallow AI Training”, diseñada para que los administradores de sitios puedan permitir que sus páginas aparezcan en los buscadores y, al mismo tiempo, impedir que determinados rastreadores las utilicen para entrenar modelos. La distinción busca resolver una tensión que hasta ahora muchas herramientas de control trataban de forma demasiado general.

La indexación permite que un buscador conozca una página y la presente a una persona que está buscando información, mientras que el entrenamiento implica incorporar ese material a un sistema que puede reutilizar patrones y conocimientos en futuras respuestas. Para los editores, conservar la primera opción puede aportar tráfico, pero autorizar la segunda sin condiciones puede reducir el valor de la visita original.

Según la información publicada sobre el anuncio, Apple y Google respaldan la separación entre la visibilidad en buscadores y el uso del contenido para entrenamiento. Microsoft también ha expresado su apoyo a la preferencia de no entrenamiento, aunque su implementación está prevista para una etapa posterior.

La herramienta no resuelve por sí sola cuánto debe pagarse, cómo se verificará el uso posterior de los datos o qué ocurrirá cuando un rastreador ignore las preferencias de un sitio. Sin embargo, ofrece a los editores un mecanismo más específico para expresar sus condiciones y abre la puerta a negociaciones en las que el acceso al contenido deje de considerarse automáticamente gratuito.

Compensación, crédito y sostenibilidad

La presión sobre los creadores no se limita al dinero que una página puede dejar de recibir. Escritores, cineastas, músicos, investigadores y periodistas también dependen de que su nombre aparezca asociado con una obra, porque la reputación puede determinar nuevas oportunidades, contratos y reconocimiento público.

Prince sostuvo que la transformación de los medios digitales podría desplazar el premio a la popularidad por una valoración mayor de la credibilidad. A su juicio, la industria se ha concentrado en cómo garantizar el pago a quienes producen información, pero todavía no ha pensado lo suficiente en cómo asegurarse de que esas personas sean reconocidas por sus aportes.

El CEO de Cloudflare incluso planteó la posibilidad de crear un premio equivalente a un Óscar o un Nobel del conocimiento para ayudar a identificar a quienes originan ideas y contenidos valiosos. Aunque se trata de una propuesta conceptual, refleja una inquietud concreta: un sistema que remunera el resultado sin atribuir la fuente puede debilitar los incentivos para investigar, crear y publicar.

El problema también aparece en el frente legal. Sony Music y Warner Music presentaron una demanda contra Anthropic en la que alegan que la empresa utilizó canciones protegidas para entrenar sus sistemas. El caso se suma a la creciente disputa sobre la propiedad intelectual y el uso de materiales protegidos para desarrollar productos comerciales de inteligencia artificial.

El futuro de internet frente a la IA

La expansión de los agentes automatizados puede ofrecer beneficios, como respuestas más rápidas, herramientas de búsqueda más eficientes y servicios capaces de procesar grandes volúmenes de información. No obstante, esas ventajas dependen de una infraestructura financiada y de un ecosistema de creadores que pueda continuar produciendo el material que los modelos necesitan.

Prince advirtió que el escenario que imagina no está compuesto por cinco grandes compañías de inteligencia artificial, sino por 500.000 empresas y sistemas compitiendo por datos, capacidad informática y usuarios. En un mercado de esa escala, la ausencia de reglas para pagar y reconocer a los creadores podría multiplicar los conflictos entre plataformas tecnológicas y propietarios de contenido.

La advertencia también alcanza a la infraestructura que conecta a los usuarios con esos servicios. Cada solicitud automatizada consume recursos de redes, centros de datos y proveedores de seguridad, de modo que un crecimiento acelerado del tráfico sin un modelo de compensación puede trasladar los costos a los sitios pequeños y a las organizaciones que producen información.

El debate, por tanto, no consiste únicamente en bloquear o permitir bots, sino en definir qué tipo de acceso corresponde a cada propósito y bajo qué condiciones. La configuración de Cloudflare representa uno de los primeros intentos visibles de separar la búsqueda del entrenamiento, mientras las demandas y las negociaciones con empresas de IA pueden determinar si esa distinción se convierte en una práctica habitual de internet.

La sostenibilidad de la web dependerá de que los usuarios puedan encontrar información confiable, los creadores reciban crédito y las compañías que desarrollan modelos asuman parte del costo de los insumos que utilizan. Sin esos elementos, Prince teme que internet termine dominado por sistemas capaces de producir millones de textos, pero cada vez menos capaz de financiar a quienes verifican y crean la información original.


Imagen original de DiarioBitcoin, creada con inteligencia artificial, de uso libre, licenciada bajo Dominio Público.

Este artículo fue escrito por un redactor de contenido de IA y revisado por un editor humano para garantizar calidad y precisión.


ADVERTENCIA: DiarioBitcoin ofrece contenido informativo y educativo sobre diversos temas, incluyendo criptomonedas, IA, tecnología y regulaciones. No brindamos asesoramiento financiero. Las inversiones en criptoactivos son de alto riesgo y pueden no ser adecuadas para todos. Investigue, consulte a un experto y verifique la legislación aplicable antes de invertir. Podría perder todo su capital.

Suscríbete a nuestro boletín