Más Robots que Humanos en el Tráfico Web
El reciente análisis de Cloudflare ha revelado un cambio significativo en la dinámica del tráfico en línea: actualmente, los robots superan en número a los humanos que navegan por las páginas web. Este año, el tráfico humano representó el 47% de todas las solicitudes HTML, mientras que los bots no asociados a inteligencia artificial (IA) generaron el 44%, y los rastreadores de IA aportaron un 4.2% adicional. Este fenómeno marca un hito en la historia de la navegación web.
Crecimiento del Tráfico Online
Durante el último año, el tráfico en línea a nivel mundial experimentó un aumento cercano al 20%, impulsado principalmente por el uso de bots por parte de grandes corporaciones tecnológicas. Estos bots son esenciales para el funcionamiento de buscadores y para el entrenamiento de sofisticados modelos de IA. El incremento del tráfico se observó en varias fases, comenzando con un crecimiento gradual a partir de mayo, que alcanzó un aumento del 5% en comparación con el volumen de referencia establecido entre el 12 y el 18 de enero.
A partir de agosto, la tendencia de crecimiento se aceleró, culminando en un aumento anual del 19%, superando el incremento del 17% registrado en 2024.
Protocolo de Licencias para el Uso de Contenidos
En un esfuerzo por regular el uso de contenido en el entrenamiento de IA, se ha creado un protocolo estandarizado que permite a los propietarios de contenido definir las condiciones de pago para los desarrolladores de IA que extraen información de sus sitios web. Esta medida se convierte en un paso importante para proteger los derechos de los creadores de contenido.
El Dominio de los Bots y la IA en el Tráfico Web
Los servicios en línea como Google y Facebook siguen siendo los más utilizados a nivel mundial, pero la creciente adopción de soluciones de IA generativa es evidente. ChatGPT de OpenAI se posiciona como la herramienta más utilizada, mientras que otros servicios como Claude de Anthropic y GitHub Copilot de Microsoft han ganado relevancia. La entrada de nuevos competidores en el mercado resalta la rápida evolución del sector.
El informe de Cloudflare subraya que, en 2025, los bots y rastreadores de IA han suscitado controversia debido a su consumo intensivo de contenido, ya que no todos cumplen con las directrices de los propietarios para limitar el rastreo. Una proporción significativa del tráfico en línea depende de estos sistemas automatizados, lo que plantea preocupaciones sobre la sostenibilidad y la ética en su uso.
Diferencias en Tráfico por Origen
A inicios de año, los rastreadores no basados en IA eran responsables de la mitad de las solicitudes HTML, superando en siete puntos porcentuales el tráfico generado por usuarios humanos. Para principios de junio, esta diferencia se amplió a 25 puntos porcentuales. Aunque la brecha se ha ido reduciendo, el 2 de diciembre, el tráfico humano representó el 47%, mientras que los bots no asociados a IA generaron el 44%.
La participación de los bots de IA, aunque menor, también ha mostrado fluctuaciones. En abril, alcanzaron un mínimo del 2.4%, mientras que a finales de junio su participación se elevó al 6.4%.
Funciones de los Bots de IA
La mayoría de los bots de IA se utilizan para tres propósitos clave: entrenamiento, búsqueda y acciones del usuario. El rastreo para entrenamiento es el que más tráfico genera, superando por mucho al rastreo para búsquedas y acciones de usuario. Este fenómeno está influenciado en gran medida por el GPTBot de OpenAI.
A medida que avanza el año, ha habido un notable aumento en el rastreo vinculado a acciones de los usuarios, que se multiplicó por más de 21 veces entre enero y diciembre.
Reacción de la Industria Editorial
El análisis concluye con una preocupación generalizada por el uso indebido de publicaciones por parte de empresas tecnológicas para entrenar modelos de IA. Los editores han expresado su inquietud sobre cómo este tráfico no se traduce en visitas a sus sitios web, afectando sus oportunidades de ingresos publicitarios.
Iniciativas como la Data Provenance Initiative están tomando medidas para restringir el acceso a los contenidos que anteriormente eran públicos, haciendo que un 25% de los datos considerados de mayor calidad se vuelva inaccesible. Esto representa un cambio significativo en la forma en que el contenido en línea es utilizado y monetizado.
