Ir al contenido
CloudflareTelemetría de plataforma

~80%

72%un año antes

Parte del crawling de IA destinada a entrenamiento y no a recuperación

¿Los crawlers de IA recogen datos de entrenamiento o responden preguntas?

El entrenamiento explicaba cerca del 80% de la actividad de los bots de IA en julio de 2025, frente al 72% de un año antes.

ValorJulio de 2025 · Global

~80%Parte del crawling de IA destinada a entrenamiento y no a recuperación

Conviene separarlo de la cuestión de la visibilidad, porque tiran en direcciones opuestas. Un sitio que bloquea los crawlers de entrenamiento no se vuelve por ello más visible en las respuestas, y un sitio que quiere aparecer en las respuestas no está obligado a entregar datos de entrenamiento. En todos los grandes fabricantes los dos controles son independientes.

Fuente

Periodo de referencia
Ámbito geográfico
Global
Tipo de evidencia
Telemetría de plataforma
Muestra
Share of AI bot activity Cloudflare classifies as training rather than search or user action. Dominated by one bot, OpenAI's GPTBot
Para comparar
un año antes: 72%
Última verificación

No hemos consultado el instrumento primario de esta cifra: procede del resumen del propio editor o de un documento que la cita. Trate el nivel como indicativo.

Método

Cloudflare, hasta aproximadamente julio de 2025. El reparto se apoya en la clasificación que hace Cloudflare del propósito declarado de cada user-agent, la taxonomía incluye una categoría de propósito no declarado y el agregado está dominado por un solo bot, GPTBot de OpenAI. Es, por tanto, más una afirmación sobre OpenAI que sobre el crawling de IA en general.

Método →

Preguntas relacionadas

Indicadores relacionados