40% de internet son bots: la IA está destruyendo la web por dentro

Red de datos con nodos de inteligencia artificial
Los bots de IA representan el 40% del tráfico total de internet. Foto: Unsplash.

La web como la conocemos está muriendo — y la culpa es de la IA

Hace una semana, el desarrollador Michał Górny tomó una decisión drástica: apagó el sistema de bugs de Gentoo Linux, uno de los proyectos open source más importantes del mundo. Su razón? Miles de bots de IA lo estaban abrumando con IPs diferentes cada vez, imposible de bloquear.

"No tengo tiempo para lidiar con esta mierda", escribió en Mastodon el 8 de agosto de 2026. "No se supone que yo tenga que estar lidiando con esto."

Y Gentoo no está solo. Según un reporte de WIRED, los bots malos ya representan el 40% de todo el tráfico de internet. No el 5%, no el 10%. El 40%. Casi la mitad de lo que se mueve en la web no son humanos.

La epidemia de bots que nadie quiere ver

El problema es mucho más grande que Gentoo. Ars Technica reportó que los desarrolladores de código abierto están bloqueando países enteros porque los bots de IA dominan el tráfico de regiones específicas. No es que un bot moleste — es que cientos de miles de IPs diferentes, todas rastreando tu sitio al mismo tiempo, generan más tráfico que toda tu base de usuarios combinada.

PatronView, una plataforma de marketing, bloqueó a Amazon después de que su bot scrapeará 117,000 páginas diarias. No era una vez al día. Era una vez cada segundo.

Y no es solo open source. Más de 340 medios de comunicación han bloqueado al Internet Archive, la organización sin fines de lucro que preserva la historia de internet. Si crees que la web es un archivo permanente, piénsalo de nuevo — los dueños del contenido están encerrando las puertas.

¿Qué están haciendo los bots exactamente?

Los bots de IA no son como los bots de antes que buscaban spam. Estos son crawlers de entrenamiento de modelos — OpenAI, Google, Meta, Amazon — y están scrapeando cada página, cada artículo, cada comment section de internet para alimentar sus próximos modelos.

El problema es que lo hacen sin permiso, sin límites, y sin consecuencias. Los servidores de open source no están diseñados para manejar cientos de miles de conexiones simultáneas de bots. Cada petición de un bot de IA es una carga real en el servidor — CPU, ancho de banda, almacenamiento.

Y cuando el proyecto no puede pagar la factura del servidor, se apaga. Así de simple. Así de triste.

La ironía: Cloudflare se DDoS-eó a sí mismo

Mientras tanto, Cloudflare — la empresa que se supone que protege internet de los ataques DDoS — se DDoS-eó a sí misma con un error en React. Un hook useEffect mal configurado en su dashboard provocó una cascada de peticiones que colapsó el servicio para miles de clientes.

La empresa que vende protección contra bots creó accidentalmente un bot que atacó su propia infraestructura. Si eso no es una metáfora perfecta de 2026, no sé qué lo es.

¿Qué podemos hacer?

robots.txt ya no funciona. Los bots de IA simplemente lo ignoran. El archivo que durante 20 años fue el código de conducta de internet ahora es papel mojado para las grandes empresas de IA.

Algunos proyectos están tomando medidas drásticas:

  • Bloqueo por IP ranges completos — desafortunadamente, esto también bloquea usuarios reales
  • Captchas agresivas — que afectan la experiencia de los usuarios legítimos
  • APIs con autenticación — que rompen herramientas de desarrolladores
  • Cierre total de servicios — la opción más triste pero cada vez más común

Ninguna de estas soluciones es ideal. Cuando la IA se alimenta de internet sin pedir permiso, todos pierden.

El problema real: quién paga la factura

OpenAI gasta millones en GPUs para entrenar modelos. Google gasta miles de millones. Pero el contenido que entrenan esos modelos lo generaron usuarios gratuitos de internet. Los blogs, los foros, la documentación técnica, los comentarios — todo eso fue creado por humanos sin esperar nada a cambio.

Y ahora las empresas de IA están cargando el costo de su entrenamiento en los servidores de los creadores. Es como si un restaurante usara los ingredientes de otro restaurante sin pagar, y cuando el dueño se queja, le dicen "es para el progreso de la humanidad".

El desarrollador de Gentoo lo resumió mejor que nadie: "No se supone que yo tenga que estar lidiando con esto."

Lo que viene

Si este ritmo continúa, 2026 será el año en que la web open source como la conocemos dejó de funcionar. Los proyectos pequeños no podrán soportar el tráfico de bots. Los blogs personales se cerrarán. Los foros técnicos desaparecerán.

Y todo para entrenar modelos que las grandes empresas venderán a otros humanos que antes leían esa contenido gratis.

Comparte esto si crees que la IA debería pedir permiso antes de absorber internet.

¿Tú qué piensas? ¿Los bots de IA deberían tener límites legales de scraping? ¿O "si está en internet es libre"? Cuéntame en los comentarios 👇