📱 Tutorial
99% del tráfico de mi sitio web son bots — y yo mismo soy un scraper
Un desarrollador con 1.5 millones de páginas en su sitio descubrió algo que debería preocuparnos a todos: el 99% de su tráfico no son personas. Son bots. Y lo más irónico — su propio sitio obtiene datos mediante scraping de documentos públicos. Un scraper que se queja de otros scrapers.
La historia apareció en Hacker News con 376 puntos y más de 535 comentarios — un ratio que indica que esto toca un nervio real en la comunidad tech. Y tiene toda la razón.
🤖 El problema real: tu VPS de $5 ya no alcanza
El dueño del sitio explicó que recibe aproximadamente 1 millón de visitantes "únicos" según Cloudflare, pero sus usuarios reales son solo unas decenas al día. El resto son bots que rastrean, indexan, copian y consumen ancho de banda constantemente.
Y aquí viene el golpe: los planes de hosting económicos simplemente no están diseñados para esto. Un VPS de $5 al mes colapsa cuando miles de bots lo visitan simultáneamente. El costo real de tener un sitio web en 2026 se ha multiplicado por 10 gracias a los bots.
Los comentarios en HN revelaron casos extremos: un usuario reportó tener 99.999% de tráfico bots con Cloudflare, con solo unas decenas de usuarios humanos reales. Otros confirmaron que bloquear por geolocalización funciona... hasta que viajas al extranjero y necesitas VPN para acceder a tu propio sitio.
🌐 La web abierta está en peligro de extinción
Uno de los comentarios más impactantes del hilo dice: "La web va a convertirse en un montón de jardines amurallados privados. Los sitios se pondrán en no-index. Solo los descubrirás por referido de alguien real."
Esto no es ciencia ficción — ya está pasando. Sitios como Reddit bloquean scraping masivo, Twitter/X cerró su API gratuita, y hasta los sitios de noticias más pequeños ahora usan Cloudflare con verificación humana obligatoria. La era de la web abierta y rastreable se está acabando.
Y hay una ironía meta que no puede ignorarse: varios usuarios señalaron que el propio artículo parece haber sido generado por IA con un 95% de confianza en un detector. Un scraper escribiendo con IA sobre el problema de los scrapers. La serpiente se está devorando la cola.
🛡️ ¿Qué puede hacer un sitio web pequeño?
Las soluciones que discutieron los usuarios de HN son reveladoras del estado actual:
- Bloqueo geográfico: Funciona para sitios locales, pero rompe la experiencia para viajeros
- Rate limiting agresivo: Funciona hasta cierto punto, pero los bots modernos rotan IPs
- Cloudflare + verificación humana: El más efectivo, pero frustra a usuarios reales
- Renderizado del lado del servidor (SSR): Obliga a los bots a ejecutar JS, pero no los detiene
- API privada + autenticación: La solución más radical — cerrar la web y hacerla accesible solo por invite
Ninguna de estas soluciones es perfecta. Todas sacrifican algo: usabilidad, costo, o la filosofía misma de la web abierta.
💸 El costo oculto de los bots para Latinoamérica
En Latinoamérica el problema es peor. Los desarrolladores que operan sitios con presupuestos ajustados — un VPS de $5/mes es una inversión significativa en muchos países — se encuentran con que el 99% de sus recursos los consumen máquinas, no personas.
Servicios como Cloudflare tienen planes gratuitos que ayudan, pero no resuelven el problema de fondo: la infraestructura web fue diseñada para humanos y ahora está dominada por máquinas que la explotan sin dar nada a cambio.
Un desarrollador dominicano que paga $5/mes por hosting y recibe 1,000 visitas reales al mes está pagando el mismo precio que uno con 100,000 visitas reales — pero el 99% de esas 100,000 son bots que no generan ingresos, no comparten contenido, y solo consumen CPU y ancho de banda.
🔮 El futuro: ¿web abierta o walled gardens?
La conclusión del hilo de HN es deprimente pero clara: la web abierta tal como la conocemos está muriendo. Los bots la están matando con voracidad. Cada scraping request, cada indexación automatizada, cada crawler de IA que consume contenido sin compensar al creador está erosionando la viabilidad económica de mantener sitios abiertos.
Y el problema se retroalimenta: a medida que más sitios se cierran, los bots se vuelven más agresivos para acceder, lo que obliga a más sitios a cerrarse. Es una espiral descendente sin un final claro.
El autor del sitio original lo sabe: es un scraper que se queja de scrapers. Y tiene toda la razón en quejarse. Porque si ni siquiera los sitios que alimentan a otros sitios pueden sobrevivir al asalto de bots, ¿quién puede?
¿Tienes un sitio web o blog? ¿Cuánto de tu tráfico crees que son bots reales? Comparte esto con alguien que piensa que tener un blog es fácil — el 99% de su tráfico probablemente son máquinas.