🔥 Polémica
El mercado negro de la IA: así funciona la reventa de tokens de ChatGPT y Claude
Imagina esto: mientras tú pagas $20 al mes por ChatGPT Plus o $200 por Claude Pro, hay desarrolladores en China consiguiendo el mismo acceso a los modelos más potentes por $2.60 al mes. O incluso menos. No es una promo. Es un mercado negro que mueve millones.
Se llama «token relay» o «estación de transferencia», y es la infraestructura invisible que alimenta un ecosistema de fraude, reventa y acceso no autorizado a los modelos de IA más caros del mundo. Y está funcionando a plena vista.
¿Qué es un relay de tokens?
Un relay es un servicio que actúa como intermediario entre tú y los modelos de IA de OpenAI, Anthropic o Google. En lugar de pagar directamente a la compañía, le pagas al relay, que redirige tu tráfico a través de cuentas robadas, tarjetas de crédito virtuales o créditos gratuitos obtenidos de forma masiva.
El resultado: acceso a los mismos modelos por una fracción del precio oficial. Literalmente. Un operador chino listaba el equivalente a $3,333 en crédito oficial de Anthropic por apenas 425 RMB — eso es $0.13 por cada $1 de uso oficial. Un 87% de descuento.
Las cuatro capas del mercado negro
El ecosistema no es un tipo con una cuenta robada. Es una industria organizada en cuatro niveles:
1. Mercaderes de tarjetas virtuales y cuentas robadas. Venden tarjetas de crédito virtuales diseñadas para pasar los controles de facturación de EE.UU. y Europa, junto con cuentas registradas en masa. Son la base de toda la pirámide.
2. Pools de cuentas. Agregan decenas o cientos de cuentas de upstream (proveedores), manejan los tokens de autenticación, los rate limits y el failover cuando una cuenta es detectada y bloqueada. Exponen una sola API.
3. Relays / estaciones de transferencia. Envuelven la API del pool en un producto limpio, con facturación en chino, soporte por WeChat y precios competitivos. Compiten entre sí por ofrecer el descuento más grande.
4. Compradores finales. Desarrolladores chinos, startups, SaaS que buscan inferencia barata — y también compradores comerciales que usan la infraestructura para destilación de modelos.
El software que lo hace posible
Casi todos los relays funcionan con uno de dos proyectos open source: one-api (el más usado, aparece 4 veces más que su competidor) o new-api (un fork con facturación integrada).
Ambos son paneles compatibles con OpenAI. Un operador lo despliega, añade canales con pools de claves API, y expone un solo endpoint. Cada petición saca una clave del pool, la reenvía al proveedor original, devuelve la respuesta y descuenta del saldo del comprador.
No hay nada ilegal en el software. Empresas legítimas lo usan para gestionar sus propias cuentas. El problema es cuando los canales se llenan con claves robadas, filtradas o compartidas, y se revenden violando los términos de servicio.
Los métodos del fraude
Los operadores no se limitan a revender cuentas robadas. Tienen un arsenal de técnicas:
🧾 Abuso de créditos gratuitos: Automatizan la creación masiva de cuentas para reclamar los créditos iniciales que OpenAI y Anthropic regalan a nuevos usuarios. Luego redirigen todo ese tráfico a sus propios clientes.
💳 Chargeback cycling: Usan tarjetas de crédito para comprar créditos, consumen el acceso, y luego disputan el cargo con el banco. La compañía de IA pierde el dinero pero el crédito ya fue usado.
🔑 Tokens de capa aplicación: No solo roban cuentas de laboratorio. También cosechan tokens de aplicaciones de consumo que usan modelos de IA por detrás. Para un pool, da igual si el token viene de un laboratorio o de una app: todo es explotable.
⚡ Ataques de agotamiento: Una forma emergente de abuso donde los atacantes lanzan una avalancha de peticiones concurrentes solo para quemar el presupuesto del proveedor. No hay motivación financiera — es sabotaje puro.
¿Por qué debería importarte?
Porque este mercado no solo afecta a OpenAI y Anthropic. Te afecta a ti. Los costos del fraude se trasladan a los precios que pagan los usuarios legítimos. Las empresas de IA pierden millones al día en abuso de créditos y cargos disputados.
Y hay un ángulo más oscuro: algunos de estos relays chinos están siendo usados por startups occidentales que cierran los ojos y compran tokens baratos para sus productos. Cuando el relay es detectado y cerrado, su servicio se cae. Han construido su negocio sobre arena.
Más preocupante aún: si un relay puede redirigir tu tráfico, también puede interceptarlo, modificarlo o inyectar respuestas maliciosas. Estás pagando por acceso a IA, pero no sabes qué está pasando realmente entre tu petición y la respuesta del modelo.
El tamaño del problema
Foros chinos enteros están dedicados a discutir abiertamente estos métodos. Los operadores compiten en precios, comparten técnicas para evadir la detección y celebran cuando logran mantener una cuenta activa por meses.
Un solo operador en un foro chino vendía acceso a modelos de Anthropic a 13 centavos por cada dólar de valor oficial. La escala sugiere que no es un tipo con una cuenta robada — es una operación industrializada con cientos o miles de cuentas simultáneas.
No estamos hablando de un hackeo. Estamos hablando de un mercado paralelo completamente funcional con su propia cadena de suministro, software especializado, atención al cliente y competencia de precios. Es la economía sumergida de la IA, y está creciendo.
La próxima vez que veas un servicio de IA "demasiado barato para ser verdad", probablemente lo sea. Y lo más probable es que esté funcionando sobre un relay chino que tú — y tu bolsillo — están financiando sin saberlo.
Comparte esto con alguien que todavía cree que los $20 de ChatGPT son caros. Hay cosas mucho más baratas — y mucho más turbias.