🖡️ Tecnologia
Google quito los frenos a Gemini 4 Argon y nadie te dice por que
Google acaba de publicar un modelo de IA al que le quito los frenos, y solo se lo esta dando a los que se supone que lo usen para atacar. Se llama Gemini 4 Argon y es, hasta hoy, la IA mas capaz que existe.
Lo raro no es lo rapido que llego. Lo raro es como llego. Mientras OpenAI y Anthropic lanzan modelos para todo el mundo, Google decidio sacar a Argon con las puertas cerradas y esperando solo a un punado de defensores ciberneticos.
Lo primero: que es y que puede hacer
Argon no es un chatbot mas. Es el modelo frontier de Google para tareas largas y complejas: programacion, trabajo legal, finanzas y defensa cibernetica. Lo presento Koray Kavukcuoglu, SENIOR de Google DeepMind, el mismo tipo que inicio el equipo de deep learning que creo DQN y WaveNet.
El dato tecnico que mas importa: limite de salida de 1 millon de tokens. Antes eran 64K. Dieciseis veces mas aire para pensar antes de responder.
Los numeros en benchmarks son los mejores registrados en su categoria: 77.9% en DeepSWE v1.1 (ingenieria real de software), 51.3% y primer lugar en AutomationBench de Zapier, 91.7% en LVBench para comprension de video largo, y primer lugar tambien en las evaluaciones de finanzas y de Harvey para trabajo legal.
Lo que Google hizo con sus propios datos
Google no dio una demo de laboratorio. Dio numeros de produccion:
En computacion cuantica, Argon optimizo los recursos de espacio-tiempo (qubits por compuertas) de subrutinas que estaban bloqueando aplicaciones. En un caso vencio 40% por encima del baseline publicado, y lo hizo en minutos.
En infraestructura, un equipo de agentes Argon analizo telemetria de perfilado de toda la flota de centros de datos y aplico optimizaciones de memoria de forma autonoma: liberaron mas de 300 TiB de memoria, con un ahorro estimado entre 500 TiB y 1 PiB en total.
Y lo mas practico: esta migrando codigo de C/C++ a Rust dentro de Google, desde decenas de miles de lineas en librerias como re2 hasta mas de 800.000 lineas del kernel Fuchsia Zircon. En libgav1 (el decodificador de video open source), los agentes reemplazaron 32.000 lineas de codigo SIMD y produjeron un decodificador 2.7 veces mas rapido que el port en Rust, con salida de video identica.
La parte que nadie te dice: sin guardarrailes
Aqui esta el angulo crudo. Google entreno a Argon para que sea autonomo en encontrar, validar y parchear vulnerabilidades. Y decidio publicarlo, para los defensores de confianza de Google y sus propios equipos internos, sin las restricciones de ciberseguridad. Sin limites. Sin candado.
Y en la primera demostracion publica, el modelo encontro una vulnerabilidad critica que exponia informacion personal sensible en software de salud usado por hospitales en todo el mundo. Una brecha que los modelos frontier anteriores no habian detectado. Tambien empata en el primer lugar del benchmark de vulnerabilidades con 68%.
Google no lo ha lanzado a todo el mundo. Argon esta llegando unicamente a un grupo de defensores de confianza mediante el programa Fairwind. La empresa esta participando en el proceso voluntario del gobierno de EE.UU. para acceso previo a modelos antes del lanzamiento.
La velocidad viene con precio
Cuando abra al publico, empieza en $2 por millon de tokens de entrada y $10 por millon de salida. La cache de entrada tiene 95% de descuento. Ese precio introductorio se acaba: despues pasa a $4 y $20.
Es una jugada brillante de posicionamiento. Los modelos frontier se vuelven commodity en capacidad, y el valor se mueve a quien puede darlos mas baratos y a quien los deja usar de verdad.
Que significa para LATAM
Un par de cosas, y no son las bonitas.
Lo bueno: un modelo con 1M de tokens y contexto largo es exactamente lo que necesitan los equipos que trabajan con documentacion legal, contratos y expedientes medicos enormes, cosas que en LATAM se procesan mal por culpa del costo y de los limites.
Lo malo: esa misma capacidad de encontrar y parchear vulnerabilidades de forma autonoma no distingue entre un hospital en Boston y uno en Santo Domingo. El software medico mal hecho es igual de mal hecho en toda la region. Si este tipo de herramienta se comercializa rapido, la seguridad del codigo de terceros que usas en tu clinica o tu consultorio va a importar mucho mas que nunca.
Y ojo con esto: Google dice que Argon es su modelo mas resistente hasta la fecha contra prompt injection indirecto, liderando el benchmark de Gray Swan. "Hasta la fecha" es una frase de marketing. Los atacantes se adaptan.
En resumen
Google no lanzo un modelo. Lanzo una decision: abrir las capacidades ofensivas mas potentes de la IA, cerradas solo a quien jura usarlas para defenderse, y esperar a que el mundo se prepare antes de soltarla.
Es la primera vez que una empresa de este tamano pone un modelo asi en la mesa y dice dennos tiempo. Puede ser prudencia necesaria. Tambien puede ser el momento en que todos los equipos de seguridad descubren que necesitaban esas defensas hace cinco anos.
Argon llega primero a los APIs de pago y a los suscriptores de Google AI Ultra. Los demas, en los proximos meses. Mientras tanto, tu codigo sigue ahi afuera, sin parches.
Comparte esto si crees que las empresas de IA deberian publicar modelos con capacidad ofensiva antes de que existan los parches que los defienden.
Tu confias en que Google suelte esto al publico sin problemas, o crees que se esta adelantando? Dinos en los comentarios.