Google anunció el lanzamiento de Gemini 4 Argon, su modelo de Inteligencia Artificial de frontera, diseñado para resolver flujos de trabajo complejos y con un marcado protagonismo en la ciberdefensa y la detección autónoma de vulnerabilidades de seguridad.
El anuncio se produce en un momento de creciente preocupación por el rápido avance de la IA.
La apuesta de Google
En la víspera, el consejero delegado de la firma, Sundar Pichai, firmó junto al presidente de Estados Unidos, Donald Trump, y otros líderes del sector el Acuerdo de la Casa Blanca sobre superinteligencia, un compromiso voluntario impulsado desde la Casa Blanca para implementar auditorías y controles internos en áreas críticas como la ciberseguridad y las amenazas biológicas.
En el ámbito de la ciberdefensa, Argon se situó en el primer puesto, empatado con otro modelo, en la prueba de referencia CWE-bench v1, que evalúa la capacidad técnica para identificar y subsanar vulnerabilidades críticas, con una puntuación de un 68%.
Además de corregir fallos, la compañía destacó que el sistema puede localizar, validar y reparar vulnerabilidades de manera autónoma en más de veinte lenguajes de programación y analizar sistemas web en funcionamiento sin acceso a su código fuente.
Google comenzará a desplegar el modelo de forma escalonada a través de su programa Fairwind, al proporcionar a los participantes acceso sin las restricciones habituales en materia de ciberseguridad para que puedan aprovechar sus capacidades defensivas.
Entre las organizaciones que ya lo utilizan figura la firma Wiz, en el marco de su iniciativa Scan for Good, donde el modelo descubrió una vulnerabilidad crítica que exponía información personal confidencial en un software utilizado en hospitales de todo el mundo, un riesgo que, según Google, no había sido detectado por otros modelos.
Este verano saltaron las alarmas éticas y de seguridad después de que un investigador de Anthropic dimitiera por dudas sobre el desarrollo responsable del sector, mientras modelos de OpenAI protagonizaron accesos no autorizados a sistemas de la plataforma Hugging Face.
El clima de cautela derivó también en que OpenAI decidiera descartar su modelo GPT-6.1 Astra, debido a preocupaciones de ciberseguridad, al subrayar la urgencia de blindar los nuevos sistemas antes de su despliegue masivo.
Solución de ciberseguridad
Google remarcó que Argon puede encontrar, verificar y reparar por su cuenta fallas graves de software. Una falla es un error en un programa que un atacante puede usar para entrar.
El sistema que la detecta para arreglarla es el mismo que la detecta para aprovecharla. No hay dos versiones.
Por eso Google entrega el modelo a los defensores de confianza y a sus propios equipos “sin barandas” de ciberseguridad: sin los filtros que lo frenan cuando alguien le pide algo riesgoso.
Para todos los demás, los filtros siguen puestos y se ajustan con lo que aprenda de este grupo.
Wiz, una empresa de seguridad, usó Argon y encontró una falla grave en un software de salud que usan hospitales de todo el mundo y que dejaba expuestos datos personales. Según Google, los modelos anteriores no la habían visto.
Una herramienta que encuentra fallas a esa escala vale lo mismo para el que repara y para el que ataca. Google elige a quién se la da primero y gana tiempo para ajustar los filtros antes de abrirla.
El 2 de junio, la Casa Blanca firmó una orden ejecutiva que creó un mecanismo voluntario: las empresas pueden darle al gobierno hasta 30 días de acceso a sus modelos más avanzados antes de entregarlos a socios de confianza, y colaborar en elegir a esos socios. Sin licencias ni permisos obligatorios, pero con la invitación sobre la mesa.
OpenAI ya había pasado por ese circuito: el 26 de junio abrió GPT-5.6 a un grupo reducido de socios elegidos, bajo revisión del gobierno, y recién el 9 de julio al público.
Google acaba de hacer lo mismo con Argon. Dos de las tres empresas que dominan el mercado ya ordenan sus lanzamientos con el Estado en la lista.
Alcanzó con una orden ejecutiva y con que el primero aceptara. Después del segundo, quedarse afuera del proceso tiene más costo que entrar.
Argon supera a GPT-6 Astra, de OpenAI, y a Claude Opus 5.5, de Anthropic, en pruebas de programación, finanzas y trabajo legal. En una de ellas, que mide tareas largas de ingeniería de software, marca 77,9%, el mejor resultado conocido.
Todas las cifras las produjo Google. Nadie fuera de la empresa y del grupo elegido puede repetir la prueba hoy.
Argon puede escribir respuestas de hasta un millón de tokens, la unidad en que estos sistemas cuentan el texto, algo así como tres cuartos de una palabra en inglés. El tope anterior era 64.000.
En la práctica, puede resolver un problema largo de un tirón, sin cortar y retomar. El precio de lanzamiento, cuando llegue a los desarrolladores: US$ 2 por millón de tokens de entrada y US$ 10 por millón de salida.
El lanzamiento dejó de ser un evento comercial y pasó a ser una fila. Primero el Estado, después los que defienden, después los que pagan, al final el resto. Quien arma la fila decide quién sabe primero qué puede hacer la máquina, y ese poder hoy lo comparten tres empresas y un gobierno.