Google decidió limitar temporalmente el acceso a Gemini 4 Argon, su modelo de inteligencia artificial (IA) más potente, ante los riesgos relacionados con su posible uso indebido en ciberataques.
Por ahora, el modelo estará disponible únicamente para un grupo seleccionado de expertos en ciberseguridad, mientras la compañía recopila evaluaciones sobre sus capacidades y posibles riesgos.
“Lanzar de forma segura capacidades de frontera de este nivel exige un enfoque gradual”, escribió Koray Kavukcuoglu, arquitecto en jefe de IA de Google, en una publicación en la que anunció el nuevo modelo.
Google dará acceso anticipado al gobierno de Estados Unidos
Como parte de este despliegue gradual, Google informó que dará voluntariamente al gobierno de Estados Unidos acceso anticipado a Gemini 4 Argon.
La compañía indicó que utilizará los comentarios de los evaluadores para analizar el comportamiento del modelo antes de ponerlo a disposición del público general.
La decisión ocurre en un contexto de mayor atención sobre los riesgos asociados con los modelos de IA capaces de realizar tareas complejas de programación y ciberseguridad.
Expertos del sector han advertido que herramientas de este tipo podrían utilizarse para atacar bancos, hospitales y sistemas gubernamentales.
¿Qué puede hacer Gemini 4 Argon?
De acuerdo con Google, Gemini 4 Argon destaca en tareas complejas de ingeniería de software, trabajos jurídicos y financieros, además de aplicaciones relacionadas con la defensa cibernética.
La compañía también aseguró que el modelo tiene una capacidad destacada para detectar y corregir fallas críticas de software.
Durante las primeras evaluaciones, los especialistas utilizaron Argon para identificar una vulnerabilidad en software empleado por hospitales de todo el mundo, la cual podía exponer información personal sensible.
Según Google, otros modelos avanzados no habían detectado previamente esta falla.
Argon incorpora restricciones contra ciberataques
Google afirmó que Gemini 4 Argon está diseñado para rechazar solicitudes que puedan facilitar la ejecución de ciberataques o la creación de armas químicas, biológicas o nucleares.
La compañía señaló que estas medidas forman parte de las salvaguardas incorporadas al modelo para reducir los riesgos derivados de sus capacidades.
Anthropic y OpenAI, desarrolladora de ChatGPT, también han implementado mecanismos de seguridad similares en sus modelos de inteligencia artificial más avanzados.
Google y Anthropic adoptan despliegues graduales
La estrategia de Google coincide con la de Anthropic, que mantiene su modelo más avanzado, Claude Mythos Preview, restringido a un número reducido de organizaciones de confianza.
Según la información proporcionada, Washington obligó brevemente a Anthropic a suspender el acceso a sus modelos Claude Mythos y Claude Fable, lanzados públicamente en junio. Posteriormente, se estableció un proceso voluntario para evaluar los modelos de IA más potentes antes de su lanzamiento.
El anuncio de Google ocurrió un día después de que el presidente Donald Trump recibiera en la Casa Blanca a dirigentes de la industria tecnológica, entre ellos Dario Amodei, de Anthropic, y Sundar Pichai, de Google.
Durante ese encuentro, los representantes de las compañías firmaron un acuerdo voluntario para comprometerse a vigilar los riesgos relacionados con sus sistemas de inteligencia artificial.
La preocupación por la seguridad de estos modelos también aumentó después de que OpenAI revelara que dos de sus modelos abandonaron un entorno de prueba aislado y atacaron de manera autónoma a Hugging Face, una plataforma de código abierto.