GPT-6 Sol y Claude Opus 5.5 ya disponiblesGPT-6 Sol por la mitad del precio de 5.6 Sol
Blog
Guía

Análisis de Gemini 4 Argon: un gran lanzamiento, todavía sin API pública

Argon parece una actualización frontier seria, pero la decisión sensata hoy es evaluar la evidencia y esperar un contrato invocable antes de mover tráfico de producción.

13 min de lecturaOmniaKey
Gemini 4 ArgonGemini 4análisis de modeloprecio de APIciberseguridad

Gemini 4 Argon es el primer modelo frontier de Google dentro de Gemini 4. Google lo anunció el 2026-09-30 para ingeniería de software de larga duración, trabajo de conocimiento empresarial y ciberseguridad defensiva. El lanzamiento es real, pero el acceso es gradual: primero llega a defensores cibernéticos de confianza mediante el programa Fairwind, y después a clientes de API de pago y suscriptores de Google AI Ultra.

Por eso este texto es un análisis del lanzamiento, no un benchmark práctico de la API. Google comunica resultados fuertes en DeepSWE, AutomationBench, LVBench y evaluaciones de seguridad. Artificial Analysis ya tiene una instantánea independiente inicial, aunque su panel de velocidad todavía está incompleto. No usamos una credencial de Gemini ni ejecutamos una solicitud facturable, y Argon no aparecía en el catálogo público de OmniaKey al comprobarlo.

Datos comprobados el 2026-10-01. Los datos de lanzamiento y las puntuaciones del proveedor proceden del anuncio y los materiales de seguridad de Google. Las cifras independientes están identificadas por separado. Google todavía no ha publicado un model ID público estable, un contrato de endpoint, una guía de migración de SDK ni una fecha de disponibilidad general; por eso no inventamos una petición ni afirmamos acceso de producción.

Respuesta rápida

PreguntaRespuesta verificada al 2026-10-01
¿Qué se lanzó?Gemini 4 Argon, un modelo frontier para código, conocimiento empresarial y ciberdefensa.
¿Puede llamarlo cualquiera hoy?No. Empieza con defensores de confianza y luego se amplía a clientes de API de pago y suscriptores de Google AI Ultra.
¿Cuál es el API model ID?Google anunció el nombre del producto, pero no un ID de API público estable. No adivines gemini-4-argon.
¿Cuál es el límite de contexto o salida?Google dice que la salida llega a 1M de tokens, frente a 64K en modelos Gemini anteriores. El contrato de entrada final sigue pendiente.
¿Cuál es el precio inicial?$2 por 1M de tokens de entrada y $10 por 1M de salida; la entrada en caché tiene un 95% de descuento.
¿Qué ocurre después del periodo inicial?Google indica $4 por 1M de entrada y $20 por 1M de salida.
¿Existe un benchmark público reproducible?Google publica resultados propios y Artificial Analysis muestra un Intelligence Index inicial de 53. No ejecutamos un benchmark facturable propio.
¿OmniaKey enruta Argon?No aparecía en el catálogo público de OmniaKey en la fecha de comprobación. Consulta el catálogo antes de planificar una migración.

El veredicto corto es prometedor, pero no listo para cambiar producción sin pruebas. Cuando tu cuenta pueda llamarlo, merece estar arriba de la cola de evaluación. Mientras tanto, usa una ruta validada como Gemini 3.8 Flash como línea base.

Qué anunció Google

Google llama a Argon su nuevo modelo frontier y dice que ya impulsa flujos internos. El primer grupo externo son defensores cibernéticos de confianza del programa Fairwind. La compañía afirma que lo ampliará a desarrolladores, empresas y consumidores “lo antes posible”, empezando por clientes de API de pago y suscriptores de Google AI Ultra.

Un anuncio demuestra que el modelo existe, pero no que todos los proyectos de Google AI Studio, regiones, SDK, gateways y cuentas puedan llamarlo. La anterior guía sobre el estado de Gemini 4 separaba correctamente un programa de entrenamiento nombrado de un modelo API invocable. Argon ya es un producto anunciado; la disponibilidad amplia sigue siendo una comprobación distinta.

Perfil de capacidades

CapacidadLo publicadoCómo leerlo
Razonamiento largoRazonamiento profundo para flujos complejos y de varios pasosEs un objetivo de uso, no una garantía para todo prompt largo.
Ingeniería de softwareDeepSWE v1.1 de 77.9% en el informe de GoogleResultado del proveedor con un arnés y configuración concretos.
Trabajo empresarialCódigo, finanzas, investigación legal, redacción y análisis visualRequiere pruebas de aceptación por dominio.
MultimodalidadComprensión visual de gráficos, documentos y vídeos largosEl artículo de lanzamiento no publica el esquema completo de entrada.
CiberdefensaDescubrimiento, validación y corrección de vulnerabilidadesAcceso y guardas difieren para defensores y usuarios generales.
SalidaHasta 1M de tokens según GoogleEs un límite, no una recomendación para generar un millón de tokens.

Google también describe ejemplos internos: Argon superó en 40% una línea base de optimización cuántica, liberó más de 300 TiB de memoria al analizar una flota de centros de datos y aceleró a 2,7 veces un port de Rust del decodificador libgav1 frente a la implementación Rust existente. Son afirmaciones sobre flujos de Google, no mediciones independientes. Las reescrituras grandes pasaron auditorías automáticas y manuales antes de producción.

El perfil práctico es claro: Argon busca tareas que exigen planificar, usar herramientas, inspeccionar mucha evidencia y mantener coherencia durante muchos pasos. Una pregunta de chat corta no mide esa ventaja.

Benchmarks: una señal fuerte con un límite claro

EvaluaciónGemini 4 ArgonQué dice Google que mide
DeepSWE v1.177.9%Ingeniería de software de larga duración
AutomationBench51.3%Ejecución de funciones empresariales de extremo a extremo
LVBench91.7%Comprensión de vídeo largo
CWE-bench v168%Corrección de vulnerabilidades; empate en primer lugar
Vals Finance Agent v2Se afirma resultado líderInvestigación financiera de varios pasos
Harvey Legal Agent BenchmarkSe afirma resultado líderInvestigación y redacción legal

Estas cifras permiten una conclusión concreta: Google está apuntando a tareas donde importan el contexto largo, las herramientas y el razonamiento sostenido. No demuestran un ranking universal. DeepSWE usa la configuración de Google, y los proveedores pueden diferir en prompts, arnés, reintentos, permisos y criterios de parada.

9to5Google recogió la comparación de DeepSWE de Google: Argon 77.9%, Claude Opus 5.5 74.2% y GPT-6 Astra 74.1%. Es contexto de lanzamiento, no una prueba independiente con las mismas condiciones. Artificial Analysis muestra un Intelligence Index de 53 para su instantánea de alto razonamiento; la velocidad aún figura como no disponible.

Para decidir, registra modelo, ajuste de razonamiento, herramientas, contexto, reintentos, tokens de salida, latencia, resultado aceptado y minutos de corrección humana. Sin esos campos, un resultado de benchmark no predice coste ni fiabilidad del agente.

Por qué la ciberseguridad condiciona el lanzamiento

Google no trata Argon como un lanzamiento normal. Los defensores de confianza y los equipos internos recibirán una versión sin guardas cibernéticas para aprovechar la capacidad defensiva completa, mientras que la disponibilidad general sigue reforzando las defensas contra el abuso.

El anuncio menciona cuatro áreas:

  1. Prevención del abuso. Mejorar la detección del uso indebido en ataques cibernéticos y CBRN sin bloquear investigación legítima de doble uso.
  2. Inyección indirecta. Entrenamiento adversarial y red teaming contra instrucciones ocultas en contenido recuperado.
  3. Supervisión de desalineación. Supervisar razonamiento y acciones y detener la ejecución si supera la intención del usuario.
  4. Entornos endurecidos. Aislar y sellar sandboxes antes de evaluaciones de alto riesgo.

Esas son afirmaciones de seguridad y controles de lanzamiento, no permiso para probar sistemas ajenos. Usa código propio, vulnerabilidades sintéticas, una red aislada y una condición de parada explícita.

Precio y estado de la API

ConceptoPrecio Argon publicado por Google
Entrada introductoria$2.00 / 1M tokens
Salida introductoria$10.00 / 1M tokens
Entrada en caché95% menos que la entrada, o $0.10 / 1M al precio inicial
Después de la introducción$4.00 entrada / $20.00 salida por 1M tokens

Es el precio del proveedor, no una tarifa de OmniaKey. El anuncio tampoco fija fecha de disponibilidad general, model ID exacto, endpoints aceptados, límites de velocidad, condiciones Batch, reglas regionales ni contrato final de caché.

No pegues gemini-4-argon en un cliente suponiendo que es un ID válido. Cuando exista la página del modelo, comprueba a la vez la cadena exacta, versión de API, SDK, controles de pensamiento, streaming, esquemas de herramientas y contabilidad de salida. El catálogo vivo define la disponibilidad y precio de OmniaKey; el 1 de octubre Argon no estaba listado.

Puedes consultar ambos catálogos sin poner la clave en la URL:

bash
set -o pipefail
curl --fail-with-body --silent --show-error \
  https://generativelanguage.googleapis.com/v1beta/models \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
| jq -r '.models[]?.name | sub("^models/"; "") | select(. == "gemini-4-argon" or startswith("gemini-4-argon-"))'
bash
set -o pipefail
curl --fail-with-body --silent --show-error https://api.omniakey.com/v1/models \
  -H "Authorization: Bearer $OMNIAKEY_API_KEY" \
| jq -r '.data[]?.id | select(. == "gemini-4-argon" or startswith("gemini-4-argon-"))'

Una respuesta vacía solo describe esa credencial y ese momento. No descarta un acceso privado ni justifica inventar un alias de producción.

Qué dice la primera instantánea independiente

Artificial Analysis lista Gemini 4 Argon (High) como modelo de razonamiento con entrada de texto e imagen, salida de texto y contexto de 1M tokens. Su Intelligence Index es 53, frente a una mediana cercana a 26, y estima $1.99 por tarea del índice. Generó 110M tokens en la evaluación, por encima de su mediana de 82M.

La misma página marca la velocidad como no disponible y los precios del proveedor como datos iniciales. Sirve como señal de calidad y verbosidad, no como promesa de latencia ni sustituto de la tarifa de Google. Anota la fecha cada vez que cites el resultado.

Cómo evaluarlo cuando se abra el acceso

Usa un conjunto fijo, no una colección de prompts de lanzamiento:

  1. Cambio de repositorio. Una función acotada con tests deterministas y diff revisable.
  2. Depuración larga. Un fallo entre módulos cuyo origen se conoce pero no es obvio.
  3. Permisos de herramientas. Lectura permitida, escritura denegada, argumento mal formado, cancelación y reintento.
  4. Trabajo de conocimiento. Un documento financiero o legal con fuentes y rúbrica.
  5. Contexto multimodal. Vídeo largo, gráficos o documentos con respuesta conocida.
  6. Sandbox de seguridad. Vulnerabilidades sintéticas y una comprobación de que respeta el límite.

Guarda en cada ejecución el ID y proveedor, ajuste de razonamiento y herramientas, tokens de entrada/caché/razonamiento/salida, primer token, latencia total, reintentos y errores, aprobado a la primera, minutos de reparación y coste directo o de gateway.

Compara con Gemini 3.8 Flash, Claude Opus 5.5 o GPT-6 Astra usando el mismo commit y herramientas. Un modelo que puntúa más pero necesita más reintentos puede costar más; ser rápido en una respuesta corta no garantiza ganar en una tarea larga.

Veredicto: ponlo en cola, no migres automáticamente

Gemini 4 Argon es uno de los anuncios de modelos más relevantes de 2026. Los resultados de DeepSWE, empresa, vídeo y ciberseguridad encajan con su objetivo de tareas largas y con herramientas. Cuando se abra la API, el límite de salida de 1M y el precio inicial $2/$10 hacen posible un piloto medido.

Persisten límites claros: Google controla la tabla principal, faltan el model ID y el contrato SDK, el acceso es gradual y no hay datos independientes de velocidad. Fija ahora una línea base, solicita acceso por la vía documentada y cambia solo después de que el mismo conjunto de aceptación pase. Consulta el catálogo de modelos para las rutas de OmniaKey; mientras Argon se despliega, la guía de precios de Gemini 3.8 Flash sigue siendo la referencia de coste de Google.

Preguntas frecuentes

¿Gemini 4 Argon está disponible para todos?

No. Google empieza con defensores de confianza de Fairwind y después prevé clientes de API de pago y suscriptores de Google AI Ultra. No hay fecha de disponibilidad general.

¿Cuál es el API model ID de Gemini 4 Argon?

Google anunció el nombre, pero el material de lanzamiento no publica un ID estable. Trata gemini-4-argon como texto de búsqueda hasta que la página del modelo y Models API devuelvan el ID exacto.

¿Cuánto cuesta Gemini 4 Argon?

El precio inicial es $2 por 1M tokens de entrada y $10 por 1M de salida; la entrada en caché cuesta 95% menos. Después serán $4 y $20 según Google. No es una tarifa de OmniaKey.

¿Argon tiene contexto de un millón de tokens?

Google especifica un límite de salida de 1M, frente a 64K. Artificial Analysis muestra un contexto de 1M. Confirma el contrato final de entrada y salida en la documentación de Google antes de presupuestar.

¿Debo sustituir Gemini 3.8 Flash ahora?

No automáticamente. Conserva tu ruta validada como línea base y repite las mismas tareas cuando Argon tenga acceso, precio y comportamiento de SDK documentados.

Fuentes consultadas

Fuentes oficiales:

Fuentes independientes y secundarias:

Comprobado el 2026-10-01. Los precios, la disponibilidad, los model ID y los resultados pueden cambiar; revisa la página actual de Google y el catálogo vivo de OmniaKey antes de modificar producción.