GPT-6 Sol e Claude Opus 5.5 disponibiliGPT-6 Sol a metà prezzo rispetto a 5.6 Sol
Blog
Guida

Recensione di Gemini 4 Argon: lancio forte, API pubblica non ancora disponibile

Argon sembra un aggiornamento frontier importante, ma oggi conviene valutare le prove e aspettare un contratto chiamabile prima di spostare traffico in produzione.

13 min di letturaOmniaKey
Gemini 4 ArgonGemini 4recensione modelloprezzo APIcybersicurezza

Gemini 4 Argon è il primo modello frontier di Google della generazione Gemini 4. Google lo ha annunciato il 2026-09-30 per ingegneria del software di lunga durata, lavoro di conoscenza aziendale e difesa informatica. Il lancio è reale, ma l’accesso è graduale: prima ai difensori cyber di fiducia tramite Fairwind Program, poi ai clienti API paganti e agli abbonati Google AI Ultra.

Questa è quindi una recensione del lancio, non un benchmark API eseguito da noi. Google riporta risultati forti su DeepSWE, AutomationBench, LVBench e valutazioni di sicurezza. Artificial Analysis offre un primo snapshot indipendente, ma il pannello della velocità è ancora incompleto. Non abbiamo usato credenziali Gemini né eseguito richieste a pagamento; al controllo Argon non era nel catalogo pubblico OmniaKey.

Verificato il 2026-10-01. I fatti sul lancio e i punteggi del provider provengono dall’annuncio e dai materiali di sicurezza Google. I dati indipendenti sono indicati separatamente. Google non ha ancora pubblicato un model ID pubblico stabile, un contratto endpoint, una guida di migrazione SDK o una data di disponibilità generale; non inventiamo quindi richieste e non dichiariamo accesso in produzione.

Risposta rapida

DomandaRisposta verificata al 2026-10-01
Cosa è stato lanciato?Gemini 4 Argon, modello frontier per codice, lavoro di conoscenza e cyberdifesa.
Chiunque può chiamarlo oggi?No. Si parte dai difensori fidati, poi clienti API paganti e abbonati Google AI Ultra.
Qual è l’API model ID?Il nome è stato annunciato, ma non esiste ancora un ID API pubblico stabile. Non indovinare gemini-4-argon.
Qual è il limite di contesto o output?Google indica 1M di token in output, contro 64K nei Gemini precedenti. Il contratto di input finale manca.
Qual è il prezzo introduttivo?$2 per 1M token di input e $10 per 1M di output; l’input in cache ha il 95% di sconto.
Cosa succede dopo?Google indica $4 input e $20 output per 1M token.
Esiste un benchmark pubblico riproducibile?Google pubblica risultati del vendor; Artificial Analysis mostra un primo Intelligence Index di 53. Non abbiamo eseguito un benchmark a pagamento.
OmniaKey instrada Argon?Alla data del controllo non era nel catalogo pubblico OmniaKey. Verifica il catalogo prima della migrazione.

Il verdetto breve è promettente, ma non pronto per una sostituzione in produzione senza test. Quando l’account potrà chiamarlo, mettilo in cima alla coda di valutazione. Nel frattempo usa una rotta verificata come Gemini 3.8 Flash come baseline.

Cosa ha annunciato Google

Google definisce Argon il nuovo modello frontier e dice che è già usato nei flussi interni. Il primo gruppo esterno è formato da difensori cyber fidati del Fairwind Program. L’accesso arriverà a sviluppatori, aziende e consumatori “il prima possibile”, iniziando dai clienti API paganti e dagli abbonati Google AI Ultra.

Un annuncio prova l’esistenza del modello, non che ogni progetto AI Studio, regione, SDK, gateway o account possa chiamarlo. La precedente guida sullo stato di Gemini 4 separava correttamente un programma di training nominato da un modello API invocabile. Argon è ora un prodotto annunciato; la disponibilità generale resta una verifica distinta.

Profilo delle capacità

CapacitàCosa è stato pubblicatoCome leggerla
Ragionamento lungoRagionamento profondo per flussi complessi e multi-stepObiettivo d’uso, non garanzia per ogni prompt lungo.
Ingegneria softwareDeepSWE v1.1 al 77.9% nel report GoogleRisultato del provider con harness e impostazioni precise.
Lavoro aziendaleCodice, finanza, ricerca legale, scrittura e analisi visivaServono test di accettazione per dominio.
MultimodalitàComprensione di grafici, documenti e video lunghiLo schema completo di input non è nell’annuncio.
CyberdifesaScoperta, verifica e correzione di vulnerabilitàAccesso e guardrail cambiano tra difensori e utenti generali.
OutputFino a 1M di token secondo GoogleUn limite massimo, non un invito a generare un milione di token.

Google descrive anche esempi interni: Argon ha superato del 40% una baseline pubblicata di ottimizzazione quantistica, liberato oltre 300 TiB di memoria nell’analisi di una flotta e reso un port Rust del decoder libgav1 2,7 volte più veloce dell’implementazione Rust esistente. Sono affermazioni sui flussi Google, non misure indipendenti. Le grandi riscritture hanno ricevuto audit automatici e umani prima della produzione.

Il profilo pratico è chiaro: Argon mira a lavori che richiedono pianificazione, strumenti, molta evidenza e coerenza su molti passaggi. Una domanda breve non misura questo vantaggio.

Benchmark: segnale forte, limite preciso

ValutazioneGemini 4 ArgonCosa misura secondo Google
DeepSWE v1.177.9%Ingegneria software di lunga durata
AutomationBench51.3%Esecuzione end-to-end di funzioni aziendali
LVBench91.7%Comprensione di video lunghi
CWE-bench v168%Correzione di vulnerabilità, pari merito al primo posto
Vals Finance Agent v2Risultato leader dichiaratoRicerca finanziaria multi-step
Harvey Legal Agent BenchmarkRisultato leader dichiaratoRicerca e redazione legale

Questi numeri sostengono una conclusione limitata: Google punta a lavori in cui contano contesto lungo, strumenti e ragionamento continuo. Non dimostrano una classifica universale. DeepSWE usa il setup Google e prompt, harness, retry, permessi e criteri di stop possono variare.

9to5Google ha riportato il confronto DeepSWE di Google: Argon 77.9%, Claude Opus 5.5 74.2%, GPT-6 Astra 74.1%. È contesto di lancio, non test indipendente a condizioni uguali. Artificial Analysis mostra Intelligence Index 53 per il suo snapshot ad alto reasoning; la velocità non è ancora disponibile.

Per decidere, registra modello, livello di ragionamento, strumenti, contesto, retry, token di output, latenza, risultato accettato e minuti di correzione umana. Un singolo punteggio non predice costo o affidabilità dell’agente.

Perché la sicurezza informatica limita il lancio

Google non tratta Argon come un normale lancio. Difensori fidati e team interni riceveranno una versione senza guardrail cyber per usare tutta la capacità difensiva, mentre le protezioni contro gli abusi vengono rafforzate prima dell’uscita generale.

L’annuncio cita quattro aree:

  1. Prevenzione degli abusi. Monitorare abusi cyber e CBRN preservando la ricerca legittima dual-use.
  2. Prompt injection indiretta. Red teaming e addestramento avversariale contro istruzioni nascoste nei contenuti recuperati.
  3. Monitoraggio del disallineamento. Osservare ragionamento e azioni e fermare l’esecuzione oltre l’intento dell’utente.
  4. Ambienti più solidi. Isolare e sigillare sandbox prima delle valutazioni ad alto rischio.

Sono controlli di sicurezza e rilascio, non un permesso di testare sistemi altrui in modo offensivo. Usa codice tuo, vulnerabilità sintetiche, rete isolata e una condizione di stop esplicita.

Prezzo e stato API

VocePrezzo Argon pubblicato da Google
Input introduttivo$2.00 / 1M token
Output introduttivo$10.00 / 1M token
Input in cache95% sotto il prezzo input, cioè $0.10 / 1M al prezzo iniziale
Dopo l’introduzione$4.00 input / $20.00 output per 1M token

È il prezzo del provider, non un prezzo OmniaKey. L’annuncio non fissa data di disponibilità generale, model ID esatto, endpoint accettati, limiti, condizioni Batch, regole regionali o contratto cache finale.

Non inserire gemini-4-argon nel client presumendo che sia un ID valido. Quando arriverà la pagina modello, controlla insieme stringa esatta, versione API, SDK, controlli di thinking, streaming, schemi degli strumenti e conteggio dell’output. Il catalogo live determina accesso e prezzo OmniaKey; il 1° ottobre Argon non era elencato.

Puoi controllare entrambi i cataloghi senza mettere la chiave nell’URL:

bash
set -o pipefail
curl --fail-with-body --silent --show-error \
  https://generativelanguage.googleapis.com/v1beta/models \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
| jq -r '.models[]?.name | sub("^models/"; "") | select(. == "gemini-4-argon" or startswith("gemini-4-argon-"))'
bash
set -o pipefail
curl --fail-with-body --silent --show-error https://api.omniakey.com/v1/models \
  -H "Authorization: Bearer $OMNIAKEY_API_KEY" \
| jq -r '.data[]?.id | select(. == "gemini-4-argon" or startswith("gemini-4-argon-"))'

Un risultato vuoto vale solo per quella credenziale e quel momento. Non esclude un accesso privato e non giustifica un alias di produzione inventato.

Cosa mostra il primo snapshot indipendente

Artificial Analysis elenca Gemini 4 Argon (High) come modello reasoning con input testo e immagini, output testo e contesto da 1M token. Il suo Intelligence Index è 53, sopra una mediana vicina a 26, con costo stimato di $1.99 per task dell’indice. La valutazione ha generato 110M token contro una mediana di 82M.

La stessa pagina indica velocità di output non disponibile e prezzi provider ancora iniziali. È un segnale di qualità e verbosità, non una promessa di latenza né un sostituto della tariffa Google. Conserva la data quando lo citi.

Come valutarlo quando l’accesso sarà aperto

Usa un set fisso invece di una raccolta di prompt di lancio:

  1. Modifica del repository. Funzione limitata con test deterministici e diff revisionabile.
  2. Debug lungo. Errore tra moduli con causa conosciuta ma non ovvia.
  3. Permessi degli strumenti. Lettura consentita, scrittura negata, argomento errato, annullamento e retry.
  4. Lavoro di conoscenza. Documento finanziario o legale con fonti e rubrica.
  5. Contesto multimodale. Video lungo, grafici o documenti con risposta nota.
  6. Sandbox di sicurezza. Vulnerabilità sintetiche e test di arresto al confine.

Per ogni esecuzione salva ID e provider, impostazioni di reasoning e strumenti, token input/cache/reasoning/output, tempo al primo token, latenza totale, retry ed errori, successo al primo tentativo, minuti di correzione e costo diretto o gateway.

Confrontalo con Gemini 3.8 Flash, Claude Opus 5.5 o GPT-6 Astra allo stesso commit e con gli stessi strumenti. Più score con più retry può costare di più.

Verdetto: mettilo in coda, non migrare automaticamente

Gemini 4 Argon è uno degli annunci di modelli più rilevanti del 2026. I risultati su DeepSWE, lavoro aziendale, video e cyberdifesa sono coerenti con l’obiettivo di compiti lunghi e ricchi di strumenti. Quando l’API sarà aperta, il limite output da 1M e il prezzo iniziale $2/$10 permetteranno un pilota misurato.

I limiti restano netti: Google controlla la tabella principale, mancano model ID pubblico e contratto SDK, l’accesso è graduale e i dati indipendenti sulla velocità non sono pronti. Fissa ora una baseline, chiedi accesso tramite il percorso documentato e passa solo dopo che lo stesso set di accettazione è superato. Il catalogo modelli mostra le rotte OmniaKey; mentre Argon si amplia, la guida prezzi Gemini 3.8 Flash resta il riferimento di costo Google.

Domande frequenti

Gemini 4 Argon è disponibile per tutti?

No. Google inizia con difensori Fairwind fidati e poi prevede clienti API paganti e abbonati Google AI Ultra. Non esiste una data generale.

Qual è l’API model ID di Gemini 4 Argon?

Google ha annunciato il nome ma non un ID pubblico stabile nei materiali di lancio. Tratta gemini-4-argon come testo di ricerca finché pagina modello e Models API non restituiranno l’ID esatto.

Quanto costa Gemini 4 Argon?

Il prezzo introduttivo è $2 per 1M token di input e $10 per 1M di output; l’input cache costa il 95% in meno. Dopo saranno $4 e $20 secondo Google. Non è un prezzo OmniaKey.

Argon ha un contesto di un milione di token?

Google specifica un limite di output di 1M, prima 64K. Artificial Analysis indica contesto 1M. Conferma il contratto finale di input e output nella documentazione prima del budget.

Devo sostituire Gemini 3.8 Flash ora?

Non automaticamente. Mantieni la rotta verificata come baseline e ripeti gli stessi task quando accesso, prezzo e comportamento SDK di Argon saranno documentati.

Fonti consultate

Fonti ufficiali:

Fonti indipendenti e secondarie:

Verificato il 2026-10-01. Prezzi, disponibilità, model ID e risultati possono cambiare; controlla la pagina modello Google aggiornata e il catalogo live OmniaKey prima di modificare la produzione.