Tutte le notizie

AI · MODELLI

Gemini 4 Argon: il nuovo modello Google per lavori complessi e cybersecurity

Google ha presentato Gemini 4 Argon il 30 settembre 2026, un modello per attività lunghe e complesse. Per ora arriva solo a esperti di cybersecurity, poi sarà aperto a sviluppatori, imprese e consumatori.

1 ottobre 2026 4 min di lettura
Gemini 4 Argon: il nuovo modello Google per lavori complessi e cybersecurity

Google ha presentato Gemini 4 Argon, il nuovo modello di intelligenza artificiale pensato per attività lunghe e complesse come sviluppo software, finanza, diritto e cybersecurity. Annunciato il 30 settembre 2026, per ora viene distribuito solo a un gruppo selezionato di esperti di sicurezza informatica attraverso il programma Fairwind, prima di aprirsi a sviluppatori, imprese e consumatori. La novità più evidente è il limite di output portato a 1 milione di token, contro i 64mila della versione precedente.

Cosa può fare Gemini 4 Argon?

Argon è nato per affrontare ragionamenti di lunga durata su compiti che richiedono pianificazione, impiego di strumenti e generazione di grandi quantità di codice o documenti. I dati forniti da Google mostrano che Argon raggiunge il 77,9% sul benchmark DeepSWE v1.1, incentrato su compiti di ingegneria del software di lunga durata, e il 51,3% su AutomationBench di Zapier, che misura la capacità di eseguire interamente funzioni aziendali. Per quanto riguarda il Vals Index, indicatore dell'impatto economico in ambito finanziario, codice, legale e fiscale, occupa il primo posto su 41 modelli con il 68,90%. Inoltre, sempre in base ai dati di Google, su LVBench per la comprensione di video lunghi ottiene il miglior risultato con il 91,7%. È anche in grado di analizzare grafici professionali, ricavare dettagli da video lunghi e lavorare su più documenti. A titolo di paragone, il limite di 1 milione di token in output equivale a circa 600-750 mila parole, cioè quattro o cinque romanzi da 500 pagine in un'unica sessione. Altri modelli di punta come GPT-6 Astra e Claude Fable 5 possono leggere più di un milione di token in input, ma si fermano a 128.000 token in output.

Dentro Google, Argon è già usato da migliaia di dipendenti per attività di programmazione, ricerca e scrittura. Ha aiutato i ricercatori di calcolo quantistico a migliorare del 40% una routine rispetto ai risultati già pubblicati e ha liberato oltre 300 TiB di memoria nei data center grazie all'analisi automatica dei dati di telemetria. Un'altra applicazione interna riguarda la migrazione di codice da C/C++ a Rust: si parla di decine di migliaia di righe, fino a oltre 800mila per il kernel Fuchsia Zircon. Per la libreria libgav1, gli agenti di Argon hanno sostituito 32mila righe di codice SIMD ottenendo un decoder video più sicuro e 2,7 volte più veloce.

Prezzo e quando esce per tutti?

Google ha optato per una distribuzione graduale: prima gli esperti di sicurezza informatica del programma Fairwind, poi chi usa le API a pagamento e chi ha un abbonamento a Google AI Ultra; non è stata fornita una data precisa per il rilascio al grande pubblico. Google partecipa al processo volontario del governo statunitense per l'accesso anticipato ai modelli e raccoglierà i commenti dei primi tester prima di estendere la disponibilità. Il prezzo di lancio è 2 dollari per milione di token in ingresso e 10 dollari per milione di token in uscita; i token ripresi dalla cache costano il 95% in meno, e alla fine del periodo promozionale i prezzi saliranno a 4 e 20 dollari, ma Google non ha indicato quando terminerà l'offerta. La decisione di applicare prezzi aggressivi mira a ridurre uno degli ostacoli all'adozione degli agenti AI: un sistema che opera a lungo tende a consumare un numero molto superiore di token rispetto a un normale chatbot.

Cosa cambia per la cybersecurity?

Argon è stato addestrato anche per la difesa informatica: può individuare, validare e correggere da solo vulnerabilità critiche del software. Per i difensori di fiducia e i team interni di Google, il modello viene rilasciato senza protezioni informatiche, così da sfruttarne appieno le capacità. Wiz lo sta già usando attraverso l'iniziativa Scan for Good. Google ha dichiarato: «Per impedire ad Argon di uscire dai limiti consentiti e tentare di portare a termine un'attività in un modo che va oltre le intenzioni dell'utente, stiamo implementando delle misure di mitigazione del disallineamento che monitorano il flusso di pensiero e le azioni di Argon e ne interrompono l'esecuzione quando necessario». Sul fronte della sicurezza, Google spiega che Argon è progettato per bloccarsi davanti a richieste dannose in ambito informatico, biologico, radiologico e nucleare, e per resistere ai tentativi di manipolazione indiretta.

Per chi lavora in Italia o gestisce un'impresa, il messaggio è semplice: i modelli AI stanno passando dalla generazione di singole risposte all'esecuzione di interi flussi di lavoro. Il costo per token conta meno della capacità di completare un'attività senza continui interventi umani, e su questo terreno Google vuole competere con OpenAI e Anthropic. Per le piccole imprese e i professionisti, strumenti simili arriveranno prima nelle grandi organizzazioni e poi, gradualmente, nei pacchetti consumer e business.

Fonti: Google, Corriere della Sera, AI4BusinessApri la fonte