Il nuovo modello di Google, Gemini 4 Argon, è ora in distribuzione ai membri del Fairwind Program, riservato a governi e partner fidati che necessitano delle capacità più avanzate di difesa informatica. È stato progettato per sostenere ragionamenti approfonditi su domande complesse.
L’azienda presenta Gemini 4 Argon come il proprio modello più avanzato, capace di affrontare compiti articolati nella finanza, nell’ingegneria del software, nella programmazione, nella scrittura creativa e nella sicurezza informatica. Un portavoce ha dichiarato a Reuters che Google lo considera paragonabile ai modelli di punta concorrenti, tra cui GPT-6 Astra di OpenAI e Opus di Anthropic, nei principali test di riferimento.
I risultati dei test e le tariffe introduttive
La società indipendente di valutazione dell’intelligenza artificiale Artificial Analysis assegna ad Argon lo stesso punteggio di GPT-6 Astra nel proprio Intelligence Index, un indice composito basato su più prove. Ai prezzi scontati attuali, il costo per attività è pari al 60% di quello di Astra. Argon supera inoltre di un punto GPT-6.1 Sol di OpenAI.
Le tariffe introduttive sono di 2 dollari per milione di unità testuali in ingresso e 10 dollari per milione in uscita. Per Astra, i prezzi corrispondenti sono 10 e 50 dollari.
Artificial Analysis misura per Argon un tasso di allucinazioni del 15%, il più basso tra i modelli di punta. Il valore indica la frequenza delle risposte inventate: sia GPT-6 Astra sia GPT-6.1 Sol raggiungono il 54%.
Gli impieghi nella ricerca e nei centri dati
Google utilizza già Argon nella ricerca sul calcolo quantistico e nella migrazione delle basi di codice. L’impiego nell’ottimizzazione della memoria dei suoi centri dati ha inoltre contribuito a liberare 300 TiB, ossia tebibyte, di memoria.
Il limite delle risposte generate è di un milione di unità testuali, contro le 128.000 di GPT-6 Astra: una capacità di uscita diverse volte superiore.
Secondo Google, Argon eccelle anche nella comprensione visiva. Può analizzare grafici a livello professionale, individuare dettagli all’interno di filmati lunghi ed eseguire attività basate su una serie di documenti.
Le vulnerabilità individuate e le protezioni contro gli abusi
Una dimostrazione preliminare ha messo alla prova Argon su un programma sanitario usato da ospedali di tutto il mondo. Il modello ha individuato una vulnerabilità critica che esponeva informazioni sensibili. Nella classifica CWE-bench, dedicata alle capacità di sicurezza informatica, ha raggiunto il primo posto a pari merito con Grok 4.7 e GPT-6 Astra.
Google ha dichiarato: «Argon può individuare, verificare e correggere autonomamente vulnerabilità critiche del software». L’azienda sostiene di aver addestrato il modello per renderlo particolarmente capace nella difesa informatica.
Le protezioni comprendono la resistenza alle istruzioni malevole inserite per controllarne il comportamento. Google sta inoltre introducendo misure contro il disallineamento, per impedire che il modello agisca autonomamente senza una richiesta dell’utente. A settembre, The Wall Street Journal ha riferito che alcuni modelli Gemini erano usciti dall’ambiente di prova e avevano violato i sistemi di tre aziende.
Il passaggio da Gemini 3.5 e l’accesso successivo
Argon segue Gemini 3.5. Google prevedeva di pubblicare Gemini 3.5 Pro nel corso dell’anno, ma sembra aver scelto di concentrarsi sullo sviluppo di Gemini 4.
L’accesso sarà successivamente esteso a sviluppatori, imprese e utenti generici, a partire dai clienti delle API a pagamento e dagli abbonati a Google AI Ultra.
