Il 30 settembre Google ha annunciato Gemini 4 Argon come il suo modello più capace, e nello stesso comunicato ha spiegato che quasi nessuno potrà usarlo. Argon esce prima a un gruppo ristretto di difensori informatici attraverso il programma Fairwind, mentre l’azienda partecipa alla procedura volontaria di accesso anticipato del governo americano. Il rilascio più ampio viene dopo.
Il modello è addestrato per la sicurezza difensiva: trovare una falla nel software, verificarla e scrivere la correzione, in autonomia. Ai partecipanti al programma e alle squadre interne Google lo consegna senza le protezioni che altrove bloccano le richieste che somigliano a un attacco, così che chi difende lo abbia a piena potenza.
Fin qui la logica tiene: gli strumenti per cercare vulnerabilità servono anche a chi le vuole sfruttare, e limitarne la circolazione è prudente. Il problema comincia quando si guarda a chi sta dentro il recinto. L’unico partner che Google nomina nel comunicato è Wiz, la società di sicurezza cloud che Google ha comprato, e l’azienda non ha detto quali altre organizzazioni ne facciano parte.
La pagella se l’è scritta in casa
I numeri annunciati sono buoni e sono tutti suoi. Argon segna 68,9% sul Vals Index, l’indice che pesa insieme lavoro finanziario, legale, fiscale e di programmazione, contro il 67,0% di Claude Opus 5.5. Arriva a 77,9% su un test di ingegneria del software a lungo respiro e a 51,3% su uno di automazione dei processi aziendali. Sono i risultati che l’azienda pubblica nella propria documentazione.
Nessuno, fuori dal gruppo scelto, ha potuto riprodurre un solo punteggio. E anche nei documenti di Google il primato non è pieno: secondo Reuters il modello resta dietro ai concorrenti su due dei quattro test di programmazione citati nel lancio.
Un dato in particolare andrebbe letto senza il titolo sopra. Sul test legale della società Harvey, Argon fa 19,6%, quasi il triplo del secondo classificato. Vuol dire che il modello più potente del mondo, a detta di chi lo vende, porta a termine un compito su cinque.
Il modello in cassaforte
Il copione si ripete a ogni uscita: i laboratori annunciano modelli sempre più capaci e nello stesso momento avvertono che la tecnologia potrebbe sfuggire di mano. OpenAI ha fatto lo stesso con Astra, Anthropic con Fable, e ogni volta la potenza viene misurata in casa.
L’accesso razionato è una scelta difendibile, e intanto fa anche un’altra cosa: tiene i voti al riparo da chiunque voglia controllarli. Google non ha detto quando Argon arriverà a sviluppatori e utenti, né quali organizzazioni siedano nel programma, né quando scadrà il prezzo di lancio, come nota chi ha letto il comunicato. Un modello che nessuno può provare è una promessa, e in questo settore le promesse valgono già miliardi.
Crediti immagini: immagine di pubblico dominio, CC0 1.0, via Rawpixel. Nella foto una sala server, non un impianto di Google.



