I nuovi modelli Gemini Flash di Google sono costruiti per un'IA che funziona da sola
I modelli Gemini 3.6 Flash e 3.5 Flash-Lite di Google DeepMind promettono agenti AI più economici e veloci. Ecco cosa significa per le app e i giochi che effettivamente usi.

Punti chiave
- Google DeepMind ha annunciato Gemini 3.6 Flash e Gemini 3.5 Flash-Lite nel giorno del lancio, pensati per eseguire agenti AI su larga scala.
- Google afferma che 3.6 Flash utilizza il 17% di token di output in meno rispetto a 3.5 Flash secondo l'Artificial Analysis Index, a $1,50 per milione di token di input e $7,50 per milione di token di output.
- Gemini 3.5 Flash-Lite funziona a 350 token di output al secondo, a un prezzo di $0,30 per milione di token di input e $2,50 per milione di token di output.
- Nel benchmark OSWorld-Verified, che testa la capacità di un'IA di utilizzare un computer reale, 3.6 Flash ha ottenuto l'83,0% rispetto al 78,4% di 3.5 Flash.
- Google DeepMind ha confermato che il pre-addestramento di Gemini 4, il suo prossimo modello principale, è iniziato.
Google ha appena cambiato silenziosamente i conti per chiunque stia sviluppando un'IA che fa le cose per te.
Nel giorno del lancio, Google DeepMind ha rilasciato due nuove versioni della sua famiglia Gemini: Gemini 3.6 Flash e Gemini 3.5 Flash-Lite. Gemini è la linea di modelli AI di Google, i "cervelli" software dietro i chatbot e, sempre più, gli agenti AI (programmi che svolgono compiti multi-step per tuo conto, come prenotare viaggi o correggere codice).
Il titolo non riguarda un modello più grande e intelligente. È il contrario. Questi sono i cavalli da lavoro.
Perché una persona normale dovrebbe interessarsi a un modello AI più economico?
Perché il prezzo e la velocità decidono se il demo intelligente che hai visto l'anno scorso finisce davvero dentro le app che usi.
Eseguire un grande modello AI costa denaro ogni volta che risponde. Questo costo è misurato in token, che sono solo porzioni di testo che il modello legge e scrive. Google afferma che Gemini 3.6 Flash utilizza il 17% di token di output in meno rispetto al precedente 3.5 Flash per svolgere lo stesso compito, secondo l'indice indipendente Artificial Analysis Index. In un test di coding chiamato DeepSWE, il risparmio ha raggiunto il 65%.
In parole semplici: il modello batte meno attorno al cespuglio e va al sodo più velocemente. Questo riduce la bolletta per l'azienda che sviluppa la tua app, ed è così che funzionalità come un compagno IA integrato in un gioco o un bot intelligente di servizio clienti diventano finanziariamente possibili.
I prezzi sono di $1,50 per milione di token di input e $7,50 per milione di token di output. Un milione di token corrisponde approssimativamente a 750.000 parole.
Il fratellino minore potrebbe essere la vera storia
Gemini 3.5 Flash-Lite è il piccolo e veloce. Google lo cronometra a 350 token di output al secondo, a un prezzo di $0,30 per milione di token di input e $2,50 per milione di token di output.
Questa velocità è importante per qualsiasi cosa abbia bisogno di sembrare istantanea. Pensa a un avversario AI in un gioco che deve reagire in tempo reale, o a uno strumento di elaborazione documenti che elabora migliaia di fatture durante la notte.
Su Terminal-Bench 2.1, un test che misura quanto bene un'IA riesce a gestire una riga di comando del computer, Flash-Lite è passato dal 31% al 54%. Su OSWorld-Verified, che chiede all'IA di operare effettivamente un desktop come farebbe un umano, ha raggiunto il 74%.
Entrambi i nuovi modelli ora includono "computer use" come strumento integrato. Questo significa che l'IA può fare clic su pulsanti, compilare moduli e muovere un cursore senza che uno sviluppatore lo colleghi manualmente.
E la sicurezza?
Google afferma che 3.6 Flash viene fornito con protezioni più forti contro gli abusi in scenari chimici, biologici, radiologici, nucleari e di offesa informatica. È stato anche addestrato a rifiutare meno richieste innocue, un problema comune con le versioni precedenti di Gemini che a volte dicevano di no a domande noiose e quotidiane.
C'è anche un cugino specializzato. Gemini 3.5 Flash Cyber alimenta CodeMender, l'agente di Google che cerca falle di sicurezza nel codice software.
Cosa succede dopo?
Gemini 3.5 Pro, il modello principale più grande, è ancora in fase di test con i partner. E Google ha confermato la parte interessante alla fine: il pre-addestramento di Gemini 4 è iniziato.
Per i giocatori, gli sviluppatori e chiunque stia aspettando funzionalità AI che non costano una fortuna da eseguire, la direzione è chiara. La frontiera fa titoli. I modelli Flash vengono distribuiti.



