Gemini 3.5 Flash Cyber di Google trova 55 bug nel motore di Chrome che i rivali hanno ignorato

Il nuovo modello di sicurezza AI di Google si rivela straordinariamente efficace nella ricerca di vulnerabilità, con costi molto inferiori rispetto ai concorrenti più pesanti.

AI2Day Newsdesk· 3 min read
Extreme close-up of a glowing green padlock icon cracking apart on a dark laptop screen, shards of digital light scattering across a desk surface, shallow depth
Share

Punti chiave

  • Google ha lanciato Gemini 3.5 Flash Cyber il 22 luglio 2026 come modello AI a basso costo costruito specificamente per trovare e correggere difetti di sicurezza nei software.
  • Il modello ha trovato 55 vulnerabilità confermate in V8, il motore JavaScript all'interno del browser Chrome di Google, rispetto alle 47 trovate dal vecchio Gemini 3.5 Flash.
  • Dieci di quei 55 bug erano scoperte esclusive: nessun altro modello AI li aveva individuati.
  • Flash Cyber è disponibile inizialmente per governi e partner fidati tramite CodeMender, lo strumento di codifica incentrato sulla sicurezza di Google.
  • Mythos 5, il modello di sicurezza rivale di Anthropic, costa il doppio rispetto a Claude Opus 4.8, il modello più potente di Anthropic.

Le vulnerabilità software, i difetti nascosti nel codice che gli hacker sfruttano per penetrare nei sistemi, costano miliardi di dollari alle aziende e ai governi ogni anno. Trovarli velocemente e a basso costo è estremamente importante. Google crede di avere una nuova soluzione.

Martedì, Google ha annunciato Gemini 3.5 Flash Cyber, un modello AI messo a punto specificamente per il lavoro di cybersicurezza. Si integra in CodeMender, l'agente di codifica AI di Google, un software che può eseguire autonomamente compiti di programmazione multi-fase. Insieme, scansionano il codice velocemente, cercando debolezze prima che gli aggressori possano sfruttarle.

I numeri sono impressionanti. Su V8, il motore JavaScript che alimenta Chrome e innumerevoli altre applicazioni, Flash Cyber ha trovato 55 problemi unici confermati. Gemini 3.5 Flash standard ne ha trovati 47. Claude Opus 4.6 di Anthropic ne ha trovati 36. Flash Cyber ha anche ottenuto risultati competitivi nel benchmark CyberGym, un test del settore progettato per misurare come i sistemi AI affrontano le sfide di cybersicurezza, quando gli vengono concessi fino a cinque tentativi per compito.

La scelta progettuale principale di Google è stata la ripetizione su larga scala. CodeMender può chiamare Flash Cyber più volte in rapida successione, e ogni passaggio scopre nuovi percorsi di codice che l'esecuzione precedente aveva perso. È come chiedere a un lettore attento di controllare un manoscritto più e più volte: ogni lettura scopre qualcosa di nuovo.

L'elefante nella stanza è Mythos 5 di Anthropic, un potente modello di sicurezza rilasciato nell'ambito dell'iniziativa Project Glasswing dell'azienda. Secondo quanto riferito da The Verge AI, Mythos 5 è potente ma costoso, costandone il doppio per ogni utilizzo rispetto a Claude Opus 4.8, il modello premium di Anthropic per usi generici. Microsoft ha adottato Mythos per i controlli di sicurezza e ha registrato il più grande Patch Tuesday di sempre, il rilascio mensile di correzioni software, dopo che l'AI ha fatto emergere un'ondata di nuove vulnerabilità.

Flash Cyber è il tentativo di Google di offrire risultati comparabili a una frazione del costo di esecuzione. Questo è importante soprattutto quando è necessario scansionare enormi basi di codice ripetutamente, non solo una volta.

Per ora, Flash Cyber è riservato a governi e partner fidati. Un accesso più ampio non è ancora stato confermato.

Gli utenti ordinari dovrebbero preoccuparsi di tutto questo?

No. Questo è uno strumento per le persone che difendono il software, non una minaccia per le persone che lo utilizzano. Quando l'AI trova un bug nel motore di Chrome prima che lo faccia un criminale, il tuo browser viene corretto più velocemente. Il rischio diminuisce, non aumenta.

Il quadro generale è una corsa tra i laboratori di AI per dominare il mercato della sicurezza. Google ha Flash Cyber. Anthropic ha Mythos. Z.ai cinese sostiene che il suo modello può competere. Quella competizione, indipendentemente dai suoi costi, dovrebbe significare patch di vulnerabilità più veloci ed economiche per tutti.

© 2026 AI2Day