Gemini Robotics 2 di Google vuole costruire un robot che possa fare qualsiasi cosa gli chiedi
Una nuova famiglia di modelli di intelligenza artificiale da Google DeepMind spinge i robot fisici verso assistenti generici, con migliore destrezza, lavoro di squadra multi-robot, e un modello che gli sviluppatori possono provare proprio ora.

Punti chiave
- Google DeepMind ha lanciato Gemini Robotics 2, una nuova famiglia di modelli di intelligenza artificiale per robot fisici, nel 2025.
- Il rilascio include tre sotto-modelli, uno dei quali è disponibile pubblicamente ai sviluppatori oggi tramite l'API Gemini Live.
- Gemini Robotics ER 2 è un modello di "ragionamento incarnato" aggiornato che DeepMind afferma essere un passo significativo rispetto alla versione precedente 1.6.
- L'obiettivo è un "robot generalista" che possa rispondere a qualsiasi istruzione vocale o digitata, un concetto che gli scienziati di Google chiamano "AGI fisico" (intelligenza artificiale generale).
- Il nuovo sistema può controllare un intero corpo di robot umanoide, incluse mani complesse con più dita.
Per anni, i video diventati virali hanno seguito lo stesso copione: un robot elegante fa un salto mortale, mantiene una posa, poi si ferma. Impressionante. Anche inutile. Quelle macchine erano costruite per fare esattamente una cosa, e nient'altro.
Google vuole cambiare completamente le cose.
Che cosa ha annunciato davvero Google?
Gemini Robotics 2 è un nuovo insieme di modelli di intelligenza artificiale, ossia cervelli software addestrati su enormi quantità di dati, progettati per funzionare all'interno di robot fisici. Dove i sistemi precedenti potevano gestire movimenti ristretti e pre-programmati, questo rilascio mira a qualcosa di più ampio.
L'obiettivo principale è quello che i ricercatori di DeepMind chiamano "AGI fisico", termine abbreviato per intelligenza artificiale generale applicata al mondo reale. L'idea è semplice da esprimere e difficile da costruire: dici a un robot cosa fare, e lui capisce come farlo. Nessuna programmazione speciale per ogni nuovo compito. Nessuno script rigido.
Tre sotto-modelli sono contenuti all'interno della famiglia Gemini Robotics 2. Il più accessibile al momento è Gemini Robotics ER 2, dove "ER" sta per ragionamento incarnato, il che significa la capacità di comprendere un ambiente fisico e agire all'interno di esso. Gli sviluppatori possono connettersi ad esso oggi tramite l'API Gemini Live, un'interfaccia di programmazione che consente ai team di software di costruire e testare comportamenti dei robot.
Come riportato per primo da Ars Technica AI, DeepMind descrive ER 2 come un balzo significativo rispetto al precedente modello Gemini Robotics 1.6.
Che cosa possono effettivamente fare questi robot adesso?
Tre miglioramenti risaltano dall'annuncio di Google.
Per primo, il sistema può gestire il controllo dell'intero corpo, il che significa che coordina un robot umanoide completo, da capo a piedi, comprese le mani con più dita in movimento. Quel tipo di destrezza è stato un ostacolo persistente.
Per secondo, i robot possono leggere continuamente un ambiente che cambia piuttosto che basarsi su un'istantanea fissa. Una scatola si muove; il robot si adatta.
Per terzo, più robot possono ora collaborare su un singolo compito, passandosi oggetti tra loro o dividendo i passaggi di un lavoro.
| Capacità | Versione precedente | Gemini Robotics 2 |
|---|---|---|
| Controllo umanoide a corpo intero | Limitato | Sì |
| Collaborazione multi-robot | No | Sì |
| Analisi continua dell'ambiente | Parziale | Migliorata |
| Accesso API per sviluppatori | No | Sì (ER 2 oggi) |
Dovrebbero preoccuparsene le persone comuni adesso?
Non ancora, ma la direzione è importante. Al momento, Gemini Robotics 2 è uno strumento per sviluppatori, qualcosa per laboratori e aziende che costruiscono robot, non un prodotto che puoi acquistare.
Quello che Google sta davvero facendo è colmare il divario tra un robot che esegue un trucco provato e uno che potrebbe, un giorno, aiutare in un magazzino, una cucina o una casa di cura. Ogni uno di questi rilasci riduce un po' di più quel divario.
Nel momento in cui i robot possono davvero seguire istruzioni aperte in modo affidabile, la pressione economica per distribuirli sarà significativa. Vale la pena osservare, anche se il tuo robot domestico è ancora a molti anni di distanza.
Domande comuni
Che cos'è "AGI fisico" e perché Google usa questa espressione?
AGI, intelligenza artificiale generale, si riferisce a un sistema di intelligenza artificiale in grado di gestire qualsiasi compito che un essere umano possa svolgere, piuttosto che solo un lavoro specifico. Gli scienziati di Google usano "AGI fisico" per descrivere quella stessa flessibilità applicata ai robot che operano nel mondo reale.
Gli sviluppatori possono usare Gemini Robotics 2 oggi?
Uno dei tre sotto-modelli, Gemini Robotics ER 2, è disponibile ora tramite l'API Gemini Live. Gli altri modelli della famiglia non sono ancora accessibili pubblicamente.



