Gemini Robotics 2 de Google : construire un robot capable de faire ce qu'on lui demande
Une nouvelle famille de modèles d'IA de Google DeepMind rapproche les robots physiques de l'assistant universel, avec une meilleure dextérité, une collaboration multi-robots, et un modèle que les développeurs peuvent tester dès maintenant.

Points clés
- Google DeepMind a lancé Gemini Robotics 2, une nouvelle famille de modèles d'IA pour robots physiques, en 2025.
- Le lancement comprend trois sous-modèles, dont un est accessible aux développeurs dès aujourd'hui via l'API Gemini Live.
- Gemini Robotics ER 2 est un modèle amélioré de « raisonnement incarné » que DeepMind présente comme une avancée significative par rapport à sa version précédente 1.6.
- L'objectif est un « robot généraliste » capable de répondre à n'importe quelle instruction parlée ou écrite, concept que les scientifiques de Google qualifient d'« AGI physique » (intelligence générale artificielle).
- Le nouveau système peut contrôler un corps de robot humanoïde complet, y compris les mains complexes à plusieurs doigts.
Depuis des années, les vidéos virales suivent le même scénario : un robot élégant fait une pirouette arrière, adopte une position, puis s'arrête. Impressionnant. Aussi inutile. Ces machines ont été construites pour faire exactement une seule chose, rien d'autre.
Google veut changer cela complètement.
Qu'a exactement annoncé Google ?
Gemini Robotics 2 est un nouvel ensemble de modèles d'IA, c'est-à-dire des cerveaux logiciels entraînés sur d'énormes quantités de données, conçus pour fonctionner à l'intérieur de robots physiques. Là où les systèmes antérieurs pouvaient gérer des mouvements étroits et préprogrammés, cette version vise quelque chose de plus large.
L'objectif phare est ce que les chercheurs de DeepMind appellent l'« AGI physique », raccourci pour intelligence générale artificielle appliquée au monde réel. L'idée est simple à énoncer et difficile à concrétiser : vous dites à un robot ce qu'il faut faire, et il comprend comment. Pas de programmation spéciale pour chaque nouvelle tâche. Pas de script rigide.
Trois sous-modèles composent la famille Gemini Robotics 2. Le plus accessible actuellement est Gemini Robotics ER 2, « ER » signifiant raisonnement incarné, c'est-à-dire la capacité à comprendre un environnement physique et à agir en son sein. Les développeurs peuvent s'y connecter dès aujourd'hui via l'API Gemini Live, une interface de programmation qui permet aux équipes logicielles de construire et tester les comportements des robots.
Comme l'a rapporté en premier Ars Technica AI, DeepMind décrit ER 2 comme un saut significatif par rapport au modèle précédent Gemini Robotics 1.6.
Que peuvent réellement faire ces robots maintenant ?
Trois améliorations se distinguent dans l'annonce de Google.
D'abord, le système peut gérer le contrôle du corps entier, ce qui signifie qu'il coordonne un robot humanoïde complet, de haut en bas, y compris des mains avec plusieurs doigts mobiles. Ce genre de dextérité a été un goulot d'étranglement persistant.
Ensuite, les robots peuvent continuellement lire un environnement changeant plutôt que de se fier à un instantané fixe. Une boîte se déplace ; le robot s'ajuste.
Enfin, plusieurs robots peuvent désormais collaborer sur une seule tâche, se passant des objets ou divisant les étapes d'un travail.
| Capacité | Version précédente | Gemini Robotics 2 |
|---|---|---|
| Contrôle humanoïde du corps entier | Limité | Oui |
| Collaboration multi-robots | Non | Oui |
| Analyse continue de l'environnement | Partielle | Améliorée |
| Accès à l'API pour les développeurs | Non | Oui (ER 2 dès aujourd'hui) |
Les gens ordinaires devraient-ils s'en soucier pour l'instant ?
Pas encore tout à fait, mais la direction est importante. Pour le moment, Gemini Robotics 2 est un outil pour développeurs, quelque chose pour les laboratoires et les entreprises qui construisent des robots, pas un produit que vous pouvez acheter.
Ce que Google fait réellement, c'est combler le fossé entre un robot qui exécute un tour répété et celui qui pourrait, un jour, aider dans un entrepôt, une cuisine ou une maison de retraite. Chaque lancement réduit un peu plus cet écart.
Le moment où les robots pourront véritablement suivre des instructions ouvertes de façon fiable, la pression économique pour les déployer sera significative. Cela vaut la peine de suivre, même si votre robot domestique est encore à des années de distance.
Questions fréquentes
Qu'est-ce que l'« AGI physique » et pourquoi Google utilise-t-il cette expression ?
L'AGI, intelligence générale artificielle, désigne un système d'IA capable de gérer n'importe quelle tâche qu'un humain peut accomplir, plutôt qu'un seul travail spécifique. Les scientifiques de Google utilisent « AGI physique » pour décrire cette même flexibilité appliquée aux robots opérant dans le monde réel.
Les développeurs peuvent-ils utiliser Gemini Robotics 2 dès aujourd'hui ?
L'un des trois sous-modèles, Gemini Robotics ER 2, est disponible dès maintenant via l'API Gemini Live. Les autres modèles de la famille ne sont pas encore accessibles au public.



