El Gemini Robotics 2 de Google quiere construir un robot que haga cualquier cosa que le pidas

Una nueva familia de modelos de IA de Google DeepMind acerca los robots físicos a asistentes de propósito general, con mejor destreza, trabajo en equipo multirobótico y un modelo que los desarrolladores pueden probar ahora.

AI2Day Newsdesk4 min read
A friendly, rounded white home robot with a soft fabric-covered body and a simple cartoon-like face display stands in a bright, tidy modern living room, its two
Share

Puntos clave

  • Google DeepMind lanzó Gemini Robotics 2, una nueva familia de modelos de IA para robots físicos, en 2025.
  • El lanzamiento incluye tres submodelos, uno de los cuales está disponible públicamente para desarrolladores hoy a través de la API de Gemini Live.
  • Gemini Robotics ER 2 es un modelo mejorado de "razonamiento encarnado" que DeepMind describe como un avance significativo respecto a su versión anterior 1.6.
  • El objetivo es un "robot generalista" que pueda responder a cualquier instrucción hablada o escrita, un concepto que los científicos de Google llaman "AGI física" (inteligencia artificial general).
  • El nuevo sistema puede controlar un cuerpo de robot humanoide completo, incluidas manos complejas con múltiples dedos.

Durante años, los videos virales han seguido el mismo guión: un robot elegante hace un salto mortal, mantiene una postura, y se detiene. Impresionante. También inútil. Esas máquinas fueron construidas para hacer exactamente una cosa, nada más.

Google quiere cambiar eso completamente.

¿Qué anunció realmente Google?

Gemini Robotics 2 es un nuevo conjunto de modelos de IA, es decir, cerebros de software entrenados con cantidades masivas de datos, diseñados para funcionar dentro de robots físicos. Mientras que los sistemas anteriores podían manejar movimientos estrechos y preprogramados, este lanzamiento apunta a algo más amplio.

El objetivo principal es lo que los investigadores de DeepMind llaman "AGI física", abreviatura de inteligencia artificial general aplicada al mundo real. La idea es simple de expresar y difícil de construir: le dices a un robot qué hacer, y él descubre cómo. Sin programación especial para cada tarea nueva. Sin guiones rígidos.

Tres submodelos están dentro de la familia Gemini Robotics 2. El más accesible en este momento es Gemini Robotics ER 2, donde "ER" significa razonamiento encarnado, que significa la capacidad de comprender un entorno físico y actuar dentro de él. Los desarrolladores pueden conectarse a él hoy a través de la API de Gemini Live, una interfaz de programación que permite a los equipos de software construir y probar comportamientos de robots.

Según informó primero Ars Technica AI, DeepMind describe ER 2 como un salto significativo sobre el modelo anterior Gemini Robotics 1.6.

¿Qué pueden hacer realmente estos robots ahora?

Tres mejoras destacan del anuncio de Google.

Primero, el sistema puede manejar control de cuerpo completo, es decir, coordina un robot humanoide completo, de arriba a abajo, incluidas manos con múltiples dedos móviles. Ese tipo de destreza ha sido un obstáculo persistente.

Segundo, los robots pueden leer continuamente un entorno cambiante en lugar de depender de una instantánea fija. Una caja se mueve; el robot se adapta.

Tercero, múltiples robots ahora pueden colaborar en una sola tarea, pasándose objetos entre ellos o dividiendo los pasos de un trabajo.

Capacidad Versión anterior Gemini Robotics 2
Control humanoide de cuerpo completo Limitado
Colaboración multirobótica No
Análisis continuo del entorno Parcial Mejorado
Acceso a API para desarrolladores No Sí (ER 2 hoy)

¿Debería importarle a la gente común todavía?

Aún no, pero la dirección es importante. Ahora mismo, Gemini Robotics 2 es una herramienta para desarrolladores, algo para laboratorios y empresas que construyen robots, no un producto que puedas comprar.

Lo que Google realmente está haciendo es cerrar la brecha entre un robot que realiza un truco ensayado y uno que podría, algún día, ayudar en un almacén, una cocina o un hogar de cuidados. Cada uno de estos lanzamientos reduce esa brecha un poco más.

En el momento en que los robots puedan seguir genuinamente instrucciones abiertas de manera confiable, la presión económica para desplegarlos será significativa. Eso vale la pena observar, incluso si tu robot doméstico aún está a años de distancia.

Preguntas comunes

¿Qué es "AGI física" y por qué Google usa esa frase?

AGI, inteligencia artificial general, se refiere a un sistema de IA capaz de manejar cualquier tarea que un humano pueda, en lugar de solo un trabajo específico. Los científicos de Google usan "AGI física" para describir esa misma flexibilidad aplicada a robots operando en el mundo real.

¿Pueden los desarrolladores usar Gemini Robotics 2 hoy?

Uno de los tres submodelos, Gemini Robotics ER 2, está disponible ahora a través de la API de Gemini Live. Los otros modelos de la familia aún no son accesibles públicamente.

© 2026 AI2Day