O Gemini Robotics 2 do Google quer construir um robô que faça tudo o que pedirmos

Uma nova família de modelos de IA do Google DeepMind aproxima os robôs físicos de assistentes de uso geral, com melhor destreza, trabalho em equipa de múltiplos robôs, e um modelo que os programadores podem experimentar agora.

AI2Day Newsdesk4 min read
A friendly, rounded white home robot with a soft fabric-covered body and a simple cartoon-like face display stands in a bright, tidy modern living room, its two
Share

Pontos-chave

  • O Google DeepMind lançou o Gemini Robotics 2, uma nova família de modelos de IA para robôs físicos, em 2025.
  • O lançamento inclui três sub-modelos, sendo um deles disponibilizado publicamente aos programadores hoje através da Gemini Live API.
  • O Gemini Robotics ER 2 é um modelo de "raciocínio incorporado" atualizado que o DeepMind considera um avanço significativo em relação à versão anterior 1.6.
  • O objetivo é um "robô generalista" que possa responder a qualquer instrução falada ou digitada, um conceito que os cientistas do Google chamam de "AGI física" (inteligência artificial geral).
  • O novo sistema consegue controlar um corpo de robô humanóide completo, incluindo mãos complexas com múltiplos dedos.

Durante anos, os vídeos virais seguiram sempre o mesmo roteiro: um robô elegante faz um mortal para trás, sustém uma posição, depois para. Impressionante. Também inútil. Essas máquinas foram construídas para fazer exatamente uma coisa, e nada mais.

O Google quer mudar isso completamente.

O que é que o Google anunciou realmente?

O Gemini Robotics 2 é um novo conjunto de modelos de IA, ou seja, cérebros de software treinados com quantidades massivas de dados, concebidos para funcionar dentro de robôs físicos. Enquanto que os sistemas anteriores conseguiam lidar com movimentos reduzidos e pré-programados, este lançamento visa algo mais abrangente.

O objetivo principal é aquilo que os investigadores do DeepMind chamam de "AGI física", abreviatura de inteligência artificial geral aplicada ao mundo real. A ideia é simples de enunciar e difícil de concretizar: diz ao robô o que fazer, e ele descobre como. Sem programação especial para cada nova tarefa. Sem script rígido.

Três sub-modelos integram a família Gemini Robotics 2. O mais acessível neste momento é o Gemini Robotics ER 2, sendo "ER" a abreviatura de embodied reasoning (raciocínio incorporado), que significa a capacidade de compreender um ambiente físico e atuar dentro dele. Os programadores podem conectar-se a ele hoje através da Gemini Live API, uma interface de programação que permite às equipas de software construir e testar comportamentos de robôs.

Conforme noticiado pela primeira vez pela Ars Technica AI, o DeepMind descreve o ER 2 como um salto significativo em relação ao modelo anterior Gemini Robotics 1.6.

O que é que estes robôs conseguem fazer agora?

Três melhorias destacam-se do anúncio do Google.

Primeiro, o sistema consegue fazer controlo de corpo inteiro, o que significa que coordena um robô humanóide completo, da cabeça aos pés, incluindo mãos com múltiplos dedos em movimento. Esse tipo de destreza tem sido um obstáculo pertinaz.

Segundo, os robôs conseguem ler continuamente um ambiente em mudança em vez de depender de uma imagem fixa. Uma caixa move-se; o robô ajusta-se.

Terceiro, múltiplos robôs conseguem agora colaborar numa única tarefa, passando objetos entre eles ou dividindo os passos de um trabalho.

Capacidade Versão anterior Gemini Robotics 2
Controlo humanóide de corpo inteiro Limitado Sim
Colaboração multi-robô Não Sim
Análise contínua do ambiente Parcial Melhorada
Acesso à API para programadores Não Sim (ER 2 agora)

Devem as pessoas comuns preocupar-se agora?

Ainda não, mas a direção é importante. Neste momento, o Gemini Robotics 2 é uma ferramenta para programadores, algo para laboratórios e empresas que constroem robôs, não um produto que possa comprar.

O que o Google está a fazer realmente é fechar a lacuna entre um robô que executa um truque ensaiado e um que pudesse, um dia, ajudar num armazém, numa cozinha, ou numa casa de repouso. Cada um destes lançamentos reduz essa lacuna um pouco mais.

No momento em que os robôs conseguirem cumprir de forma fiável instruções abertas, a pressão económica para os implementar será significativa. Isto merece atenção, mesmo que o seu robô doméstico ainda esteja a anos de distância.

Perguntas frequentes

O que é "AGI física" e por que é que o Google usa essa expressão?

AGI, inteligência artificial geral, refere-se a um sistema de IA capaz de lidar com qualquer tarefa que um humano possa fazer, em vez de apenas um trabalho específico. Os cientistas do Google usam "AGI física" para descrever essa mesma flexibilidade aplicada a robôs a funcionar no mundo real.

Podem os programadores usar o Gemini Robotics 2 hoje?

Um dos três sub-modelos, o Gemini Robotics ER 2, está disponível agora através da Gemini Live API. Os outros modelos da família ainda não estão acessíveis publicamente.

© 2026 AI2Day