O Google DeepMind lançou o Gemini Robotics 2, uma família de modelos para controlar um robô — nas palavras da fonte — dos pés até a ponta dos dedos.
A versão anterior tratava basicamente da parte superior do corpo e de tarefas sobre a mesa. Esta combina caminhar, equilibrar-se, alcançar, agarrar e raciocinar numa sequência contínua.
Por que isso importa
- Sequência contínua: entender a ordem, localizar o objeto, andar até ele, pegar, atravessar a sala e depositar no lugar certo.
- São três modelos com papéis distintos, não um só.
- Um deles roda no próprio robô, completamente offline.
- Dá para experimentar no AI Studio.
1.Os três modelos e para que serve cada um
3 min- Gemini Robotics 2 — o modelo de visão-linguagem-ação. Converte sua instrução em linguagem natural, mais o que as câmeras do robô veem, em comandos motores.
- Gemini Robotics ER2 — o raciocínio de alto nível. Entende o ambiente, planeja tarefas, corrige falhas e coordena múltiplos robôs.
- Gemini Robotics On-Device 2 — versão menor que roda no próprio robô, sem conexão com a internet.
A divisão espelha como uma pessoa opera: um nível decide o que fazer e replaneja quando dá errado, outro executa o movimento. O modelo local resolve o problema prático da conectividade — robô que depende de internet para se mexer trava quando a rede cai.
Ficha técnica
- Acesso
- AI Studio + programa de testadores
- Modelos
- 3 (VLA, ER2, On-Device 2)
- Escopo
- Corpo inteiro

Continue no microcurso completo
Você leu a abertura de 3 aulas
O microcurso traz o passo a passo completo, os critérios de escolha, onde a ferramenta falha, para quem ela realmente serve — e, no Expert, o endereço oficial para começar hoje.
- O que mudou nas mãos2 min
- Como colocar a mão1 min
Como apuramos
Acompanhamos os lançamentos direto nas fontes primárias, transcrevemos o que é demonstrado, conferimos cada nome e cada número contra a documentação oficial do fabricante e reescrevemos em português — com o que a ferramenta não faz junto, que é a parte que o anúncio omite.


