O Google DeepMind lançou o Gemini Robotics 2, uma família de modelos para controlar um robô — nas palavras da fonte — dos pés até a ponta dos dedos.
A versão anterior tratava basicamente da parte superior do corpo e de tarefas sobre a mesa. Esta combina caminhar, equilibrar-se, alcançar, agarrar e raciocinar numa sequência contínua.
Por que isso importa
- Sequência contínua: entender a ordem, localizar o objeto, andar até ele, pegar, atravessar a sala e depositar no lugar certo.
- São três modelos com papéis distintos, não um só.
- Um deles roda no próprio robô, completamente offline.
- Dá para experimentar no AI Studio.
1.Os três modelos e para que serve cada um
3 min- Gemini Robotics 2 — o modelo de visão-linguagem-ação. Converte sua instrução em linguagem natural, mais o que as câmeras do robô veem, em comandos motores.
- Gemini Robotics ER2 — o raciocínio de alto nível. Entende o ambiente, planeja tarefas, corrige falhas e coordena múltiplos robôs.
- Gemini Robotics On-Device 2 — versão menor que roda no próprio robô, sem conexão com a internet.
A divisão espelha como uma pessoa opera: um nível decide o que fazer e replaneja quando dá errado, outro executa o movimento. O modelo local resolve o problema prático da conectividade — robô que depende de internet para se mexer trava quando a rede cai.
Ficha técnica
- Acesso
- AI Studio + programa de testadores
- Modelos
- 3 (VLA, ER2, On-Device 2)
- Escopo
- Corpo inteiro
- Offline
- Sim, na versão On-Device 2
- Demonstrado em
- Humanoide Apollo 2

Continue no microcurso completo
Você leu a primeira de 3 aulas
A versão detalhada traz o passo a passo completo, os critérios de escolha, onde a ferramenta falha e para quem ela realmente serve.
- O que mudou nas mãos2 min
- Como colocar a mão1 min
De onde saiu este microcurso
Do capítulo “Gemini Robotics 2” (aos 22:10) do vídeo New Deepseek, Seedance 2.5, Minimax H3, Gemini Robotics, AMD models: AI NEWS, do canal AI Search. Transcrevemos, conferimos os nomes contra as páginas oficiais e reescrevemos em português.

