Gemini Robotics 2 eleva a inteligência robótica para colaboração e adaptação
Aprofundamento CEVIU
Aprofundamento
O Gemini Robotics 2, da DeepMind, representa um salto significativo na robótica autônoma. Ele integra inteligência de corpo inteiro nos robôs, permitindo que executem tarefas complexas com agilidade inédita. Esta plataforma é sustentada por três modelos chave: o Gemini Robotics 2 (VLA), que traduz entrada visual e de linguagem em controle motor para robôs humanoides e bi-braços, habilitando manipulação dexterosa; o Gemini Robotics ER 2 (Embodied Reasoning), um modelo VLM que atua como agente para comunicação humana, entendimento do mundo físico e planejamento de tarefas multi-etapas; e o Gemini Robotics On-Device 2, um VLA otimizado para execução local em dispositivos, essencial para ambientes com restrições de conectividade.
A capacidade de controle de corpo inteiro é um diferencial, permitindo que robôs como o Apptronik Apollo 2 executem sequências de movimentos como andar, agachar e manipular objetos em espaços complexos. A destreza é aprimorada com o controle de mãos articuladas de 22 graus de liberdade, como a SharpaWave, para tarefas delicadas. O modelo ER 2 gerencia raciocínio complexo e colaboração multi-robô, possibilitando que diferentes tipos de robôs trabalhem juntos em fluxos de trabalho que um único robô não conseguiria. A adaptação rápida a novos corpos robóticos em poucas horas, com base em poucas centenas de exemplos, é outro avanço crucial, especialmente para a experiência do desenvolvedor (DX).
O que mudou
O Gemini Robotics 2 demonstra uma evolução clara em relação às versões anteriores. Antes, modelos focavam no controle da parte superior do corpo para tarefas de mesa. Agora, com o Gemini Robotics 2, a IA expande-se para o controle de corpo inteiro, permitindo que robôs humanoides, como o Apollo 2, executem uma gama muito maior de movimentos, incluindo locomoção e manipulação complexa.
Outro avanço significativo está na adaptação de modelos. O Gemini Robotics On-Device 2, por exemplo, herda e aprimora as técnicas de “transferência de movimento” do Gemini Robotics 1.5. Isso significa que a nova versão consegue se adaptar a novos corpos robóticos em apenas algumas horas, usando menos de duzentos exemplos, um salto na eficiência e flexibilidade para a integração de novos hardwares.
Por que isso importa
Para o desenvolvedor, a chegada do Gemini Robotics 2 significa o acesso a uma plataforma de IA robótica muito mais flexível e poderosa. A capacidade de controlar robôs de corpo inteiro e aprimorar a destreza abre novas avenidas para a automação de tarefas em logística, manufatura e serviços. A integração de modelos de raciocínio (ER 2) permite criar agentes mais autônomos, capazes de planejar e executar sequências complexas, corrigindo-se quando necessário.
A otimização para execução on-device, com rápida adaptação a diferentes arquiteturas de hardware, diminui a barreira de entrada para a prototipagem e implementação. Isso acelera o ciclo de desenvolvimento e permite que a robótica inteligente se torne mais presente em ambientes reais, sem depender de conectividade constante, impactando diretamente a performance e a usabilidade em escala.
Linha do tempo
NVIDIA Research avança em grasping robótico, condução autônoma e treinamento em larga escala de agentes.
Gemini 3.5 Flash passa a ter computer use integrado.
A 1X revoluciona robótica com mãos articuladas para o lar.
NVIDIA Amplia Família Jetson Thor com Módulos T3000 e T2000 para IA de Borda Robótica.
NVIDIA Apresenta Cosmos 3 Edge: Um Salto para Robôs Autônomos com IA de Visão.
Unitree eleva o patamar da robótica com o GD01, um mecha transformável que promete revolucionar interações.
Gemini Robotics 2 eleva a inteligência robótica para colaboração e adaptação.
Perguntas frequentes
O que significa "inteligência de corpo inteiro" no contexto do Gemini Robotics 2?
A inteligência de corpo inteiro permite que os robôs coordenem todos os seus movimentos, desde a locomoção até a manipulação fina. Isso significa que eles podem andar, agachar, esticar e usar mãos ou garras de forma coesa para interagir com o ambiente, em vez de se limitar a tarefas localizadas.
Quais são os principais modelos que compõem a plataforma Gemini Robotics 2?
A plataforma é formada por três modelos: Gemini Robotics 2 (VLA), que converte entradas visuais e de linguagem em controle motor; Gemini Robotics ER 2 (ER), um modelo de raciocínio que planeja tarefas e se comunica; e Gemini Robotics On-Device 2 (VLA), otimizado para execução local e rápida adaptação a novos robôs.
Como o Gemini Robotics 2 aprimora a colaboração entre robôs?
O Gemini Robotics ER 2, o modelo de raciocínio, agora habilita a colaboração multi-robô. Diferentes tipos de robôs podem se comunicar e coordenar para realizar fluxos de trabalho complexos que seriam inviáveis para um único robô, aumentando a eficiência em tarefas maiores.
Qual a importância da adaptação rápida a novos hardwares no Gemini Robotics On-Device 2?
A adaptação rápida permite que o modelo seja configurado para novos corpos robóticos em poucas horas, usando um número limitado de exemplos. Isso é crucial para a flexibilidade, reduzindo o tempo de desenvolvimento e o custo de integração, facilitando a adoção da tecnologia em diversas plataformas de robótica.
Fontes
- deepmind.googlefonte original
- Categoria
- CEVIU Web Dev
- Publicado
- 31 de julho de 2026
- Editoria
- CEVIU Web Dev

