CEVIU Logo
Voltar
Gemini Robotics 2: Robôs Adquirem Inteligência de Corpo Inteiro para Tarefas Complexas

Gemini Robotics 2 eleva a inteligência robótica para colaboração e adaptação

Aprofundamento CEVIU

Aprofundamento

O Gemini Robotics 2, da DeepMind, representa um salto significativo na robótica autônoma. Ele integra inteligência de corpo inteiro nos robôs, permitindo que executem tarefas complexas com agilidade inédita. Esta plataforma é sustentada por três modelos chave: o Gemini Robotics 2 (VLA), que traduz entrada visual e de linguagem em controle motor para robôs humanoides e bi-braços, habilitando manipulação dexterosa; o Gemini Robotics ER 2 (Embodied Reasoning), um modelo VLM que atua como agente para comunicação humana, entendimento do mundo físico e planejamento de tarefas multi-etapas; e o Gemini Robotics On-Device 2, um VLA otimizado para execução local em dispositivos, essencial para ambientes com restrições de conectividade.

A capacidade de controle de corpo inteiro é um diferencial, permitindo que robôs como o Apptronik Apollo 2 executem sequências de movimentos como andar, agachar e manipular objetos em espaços complexos. A destreza é aprimorada com o controle de mãos articuladas de 22 graus de liberdade, como a SharpaWave, para tarefas delicadas. O modelo ER 2 gerencia raciocínio complexo e colaboração multi-robô, possibilitando que diferentes tipos de robôs trabalhem juntos em fluxos de trabalho que um único robô não conseguiria. A adaptação rápida a novos corpos robóticos em poucas horas, com base em poucas centenas de exemplos, é outro avanço crucial, especialmente para a experiência do desenvolvedor (DX).

O que mudou

O Gemini Robotics 2 demonstra uma evolução clara em relação às versões anteriores. Antes, modelos focavam no controle da parte superior do corpo para tarefas de mesa. Agora, com o Gemini Robotics 2, a IA expande-se para o controle de corpo inteiro, permitindo que robôs humanoides, como o Apollo 2, executem uma gama muito maior de movimentos, incluindo locomoção e manipulação complexa.

Outro avanço significativo está na adaptação de modelos. O Gemini Robotics On-Device 2, por exemplo, herda e aprimora as técnicas de “transferência de movimento” do Gemini Robotics 1.5. Isso significa que a nova versão consegue se adaptar a novos corpos robóticos em apenas algumas horas, usando menos de duzentos exemplos, um salto na eficiência e flexibilidade para a integração de novos hardwares.

Por que isso importa

Para o desenvolvedor, a chegada do Gemini Robotics 2 significa o acesso a uma plataforma de IA robótica muito mais flexível e poderosa. A capacidade de controlar robôs de corpo inteiro e aprimorar a destreza abre novas avenidas para a automação de tarefas em logística, manufatura e serviços. A integração de modelos de raciocínio (ER 2) permite criar agentes mais autônomos, capazes de planejar e executar sequências complexas, corrigindo-se quando necessário.

A otimização para execução on-device, com rápida adaptação a diferentes arquiteturas de hardware, diminui a barreira de entrada para a prototipagem e implementação. Isso acelera o ciclo de desenvolvimento e permite que a robótica inteligente se torne mais presente em ambientes reais, sem depender de conectividade constante, impactando diretamente a performance e a usabilidade em escala.

Linha do tempo

  1. NVIDIA Research avança em grasping robótico, condução autônoma e treinamento em larga escala de agentes.

  2. Gemini 3.5 Flash passa a ter computer use integrado.

  3. A 1X revoluciona robótica com mãos articuladas para o lar.

  4. NVIDIA Amplia Família Jetson Thor com Módulos T3000 e T2000 para IA de Borda Robótica.

  5. NVIDIA Apresenta Cosmos 3 Edge: Um Salto para Robôs Autônomos com IA de Visão.

  6. Unitree eleva o patamar da robótica com o GD01, um mecha transformável que promete revolucionar interações.

  7. Gemini Robotics 2 eleva a inteligência robótica para colaboração e adaptação.

Perguntas frequentes

O que significa "inteligência de corpo inteiro" no contexto do Gemini Robotics 2?

A inteligência de corpo inteiro permite que os robôs coordenem todos os seus movimentos, desde a locomoção até a manipulação fina. Isso significa que eles podem andar, agachar, esticar e usar mãos ou garras de forma coesa para interagir com o ambiente, em vez de se limitar a tarefas localizadas.

Quais são os principais modelos que compõem a plataforma Gemini Robotics 2?

A plataforma é formada por três modelos: Gemini Robotics 2 (VLA), que converte entradas visuais e de linguagem em controle motor; Gemini Robotics ER 2 (ER), um modelo de raciocínio que planeja tarefas e se comunica; e Gemini Robotics On-Device 2 (VLA), otimizado para execução local e rápida adaptação a novos robôs.

Como o Gemini Robotics 2 aprimora a colaboração entre robôs?

O Gemini Robotics ER 2, o modelo de raciocínio, agora habilita a colaboração multi-robô. Diferentes tipos de robôs podem se comunicar e coordenar para realizar fluxos de trabalho complexos que seriam inviáveis para um único robô, aumentando a eficiência em tarefas maiores.

Qual a importância da adaptação rápida a novos hardwares no Gemini Robotics On-Device 2?

A adaptação rápida permite que o modelo seja configurado para novos corpos robóticos em poucas horas, usando um número limitado de exemplos. Isso é crucial para a flexibilidade, reduzindo o tempo de desenvolvimento e o custo de integração, facilitando a adoção da tecnologia em diversas plataformas de robótica.

Fontes

Avalie este artigo:
Compartilhar:
Categoria
CEVIU Web Dev
Publicado
31 de julho de 2026
Editoria
CEVIU Web Dev

Quer receber mais sobre CEVIU Web Dev?

Conteúdo curado diariamente, direto no seu e-mail.

Conteúdo curado diariamenteDiversas categoriasCancele quando quiser
Gemini Robotics 2 eleva a inteligência robótica