Voltar para notícias
blog.google
0 visualizações

Google DeepMind lança Gemini Robotics ER 2 com colaboração

Novo modelo de raciocínio incorporado permite que robôs planejem tarefas em múltiplas etapas, corrijam erros em tempo real e trabalhem juntos. Já disponível para desenvolvedores via API.

Google DeepMind lança Gemini Robotics ER 2 com colaboração
O Google DeepMind anunciou o lançamento do Gemini Robotics ER 2, um modelo de inteligência artificial projetado para atuar como um "cérebro" de alto nível para robôs. A novidade permite que máquinas realizem raciocínio espacial em tempo real, planejem tarefas complexas com várias etapas e colaborem entre si em espaços compartilhados. O modelo já está disponível para desenvolvedores por meio da Gemini API, do Google AI Studio e da plataforma Gemini Enterprise Agent. O Gemini Robotics ER 2 representa um avanço significativo em relação ao seu antecessor, o ER 1.6. Uma das principais melhorias está na capacidade de processar vídeos em tempo real, permitindo que o robô acompanhe seu próprio progresso, identifique erros e se adapte sem precisar reiniciar todo o processo. O modelo também introduz a colaboração multi-robô, possibilitando que diferentes máquinas — como um robô com rodas e um humanoide — trabalhem juntas para concluir tarefas que um único robô não conseguiria realizar sozinho. Em testes de benchmark, o Gemini Robotics ER 2 superou modelos concorrentes e a versão anterior em tarefas como classificação de progresso (57,4% de precisão) e identificação de momentos críticos em vídeos (91,3% de acerto). Além disso, o modelo é o mais seguro já lançado pela DeepMind para robótica, com melhorias significativas em benchmarks de segurança, como a capacidade de parar um robô quando um humano se aproxima e retomar o trabalho automaticamente após a área ser liberada. O modelo também pode integrar ferramentas como o Google Search para buscar informações ou funções personalizadas definidas pelo desenvolvedor. A disponibilização pública do Gemini Robotics ER 2 abre caminho para que startups, pesquisadores e empresas criem agentes físicos de IA mais úteis e seguros. O Google DeepMind disponibilizou exemplos de código no GitHub para ajudar desenvolvedores a configurar o modelo e integrá-lo a sistemas robóticos existentes. A expectativa é que a tecnologia acelere o desenvolvimento de robôs capazes de atuar em ambientes dinâmicos, como armazéns, hospitais e residências, onde a interação segura e eficiente com humanos é essencial.