A Google lança o Gemini Robotics ER 1.6: modelo de robótica SOTA, especialista em raciocínio visual e espacial

A Google DeepMind publicou um modelo de base totalmente novo para robôs, o Gemini Robotics ER 1.6, em que o ER significa Embodied Reasoning (raciocínio incorporado). Este modelo alcança o atual melhor nível (SOTA) em raciocínio visual e espacial e já foi disponibilizado através da Gemini API. Logan Kilpatrick, responsável pelas relações com programadores de IA na Google, divulgou esta notícia nas redes sociais. (Fonte)

O que é o Embodied Reasoning?

Embodied Reasoning refere-se à capacidade dos modelos de IA compreenderem e raciocinarem sobre o mundo físico. Ao contrário dos modelos de linguagem tradicionais, os modelos de raciocínio incorporado precisam de lidar com a posição dos objetos no espaço tridimensional, bem como com a sua forma, materiais e relações de interação física. O Gemini Robotics ER 1.6 foi otimizado especificamente para este tipo de tarefas, permitindo que os robôs compreendam com mais precisão o ambiente envolvente e tomem decisões adequadas sobre as ações a executar.

Capacidades principais

As principais vantagens do Gemini Robotics ER 1.6 concentram-se em duas vertentes:

Capacidade Descrição Raciocínio visual Capacidade de identificar objetos a partir de imagens e vídeos, compreender a estrutura do cenário e, com base nisso, tomar decisões Raciocínio espacial Compreender a posição relativa, a distância e a direção dos objetos no espaço tridimensional, apoiando a planificação de operações complexas

A combinação destas duas capacidades permite que os robôs lidem com tarefas do mundo real mais complexas. Por exemplo, num ambiente de armazém, o robô precisa de identificar simultaneamente objetos de diferentes formas e calcular o melhor ângulo de pega e a posição de colocação — exatamente o tipo de cenário em que o Gemini Robotics ER 1.6 é particularmente competente.

Utilização através da Gemini API

Ao contrário de muitos modelos de robôs do passado que ficaram apenas na fase de artigo, o Gemini Robotics ER 1.6 já disponibiliza acesso através da Gemini API. Isto significa que os programadores e os fabricantes de hardware podem integrar diretamente este modelo nos seus próprios sistemas de robôs, sem necessidade de treinar o modelo do zero.

A disponibilização da API também reduz o limiar para o desenvolvimento de IA para robôs. No passado, desenvolver um sistema de robôs com capacidades de raciocínio visual e espacial exigia uma recolha massiva de dados e trabalho de treino de modelos. Agora, os programadores podem concentrar-se no desenvolvimento do design do hardware e dos casos de uso, deixando as capacidades de raciocínio de base a cargo do Gemini Robotics ER 1.6.

O posicionamento da Google em IA para robôs

O Gemini Robotics ER 1.6 é o mais recente resultado da Google DeepMind na área da robótica. Do RT-2, numa fase inicial, até à série Gemini Robotics de hoje, a Google tem continuado a expandir as capacidades dos grandes modelos de linguagem para a interação com o mundo físico. A versão ER 1.6 melhora ainda mais a exatidão do raciocínio face aos antecessores, destacando-se particularmente em cenários que exigem manipulações mais precisas.

À medida que a indústria de robôs entra numa nova fase de crescimento, os modelos de base com fortes capacidades de raciocínio visual e espacial tornar-se-ão infraestrutura-chave. Para saber mais sobre a evolução do ecossistema Gemini, pode consultar o guia completo do Gemini.

Este artigo Google lançou o Gemini Robotics ER 1.6: modelo de robôs SOTA, especializado em raciocínio visual e espacial foi publicado pela primeira vez em Cadeia de Notícias ABMedia.

Isenção de responsabilidade: As informações contidas nesta página podem ser provenientes de terceiros e não representam os pontos de vista ou opiniões da Gate. O conteúdo apresentado nesta página é apenas para referência e não constitui qualquer aconselhamento financeiro, de investimento ou jurídico. A Gate não garante a exatidão ou o carácter exaustivo das informações e não poderá ser responsabilizada por quaisquer perdas resultantes da utilização destas informações. Os investimentos em ativos virtuais implicam riscos elevados e estão sujeitos a uma volatilidade de preços significativa. Pode perder todo o seu capital investido. Compreenda plenamente os riscos relevantes e tome decisões prudentes com base na sua própria situação financeira e tolerância ao risco. Para mais informações, consulte a Isenção de responsabilidade.

Related Articles

Hong Kong vai anunciar amanhã a sexta lista de principais empresas

O Secretário Financeiro de Hong Kong, Paul Chan, anunciou a apresentação de uma nova lista de principais empresas, atraindo mais de 100 negócios avaliados acima de 100 mil milhões de HKD em sectores como as ciências da vida, a IA e a fintech, realçando o atractivo de Hong Kong para o investimento internacional.

GateNews1h atrás

O robô Lightning da Honor vence a Meia-Maratona de Robôs Humanoides de Pequim 2026 com 50:26

O robô humanoide "Lightning" da Honor estabeleceu um novo recorde na Meia-Maratona de Robôs Humanoides de Yizhuang em Pequim 2026, concluindo a corrida em 50 minutos e 26 segundos, superando o recorde mundial humano.

GateNews5h atrás

As acções da Meta sobem 1,73% enquanto a empresa planeia um despedimento de 8.000 trabalhadores com início a 20 de maio

A Meta Platforms planeia cortar cerca de 8.000 empregos, ou 10% da sua força de trabalho, a partir de 20 de maio, apesar da subida dos preços das acções. A empresa, com mais de $200 mil milhões de receitas, está a concentrar-se em investimentos em IA no meio de uma reestruturação significativa, alinhando-se pelas tendências da indústria de despedimentos.

GateNews12h atrás

O relatório anual do Google afirma que o Gemini implementou bloqueio em milissegundos, impedindo 99% dos anúncios fraudulentos

O artigo discute como a Google reforçou a segurança da publicidade através do seu sistema de inteligência artificial generativa Gemini; o relatório indica que a sua velocidade de deteção de anúncios em incumprimento foi reduzida para milissegundos, com uma taxa de deteção de 99%. No ano passado, a Google removeu 8,3 mil milhões de anúncios e suspendeu 24,9 milhões de contas, o que mostra um aumento acentuado do número de anúncios fraudulentos. Os especialistas apontam que se trata de um confronto entre inteligência artificial e inteligência artificial e que, no futuro, ainda será necessário enfrentar os desafios das ações legais e ilegais trazidas pela IA.

ChainNewsAbmedia14h atrás

Cofundador da Ethereum Lubin: A IA será o ponto de viragem crítico para as criptomoedas, mas o monopólio das gigantes da tecnologia coloca um risco sistémico

O cofundador da Ethereum, Joseph Lubin, destacou o potencial transformador da IA para o sector das criptomoedas, ao mesmo tempo que alertou para os riscos da centralização entre grandes empresas de tecnologia. Ele imagina transacções autónomas impulsionadas por IA na blockchain e sublinha a convergência das finanças tradicionais com a DeFi.

GateNews16h atrás

Elon Musk promove cheques de “Rendimento Elevado Universal” como solução definitiva para o desemprego causado pela IA

Elon Musk defende um Rendimento Universal Elevado para combater o desemprego provocado pela IA, imaginando um futuro com abundantes bens e inflação zero. Em contraste, especialistas como Sam Altman levantam preocupações sobre a perda de empregos e propõem medidas de proteção para os trabalhadores.

Coinpedia16h atrás
Comentar
0/400
Nenhum comentário