Robôs começam a aprender tarefas novas vendo vídeos, mas ainda erram muito

A busca por inteligência artificial física avança em ritmo acelerado nos laboratórios de robótica. Atualmente, robôs começam a aprender tarefas novas vendo vídeos e pequenas demonstrações humanas. Uma reportagem publicada pela WIRED revelou como a startup Generalist AI tenta construir modelos fundamentais para o mundo real. Contudo, é essencial diferenciar demonstrações corporativas de avaliações científicas independentes.

O que os robôs demonstraram ao aprender tarefas novas vendo vídeos

Durante as demonstrações observadas pela reportagem, os braços robóticos da empresa exibiram comportamentos notáveis de adaptação. O sistema conseguiu executar tarefas sem programação prévia linha por linha. Entre as ações registradas, destacam-se:

  • Empilhar blocos e objetos com geometrias variadas.
  • Transferir itens entre recipientes diferentes daqueles usados no treinamento inicial.
  • Abrir uma bolsa com zíper e retirar cédulas de dinheiro.
  • Trocar de braço mecânico automaticamente quando encontrou obstáculos físicos.
  • Utilizar pequenos objetos da mesa como ferramentas improvisadas.

Esses testes indicam uma capacidade inicial de generalização espacial. No entanto, o sistema opera sob parâmetros proprietários da empresa, sem auditoria externa independente.

Por que aprender com poucos exemplos é difícil

Modelos de linguagem aprendem com bilhões de palavras digitais. Em contrapartida, robôs precisam lidar com a física caótica do mundo real. O atrito, o peso e a iluminação mudam a cada segundo. Ensinar uma máquina com apenas cinco ou dez demonstrações curtas exige que o modelo deduza invariâncias espaciais complexas. O robô não compreende a física como uma pessoa, mas calcula probabilidades de vetores motores a partir de pixels.

Como a Generalist coleta dados físicos

A Generalist AI combina teleoperação humana, visão computacional e vídeos curtos para alimentar sua arquitetura. Operadores humanos executam tarefas usando controladores específicos. Em seguida, os algoritmos processam essas trajetórias como sequências de dados multimodais. Dessa forma, o modelo correlaciona o fluxo visual da câmera aos comandos de torque das juntas robóticas.

O que significa improvisar uma ferramenta

Em uma das demonstrações, o robô usou uma barra para puxar um item distante. Esse comportamento chama a atenção pelo dinamismo. Contudo, isso não representa raciocínio abstrato humano. O modelo simplesmente identificou um padrão de contato mecânico que reduziu a distância do alvo. Trata-se de uma generalização estatística funcional e promissora, mas estritamente algorítmica.

O número que reduz o hype: 59%

Apesar do apelo visual dos testes, a própria Generalist AI relata uma taxa média de sucesso de aproximadamente 59%. Isso significa que o robô falha em quatro de cada dez tentativas. Especialistas externos consultados consideram o resultado promissor para modelos iniciais. Ainda assim, a ausência de benchmarks públicos padronizados exige cautela analítica por parte do setor.

De 59% a 99% existe um enorme problema de engenharia

Uma taxa de 59% funciona bem em demonstrações de laboratório. No entanto, linhas industriais e hospitais exigem índices superiores a 99,9%. A distância entre a demonstração inicial e a confiabilidade operacional envolve resolver a cauda longa de erros físicos. Pequenas variações de reflexo ou poeira podem desorientar os atuadores.

Onde robôs generalistas podem aparecer primeiro

A implementação prática desses modelos não ocorrerá de imediato em ambientes críticos. As primeiras aplicações comerciais tendem a surgir em cenários de baixo risco com supervisão humana:

  1. Separação de pacotes irregulares em centros de distribuição.
  2. Manuseio de materiais não estruturados na reciclagem.
  3. Abastecimento básico de peças em manufaturas flexíveis.

Consequências para indústria e trabalho

A transição para robôs adaptáveis transformará gradualmente o chão de fábrica. As empresas demandarão menos programadores de trajetórias fixas e mais especialistas em demonstração física e supervisão de dados. O avanço da Generalist AI comprova a viabilidade dos modelos físicos da robótica, mas a confiabilidade industrial plena ainda demandará anos de pesquisa rigorosa.

Escrito por
  • Gestora de tecnologia e transformação digital em empresas, especialista na aplicação de IA e soluções educacionais. Com experiência na liderança de projetos de TI, incluindo a implementação de sistemas ERP e o desenvolvimento prático de currículos de programação com Python e plataformas gamificadas. Formação em Direito pela UCP e Pedagogia pela UERJ, especializações em Direito e Tecnologia (Legaltechs e IA) e Neuropsicopedagogia, e certificações em Inteligência Artificial e Tutoria EAD.

Curte nosso blog? Então compartilhe nas redes!

Deixe um comentário

Escreva seu comentário abaixo.