ENPIRE (Embodied Neural Policy Improvement through Physical AutoResearch) é um framework lançado em 17 de junho de 2026 pelo GEAR Lab da NVIDIA, Carnegie Mellon University e UC Berkeley. O sistema usa agentes de codificação de IA para controlar o ciclo completo de treinamento de robôs: resetar o ambiente, buscar na...
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: What is ENPIRE, the framework released on June 17 by Nvidia's GEAR Lab, Carnegie Mellon University, and UC Berkeley, and how does it use AI. Article summary: Here is the full breakdown of ENPIRE and its context.. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
Por décadas, treinar um robô para executar uma tarefa física precisa — como encaixar uma placa de vídeo em uma placa-mãe ou amarrar uma abraçadeira de nylon — exigia que seres humanos fizessem a maior parte do trabalho: resetar a cena, ajustar algoritmos, analisar falhas e reescrever código. O gargalo não eram apenas os algoritmos; era o trabalho humano.
No dia 17 de junho de 2026, uma equipe do GEAR Lab da NVIDIA, da Carnegie Mellon University (CMU) e da UC Berkeley lançou um framework que muda essa equação. Chamado ENPIRE (Embodied Neural Policy Improvement through Physical AutoResearch), ele representa o primeiro sistema documentado onde agentes de codificação de IA de ponta executam autonomamente o ciclo completo de pesquisa em robótica em hardware real .
O ENPIRE não é um robô, nem um novo modelo de IA. É um framework de suporte — um software que envolve agentes de codificação de IA e dá a eles as ferramentas para conduzir experimentos físicos. A ideia central, segundo a equipe de pesquisa, é que a pesquisa em robótica sempre careceu de um ciclo de feedback físico repetível, e o ENPIRE fornece exatamente essa abstração .
O framework coloca agentes de codificação de IA no comando de uma frota de robôs reais e entrega a eles o ciclo completo: resetar o ambiente, pesquisar a literatura, implementar ideias, treinar e implantar políticas, auto-verificar os resultados, analisar logs, reescrever código e repetir até que a política funcione de forma confiável no mundo real .
A arquitetura do ENPIRE é um ciclo fechado composto por quatro módulos, cada um cuidando de uma parte crítica do processo de pesquisa física :
EN — Módulo de Ambiente: Reseta automaticamente a cena física para um estado inicial aleatório e verifica a conclusão da tarefa usando funções de recompensa baseadas em visão (como modelos de segmentação e detectores de caixa delimitadora). Nenhum humano precisa resetar o robô entre as tentativas .
PI — Módulo de Melhoria de Política: Inicia o refinamento da política usando vários regimes — aprendizado heurístico, chamada de ferramentas, clonagem de comportamento, aprendizado por reforço offline ou online. O agente de codificação propõe hipóteses algorítmicas e escreve o código .
R — Módulo de Rollout: Avalia a política candidata em um ou vários robôs físicos operando em paralelo. Preserva estado, ação, vídeo e dados de resultado para auditoria .
E — Módulo de Evolução: Os agentes de codificação analisam logs, consultam a literatura de pesquisa, comparam branches e modificam o código da infraestrutura de treinamento e do algoritmo para lidar com modos de falha. Receitas bem-sucedidas são reutilizadas; hipóteses que falham são descartadas .
Em vez de inventar uma camada de orquestração exótica, o framework depende de uma ferramenta familiar para colaboração distribuída: Git. Quando uma estação-agente consegue um avanço, ela faz o commit do código da política melhorada. Outras estações puxam a atualização e constroem a partir dela, permitindo melhoria distribuída e assíncrona sem coordenação centralizada .
A equipe implantou oito agentes de codificação de IA emparelhados com oito estações de trabalho robóticas, cada uma equipada com dois braços mecânicos de seis graus de liberdade, câmeras de profundidade Intel RealSense e GPUs NVIDIA RTX 5090 locais. Com uma alocação de GPUs e um orçamento generoso de tokens, os agentes foram liberados com um objetivo simples: resolver a tarefa o mais rápido possível, manter os robôs ocupados, mas seguros, e não desperdiçar poder computacional .
Os agentes equipados com ENPIRE alcançaram uma taxa de sucesso pass@8 de 99% em um conjunto de tarefas desafiadoras de manipulação que exigem contato e destreza no mundo real :
O artigo observa que a métrica pass@8 mede a capacidade emergente de tentar novamente e se recuperar dentro de um único rollout de longo horizonte (até 8 tentativas no contexto, condicionadas a falhas anteriores), e não uma amostragem de melhor de 8 tentativas independentes .
O artigo introduz duas novas métricas: Utilização Média do Robô (Mean Robot Utilization - MRU) e Utilização Média de Tokens (Mean Token Utilization - MTU) para medir a eficiência da pesquisa física com múltiplos agentes .
O sistema é intensivo em tokens. Os agentes leem artigos, escrevem código, analisam logs e iteram — cada ciclo de melhoria consome uma quantidade significativa de tokens dos LLMs. A equipe deu aos agentes um "orçamento generoso de tokens" e os instruiu a não desperdiçar poder de processamento .
Todos os três agentes de codificação de ponta testados — Codex (com GPT-5.5), Claude Code (com Opus 4.7) e Kimi Code (com Kimi K2.6) — resolveram a tarefa Push-T em simulação. No entanto, nem todos transferiram o aprendizado limpo para o hardware real. O ENPIRE não elimina a lacuna entre simulação e realidade; ele dá aos agentes de IA uma maneira de descobrir e se adaptar a essa lacuna por meio de tentativas físicas repetidas . Isso é reconhecido abertamente no artigo como uma limitação central
.
O artigo inclui uma seção de "Limitações e Direções Futuras" observando que o ENPIRE ainda requer a configuração inicial do ambiente (hardware, pipeline de percepção), e que a abordagem é limitada pela qualidade e custo dos LLMs subjacentes dos agentes de codificação .
O ENPIRE se insere em uma estratégia muito mais ampla da NVIDIA para a IA Física — a inteligência artificial que entende e age no mundo físico.
O ENPIRE é, na prática, a camada de automação de pesquisa sobre essa infraestrutura — uma maneira de fechar o ciclo entre a simulação (Cosmos/Isaac), o hardware (frotas de robôs, fábricas de IA) e a melhoria autônoma de políticas, tudo impulsionado por agentes de codificação de ponta.
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
ENPIRE (Embodied Neural Policy Improvement through Physical AutoResearch) é um framework lançado em 17 de junho de 2026 pelo GEAR Lab da NVIDIA, Carnegie Mellon University e UC Berkeley.
ENPIRE (Embodied Neural Policy Improvement through Physical AutoResearch) é um framework lançado em 17 de junho de 2026 pelo GEAR Lab da NVIDIA, Carnegie Mellon University e UC Berkeley. O sistema usa agentes de codificação de IA para controlar o ciclo completo de treinamento de robôs: resetar o ambiente, buscar na literatura, implementar ideias, treinar políticas, verificar resultados e reescrever có...
Em testes com oito robôs físicos, o ENPIRE atingiu 99% de sucesso em tarefas de manipulação delicada, como encaixar uma placa de vídeo (GPU) em um slot, organizar pinos em uma caixa e cortar abraçadeiras de nylon.