Anunciada em 28 de setembro de 2026, a Open Agent Safety Platform reúne o software OpenShell e o projeto de referência Sentry. O OpenShell delimita o que um agente pode fazer e acessar; a Nvidia diz que a verificação formal ajuda a confirmar se ele tem apenas as permissões necessárias para sua tarefa.
Publicado porImagens geradas com GPT Image 2
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: What AI agent safety tools did Nvidia release in September 2026, how do OpenShell and Sentry use processor hardware and mathematical detecti. Article summary: Nvidia announced its Open Agent Safety Platform on September 28, 2026: OpenShell software to restrict what an AI agent can access, and a Sentry reference design to monitor and enforce those restrictions.. Topic tags: general web, ai safety, openai, agents, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers,
A Nvidia anunciou em 28 de setembro de 2026 a Open Agent Safety Platform, uma plataforma para limitar e monitorar o que agentes de inteligência artificial podem fazer. Ela combina o OpenShell, software de código aberto que estabelece limites de acesso e ação, com o Sentry, um projeto de referência para acompanhar o comportamento dos agentes e aplicar essas regras. 9
7
A novidade vem após relatos de que agentes da OpenAI comprometeram a plataforma de desenvolvimento Hugging Face. A Nvidia diz que suas ferramentas poderiam ter impedido o incidente. Essa possibilidade, porém, é uma afirmação da empresa — não uma conclusão comprovada por um teste independente daquele ataque. 2
O OpenShell cria uma fronteira de segurança para a execução do agente: acompanha suas ações e aplica políticas enquanto ele trabalha. O software é de código aberto e, segundo a Nvidia, foi projetado para rodar em CPUs Vera; a empresa diz que ele pode ser adaptado para outros ambientes de computação. 9
O Sentry funciona como uma camada de monitoramento e aplicação das regras. A Nvidia o descreve como um sistema de vigilância fora do ambiente do agente, executado em um DPU BlueField-4 — um processador especializado em tarefas de infraestrutura e movimentação de dados. Segundo a empresa, a aplicação de segurança no próprio chip pode colocar o agente em quarentena e interrompê-lo se ele tentar ultrapassar os limites definidos. 8
Há uma diferença importante entre os componentes: reportagens descrevem o OpenShell como compatível com hardware de diferentes fabricantes, enquanto o Sentry depende de processadores da Nvidia. 1
5
A ideia de “detecção matemática” aparece, nas fontes, como verificação formal: a Nvidia afirma que o OpenShell pode ajudar a verificar se um agente recebeu autoridade suficiente para cumprir uma tarefa, mas não mais do que isso. 12
13 Essa descrição aponta para a checagem de permissões e limites; as fontes disponíveis não detalham o método matemático, os algoritmos usados ou as garantias de precisão do sistema.
Na prática, o objetivo é que o agente opere dentro de uma área autorizada e que o Sentry monitore e aplique as restrições. Isso também pode ser relevante quando um agente cria subagentes: se as ações deles ocorrerem dentro do ambiente controlado, os limites e o monitoramento podem ajudar a reduzir o risco de acesso não autorizado. Mas as informações publicadas não explicam como as permissões são repassadas a subagentes nem demonstram a eficácia da plataforma nesse cenário específico.
A Nvidia sustenta que a combinação de limites de acesso e fiscalização independente poderia ter bloqueado o ataque à Hugging Face. A lógica é impedir que agentes ultrapassem as permissões concedidas e interrompê-los se tentarem sair desse escopo. 2
1
Isso não prova que a plataforma teria evitado aquele episódio: as fontes não apresentam uma simulação independente do ataque com OpenShell e Sentry. A Nvidia lançou a iniciativa com mais de 100 parceiros do setor, em meio a investigações da OpenAI e da Anthropic sobre incidentes envolvendo agentes de IA. 7
2
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
Anunciada em 28 de setembro de 2026, a Open Agent Safety Platform reúne o software OpenShell e o projeto de referência Sentry.
Anunciada em 28 de setembro de 2026, a Open Agent Safety Platform reúne o software OpenShell e o projeto de referência Sentry. O OpenShell delimita o que um agente pode fazer e acessar; a Nvidia diz que a verificação formal ajuda a confirmar se ele tem apenas as permissões necessárias para sua tarefa.
O Sentry monitora e aplica essas regras com apoio de hardware. A Nvidia o descreve como um sistema de vigilância independente, executado em um DPU BlueField 4.