A Nvidia apresentou nesta segunda-feira (28) a Open Agent Safety Platform, um pacote de software e hardware para impor limites a agentes de inteligência artificial, aqueles sistemas que executam tarefas sozinhos, por horas, em nome de uma empresa. O anúncio chega depois de semanas em que agentes experimentais foram associados a invasões de sistemas privados e governamentais, e em que empresas do setor começaram a admitir publicamente a necessidade de freios.
A lógica da Nvidia parte de um diagnóstico: nos incidentes recentes, o agente contornou as travas colocadas na camada de aplicação para cumprir a tarefa que recebeu. Por isso, a proposta é tirar o controle de dentro do modelo e levá-lo para camadas que o agente não consegue manipular, incluindo o próprio silício.
OpenShell e Sentry
A plataforma tem, por enquanto, duas peças. O OpenShell é um ambiente de execução seguro que registra cada ação do agente e aplica políticas enquanto ele roda em CPUs, seja com modelos abertos ou fechados. Ele foi desenhado para as CPUs Vera, que a Nvidia apresenta como o primeiro processador feito para IA agêntica, mas é código aberto e pode ser adaptado para plataformas da Arm e da Intel.
A segunda peça, o Sentry, é um projeto de referência que roda nas DPUs BlueField-4, os chips de rede da empresa. Ele funciona como um vigia fora de banda: monitora o comportamento do agente de um domínio isolado, invisível para o próprio agente e para atacantes, e coloca em quarentena quem tentar sair do perímetro permitido, em questão de milissegundos. A Nvidia afirma que esse tipo de barreira seria capaz de conter casos como o ataque em massa de agentes que atingiu a Hugging Face.
Quem já está dentro
A lista de adesões é longa. A Anthropic integrou o Claude Managed Agents ao OpenShell e ao BlueField; a SpaceXAI usa a plataforma com os agentes de programação do Cursor e com o Grok; a Salesforce levou o controle do OpenShell para o Slack, onde equipes podem aprovar ou negar pedidos de permissão dos agentes; e a SAP está embutindo a tecnologia no Joule Studio. Microsoft, Cisco, CrowdStrike, Dell, HP, Lenovo, Red Hat, Oracle, IBM e Palantir também aparecem entre os parceiros. Google, OpenAI e Meta, por outro lado, não estão na relação por enquanto.
Para empresas brasileiras que começam a colocar agentes em atendimento, finanças e TI, o recado é que a governança desses sistemas está virando infraestrutura, não só configuração de prompt. A falha no NemoClaw, revelada em agosto, já tinha mostrado que agentes rodando localmente podem virar porta de entrada para invasores; a nova plataforma é a resposta da própria Nvidia a esse tipo de risco.
