A Anthropic trabalhou com a NVIDIA na recém-anunciada Open Agent Safety Platform, adicionando camadas de segurança e controle à pilha de agentes do Claude, na medida em que empresas migram de uma IA que responde perguntas para agentes que atuam em várias áreas do negócio com dados proprietários.
São duas peças envolvidas. O Claude Managed Agents, o conjunto de APIs componíveis da Anthropic para construir agentes de nível de produção, agora executa o loop do agente em um servidor separado do sandbox onde o trabalho acontece, e guarda credenciais — senhas e chaves de acesso — em um cofre separado que o agente nunca vê. O sistema também registra trilhas de auditoria do que cada agente fez e se integra aos controles de acesso já existentes na empresa.
O OpenShell, da NVIDIA, é um software de runtime seguro e open-source lançado sob a licença Apache 2.0, que governa o que um agente consegue alcançar enquanto trabalha. Ele bloqueia toda ação a menos que uma regra a permita, verificando cada chamada de ferramenta contra regras sobre arquivos, conexões de rede e dados, com cada decisão registrada em log. Um verificador de políticas embutido no OpenShell usa prova matemática para confirmar o que um agente de fato consegue acessar sob as regras que uma equipe escreveu.
A Anthropic apresenta os dois sistemas como camadas independentes: cada uma é projetada para impor seus próprios limites sozinha, de modo que a proteção não dependa de uma única camada se manter firme, e as empresas podem adotar as partes que se encaixam na configuração de sandbox que já possuem.
O Managed Agents já está disponível e pode rodar em um sandbox na infraestrutura própria da empresa ou com um provedor gerenciado. O OpenShell já está disponível no GitHub e na página de recursos para desenvolvedores da NVIDIA. A Anthropic cita Notion, Rakuten e Asana como empresas que já rodam fluxos de trabalho especializados e multiagentes no Managed Agents, embora detalhes sobre a adoção do OpenShell por nome não sejam fornecidos.