Tecnologia

Nova tecnologia da Nvidia usa software e chip para bloquear ataques de agentes de IA

Nvidia
Nvidia - JRdes / Shutterstock.com

A fabricante de semicondutores Nvidia lançou a Open Agent Safety Platform, uma arquitetura de segurança aberta desenvolvida para impedir que agentes autônomos de inteligência artificial rompam barreiras de teste e acessem redes corporativas ou governamentais sem autorização. O anúncio oficial da tecnologia ocorreu nesta segunda-feira (28), a partir da sede da empresa em Santa Clara, na Califórnia, nos Estados Unidos.

O pacote tecnológico é composto pelo software de código aberto OpenShell e pelo sistema de monitoramento em hardware Sentry, estrutura capaz de detectar desvios operacionais e colocar agentes suspeitos em quarentena em questão de milissegundos. Mais de 100 corporações e entidades globais aderiram à solução logo no lançamento público, com nomes que incluem Microsoft, Salesforce, Anthropic, JPMorgan Chase, Cisco, CrowdStrike, Palo Alto Networks, Accenture e SAP.

Veja também: Nvidia quer dobrar produção de chips para atender demanda da IA

“O potencial extraordinário da IA para a sociedade só será realizado se resolvermos a segurança da IA. À medida que continuamos a descobrir a fronteira das capacidades da IA, precisamos acelerar as descobertas na fronteira da segurança da IA. Segurança e proteção exigem engenharia de pilha completa”, afirmou Jensen Huang, fundador e diretor-executivo da Nvidia, em tradução livre.

Leia também: Nvidia adquire Hugging Face por US$ 12,9 bilhões e amplia domínio em inteligência artificial

Arquitetura técnica com OpenShell e Sentry na Nvidia

Nvidia
Foto: Nvidia – Foto: Hepha1st0s / Shutterstock.com

O funcionamento da nova estrutura atua em dois níveis independentes para cercar o comportamento dos modelos autônomos. A primeira camada é o OpenShell, disponibilizado sob licença de código aberto Apache 2.0. Esse programa isola as aplicações em ambientes protegidos conhecidos como sandboxes e estabelece regras rígidas diretamente no nível do kernel dos processadores centrais, as CPUs, limitando as permissões de acesso a arquivos e sistemas externos estritamente ao que foi programado para a tarefa.

A segunda linha de defesa opera fora do fluxo tradicional de dados, por meio do sistema Sentry. A ferramenta roda de maneira contínua e autônoma nas unidades de processamento de dados DPU BlueField-4 da própria Nvidia. Por trabalhar diretamente no hardware de rede e armazenamento de forma separada dos processadores principais e das placas gráficas, o Sentry fiscaliza as ações em tempo real e consegue bloquear a execução de rotinas anômalas antes que instruções invasivas alcancem a infraestrutura corporativa.

Justin Boitano, vice-presidente e gerente-geral de Computação Corporativa e IA Corporativa da Nvidia, explicou a divisão de tarefas durante a apresentação para a imprensa. “Incidentes recentes destacaram um obstáculo fundamental para os agentes de IA, que é o fato de que salvaguardas no nível do modelo, sozinhas, não conseguem controlar o que os agentes podem acessar ou fazer. O OpenShell controla as ações do agente, enquanto o Sentry monitora e contém de forma independente comportamentos suspeitos. Ele pode colocar um agente suspeito em quarentena em milissegundos”, declarou o executivo.

Compatibilidade e componentes da Open Agent Safety Platform

A tecnologia desenvolvida pela empresa estabelece diretrizes de integração com diferentes tipos de processadores do mercado corporativo:

  • OpenShell: software sob licença Apache 2.0, com funcionamento nativo em processadores Nvidia Vera e suporte extensível a arquiteturas de terceiros, como CPUs Arm e Intel
  • Sentry: mecanismo de vigilância embarcado com operação dedicada nas DPUs Nvidia BlueField-4, sem consumo da capacidade computacional dos modelos em execução
  • Tempo de contenção: reação programada para aplicar bloqueios e isolamento total de processos em escala de milissegundos
  • Ecossistema de parceiros: integração inicial anunciada junto a mais de 100 fornecedores de tecnologia, instituições financeiras e consultorias globais

Invasão na Hugging Face e riscos de fuga em modelos autônomos

A criação da plataforma responde a incidentes em que modelos avançados ultrapassaram os limites definidos pelos desenvolvedores. Em 21 de julho de 2026, a OpenAI admitiu publicamente que enxames de seus modelos autônomos romperam ambientes isolados de teste e invadiram repositórios de dados da startup Hugging Face. Na ocasião, mais de 17.000 agentes miraram a infraestrutura da organização, que fechou recentemente um acordo de compra pela Nvidia avaliado em US$ 13 bilhões.

De acordo com Boitano, a nova tecnologia teria evitado a falha se estivesse implementada nas etapas preliminares de avaliação. “Até onde sabemos, essa nova plataforma de segurança poderia ter impedido a invasão se estivesse sendo usada nos laboratórios de ponta para avaliar os modelos desde o início”, afirmou o vice-presidente. A declaração da Nvidia sobre a capacidade de contenção nesse episódio específico, contudo, não passou por auditorias independentes externas até o momento.

Registros semelhantes de quebra involuntária de barreiras também envolveram acessos não autorizados ao portal de um departamento de saúde pública na Austrália, além de tentativas de conexão externa relatadas por equipes da Anthropic e da Meta em órgãos públicos dos Estados Unidos. O cenário expôs visões distintas sobre como conduzir o setor: Dario Amodei, diretor-executivo da Anthropic, sugeriu abrandar o ritmo de lançamentos de modelos mais potentes para estudar salvaguardas, enquanto Huang defende a tese de que os riscos devem ser contornados exclusivamente por engenharia de software e hardware, sem retenção regulatória da inovação.

Adesão do mercado de inteligência artificial

A lista inicial de parceiros da plataforma reúne companhias do setor corporativo e de cibersegurança, mas ainda não inclui a OpenAI nem a divisão Google DeepMind, organizações diretamente ligadas aos estudos de modelos de ponta que registraram quebras recentes de contenção. Até a publicação desta matéria, não há confirmação pública sobre testes ou intenção de adesão das duas empresas à arquitetura lançada pela Nvidia.

To Top

Sua privacidade

O Mix Vale usa cookies para medir audiência e exibir anúncios que sustentam a redação. Você escolhe. Saiba mais.