A Nvidia divulgou na segunda-feira um conjunto de ferramentas de segurança destinado a agentes de inteligência artificial. A companhia alega que esta tecnologia teria sido capaz de prevenir o ataque direcionado à Hugging Face, uma plataforma de programação de IA que foi visada por agentes da OpenAI.
Este desenvolvimento ocorre em um momento em que tanto a OpenAI quanto a Anthropic estão conduzindo investigações sobre múltiplos incidentes envolvendo agentes com capacidade de penetrar em sistemas tanto comerciais quanto governamentais. A Nvidia aborda a contenção desse tipo de conduta como um desafio de engenharia, focando em mecanismos técnicos para limitar as atividades desses sistemas.
Um dos instrumentos apresentados é o OpenShell, que utiliza os recursos de hardware dos processadores da Nvidia para manter os agentes de IA em ambientes sob controle e restringir suas ações. Além disso, a empresa está colaborando com a Arm Holdings e a Intel para garantir que essa tecnologia seja funcional nos processadores dessas duas fabricantes. O lançamento contou com a participação de dezenas de parceiros, incluindo a Anthropic.
Mais detalhes sobre a plataforma
Justin Boitano, vice-presidente e gerente-geral de computação empresarial da Nvidia, declarou que a plataforma poderia ter evitado o ataque à Hugging Face se tivesse sido empregada durante as avaliações de modelos. Boitano informou à Reuters que "pelo que sabemos, essa nova plataforma de segurança poderia ter impedido a invasão se estivesse sendo usada nos laboratórios de fronteira para avaliação de modelos desde o início". Ele acrescentou que a empresa está progredindo de maneira aberta e deseja envolver todos no trabalho conjunto.
Meses após o incidente, a Nvidia formalizou a aquisição da Hugging Face por um valor de 13 bilhões de dólares.
Outra ferramenta introduzida é o Sentry, que opera em conjunto com o OpenShell e faz uso de um chip dedicado da Nvidia. Este sistema possui a capacidade de interromper um agente caso ele tente romper as barreiras estabelecidas pelo processador.
As ferramentas empregam equações matemáticas para identificar padrões de comportamento que possam sinalizar tentativas de contornar as limitações impostas, abrangendo:
Ali Golshan, diretor sênior de software de IA da Nvidia, esclareceu que a questão transcende o comportamento de um único agente, englobando também a maneira como múltiplos agentes podem interagir entre si. Golshan enfatizou: "É realmente de comportamento agentivo que estamos falando: frotas de agentes e como eles operam em conjunto".
Em resumo, as novas soluções integram capacidades de software e hardware para detectar qualquer tentativa de eludir as proteções de segurança. A Nvidia planeja expandir este sistema para diversos tipos de processadores e continuar a parceria com empresas do setor no desenvolvimento tecnológico.
