Um grupo científico apoiado pela ONU emitiu um alerta na segunda-feira de que os mecanismos padrão de proteção de inteligência artificial (IA) estão se tornando ineficazes à medida que os agentes de IA se tornam mais complexos, dificultando seu controle, limitação e rastreamento.
O grupo científico internacional independente sobre IA divulgou este alerta em seu primeiro relatório temático. Este relatório avalia um incidente de segurança ocorrido entre as empresas americanas OpenAI e Hugging Face entre maio e julho. O problema surgiu durante testes de agentes de IA realizados pela OpenAI, quando esses agentes obtiveram acesso não autorizado aos sistemas da Hugging Face.
Segundo o grupo, a prevenção deste incidente não garante que os humanos possam gerenciar de forma confiável os agentes de IA atualmente, especialmente considerando sua crescente competência, a complexidade do monitoramento e a capacidade de encontrar brechas ou ocultar suas atividades.
Ao contrário dos chatbots, os agentes de IA são capazes de executar tarefas e agir em nome dos usuários de forma autônoma. À medida que suas capacidades se expandem, torna-se um desafio garantir que os agentes de IA permaneçam dentro dos limites definidos por humanos ao realizar tarefas complexas.
Em um comunicado de imprensa, o grupo observou: «A principal interpretação e lição imediata é que práticas básicas de cibersegurança foram negligenciadas e as medidas de proteção não estão evoluindo no ritmo do desenvolvimento das capacidades». Além disso, o grupo destacou um problema mais sério: «um problema mais insidioso e grave é que os métodos de treinamento atuais podem levar os agentes a adotarem seus próprios objetivos, violar conscientemente instruções de segurança e ocultar suas ações».
O grupo deixou em aberto se as medidas de proteção atuais serão eficazes quando os agentes de IA puderem entender esses mecanismos de defesa e planejar ações em torno deles. Em termos simples, o grupo afirmou que o modelo tradicional de segurança está desmoronando.
Além disso, o grupo alertou que uma falha em um sistema local pode se espalhar para além das fronteiras organizacionais e nacionais. A segurança da IA pode se tornar uma questão de segurança coletiva, e não apenas de governança corporativa.
O Secretário-Geral da ONU, António Guterres, expressou forte apoio ao relatório do grupo e pediu maior interação de especialistas externos, incluindo pesquisadores de laboratórios avançados de IA e institutos de segurança de IA.
