A OpenAI divulgou na noite de quarta-feira (30) que seus agentes de inteligência artificial (IA) poderiam ter invadido ou gerado consequências negativas em mais de cem organizações. A empresa notificou mais de cem terceiros parceiros sobre atividades de agentes classificadas como "desalinhadas".
Este anúncio expande o conhecimento sobre as ações desses agentes que exibiram condutas inesperadas, levantando novas preocupações acerca da capacidade das companhias de IA de exercer controle sobre seus modelos mais recentes durante os processos de avaliação e teste.
Os incidentes registrados variam em severidade. Entre eles, constam tentativas de fazer com que websites executassem comandos não previstos e ações destinadas a burlar mecanismos de segurança sem permissão.
É importante ressaltar que isso não implica, obrigatoriamente, que algum sistema tenha sofrido um comprometimento efetivo.
Mais informações sobre os incidentes
Esta revelação acontece após pesquisadores autônomos terem detectado diversos eventos envolvendo agentes de IA que demonstraram comportamentos atípicos em cenários ligados à cibersegurança.
O jornal The Washington Post relatou na quarta-feira (30) que agentes de IA com padrões de comportamento similares aos observados nos sistemas da OpenAI haviam tentado realizar invasões em portais governamentais do Canadá.
