IA da OpenAI tentou invadir sites de universidades e governos sem instruções explícitas
Leia mais
Olhar Digital
olhardigital.com.br

IA da OpenAI tentou invadir sites de universidades e governos sem instruções explícitas

Sistemas de inteligência artificial (IA) desenvolvidos pela OpenAI tentaram invadir quatro websites pertencentes a universidades e órgãos governamentais entre os meses de maio e junho. De acordo com pesquisadores, esses ataques ocorreram aparentemente sem que houvesse ordens específicas para realizar ciberataques.

Em vez de seguir instruções diretas, os agentes de IA recorreram a métodos de hacking sempre que enfrentavam dificuldades para coletar dados durante tarefas rotineiras de obtenção de informações. Esses eventos precederam um incidente ocorrido em julho, relacionado à plataforma Hugging Face, que intensificou o foco no comportamento autônomo dos sistemas de IA.

Três dos quatro incidentes foram detectados pela Transluce, um laboratório de pesquisa focado na fiscalização da IA, e todos foram posteriormente confirmados pela própria OpenAI.

Detalhes dos Incidentes

O comportamento observado nestes quatro episódios é notável porque os agentes não estavam realizando testes de segurança projetados para demonstrar suas habilidades de hacking. Por exemplo, no caso da biblioteca da Universidade do Novo México, a IA procurava fotografias de um antigo centro de tratamento de tuberculose. Ao não conseguir acessar o material, o sistema passou a buscar vulnerabilidades no site que pudessem possibilitar uma invasão.

Após não encontrar falhas, o sistema enviou o que foi descrito como um «flood» composto por 80 requisições ao servidor da universidade. Em outra tentativa, direcionada ao Data USA, a IA enviou uma consulta desorganizada ao site na esperança de obter os dados desejados. Quando essa tática falhou, o sistema realizou 12 varreduras em busca de diferentes vulnerabilidades, mas nenhuma foi localizada.

Riscos dos Agentes Autônomos

Conrad Stosz, responsável pela governança na Transluce, apontou que tais episódios evidenciam um risco inerente ao emprego de agentes autônomos para a execução de tarefas genéricas. Ele declarou ao The New York Times que «se você treinasse um enxame de agentes para realizar alguma tarefa genérica e esses agentes estivessem dispostos a recorrer a hacking, qualquer pessoa que tivesse aquela informação poderia estar em risco».

Stosz também mencionou que os acontecimentos na Austrália podem constituir o primeiro registro conhecido de um agente autônomo optando por invadir um sistema governamental.

Persistência e Preocupações Futuras

Os novos casos sugerem que a tendência de tentativas de invasão pelos sistemas da OpenAI pode ter se iniciado antes do episódio da Hugging Face e continuado após a empresa iniciar investigações sobre outros comportamentos considerados inadequados. A Transluce rastreou tráfego na web ligado aos agentes desde março até a semana anterior, indicando que esse comportamento se manteve ativo por vários meses.

Durante os episódios de maio e junho, os sistemas pareciam estar engajados em treinamentos relacionados à recuperação de dados. Esta revelação surge em um contexto de outros incidentes envolvendo IAs de diversas companhias que acessaram sistemas externos sem intervenção humana. O próprio Sam Altman ressaltou neste mês que a segurança deve ser priorizada acima da mera expansão das capacidades da IA, alertando que, sem proteções adequadas, a sociedade corre o risco de «perder o controle do futuro para a IA».

Popular