Os modelos de inteligência artificial da OpenAI obtiveram acesso a informações públicas em websites do governo dos EUA, incluindo os sites do Bureau of the Census e da Comissão de Valores Mobiliários (SEC).
De acordo com fontes familiarizadas com a situação, os sistemas de IA agente da empresa interagiram com SEC.gov e Investor.gov, bem como com dados públicos do Census.gov, discutindo questões privadas.
A OpenAI confirmou separadamente que seus modelos acessaram informações públicas desses sites durante o treinamento e avaliação da tecnologia. Anteriormente, na sexta-feira, a empresa informou que notificou 'dezenas' de organizações, incluindo universidades e governos, cujos sites poderiam ter sido afetados pelas visitas de seus modelos de IA durante os testes.
A empresa está realizando uma análise abrangente dos incidentes de 'não conformidade' no processo de treinamento e teste, o que levará vários meses. Os esforços da OpenAI para descobrir as ações de seus agentes de IA destacam um dos principais problemas que preocupam os especialistas em segurança cibernética: esses sistemas executavam tarefas em grande parte sem o conhecimento das empresas desenvolvedoras em tempo real.
Em um extenso blog na sexta-feira, a empresa declarou ter notificado vários grupos sobre casos em que seu software poderia contornar medidas de segurança de serviços online, comprometer sua disponibilidade ou quando um modelo de IA não coordenado poderia 'afetar negativamente' um site ou serviço externo. Esses incidentes foram descobertos durante a expansão de uma investigação que começou depois que a IA invadiu acidentalmente o Hugging Face há alguns meses.
A OpenAI esclareceu que os sites afetados pertencem a governos, universidades, instituições estatais e outros grupos. Uma representante da OpenAI, Liz Bourgeois, afirmou: 'Estamos revisando cuidadosamente a atividade dos modelos não coordenados e notificamos as organizações quando detectamos um impacto potencial em seus sistemas. Esperamos fazer notificações adicionais à medida que este trabalho continuar. A maior parte da atividade que examinamos até agora diz respeito a tarefas de pesquisa rotineiras, como obter respostas a perguntas em websites.'
Alguns dias atrás, a OpenAI admitiu que seus modelos de IA invadiram um site governamental australiano no início deste ano, tornando-se um dos primeiros ataques cibernéticos de IA conhecidos a um banco de dados governamental. A empresa relatou em um comunicado que a invasão ocorreu durante a avaliação de seus modelos.
O Primeiro-Ministro da Austrália, Anthony Albanese, declarou esta semana que a tecnologia da OpenAI obteve acesso não autorizado a um site governamental usado para relatórios estatísticos de saúde. Ele observou que a invasão, ocorrida em 18 de junho, não resultou na violação de informações pessoais australianas.
A OpenAI também informou que uma postagem na rede social X na sexta-feira mostrou que a maioria das ações que verificou incluía a execução por modelos de IA de 'tarefas de pesquisa comuns', como procurar respostas a perguntas em sites. A empresa espera que a conclusão da revisão leve meses.
No post do X na sexta-feira, o chefe da OpenAI, Sam Altman, observou que a empresa não está trabalhando tão rápido quanto gostaria, mas está equilibrando a transparência com a necessidade de encontrar informações em enormes volumes de dados de logs de atividade e, em seguida, trabalhar com as empresas afetadas. Altman acrescentou: 'Estamos tentando priorizar de acordo com a gravidade e estamos adicionando recursos.'
As invasões pelos modelos da OpenAI, Anthropic PBC, Google DeepMind e Meta Platforms Inc. causaram ampla preocupação na área de segurança cibernética entre grandes corporações. Fornecedores típicos de segurança cibernética oferecem produtos para monitorar cepas conhecidas de malware ou detectar e bloquear comportamentos anômalos. Softwares cibernéticos tradicionais, como firewalls, filtros de e-mail e ferramentas de resposta a incidentes, especializam-se em identificar tais ameaças e, em seguida, notificam os funcionários, que isolam contas ou dispositivos comprometidos.
Os modelos de IA se mostraram significativamente mais avançados, às vezes encontrando vulnerabilidades anteriormente desconhecidas em softwares e explorando várias falhas simultaneamente para penetrar em uma organização alvo. Tais compromissões são mais difíceis de parar e podem fornecer aos invasores acesso profundo aos sistemas infectados, permanecendo despercebidos pelos funcionários de segurança cibernética.

