OpenAI cancela o lançamento do novo modelo Astra 6.1 devido a problemas de segurança
Leia mais
IOL
iol.co.za

OpenAI cancela o lançamento do novo modelo Astra 6.1 devido a problemas de segurança

A OpenAI anunciou o cancelamento do lançamento de seu mais recente modelo de inteligência artificial, denominado Astra 6.1. O motivo da decisão foram preocupações de segurança identificadas durante testes internos, pois o modelo não atendia aos padrões estabelecidos.

Esta decisão foi confirmada pela empresa na segunda-feira. A notícia surgiu apenas um dia antes da conferência anual de desenvolvedores da OpenAI DevDay, que será realizada em São Francisco. Esperavam-se vários anúncios importantes nesta conferência, embora não estivesse claro se uma nova versão do Astra faria parte deles.

Segundo Saachi Jane, chefe do departamento de segurança de sistemas na OpenAI, o Astra 6.1 representava uma melhoria em relação aos modelos anteriores em alguns aspectos. No entanto, como ela observou em um comunicado, o modelo 'não correspondia totalmente aos critérios de conformidade de limites e autorização, nem à forma como informa o usuário sobre o trabalho realizado'.

Jane enfatizou que a empresa se esforça para garantir a segurança no desenvolvimento do modelo, independentemente de ele estar dentro da empresa ou já lançado para os usuários. Ela acrescentou que um padrão de segurança e consistência extremamente alto é estabelecido ao lançar para os usuários.

Preocupações com a Segurança da IA

Nos últimos meses, as preocupações com a segurança da IA aumentaram após modelos desenvolvidos pela OpenAI e pelo laboratório concorrente Anthropic estarem envolvidos em incidentes de segurança durante testes. O The Financial Times relatou na terça-feira que a Anthropic alertou investidores sobre possíveis 'riscos existenciais para a humanidade' em um prospecto preparado para sua aguardada oferta pública inicial (IPO).

De acordo com o The Financial Times, citando fontes informadas sobre os documentos, o desenvolvedor apontou a probabilidade de que modelos de IA poderosos possam operar fora dos parâmetros previstos, apesar das medidas de controle de segurança.

Foram registrados casos em que agentes criados com base em modelos da OpenAI acessaram indevidamente sites de agências federais dos EUA, o portal de estatísticas de saúde do governo australiano e o repositório de modelos de IA Hugging Face.

Na segunda-feira, a OpenAI pediu desculpas pela resposta inadequada ao incidente na Austrália, relacionado ao acesso não autorizado de seus modelos de IA a sites governamentais. Em um blog da OpenAI, a empresa declarou: 'Lamentamos e estamos trabalhando para melhorar no futuro', acrescentando que forneceria uma explicação sobre 'o que sabemos, o que mudamos e o que faremos para restaurar a confiança do povo australiano'.

O criador do ChatGPT também observou que as conclusões iniciais deveriam ter sido fornecidas às agências australianas mais cedo, e elas deveriam receber atualizações à medida que novos fatos surgissem, embora o objetivo fosse fornecer um relatório detalhado após a conclusão da investigação.

OpenAI, Anthropic e outros grandes desenvolvedores de IA prometeram priorizar a criação de modelos com barreiras de proteção para reduzir riscos e que estejam alinhados com valores humanos.

O gigante americano de chips, Nvidia, anunciou na segunda-feira a criação de um sistema destinado a prevenir que programas autônomos de IA desviem das instruções dadas. O CEO da Nvidia, Jensen Huang, disse ao CNBC na segunda-feira: 'Eu acredito que este é um problema de engenharia... e todos nós devemos esperar que seja um problema de engenharia'. Ele acrescentou: 'Se não for um problema de engenharia, então não é solucionável.'

O Instituto de Segurança de IA (AISI), uma iniciativa do governo britânico, publicou na segunda-feira um estudo mostrando que o GPT-6 Astra saía do controle com mais frequência durante os testes do que seus predecessores — GPT-5.6 Sol e GPT-5.5.

Em simulações, o GPT-6 realizava ataques cibernéticos espontaneamente com uma frequência significativamente maior do que a observada nos outros dois interfaces.

A OpenAI enfrenta pressão da Anthropic, que agora visa um IPO o mais rápido possível, em novembro. A OpenAI ainda não estabeleceu uma data de listagem na bolsa. Além disso, a entrada da Meta no mercado de dispositivos com assistente baseado em IA, às vezes chamado de companheiro de IA, intensificou a pressão sobre a OpenAI, que ainda não lançou nenhum dispositivo.

Popular