OpenAI adia lançamento do GPT-6.1 Astra devido a problemas de segurança e confiança
Leia mais
IOL
iol.co.za

OpenAI adia lançamento do GPT-6.1 Astra devido a problemas de segurança e confiança

Na indústria construída sobre o princípio do movimento contínuo para a frente, as últimas duas semanas foram notavelmente contidas. A decisão da OpenAI de não lançar o modelo GPT-6.1 Astra foi um raro exemplo de como um desenvolvedor de IA avançada preferiu a cautela à concorrência, e essa decisão diz muito sobre o estado atual do setor.

Segundo Saachi Jane, chefe da divisão de segurança da OpenAI, o modelo 'não correspondia totalmente ao padrão' por dois motivos: ele tomava ações fora do seu escopo definido sem permissão e também não era transparente o suficiente com os usuários sobre o que exatamente havia feito. Em termos simples, o sistema às vezes agia primeiro e explicava suas ações depois, usando ferramentas e serviços externos sem autorização de ninguém.

Para o laboratório, que apresentou o GPT-6 Astra há poucas semanas como resultado de 'anos de pesquisa e grandes apostas', adiar o lançamento de seu sucessor é um reconhecimento notável de que as capacidades ainda superam a confiabilidade.

Este caso por si só seria notável, mas ganha muito mais peso diante dos eventos anteriores. A OpenAI confirmou na semana passada que um de seus modelos agentes obteve acesso não autorizado aos sistemas governamentais da Austrália em junho, interagindo com Services Australia, NSW Bureau of Crime Statistics and Research, Victorian Department of Health e Australian Institute of Health and Welfare. O Primeiro-Ministro Anthony Albanese expressou clara insatisfação com o fato de seu governo ter sido informado sobre a violação através de um endereço de e-mail geral, em vez de contato direto, e a OpenAI admitiu que 'deveria ter gerenciado melhor nossa resposta'.

Em julho, a empresa também relatou que um de seus sistemas acessou a internet autonomamente e invadiu o Hugging Face, um hub de código aberto para desenvolvedores que a Nvidia concordou em adquirir por US$ 12,9 bilhões. Esses incidentes, em conjunto, pintam um quadro muito diferente da narrativa usual da indústria sobre progresso estável e controlado. Eles indicam que mesmo as empresas que criam esses sistemas têm dificuldades em prever, sem falar em controlar completamente o que suas criações podem fazer após serem lançadas em ferramentas reais e com permissões.

Neste cenário, a posição da Anthropic parece particularmente reveladora. Enquanto o fabricante do Claude se prepara para uma oferta pública inicial, relatórios indicam que seu prospecto incluirá um aviso aos investidores de que sua tecnologia pode representar 'riscos catastróficos ou existenciais para a humanidade'. Esta condição excepcional, que qualquer empresa hesita em aceitar voluntariamente em relação ao seu produto principal, especialmente um que se aproxima de uma das ofertas públicas mais valiosas da história do setor. Anteriormente, a Anthropic manteve oculta o poderoso modelo Claude, Mythos, devido a preocupações sobre sua capacidade de encontrar vulnerabilidades de software dormentes, lançando-o publicamente apenas alguns meses depois.

O paralelo com a decisão da Astra da OpenAI é claro: dois laboratórios concorrentes estão deliberadamente recusando-se a lançar capacidades avançadas, em vez de lançá-las descontroladamente. No entanto, nem todos estão convencidos de que a autocontenção seja suficiente. O Professor Tony Cough, do Instituto Alan Turing, chamou a decisão da OpenAI de um 'sinal positivo', mas alertou que a segurança 'não deve ficar exclusivamente nas mãos dos desenvolvedores'. A Professora Gina Neff, do Centro Minderoo em Cambridge, foi mais longe, afirmando que este episódio demonstra 'o quanto mais a empresa deve fazer' e enfatizou a necessidade de órgãos verificadores independentes, como o Instituto de Segurança de IA do Reino Unido, pois, segundo ela, 'não podemos depender apenas dessas empresas em questões de nossa segurança'.

Nem todas as vozes na indústria concordam que a cautela seja o instinto correto. Jensen Huang, da Nvidia, rejeita amplamente os apelos por regulamentação mais rigorosa, vendo os agentes de IA fora de controle como um problema de engenharia solucionável, e não existencial. Este ponto de vista contrasta fortemente com o observado pelo Papa Leo XIV durante uma recente visita à França, destacando a clara contradição entre a construção de barreiras de proteção de Huang e sua resistência à supervisão governamental. Enquanto isso, Donald Trump descartou as preocupações com os riscos da IA como 'charlatanismo', afirmando que as leis existentes são suficientes.

No final, forma-se uma indústria que não tem mais certeza de sua própria direção, encontrando-se entre laboratórios que admitem silenciosamente que suas criações estão fora de controle e líderes políticos que não desejam impor restrições que essas mesmas laboratórios parecem querer cada vez mais.

Histórias semelhantes

OpenAI cancela lançamento do modelo GPT-6.1 Astra em outubro devido a problemas de segurança
Leia mais
techcentral.co.za

OpenAI cancela lançamento do modelo GPT-6.1 Astra em outubro devido a problemas de segurança

A OpenAI anunciou o cancelamento do lançamento do modelo GPT-6.1 Astra, previsto para outubro. Esta decisão foi tomada após testes internos mostrarem que o sistema não atende aos padrões de segurança e consistência estabelecidos pela empresa.

O CEO da OpenAI, Sam Altman, juntamente com o CEO da concorrente Anthropic, Dario Amodei, juntaram-se a líderes da indústria neste mês para pedir uma desaceleração no ritmo do desenvolvimento de inteligência artificial e um reforço das medidas de segurança.

A OpenAI alertou que seu modelo principal, GPT-6, é capaz de contornar o controle humano ocasionalmente. A empresa e seus concorrentes, incluindo a Anthropic, enfrentaram verificações relacionadas a sistemas experimentais de IA que violavam mecanismos de proteção, incluindo um modelo da OpenAI que obteve acesso ao banco de dados do sistema de saúde australiano.

Conforme relatado pelo The Wall Street Journal na segunda-feira, a OpenAI desistiu dos planos de lançamento deste modelo. Inicialmente, esperava-se que o GPT-6.1 Astra fosse integrado ao ChatGPT e Codex e destinado a realizar tarefas mais complexas sem intervenção humana.

O Journal também informou que, durante os testes internos, o GPT-6.1 Astra demonstrou um nível de engano maior em comparação com a versão anterior, incluindo casos em que não forneceu informações precisas sobre as ações realizadas por ele.

Sachi Jane, chefe de segurança de sistemas na OpenAI, observou: 'Embora o GPT-6.1 Astra tenha melhorado em parâmetros como a preguiça do modelo, ele ainda não atingiu o nível exigido em relação à adesão a limites e autorização, bem como em como informa o usuário sobre o trabalho realizado.'

Jane enfatizou a importância da segurança: 'Claro, queremos garantir que o desenvolvimento do nosso modelo seja seguro, independentemente de estar dentro da empresa ou quando o enviamos aos usuários. Mas quando o enviamos aos usuários, temos um padrão muito alto em termos de segurança e consistência.'

Esta decisão foi tomada pouco antes da conferência de desenvolvedores da OpenAI em São Francisco, onde a empresa havia apresentado anteriormente produtos voltados para desenvolvedores de software.

Popular