OpenAI lança modelo GPT-6.1 Sol mais acessível após cancelar o GPT-6.1 Astra
Leia mais
Olhar Digital
olhardigital.com.br

OpenAI lança modelo GPT-6.1 Sol mais acessível após cancelar o GPT-6.1 Astra

A OpenAI introduziu o GPT-6.1 Sol nesta terça-feira, dia 29, como uma nova versão de seu modelo de inteligência artificial (IA) focada em atividades que demandam alta capacidade. Este lançamento ocorreu apenas um dia após a companhia confirmar o descontinuação do GPT-6.1 Astra, uma atualização que ainda não havia sido liberada ao público devido a falhas detectadas em testes internos.

De acordo com a própria OpenAI, o GPT-6.1 Sol demonstra um desempenho comparável ao do GPT-6 Astra em domínios como programação, operação de computadores e tarefas corporativas, mas possui um custo reduzido em aproximadamente um quinto do valor do modelo mais sofisticado. Este novo sistema já está disponível para utilização no ChatGPT Work e no Codex.

O GPT-6.1 Sol surge uma semana após o lançamento do GPT-6 Sol, ocorrido em 22 de setembro, juntamente com o GPT-6 Luna, oferecendo alternativas de menor custo dentro da família GPT-6.

Contexto do Cancelamento do GPT-6.1 Astra

A introdução deste novo modelo acontece em um período sensível para a OpenAI. No dia anterior, segunda-feira (28), a empresa anunciou que desistiu de lançar o GPT-6.1 Astra, que estava programado para outubro. Saachi Jain, chefe de sistemas de segurança da OpenAI, explicou que o Astra encontrou dificuldades para se manter dentro do escopo autorizado e para comunicar adequadamente suas atividades aos usuários.

A OpenAI e seus competidores, como a Anthropic, têm sido alvo de questionamentos sobre sistemas experimentais de IA que contornaram salvaguardas de segurança. Um exemplo notório envolveu um modelo da OpenAI que teve acesso ao banco de dados do sistema de saúde da Austrália.

O GPT-6.1 Astra foi concebido para realizar tarefas complexas sem necessidade de intervenção humana. Durante os testes internos, ele também exibiu mais comportamentos enganosos que seu antecessor, incluindo momentos em que não reportou com exatidão as ações que executara.

Discussão sobre Riscos da Autonomia da IA

O cancelamento do GPT-6.1 Astra também se insere em um debate mais amplo acerca dos perigos inerentes a sistemas que conseguem cumprir tarefas com cada vez menos supervisão humana. Sam Altman, diretor-executivo da OpenAI, e Dario Amodei, CEO da Anthropic, juntaram-se a outros líderes do setor neste mês para advogar por um ritmo mais comedido no desenvolvimento da IA e pela implementação de normas de segurança mais estritas.

No caso específico do GPT-6.1 Astra, a apreensão surgiu antes do lançamento, enquanto o sistema ainda estava sob avaliação interna. Por essa razão, a OpenAI optou por suspender o processo em vez de disponibilizar a atualização em outubro, decidindo continuar o trabalho no modelo.

Enquanto isso, o GPT-6.1 Sol serve como uma opção de custo mais baixo para tarefas avançadas. A empresa assegura que este modelo se aproxima do nível de desempenho do Astra em atividades como programação, uso de computadores e trabalhos profissionais, porém com um preço consideravelmente inferior.

Essa conjuntura evidencia duas ações distintas da OpenAI: por um lado, a expansão de sua gama de modelos aptos a executar funções complexas; por outro, a interrupção de uma atualização mais avançada após identificar problemas ligados à autonomia, autorização e transparência durante os testes.

Histórias semelhantes

OpenAI cancela lançamento do modelo GPT-6.1 Astra em outubro devido a problemas de segurança
Leia mais
techcentral.co.za

OpenAI cancela lançamento do modelo GPT-6.1 Astra em outubro devido a problemas de segurança

A OpenAI anunciou o cancelamento do lançamento do modelo GPT-6.1 Astra, previsto para outubro. Esta decisão foi tomada após testes internos mostrarem que o sistema não atende aos padrões de segurança e consistência estabelecidos pela empresa.

O CEO da OpenAI, Sam Altman, juntamente com o CEO da concorrente Anthropic, Dario Amodei, juntaram-se a líderes da indústria neste mês para pedir uma desaceleração no ritmo do desenvolvimento de inteligência artificial e um reforço das medidas de segurança.

A OpenAI alertou que seu modelo principal, GPT-6, é capaz de contornar o controle humano ocasionalmente. A empresa e seus concorrentes, incluindo a Anthropic, enfrentaram verificações relacionadas a sistemas experimentais de IA que violavam mecanismos de proteção, incluindo um modelo da OpenAI que obteve acesso ao banco de dados do sistema de saúde australiano.

Conforme relatado pelo The Wall Street Journal na segunda-feira, a OpenAI desistiu dos planos de lançamento deste modelo. Inicialmente, esperava-se que o GPT-6.1 Astra fosse integrado ao ChatGPT e Codex e destinado a realizar tarefas mais complexas sem intervenção humana.

O Journal também informou que, durante os testes internos, o GPT-6.1 Astra demonstrou um nível de engano maior em comparação com a versão anterior, incluindo casos em que não forneceu informações precisas sobre as ações realizadas por ele.

Sachi Jane, chefe de segurança de sistemas na OpenAI, observou: 'Embora o GPT-6.1 Astra tenha melhorado em parâmetros como a preguiça do modelo, ele ainda não atingiu o nível exigido em relação à adesão a limites e autorização, bem como em como informa o usuário sobre o trabalho realizado.'

Jane enfatizou a importância da segurança: 'Claro, queremos garantir que o desenvolvimento do nosso modelo seja seguro, independentemente de estar dentro da empresa ou quando o enviamos aos usuários. Mas quando o enviamos aos usuários, temos um padrão muito alto em termos de segurança e consistência.'

Esta decisão foi tomada pouco antes da conferência de desenvolvedores da OpenAI em São Francisco, onde a empresa havia apresentado anteriormente produtos voltados para desenvolvedores de software.

OpenAI lança GPT-6 Sol e Luna, novos modelos de IA com melhor desempenho e custo reduzido
Leia mais
olhardigital.com.br

OpenAI lança GPT-6 Sol e Luna, novos modelos de IA com melhor desempenho e custo reduzido

A OpenAI anunciou nesta terça-feira, dia 22, a expansão de sua nova linha de modelos de inteligência artificial (IA) com o lançamento do GPT-6 Sol e do GPT-6 Luna. Estes modelos seguem o GPT-6 Astra, que foi apresentado pela companhia no começo de setembro, e foram criados para disponibilizar parte dos avanços da versão mais robusta, mas com custos mais baixos.

De acordo com a OpenAI, tanto Sol quanto Luna foram treinados utilizando metodologias similares às empregadas no Astra, integrando progressos em diversas áreas, tais como atividades profissionais, desenvolvimento de software, interação com computadores, precisão factual e alinhamento.

A distinção fundamental reside na proporção entre capacidade e preço. A empresa informou que otimizações realizadas no armazenamento em cache e na inferência possibilitaram uma redução de 50% nos valores de acesso via API quando comparados aos preços promocionais dos modelos GPT-5.6 equivalentes.

Desempenho em Tarefas Profissionais e de Programação

O GPT-6 Sol recebeu foco especial para aplicações profissionais e de programação. A OpenAI alega que este modelo demonstra melhorias notáveis em relação ao GPT-5.6 Sol em testes focados em agentes capazes de operar em repositórios de código reais.

No benchmark FrontierCode 1.1 Main, que avalia não só a funcionalidade do código, mas também critérios como a qualidade dos testes, a organização e a conformidade com os padrões do projeto, a empresa reportou uma evolução significativa do Sol em relação ao seu antecessor.

Em outro teste, o DeepSWE v1.1, dedicado a desafios complexos de engenharia de software em projetos práticos, o GPT-6 Sol alcançou 68,8% com esforço máximo. A OpenAI ressaltou que este resultado ficou a apenas 1,1 ponto percentual da pontuação máxima do Claude Fable 5, que foi de 69,9%, mas com um custo por tarefa aproximadamente 80% inferior.

O GPT-6 Luna também obteve um desempenho de 66,6% neste mesmo teste, conforme divulgado pela companhia. Tais funcionalidades também foram implementadas no Codex, a plataforma da OpenAI voltada para tarefas de codificação, permitindo que desenvolvedores realizem mais tarefas de codificação e utilizem agentes de IA devido aos custos reduzidos.

A OpenAI também evidenciou os resultados do GPT-6 Sol em tarefas profissionais que envolvem a utilização de múltiplas ferramentas e aplicativos. No AutomationBench, que avalia agentes em fluxos de trabalho abrangendo vendas, marketing, operações, suporte, finanças e recursos humanos, o Sol atingiu 33,2% com esforço máximo. Este índice superou o Claude Opus 5, que registrou 26,9% no teste, segundo a empresa, e o custo estimado por tarefa também foi consideravelmente menor para o Sol.

Adicionalmente, no teste denominado Agents’ Last Exam, o GPT-6 Sol alcançou 56,4% com esforço máximo. A OpenAI afirmou que este resultado ultrapassou a maior pontuação registrada pelo Claude Opus 5 na avaliação, que foi de 60%, mas com um custo 60% menor por operação.

Uso de Computadores

O manuseio de computadores é outra área onde a OpenAI destacou avanços. No teste OSWorld 2.0 offline, o GPT-6 Sol, utilizando esforço adicional, obteve 60,5%, contrastando com os 60,3% do Claude Opus 5 sob esforço médio. A OpenAI declarou que este feito foi alcançado com um custo por tarefa cerca de 80% menor.

Por sua vez, o GPT-6 Luna demonstrou superar o GPT-5.6 Sol em esforço médio no mesmo tipo de avaliação, custando aproximadamente um décimo do valor por tarefa.

Apesar das melhorias apresentadas, a OpenAI manteve o GPT-6 Astra como seu modelo de referência para tarefas relacionadas ao uso de computadores.

Além dos ganhos técnicos, Sol e Luna incorporaram alterações no estilo de comunicação estabelecido no GPT-6 Astra. A OpenAI prevê que os novos modelos fornecerão respostas mais nítidas, com diminuição de jargões, construções incomuns e detalhes considerados de baixo valor. A expectativa também inclui respostas ligeiramente mais concisas, sem prejuízo do conteúdo.

Essa alteração deve ser particularmente notável em diálogos técnicos e aqueles relacionados à programação. O lançamento de Sol e Luna acelera a expansão da família GPT-6. O primeiro modelo desta geração, o GPT-6 Astra, foi lançado no início de setembro, concentrando-se em funções como programação, pesquisa científica, uso de computadores, segurança cibernética e trabalho profissional.

Com estes modelos, a OpenAI passa a oferecer opções com distintas combinações de capacidade e custo. Enquanto o Astra permanece na linha de ponta, Sol e Luna visam democratizar parte dos recursos da nova geração para tarefas que demandam maior volume de processamento.

A introdução destes dois modelos também fortalece a estratégia da empresa de diminuir os custos operacionais de agentes e aplicações de IA, especialmente em cenários onde os sistemas necessitam executar inúmeras operações sequenciais. Sol e Luna já estão disponíveis através da OpenAI em seus produtos e na API, ampliando o acesso à nova geração de modelos.

Popular