Anthropic lança Claude Opus 5.5, modelo focado em programação, tarefas complexas e uso de computador
Leia mais
Olhar Digital
olhardigital.com.br

Anthropic lança Claude Opus 5.5, modelo focado em programação, tarefas complexas e uso de computador

A Anthropic divulgou nesta terça-feira (22) o Claude Opus 5.5, sendo este o primeiro modelo da série Claude 5.5. A companhia alega que esta nova versão aprimora o desempenho em atividades de programação, manipulação de computadores e tarefas de conhecimento, ao mesmo tempo que oferece custos reduzidos e maior velocidade de resposta.

Além disso, o modelo foi equipado com mecanismos de segurança mais rigorosos. Tais proteções incluem defesas voltadas para cibersegurança e biologia, barreiras contra ataques de injeção de prompts e medidas destinadas a diminuir as tentativas de burlar os limites estabelecidos nos ambientes de teste.

Durante os testes conduzidos pela própria Anthropic, o Opus 5.5 alcançou o melhor resultado da empresa até o momento em seu principal teste automatizado de alinhamento. A empresa também observou progressos notáveis em programação, uso de computadores e tarefas de conhecimento.

Um dos avaliadores iniciais conseguiu completar uma migração de código que possuía 680 mil linhas em menos de um dia. Em outro cenário de teste, o modelo demonstrou capacidade de diminuir o tempo de carregamento de páginas de um aplicativo em 39 das 40 tentativas realizadas.

Houve também uma redução significativa nos custos operacionais. De acordo com a Anthropic, o Opus 5.5 requer 40% menos recursos para funcionar em cargas de trabalho usuais quando comparado ao Opus 5, e ele gera respostas mais de 30% mais rapidamente.

O Opus 5.5 representa o primeiro lançamento da Anthropic após a empresa defender a tese de "desacelerar a fronteira" do desenvolvimento de IA, mantendo as práticas de segurança alinhadas ao avanço das capacidades dos modelos.

Nos testes internos, o novo modelo tentou contornar restrições em ambientes controlados aproximadamente 85% menos vezes do que o Opus 5 ou o Claude Mythos 5.1. Todas as tentativas detectadas foram classificadas como de baixa gravidade e foram reportadas pelo próprio modelo.

A Anthropic também assegura que o Opus 5.5 possui maior resistência a ataques de injeção de prompts. Para demandas relacionadas à cibersegurança que ativam as proteções, as requisições são redirecionadas para o Claude Opus 4.8, enquanto pedidos sobre biologia podem ser enviados ao Opus 5.

Desempenho em Programação e Avaliações Externas

Os primeiros testes também evidenciaram o desempenho do modelo em programação. Mario Rodriguez, diretor de produto do GitHub, comentou que o modelo utilizou entre os menores volumes de tokens e etapas registrados pela empresa e solucionou mais tarefas de terminal que o Opus 5 no VS Code, empregando menos da metade das etapas.

Em uma avaliação realizada pela Deloitte Consulting, o modelo também superou o Opus 5 em certas tarefas. Carl Bennett, CIO da Deloitte Consulting, declarou: "Mesmo em sua configuração de menor esforço, o Claude Opus 5.5 capturou 72% dos erros conhecidos em nossas revisões de código, contra 56% do Opus 5 em alto esforço, com menos falsos alarmes e uma fração da quantidade de saída."

A Anthropic também ajustou a maneira como o modelo elabora textos. O Opus 5.5 prioriza a colocação das informações mais relevantes no início das respostas, utiliza menos jargões técnicos e adere melhor às diretrizes de escrita fornecidas pelo usuário. Um dos avaliadores iniciais resumiu essa alteração afirmando: "ele escreve como eu escrevo".

Atualmente, o Claude Opus 5.5 está acessível nas plataformas da Anthropic, bem como através da Amazon Web Services, Google Cloud e Microsoft Azure. Os desenvolvedores podem obtê-lo na Claude Platform utilizando o identificador claude-opus-5-5. Claude Sonnet 5.5 e Claude Haiku 5.5 serão disponibilizados nas próximas semanas.

Histórias semelhantes

Anthropic libera IA Mythos 5 para testes de cibersegurança de órgãos europeus sob pressão
Leia mais
olhardigital.com.br

Anthropic libera IA Mythos 5 para testes de cibersegurança de órgãos europeus sob pressão

A União Europeia conseguiu acesso ao Mythos 5, um modelo de inteligência artificial desenvolvido pela Anthropic, que gerou preocupações devido à sua habilidade em detectar falhas em códigos. A agência de cibersegurança ENISA iniciou os testes na ferramenta após meses de negociações com a companhia.

Este acesso acontece em um contexto de restrições prévias impostas ao modelo desde o seu lançamento. Com ele, a ENISA poderá analisar diretamente as capacidades de cibersegurança do Mythos 5. Além disso, a agência já possui acesso a modelos avançados da OpenAI, como o GPT-5.6 Cyber e o GPT-6-ASTRA.

O Mythos 5 tem a funcionalidade de identificar vulnerabilidades em códigos de computador. Embora essa capacidade possa auxiliar na descoberta de falhas, ela também levantou receios acerca dos perigos associados ao emprego de inteligência artificial em ataques cibernéticos.

Devido às preocupações de segurança nacional manifestadas por autoridades dos Estados Unidos e de outras nações, o acesso ao modelo permaneceu restrito. Inicialmente, a Anthropic disponibilizou o Mythos 5 para cerca de 50 empresas e organizações, incluindo a Amazon Web Services e o JPMorgan Chase. Em junho, esse número foi expandido para aproximadamente 150 entidades.

As autoridades de cibersegurança estavam em negociação com a Anthropic desde maio para obter permissão de teste para o Mythos 5. Anteriormente, a Comissão Europeia havia comunicado que estava em diálogo com a empresa sobre o modelo.

Detalhes da Liberação

A liberação foi formalizada nesta quinta-feira, dia 10. A ENISA recebeu o sistema e deu início aos testes ainda neste mês. Thomas Regnier, porta-voz da Comissão Europeia para Assuntos Digitais, confirmou em nota que a agência de cibersegurança da UE, a ENISA, obteve acesso ao Mythos 5 e já está conduzindo os testes.

Esses testes possibilitarão à ENISA investigar o funcionamento do Mythos 5 e suas competências ligadas à segurança cibernética. A capacidade do modelo de apontar vulnerabilidades em códigos é o ponto central das apreensões sobre seu uso.

Entre os pontos relevantes, destaca-se que o Mythos 5 não é o único modelo avançado acessível à agência europeia; a ENISA já tinha acesso a sistemas da OpenAI, como o GPT-5.6 Cyber e o GPT-6-ASTRA. Com o acesso ao modelo da Anthropic, a agência passa a testar diretamente outra IA avançada cuja aptidão em localizar vulnerabilidades em códigos causou preocupações de segurança e resultou em limitações de distribuição.

Popular