A Anthropic introduziu o Claude Sonnet 5.5, um novo modelo intermediário dentro da sua família Claude 5.5. De acordo com a empresa, este modelo apresenta um desempenho mais rápido, superando em mais de 30% a velocidade do Sonnet 5, e pode apresentar uma economia de até 30% por tarefa.
O objetivo deste lançamento é otimizar a execução de atividades bem definidas, tais como a correção de códigos, a elaboração de documentos, a criação de apresentações e planilhas. Além disso, o Sonnet 5.5 recebeu aprimoramentos em áreas como design, colaboração e segurança, enquanto o modelo Opus 5.5 permanece focado em demandas mais intrincadas.
Em termos de precificação, o Sonnet 5.5 manteve os valores da versão anterior: US$ 2 por milhão de tokens de entrada (equivalente a cerca de R$ 10,42), US$ 10 por milhão de tokens de saída (R$ 52,10) e US$ 0,20 por milhão de tokens em leituras de cache (R$ 1,04).
Os tokens são as unidades textuais mínimas que os modelos de IA utilizam para interpretar uma requisição e gerar uma resposta. Como o Sonnet 5.5 geralmente necessita de menos dessas unidades para finalizar uma atividade, a Anthropic projeta uma diminuição de custo de até 30% por trabalho. Adicionalmente, o modelo gera respostas com mais de 30% de rapidez.
Este ganho de performance foi notável em testes de programação. No Terminal-Bench 4.0, uma avaliação que mensura a aptidão de uma IA em executar tarefas complexas via linha de comando — um ambiente textual usado por desenvolvedores —, o Sonnet 5.5 obteve 70,6%, comparado aos 10,3% do Sonnet 5.
A Anthropic também compartilhou outros resultados comparativos entre o Sonnet 5.5 e o Sonnet 5. Apesar dos progressos, a Anthropic ressalta que o Opus 5.5 ainda demonstra maior força em trabalhos complexos e abertos que demandam raciocínio estendido. Contudo, em certas avaliações, o Sonnet 5.5 alcançou resultados próximos aos do modelo mais avançado quando operou sob esforço máximo.
A evolução é particularmente evidente no campo da programação, onde o Sonnet 5.5 consegue assimilar bases de código rapidamente e cumprir tarefas em menos etapas. Os testadores também apontaram a eficiência do modelo no uso de ferramentas.
Nos testes preliminares realizados pela Epic, o Claude Sonnet 5.5 atingiu o padrão de qualidade esperado de um modelo de categoria superior. Daniel Vogel, diretor de operações da Epic Games, comentou sobre isso em uma nota.
As melhorias não se limitam apenas ao código; a Anthropic também enfatiza o desempenho em tarefas de criação e conhecimento, abrangendo interfaces e apresentações. Em um teste interno, o modelo recebeu materiais trimestrais, transcrições de uma corporação pública e um modelo de apresentação. O resultado foi uma revisão operacional de dez slides que dois especialistas consideraram pronta para ser enviada.
Curtis Allen, engenheiro principal do Slack, afirmou: “Sem alterar nossos prompts, o Claude Sonnet 5.5 teve desempenho melhor que o Sonnet 5 em quase todas as nossas avaliações internas do Slackbot”.
O aumento de capacidade foi acompanhado por novas camadas de proteção. O Sonnet 5.5 é o primeiro modelo da linha Sonnet a incorporar salvaguardas de cibersegurança e mecanismos de reserva similares aos empregados pela Anthropic no Opus 5.5.
As salvaguardas funcionam como dispositivos destinados a restringir o uso da IA em cenários classificados como de maior risco. No contexto de cibersegurança, as atividades rotineiras de desenvolvimento permanecem acessíveis, enquanto requisições mais perigosas podem ser redirecionadas ao Sonnet 5.
Na esfera biológica, as proteções mantêm-se idênticas às do Sonnet 5, focando em pedidos considerados de alto risco. O Sonnet 5.5 já está disponível em diversas plataformas, incluindo Amazon Web Services, Google Cloud e Microsoft Azure. O Claude Haiku 5.5 será lançado nas próximas semanas para completar a nova gama de modelos. O artigo original foi publicado inicialmente no Olhar Digital.
