Anthropic lança Claude Haiku 5.5 com redução de custos de até 75%
Leia mais
Olhar Digital
olhardigital.com.br

Anthropic lança Claude Haiku 5.5 com redução de custos de até 75%

A Anthropic introduziu o Claude Haiku 5.5 nesta quarta-feira (7), um novo modelo de inteligência artificial (IA) projetado para executar tarefas que demandam alta velocidade, grande volume de processamento e baixo custo operacional.

Este lançamento representa uma atualização da versão Haiku 4.5 e consolida a nova família Claude 5.5, que também engloba os modelos Opus 5.5 e Sonnet 5.5. A Anthropic alega que o Haiku 5.5 é atualmente seu modelo menor, mais rápido, mais acessível e mais capaz.

Um dos destaques é a significativa redução de custos; a companhia informa que o novo modelo opera em média 75% mais barato que o Haiku 4.5. Para requisições limitadas a 100 mil tokens, essa diminuição atinge impressionantes 90% por token.

Em termos de precificação, para prompts de até 100 mil tokens, o Haiku 5.5 custa US$ 0,10 por milhão de tokens de entrada (aproximadamente R$ 0,53) e US$ 0,50 por milhão de tokens de saída (cerca de R$ 2,65). Quando o limite ultrapassa 100 mil tokens, os valores sobem para US$ 0,50 (R$ 2,65) por milhão de tokens de entrada e US$ 2,50 (R$ 13,25) por milhão de tokens de saída.

A Anthropic observa que cerca de 90% das chamadas feitas ao Haiku 4.5 ficavam dentro do limite de 100 mil tokens, o que justifica a maior economia de preço para a maioria dos usos do modelo anterior.

Além disso, houve uma redução pela metade no custo de leitura de cache do Sonnet 5.5, passando de US$ 0,20 para US$ 0,10 por milhão de tokens. Segundo a Anthropic, isso resulta em uma diminuição de aproximadamente 20% nos custos do modelo em tarefas de agente.

O Claude Haiku 5.5 também se destaca por ser o primeiro modelo da categoria Haiku a incorporar um sistema de níveis ajustáveis de esforço. Essa funcionalidade permite aos desenvolvedores definir o grau de raciocínio que o modelo deve empregar antes de gerar uma resposta, possibilitando priorizar velocidade e custo em atividades simples ou elevar o esforço para demandas mais complexas, equilibrando assim custo e inteligência conforme a aplicação.

Adicionalmente, a documentação da plataforma indica que o modelo possui uma janela de contexto de um milhão de tokens.

A Anthropic também divulgou os resultados de seus próprios testes comparativos em relação ao Haiku 4.5. No benchmark OSWorld 2.1, que avalia a capacidade de agentes operarem computadores para tarefas complexas, o Haiku 5.5 alcançou 72,4%, superando os 15,7% do Haiku 4.5. No Terminal-Bench 4.0, focado em tarefas de programação no terminal, o novo modelo atingiu 39,2%, enquanto o Haiku 4.5 registrou 0%. No teste Humanity’s Last Exam, o Haiku 5.5 obteve 45,9% sem ferramentas e 57,4% com ferramentas, contrastando com os 10,2% e 18,7% do modelo precedente. É importante notar que esses dados são divulgados pela própria Anthropic e não constituem uma avaliação independente.

Comparação com Modelos da OpenAI

A Anthropic também posicionou o Haiku 5.5 em gráficos de desempenho ao lado de modelos da OpenAI. No OSWorld 2.1, por exemplo, o Haiku 5.5 obteve 72,4%, enquanto o GPT-6 Luna registrou 48,9%. No Terminal-Bench 4.0, os percentuais foram 39,2% e 16,4%, respectivamente. Como esses resultados foram selecionados e publicados pela própria Anthropic, eles devem ser analisados dentro da metodologia da empresa e não como uma comparação imparcial entre os modelos.

A empresa também relatou melhorias no comportamento de segurança do Haiku 5.5 em comparação com o Haiku 4.5. Segundo a Anthropic, o novo modelo demonstrou menos ocorrências de comportamento desalinhado e menor propensão a auxiliar em usos inadequados. As proteções em cibersegurança são mais rigorosas que no Haiku 4.5, mas menos restritivas que aquelas aplicadas aos modelos mais recentes da companhia. O sistema permite uma variedade maior de tarefas defensivas, mas impede testes de invasão e outras práticas ligadas a ataques. As salvaguardas relativas à biologia mantêm o mesmo padrão estabelecido no Sonnet 5, Sonnet 5.5 e Opus 5.

Em conjunto com o lançamento, a Anthropic ofereceu créditos mensais de API para assinantes dos planos Max e Team. Usuários do Max 5x receberão US$ 100 (cerca de R$ 530) mensalmente, e assinantes do Max 20x terão US$ 200 (cerca de R$ 1.060). Para clientes Team, o benefício totaliza US$ 500 (cerca de R$ 2.650), distribuído entre os membros da organização. Esses créditos podem ser usados em qualquer modelo da Anthropic na plataforma e visam incentivar o desenvolvimento de agentes e aplicações que utilizem a API.

A empresa também atualizou seus SDKs para Python e TypeScript, que agora suportam em modo beta o uso em computador e navegador.

Disponibilidade do Haiku 5.5

O Claude Haiku 5.5 já está acessível nas plataformas da Anthropic, incluindo Amazon Web Services (AWS), Google Cloud e Microsoft Azure. Na Claude Platform, os desenvolvedores podem acessar o modelo utilizando a identificação claude-haiku-5-5. Com este lançamento, a Anthropic conclui, em pouco mais de duas semanas, a atualização de sua linha principal Claude 5.5. O Haiku 5.5 se estabelece como a alternativa mais econômica da família, enquanto Sonnet e Opus continuam focados em tarefas mais sofisticadas.

Popular