IA

Claude Haiku 5.5: Anthropic lança modelo pequeno com custo até 75% menor

O modelo pequeno e mais barato da Anthropic chega com esforço ajustável, cache mais barato para o Sonnet 5.5 e novo crédito mensal de API para assinantes Max e Team.

Cartaz oficial do lançamento do Claude Haiku 5.5, com o nome do modelo sobre fundo bege e blocos de cor
Anthropic anuncia o Claude Haiku 5.5, modelo pequeno da família Claude 5.5. Imagem: divulgação/Anthropic

A Anthropic lançou, na quarta-feira (7 de outubro de 2026), o Claude Haiku 5.5, o modelo mais recente da família Claude 5.5, ao lado do Opus 5.5 e do Sonnet 5.5. Segundo o anúncio oficial, o modelo custa, em média, cerca de 75% menos que o Haiku 4.5 e já está disponível na Claude Platform, na Amazon Web Services, no Google Cloud e no Microsoft Azure.

O que você precisa saber

  • A Anthropic lançou o Claude Haiku 5.5 na quarta-feira (7 de outubro de 2026), que ela descreve como o modelo pequeno mais barato, rápido e capaz que já lançou.
  • Para prompts de até 100 mil tokens, o Haiku 5.5 custa US$ 0,10 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída, uma queda de 90% frente ao Haiku 4.5 nessa faixa, segundo a Anthropic.
  • O modelo é o primeiro da linha Haiku com nível de esforço ajustável, que deixa quem usa a API escolher entre gastar menos ou priorizar mais capacidade de raciocínio.
  • O Haiku 5.5 já está disponível na Claude Platform, na Amazon Web Services, no Google Cloud e no Microsoft Azure, com o identificador claude-haiku-5-5.
  • Junto do lançamento, a Anthropic cortou pela metade o preço de leitura de cache do Claude Sonnet 5.5 e criou um crédito mensal de API para assinantes dos planos Max e Team.

O que é o Claude Haiku 5.5

O Claude Haiku 5.5 é, segundo a Anthropic, o modelo pequeno mais barato, mais rápido e mais capaz que a empresa já lançou. Ele foi pensado para tarefas de alto volume e sensíveis a custo, como resumos, compactação de contexto, consultas a banco de dados e classificação de texto.

A empresa também recomenda o modelo como subagente ao lado do Claude Opus 5.5 e do Claude Sonnet 5.5 em tarefas de programação, e para atendimento ao cliente em tempo real e navegação na web. Em nota de rodapé, a Anthropic esclarece que o Haiku 5.5 é o mais rápido da linha na velocidade padrão de cada modelo, mas roda mais devagar que os modelos Opus no modo rápido ("Fast Mode").

O Haiku 5.5 também é o primeiro da categoria Haiku com nível de esforço ajustável: como já acontece nos outros modelos da Anthropic, quem usa a API escolhe entre gastar menos ou priorizar mais capacidade de raciocínio, conforme a tarefa.

Ficha rápida
Quem lançouAnthropic
O que éModelo de linguagem compacto da família Claude 5.5
QuandoQuarta-feira, 7 de outubro de 2026
Preço (até 100 mil tokens)US$ 0,10 de entrada e US$ 0,50 de saída por milhão de tokens
DisponibilidadeClaude Platform, Amazon Web Services, Google Cloud e Microsoft Azure
BrasilNão informado

Preço e disponibilidade

A Anthropic afirma que o Haiku 5.5 custa, em média, cerca de 75% menos para rodar que o Haiku 4.5. Em nota de rodapé, a empresa detalha a conta: o preço caiu 90% para pedidos de até 100 mil tokens, categoria que concentrava 90% das chamadas ao Haiku 4.5, e 50% para pedidos acima desse limite; a conta também considera que o novo tokenizador do Haiku 5.5, igual ao do Sonnet 5.5 e ao do Opus 5.5, consome um pouco mais tokens por tarefa.

Para prompts de até 100 mil tokens, o milhão de tokens de entrada custa US$ 0,10 e o de saída custa US$ 0,50; acima desse limite, os valores sobem para US$ 0,50 e US$ 2,50. A tabela completa, com cache, está na comparação abaixo.

O modelo já está disponível em todas as plataformas da Anthropic, incluindo Amazon Web Services, Google Cloud e Microsoft Azure. Na Claude Platform, o identificador do modelo é claude-haiku-5-5, e a Anthropic publicou um guia de migração para quem já usa versões anteriores do Haiku. O anúncio não informa preço ou disponibilidade diferentes para o Brasil.

Como o Haiku 5.5 se compara ao antecessor e à concorrência

A Anthropic compara o Haiku 5.5 ao Haiku 4.5, modelo que ele substitui, e ao GPT-6 Luna, da OpenAI, citado como referência de concorrência direta. No benchmark de uso de computador OSWorld 2.1 (subconjunto offline), o Haiku 5.5 chegou a 72,4% de acerto, contra 15,7% do Haiku 4.5 e 48,9% do GPT-6 Luna. O Claude Sonnet 5.5, mais caro, segue à frente dos três nesses testes, com 83,9%, segundo a tabela de desempenho publicada pela Anthropic.

Em depoimento divulgado pela própria Anthropic, Ze'ev Klapow, engenheiro de software distinto da HubSpot, descreveu o resultado de um teste interno com tarefas de CRM, em tradução livre:

O Claude Haiku 5.5 teve a melhor pontuação que já vimos nesse teste até agora, com 92,8% de média em três rodadas.

No preço, a diferença se repete em todas as faixas: o Haiku 5.5 custa menos que o Haiku 4.5 e uma fração do Sonnet 5.5, como mostra a tabela abaixo.

ItemHaiku 5.5 (até 100 mil tokens)Haiku 5.5 (acima de 100 mil tokens)Haiku 4.5Sonnet 5.5
Leitura de cacheUS$ 0,01US$ 0,05US$ 0,10US$ 0,10
Escrita de cacheUS$ 0,125US$ 0,625US$ 1,25US$ 2,50
Tokens de entradaUS$ 0,10US$ 0,50US$ 1,00US$ 2,00
Tokens de saídaUS$ 0,50US$ 2,50US$ 5,00US$ 10,00
Quanto custa rodar o Haiku 5.5, por milhão de tokens, frente ao Haiku 4.5 e ao Sonnet 5.5 Fonte: Anthropic, anúncio de 07/10/2026 (anthropic.com/claude-haiku-5-5)
BenchmarkHaiku 5.5Haiku 4.5GPT-6 LunaSonnet 5.5 (referência)
GDPval-AA v2.1 (trabalho de conhecimento, Elo)162073514371840
AA-Briefcase v1.1 (trabalho de escritório, Elo)157861413361824
OSWorld 2.1, subconjunto offline (uso de computador)72,4%15,7%48,9%83,9%
Humanity's Last Exam, sem ferramentas (raciocínio)45,9%10,2%Não informado56,9%
Terminal-Bench 4.0 (programação agêntica)39,2%0,0%16,4%70,6%
Chartography (raciocínio visual)46,4%6,4%29,1%61,6%
Desempenho do Haiku 5.5 em benchmarks de terceiros, frente ao Haiku 4.5, ao GPT-6 Luna e ao Sonnet 5.5 Fonte: Anthropic, anúncio de 07/10/2026 (anthropic.com/claude-haiku-5-5)

Segurança e outras mudanças no catálogo

A Anthropic diz que o Haiku 5.5 mostra melhorias importantes em quase todas as avaliações de alinhamento em relação ao Haiku 4.5, com menos casos de comportamento desalinhado e menor disposição do modelo em cooperar com uso indevido, segundo o anúncio.

Em cibersegurança, a empresa afirma que as salvaguardas do Haiku 5.5 são mais restritivas que as do Haiku 4.5, mas um pouco menos restritivas que as dos modelos mais recentes da Anthropic: permitem mais tarefas defensivas que as do Sonnet 5.5, mas continuam bloqueando testes de invasão e técnicas mais associadas a ataques. As salvaguardas de biologia do Haiku 5.5 são as mesmas do Sonnet 5, do Sonnet 5.5 e do Opus 5: permitem pesquisa em biologia, mas restringem pedidos que a empresa avalia como prováveis de causar dano.

Além do novo modelo, a Anthropic cortou pela metade o preço de leitura de cache do Sonnet 5.5 desde a quarta-feira (7 de outubro), de US$ 0,20 para US$ 0,10 por milhão de tokens, o que reduz em cerca de 20% o custo do Sonnet 5.5 na maior parte do trabalho agêntico, segundo a empresa. A Anthropic também vai dar um crédito mensal de API a assinantes dos planos Claude Max e Team: US$ 100 por mês no Max 5x, US$ 200 no Max 20x e até US$ 500, somados entre os usuários de uma conta, no plano Team. Para quem desenvolve, a empresa atualizou os SDKs de Python e TypeScript da Claude Platform, em beta, com suporte a uso de computador e navegação na web.

Por que importa

O Haiku 5.5 chega como o modelo mais recente da família Claude 5.5, ao lado do Opus 5.5 e do Sonnet 5.5, e é o que tem a proposta mais direta dos três: compete por tarefas de alto volume e baixo custo, o tipo de chamada que hoje sustenta boa parte do trabalho invisível de um site, como responder dúvidas simples, classificar formulários e resumir conteúdo para outros sistemas lerem.

É aí que mora o motivo pelo qual a Voh!, como agência de SEO e GEO, acompanha esse tipo de lançamento. Modelo mais barato significa mais empresas rodando assistentes embutidos dentro do próprio site ou aplicativo, e mais chamadas de IA por trás da experiência de quem pesquisa e de quem compra. Quanto mais baratas e comuns essas interações ficam, mais cedo elas chegam também à forma como ferramentas de busca com IA leem e resumem o conteúdo de um site, tema do guia sobre como aparecer no ChatGPT.

O corte de preço do Sonnet 5.5 e o novo crédito de API para assinantes Max e Team também baixam a régua de quem já paga pela Anthropic para rodar mais integrações, o que tende a acelerar a adoção de agentes de IA em tarefas de atendimento e suporte, áreas em que o volume de interação já é alto e sensível a custo.

SEO e GEO

Modelos de IA ficam mais baratos e mais presentes no dia a dia das empresas. A sua marca já está pronta para aparecer quando a IA responde?

A Voh! trabalha o conteúdo e a estrutura técnica para a sua empresa ser encontrada tanto no Google quanto nas respostas de assistentes de IA.

  • Diagnóstico gratuito em até 48h
  • Proposta só depois da análise
  • Resposta em até 24h úteis
  • SEO Mensal sem fidelidade obrigatória

Voh! Digital · Atendimento em todo o Brasil

Perfil oficial

Acompanhe a Voh! no Instagram

Os posts da marca estão em @agenciavoh. Diagnóstico e proposta continuam no formulário e no WhatsApp.