🌀 Sumário do Artigo
- Um corte de preço que fecha uma trinca de lançamentos
- Quanto custa na prática
- O que mudou além do preço
- Como ele se compara em benchmarks
- Quem já está usando o modelo em produção
- Segurança ficou mais estrita, mas não no nível dos modelos grandes
- Para quem o Haiku 5.5 faz sentido
- Perguntas Frequentes
- •Quanto custa o Claude Haiku 5.5 na API da Anthropic?
- •O que é o nível de esforço ajustável do Haiku 5.5?
- •O Claude Haiku 5.5 já está disponível para uso?
- Fontes e Referências
Um milhão de tokens de entrada no Claude Haiku 5.5 custa US$ 0,10. Há duas semanas, o mesmo volume no Haiku 4.5 custava US$ 1 — dez vezes mais. A Anthropic anunciou o novo modelo em 7 de outubro, e o número que mais chamou atenção não foi um benchmark, foi a tabela de preços: a empresa cortou o custo de lista em até 90% para prompts de até 100 mil tokens, igualando o piso cobrado pela OpenAI no GPT-6 Luna, segundo a VentureBeat.
Resposta Rápida (TL;DR): O Claude Haiku 5.5, lançado pela Anthropic em 7 de outubro de 2026, custa US$ 0,10 por milhão de tokens de entrada e US$ 0,50 por milhão de saída em prompts de até 100 mil tokens — até 90% mais barato que o Haiku 4.5. É o primeiro modelo Haiku com nível de esforço ajustável, tem janela de contexto de 1 milhão de tokens e, segundo a Anthropic, supera o GPT-6 Luna em tarefas de uso de computador e codificação agêntica.
Um corte de preço que fecha uma trinca de lançamentos
O Haiku 5.5 não chegou isolado. A Anthropic vinha prometendo a atualização desde o fim de setembro, quando lançou o Opus 5.5 com preços mais baixos e, dias depois, o Sonnet 5.5 como "parceiro de trabalho" mais rápido e barato. Em ambos os anúncios, a empresa disse que uma nova versão do Haiku viria "nas próximas semanas", sem data fechada — o que o TechCrunch já havia registrado ao cobrir o Sonnet 5.5.
Agora a trinca está completa. Opus, Sonnet e Haiku passaram por atualização de preço e desempenho em menos de três semanas, num ritmo que a própria imprensa especializada já vinha chamando de "fadiga de modelo" entre os grandes laboratórios. Quem quiser comparar os três lado a lado — custo, contexto e benchmarks — encontra a tabela atualizada no Comparador de IAs do Turbina IA.
Quanto custa na prática
A estrutura de preço do Haiku 5.5 tem duas faixas, divididas pelo tamanho do prompt. Até 100 mil tokens, a cobrança é a mais baixa da família; acima disso, sobe para uma faixa intermediária. A Anthropic explica que cerca de 90% das requisições do Haiku 4.5 ficavam dentro do limite de 100 mil tokens, então a maioria dos usuários deve sentir o corte maior na prática.
| Haiku 5.5 (≤100k tokens) | Haiku 5.5 (>100k tokens) | Haiku 4.5 | |
|---|---|---|---|
| Entrada (por milhão de tokens) | US$ 0,10 | US$ 0,50 | US$ 1,00 |
| Saída (por milhão de tokens) | US$ 0,50 | US$ 2,50 | US$ 5,00 |
| Leitura de cache | US$ 0,01 | US$ 0,05 | US$ 0,10 |
| Escrita de cache | US$ 0,125 | US$ 0,625 | US$ 1,25 |
Na média — já contando que o modelo usa um tokenizador novo e consome um pouco mais tokens por tarefa — a Anthropic estima a economia real em cerca de 75%, não os 90% da tabela bruta. Quem quer estimar o impacto de uma migração de modelo no orçamento mensal pode simular o cenário na Calculadora de Custos do site, trocando o modelo atual pelo Haiku 5.5 e comparando o total.
O que mudou além do preço
A janela de contexto saltou de 200 mil para 1 milhão de tokens, e o limite de saída dobrou, de 64 mil para 128 mil tokens, segundo o Unite.AI. A novidade mais estrutural, porém, é outra: o Haiku 5.5 é o primeiro modelo da linha com nível de esforço ajustável, recurso que a Anthropic já havia testado nos modelos maiores. Na prática, o desenvolvedor escolhe entre cinco níveis — Low, Medium, High, Xhigh e Max — e troca velocidade por profundidade de raciocínio conforme a tarefa.
Isso resolve um problema real de quem usa modelos pequenos em produção: antes, trocar de modelo para ganhar mais qualidade significava migrar toda a integração para o Sonnet ou o Opus, com custo e latência maiores. Agora dá para subir o esforço do próprio Haiku em tarefas mais difíceis e voltar ao nível baixo nas rotineiras, sem trocar de modelo nem reescrever código.
Como ele se compara em benchmarks
Nos números publicados pela própria Anthropic, o salto do Haiku 4.5 para o 5.5 é grande — e o modelo pequeno às vezes passa na frente do concorrente da OpenAI, embora continue atrás dos modelos maiores da própria Anthropic.
| Benchmark | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 |
|---|---|---|---|---|
| OSWorld 2.1 (uso de computador) | 72,4% | 15,7% | 48,9% | 83,9% |
| Terminal-Bench 4.0 | 39,2% | 0,0% | 16,4% | 70,6% |
| GDPval-AA v2.1 (Elo) | 1.620 | 735 | 1.437 | 1.840 |
| Humanity's Last Exam (com ferramentas) | 57,4% | 18,7% | — | 64,5% |
O recado por trás da tabela: na tarefa de "uso de computador", o Haiku 5.5 marca mais de 23 pontos percentuais acima do GPT-6 Luna, segundo os dados divulgados pela Anthropic. Em codificação agêntica medida pelo Terminal-Bench, a diferença é ainda maior. A própria empresa é direta sobre o limite: para tarefas longas e complexas, Sonnet 5.5 e Opus 5.5 continuam sendo a recomendação — o Haiku foi desenhado para volume, não para o trabalho mais difícil.
Quem já está usando o modelo em produção
A Anthropic publicou depoimentos de clientes que testaram o Haiku 5.5 antes do lançamento, e os números ali são mais concretos que o discurso de marketing costuma entregar. A HubSpot relatou o melhor resultado já visto num conjunto interno de testes, 92,8% de acerto em média ao longo de três rodadas. A AlphaSense mediu 0,84 contra 0,76 do Haiku 4.5 em 400 consultas — uma melhora que a empresa considerou estatisticamente significativa. Já a Box registrou pontuação 11 pontos mais alta com cerca de metade da latência anterior.
Outros dois casos mostram para que serve um modelo pequeno dentro de um pipeline maior, e não isolado. A Rogo usa o Haiku 5.5 como subagente para extrair dados de arquivamentos 10-K enquanto um modelo maior monta a apresentação final. A startup de programação Cognition colocou o modelo como "ajudante" do Devin, seu agente de codificação, e manteve uma pontuação de topo no FrontierCode reduzindo custo e latência ao mesmo tempo — um padrão de uso que também aparece em outros produtos de IA listados no Guia de Ferramentas do Turbina IA.
Segurança ficou mais estrita, mas não no nível dos modelos grandes
A Anthropic diz que o Haiku 5.5 trouxe "melhorias importantes" de alinhamento em relação ao Haiku 4.5, com menos comportamento desalinhado e menor disposição a cooperar com uso indevido. As salvaguardas de cibersegurança do novo modelo são mais rígidas que as do antecessor, mas ainda abaixo do padrão aplicado ao Sonnet 5.5 — o modelo continua bloqueando testes de invasão e técnicas típicas de ataque. Já as salvaguardas sobre biologia seguem o mesmo padrão usado no Sonnet 5 e no Opus 5: perguntas de pesquisa são permitidas, pedidos com potencial de dano real são restringidos.
Para quem o Haiku 5.5 faz sentido
A própria Anthropic resume os casos de uso recomendados: tarefas de alto volume e sensíveis a custo, como resumo de documentos, classificação e consultas a banco de dados; trabalho de subagente ao lado de modelos maiores, especialmente em codificação; atendimento ao cliente em tempo real e uso de navegador, onde a velocidade pesa mais que a profundidade de raciocínio; e buscas rápidas e pontuais, como extrair um número específico de um relatório longo.
Para times que já rodam produtos de IA em escala — e sentem o preço por token pesando na planilha todo mês — a conta é simples de fazer antes de migrar: comparar o volume real de chamadas que cai na faixa de até 100 mil tokens (a grande maioria, segundo a própria Anthropic) contra o volume que passa disso, e simular os dois preços lado a lado. Quem ainda não testa prompts com o modelo pode fazer isso na própria biblioteca de prompts do site, adaptando exemplos de uso prático para o novo preço.
Perguntas Frequentes
Quanto custa o Claude Haiku 5.5 na API da Anthropic?
Para prompts de até 100 mil tokens, US$ 0,10 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída. Acima de 100 mil tokens, o preço sobe para US$ 0,50 de entrada e US$ 2,50 de saída por milhão de tokens.
O que é o nível de esforço ajustável do Haiku 5.5?
É um controle com cinco opções — Low, Medium, High, Xhigh e Max — que deixa o desenvolvedor trocar velocidade por profundidade de raciocínio na mesma chamada de API, sem precisar migrar para um modelo maior como Sonnet ou Opus.
O Claude Haiku 5.5 já está disponível para uso?
Sim. A Anthropic liberou o modelo em 7 de outubro de 2026 na Claude Platform e via API, com disponibilidade também na AWS, no Google Cloud e no Microsoft Azure, sob o identificador claude-haiku-5-5.
Fontes e Referências
- Introducing Claude Haiku 5.5 (Anthropic)
- Anthropic launches Claude Haiku 5.5 with 90% API price reduction, matching GPT-6 Luna (VentureBeat)
- Anthropic Releases Claude Haiku 5.5, Cutting Small-Model API Prices (Unite.AI)
- Anthropic releases Sonnet 5.5, which it calls a significantly cheaper, faster work partner (TechCrunch)