
1. O que é o Claude Haiku 5.5?
2. O que muda no Claude Haiku 5.5 em relação ao Haiku 4.5
3. Claude Haiku 5.5 nos benchmarks: salto sobre o Haiku 4.5
4. Quanto custa o Claude Haiku 5.5 e onde ele está disponível
5. Claude Haiku ou Sonnet: quando usar cada modelo
6. Segurança e salvaguardas do Claude Haiku 5.5
7. O que muda para desenvolvedores na migração
8. Conclusão
Modelos pequenos costumam aparecer nos lançamentos de IA como nota de rodapé: mais baratos e mais rápidos, mas bem menos capazes que os irmãos maiores. O Claude Haiku 5.5, lançado pela Anthropic em 7 de outubro de 2026, contraria parte dessa lógica. Ele fecha a família Claude 5.5, depois do Claude Opus 5.5 e do Claude Sonnet 5.5, e supera o GPT-6 Luna, da OpenAI, em todos os testes publicados com os dois lado a lado.
A mudança mais concreta, porém, está na conta. O preço por token caiu 90% para prompts de até 100 mil tokens, faixa que concentrava nove em cada dez requisições ao Haiku 4.5, e o custo médio de operação ficou cerca de 75% menor (Anthropic, 2026). Pela primeira vez, um Haiku também vem com nível de esforço ajustável.
Este artigo explica o que é o Claude Haiku 5.5, o que muda em relação ao Haiku 4.5, como ele se sai nos benchmarks e quanto custa. Na sequência, mostra quando usar o Haiku no lugar do Sonnet ou do Opus, quais salvaguardas acompanham o modelo e o que muda para quem já tem código rodando na versão anterior.
O Claude Haiku 5.5 é o modelo de linguagem compacto da Anthropic, lançado em 7 de outubro de 2026 como sucessor do Claude Haiku 4.5. Ele ocupa a base da linha Claude, abaixo do Sonnet e do Opus, e foi desenhado para trabalho de alto volume, sensível a custo e latência: resumos, classificação, roteamento de pedidos, extração de dados e tarefas de subagente dentro de fluxos maiores.
Segundo a Anthropic, é o modelo mais rápido da empresa na configuração padrão de cada modelo, superado apenas pelo Opus no Fast Mode. Isso faz do Claude Haiku 5.5 candidato natural a aplicações em tempo real, como atendimento ao cliente e navegação autônoma na web. Para desenvolvedores, o identificador é claude-haiku-5-5.
Nos casos de uso mais interessantes, porém, o modelo raramente trabalha sozinho. A Anthropic o apresenta como subagente: enquanto o Opus 5.5 ou o Sonnet 5.5 conduz a tarefa principal, o Haiku executa as etapas curtas e repetitivas, como buscar um número num documento, compactar o histórico de uma conversa longa ou classificar um lote de chamados.
O Haiku 5.5 é o primeiro da linha com controle de esforço, o parâmetro que define quanto o modelo raciocina antes de responder, em cinco níveis do baixo ao máximo. Ele trabalha junto com o pensamento adaptativo, ativado por padrão, em que o próprio modelo decide quando e quanto pensar.
Na operação, isso muda a forma de configurar cada fluxo. Uma triagem de chamados pode rodar no esforço baixo, com resposta quase imediata e poucos tokens, enquanto a extração de cláusulas de um contrato justifica um nível mais alto. Até aqui, essa escolha exigia trocar de modelo; agora cabe num parâmetro da requisição.
A janela de contexto saltou de 200 mil para 1 milhão de tokens, e a saída máxima, de 64 mil para 128 mil tokens, os mesmos números do Sonnet 5.5 e do Opus 5.5 (Claude Platform, 2026). Tokens são as unidades de texto pelas quais os modelos processam e cobram o trabalho.
Essa expansão tem, no entanto, uma ressalva de preço: acima de 100 mil tokens por prompt, o Haiku 5.5 cobra cinco vezes mais por token.
Os clientes de acesso antecipado mediram o ganho em produtos que já estão no mercado. A Asana testou o modelo no AI Teammates, seu agente para triagem de bugs e busca de projetos atrasados, e registrou redução de mais de 30% na latência. A Box viu o Haiku 5.5 marcar 11 pontos a mais que o Haiku 4.5 com cerca de metade da latência.
O exemplo mais revelador vem da AlphaSense. O recurso Ask in Document, que responde perguntas sobre um ou poucos documentos, roda cerca de 8 milhões de chamadas por semana. Em 400 consultas de teste, o Claude Haiku 5.5 teve nota 0,84, contra 0,76 do Haiku 4.5. Num volume desses, ganhar qualidade e cortar preço ao mesmo tempo aparece no orçamento do trimestre seguinte.
Nos números divulgados pela Anthropic (2026), o salto em relação ao antecessor chega a ser desproporcional. Em alguns testes, o Haiku 4.5 praticamente não pontuava:
Para quem compara fornecedores, o confronto relevante é com o GPT-6 Luna, lançado pela OpenAI junto com o GPT-6 Sol. Benchmarks publicados pelo próprio fabricante pedem leitura cautelosa, mas uma margem de mais de 20 pontos no OSWorld é grande demais para ser atribuída só à metodologia.
Os testes de clientes apontam na mesma direção. Na bateria de tarefas de CRM da HubSpot, o Haiku 5.5 obteve a maior nota já registrada, 92,8% na média de três execuções, e foi o mais rápido numa auditoria de registros desatualizados, com a menor taxa de falsos positivos.
O limite do modelo também aparece. No Terminal-Bench 4.0, o Sonnet 5.5 marca quase o dobro, e a Anthropic reconhece que Sonnet e Opus seguem melhores em programação agêntica longa.
O preço do Claude Haiku 5.5 tem duas faixas, definidas pelo tamanho do prompt. Até 100 mil tokens, a entrada custa US$ 0,10 por milhão de tokens e a saída, US$ 0,50. Acima disso, os valores sobem para US$ 0,50 e US$ 2,50. A leitura de cache, o reaproveitamento de contexto já processado, sai por US$ 0,01 na faixa menor (Anthropic, 2026).
O Haiku 4.5 cobrava US$ 1 na entrada e US$ 5 na saída, sem distinção de faixa. Como 90% das requisições ao modelo anterior cabiam na faixa menor, a economia média fica em torno de 75%, número que puxou a cobertura do lançamento na imprensa brasileira, como a do Canaltech (2026).
Um detalhe pode distorcer as contas de quem migra. O Haiku 5.5 usa o tokenizador mais recente da Anthropic, e o mesmo texto passa a contar cerca de 30% mais tokens do que no Haiku 4.5 (Claude Platform, 2026). A página de lançamento fala em um leve aumento por tarefa e informa que os 75% de economia já descontam esse efeito.
As duas informações convivem, mas pedem cuidado com orçamentos. Limites de max_tokens, alertas de consumo e estimativas em tokens precisam ser recalculados, porque o mesmo documento vai registrar números maiores no painel de uso, ainda que a fatura do mês fique menor.
A Anthropic aproveitou o anúncio para cortar pela metade a leitura de cache do Sonnet 5.5, que passa a custar US$ 0,10 por milhão de tokens, o que deixa o modelo cerca de 20% mais barato na maioria das tarefas agênticas.
Assinantes do Max e do Team também passam a receber créditos mensais para a API, de US$ 100 a US$ 500, e os SDKs de Python e TypeScript ganharam suporte em beta a uso de computador e de navegador.
O modelo já está disponível na Claude Platform e nas nuvens da Amazon Web Services, do Google Cloud e da Microsoft Azure. A ferramenta de uso do navegador, por enquanto, funciona apenas na Claude API e no Google Cloud.
Com a família 5.5 completa, a divisão entre os modelos fica mais nítida. A Anthropic traça a linha: Sonnet 5.5 e Opus 5.5 seguem como as opções certas para programação agêntica longa, enquanto o Haiku 5.5 serve a tarefas de escopo estreito que antes eram caras demais para rodar com Claude, como compactação de contexto, resumos e trabalho de subagente.
A Rogo, plataforma de IA para o mercado financeiro, descreve bem essa divisão. Enquanto um modelo maior monta uma apresentação, um subagente Haiku 5.5 abre o relatório anual 10-K da empresa analisada e extrai a linha de receita por segmento de que o slide precisa. É preciso o bastante para essa etapa e barato o suficiente para ser chamado muitas vezes.
A Cognition seguiu a mesma lógica no Devin Fusion. Com o Opus 5.5 coordenando e o Haiku 5.5 como auxiliar, o sistema mantém 66,2 pontos no FrontierCode, nota de primeira linha, com custo e latência menores.
Para empresas, três degraus de preço transformam a escolha de modelo numa decisão de arquitetura. O Opus planeja, o Sonnet executa o trabalho de escopo definido e o Haiku absorve o volume. Sem regras de roteamento e acompanhamento do consumo por área, a tendência é concentrar tudo no modelo mais caro por precaução, problema que a governança de tokens no Claude Enterprise procura resolver.
Nas avaliações de alinhamento descritas no system card, o Haiku 5.5 melhora em quase todas as medidas frente ao Haiku 4.5, com muito menos casos de comportamento desalinhado e menor disposição a colaborar com uso indevido.
As salvaguardas acompanham a capacidade. Em cibersegurança, as travas são mais restritivas que as do Haiku 4.5, mas liberam uma gama de tarefas defensivas mais ampla do que a do Sonnet 5.5, e seguem bloqueando testes de invasão. Em biologia, valem as regras do Sonnet 5.5 e do Opus 5. Organizações dessas áreas podem pedir acesso ampliado pelos programas de verificação da Anthropic.
Uma diferença operacional pesa para quem desenvolve. Quando um classificador de segurança recusa uma requisição no Claude Haiku 5.5, a API devolve a recusa sem fallback no servidor. No Sonnet 5.5, parte desses pedidos é redirecionada a outro modelo; no Haiku, o tratamento fica inteiramente a cargo da aplicação.
Para quem tem aplicações no Haiku 4.5, trocar o identificador não basta. A documentação da Claude Platform (2026) lista cinco mudanças que passam a retornar erro:
O ponto mais traiçoeiro não gera erro. Como o pensamento adaptativo vem ligado, a resposta pode começar com blocos de raciocínio, e os tokens desse raciocínio contam para o max_tokens. Um limite baixo herdado do Haiku 4.5 pode encerrar a resposta logo depois do bloco de pensamento, antes de qualquer texto útil, o que justifica um ciclo de testes antes da troca em produção.
Em síntese, o Claude Haiku 5.5 muda o papel do modelo pequeno na linha Claude. Com preço por token até 90% menor que o do antecessor, a maior velocidade entre os Claude em configuração padrão e notas acima das do GPT-6 Luna, ele deixa de ser a opção barata para tarefas triviais e passa a sustentar etapas reais de trabalho, de auditorias em CRM à extração de dados em relatórios financeiros.
Em resumo, o lançamento junta dois movimentos que se reforçam. O Haiku ganhou recursos que eram exclusivos dos modelos maiores, como esforço ajustável e contexto de 1 milhão de tokens, e ficou mais barato ao mesmo tempo. Isso torna viável chamá-lo milhares de vezes dentro de um mesmo fluxo, algo que com o Haiku 4.5 pesava na conta e entregava pouco.
Para as empresas, a família 5.5 fecha com três degraus bem separados. O Opus 5.5 cobra US$ 4 por milhão de tokens de entrada, o Sonnet 5.5, US$ 2, e o Claude Haiku 5.5, US$ 0,10 na faixa padrão. Com 20 vezes de diferença entre Sonnet e Haiku, mandar tarefas de volume para o modelo errado deixa de ser detalhe técnico e passa a aparecer no orçamento de IA.
Quem já opera agentes com Claude tem uma tarefa concreta: mapear as etapas curtas, repetitivas e de escopo fechado dos fluxos atuais, testar o Haiku 5.5 nelas com as próprias bases e revisar as integrações afetadas pela API. Levar essa divisão para a produção pede critério de roteamento, controle de consumo e engenharia que integre o Claude aos sistemas da empresa.