Voltar

Claude Opus 5.5: o que é e o que muda no novo modelo da Anthropic

Setembro 2026
Pedro Assis
13 min
Claude Opus 5.5: o que é e o que muda no novo modelo da Anthropic
Sumário

1. O que é o Claude Opus 5.5?

2. Como foi o lançamento do Claude Opus 5.5

3. O que muda no Claude Opus 5.5 em relação ao Opus 5

4. Claude Opus 5.5 nos benchmarks: onde lidera e onde fica atrás

5. Quanto custa o Claude Opus 5.5 e onde ele está disponível

6. Segurança e salvaguardas do Claude Opus 5.5

7. Conclusão

A Anthropic lançou nesta terça-feira, 22 de setembro de 2026, o Claude Opus 5.5, primeiro modelo da nova família Claude 5.5. Segundo a empresa, o Claude Opus 5.5 entrega desempenho no nível do Claude Fable 5.1 na maior parte das tarefas e custa cerca de 40% menos para operar do que o Claude Opus 5, lançado em julho. O modelo já está disponível na API da Anthropic, nos aplicativos do Claude e nas nuvens da Amazon, do Google e da Microsoft.

O lançamento pesa mais do que a ficha técnica sugere. É o primeiro modelo que a Anthropic apresenta desde que o CEO Dario Amodei defendeu, na semana anterior, que o avanço da IA seja cadenciado para que as práticas de segurança acompanhem a capacidade dos modelos. Por isso o Opus 5.5 chega com avaliação prévia de organizações externas e com salvaguardas que até agora eram exclusivas da linha Fable, a mais avançada da empresa.

Este artigo explica o que é o Claude Opus 5.5, como foi o lançamento, o que muda em relação ao Opus 5, onde o modelo lidera nos benchmarks (e onde fica atrás), quanto custa e quais proteções acompanham a nova versão.

O que é o Claude Opus 5.5?

O Claude Opus 5.5 é um modelo de linguagem de grande porte (LLM) desenvolvido pela Anthropic e lançado em 22 de setembro de 2026 como sucessor do Claude Opus 5. Ele ocupa a faixa alta do portfólio do Claude: fica acima dos modelos Sonnet e Haiku, mais rápidos e baratos, e abaixo da linha Fable, voltada ao raciocínio mais exigente.

Nessa posição, a proposta do modelo é oferecer capacidade próxima à do topo de linha por uma fração do custo, com foco em programação, uso de computador e trabalho de conhecimento, como análise financeira, pesquisa e produção de relatórios.

O número 5.5 identifica uma nova família, e não apenas uma atualização pontual. O Opus é o primeiro a sair, e a Anthropic informa que o Claude Sonnet 5.5 e o Claude Haiku 5.5 chegam nas próximas semanas com parte das mesmas melhorias de desempenho, eficiência e segurança.

Na prática, o Opus 5.5 sempre raciocina antes de responder. A empresa retirou a opção de desligar o modo de pensamento, e o que o usuário controla é o nível de esforço, que vai de baixo a máximo e define quanto o modelo pensa antes de entregar a resposta. O padrão é o nível médio. Para desenvolvedores, o identificador na plataforma é claude-opus-5-5.

Leia também: Claude Opus 5: tudo sobre o novo modelo da Anthropic

Como foi o lançamento do Claude Opus 5.5

A Anthropic apresentou o modelo como resposta direta ao próprio discurso de cadência. Antes da liberação, o Claude Opus 5.5 passou por testes de avaliadores externos, entre eles a Frontier Design e o METR, organização independente que mede capacidades e riscos de modelos de IA. No texto de anúncio, a empresa também vincula o lançamento a um esforço mais amplo de política pública, citando o anúncio recente feito com a Accenture e a promessa de detalhar em breve novas iniciativas.

A cobertura da imprensa brasileira destacou dois eixos. A CNN Brasil enquadrou o modelo pelo binômio segurança e custo-benefício, enquanto a reportagem da Reuters publicada pelo InfoMoney deu destaque à comparação de preço com o Opus 5 e à probabilidade 85% menor de o modelo tentar contornar limites de segurança.

O contexto competitivo explica a ênfase em custo. O lançamento acontece poucas semanas depois do GPT-6 Astra, o novo modelo da OpenAI, e a Anthropic dedicou boa parte do anúncio a comparar desempenho por dólar gasto, e não apenas pontuação bruta. A mensagem implícita é que, no patamar atual de capacidade, a disputa entre os laboratórios passou a ser também sobre quanto custa cada tarefa concluída.

Parceria Oficial · Anthropic & Distrito

Acesse o Claude Enterprise com suporte, estratégia e governança no Brasil

Implemente os modelos de IA da Anthropic na sua operação com segurança. Como parceiro oficial no Brasil, o Distrito oferece estratégia, capacitação e engenharia dedicada para os seus casos de uso.

Claude Enterprise · Governança · Squads IA
Quero implementar o Claude
Leve o Claude para o core do seu negócio com a expertise e ecossistema do Distrito.

O que muda no Claude Opus 5.5 em relação ao Opus 5

A Anthropic concentra as melhorias em três frentes: programação, trabalho de conhecimento e escrita. Em todas elas, o argumento central é o mesmo. O modelo resolve mais tarefas usando menos tokens, as unidades de texto pelas quais os modelos de IA são cobrados, e isso reduz tempo e custo ao mesmo tempo.

Programação e tarefas longas

O ganho mais visível está em trabalhos extensos de software. Um cliente de acesso antecipado usou o Claude Opus 5.5 para auditar e corrigir uma base de 200 mil linhas de código em menos de três horas, trabalho em que o Opus 5 levou mais de 20 horas e consumiu 2,5 vezes mais tokens. Outro concluiu em menos de um dia a migração de 680 mil linhas de código, tarefa que, segundo a Anthropic, tomaria semanas de uma equipe de engenharia.

O teste interno mais ilustrativo envolveu o HAProxy, software amplamente usado para distribuir tráfego entre servidores. A Anthropic pediu ao Opus 5.5 e ao Fable 5.1 que reescrevessem o programa da linguagem C para Rust. As duas versões passaram em quase todos os testes de regressão do próprio HAProxy, mas o Opus 5.5 terminou em 9,5 horas, contra 12 do Fable 5.1, a um custo 51% menor.

Em outro experimento, de redução do tempo de carregamento de todas as páginas de uma aplicação web, o modelo teve sucesso em 39 de 40 tentativas.

Trabalho de conhecimento

Fora da programação, a Anthropic testou o modelo em pesquisa e análise de negócios. Num dos testes, os modelos precisavam escrever um relatório sobre o resultado trimestral de uma empresa a partir de uma cópia da web em que o balanço era difícil de localizar, e qualquer número ou citação inventada reprovava o relatório. Dezesseis dos 18 relatórios do Opus 5.5 passaram no critério de qualidade. Nem o Fable 5.1 nem o Opus 5 passaram em nenhuma tentativa.

Os relatos de clientes vão na mesma direção. A Deloitte informou que, no menor nível de esforço, o Opus 5.5 identificou 72% dos bugs conhecidos em suas revisões de código, contra 56% do Opus 5 em esforço alto. Num teste de análise de fusão entre duas empresas fictícias, com modelo financeiro em Excel e apresentação executiva, o Opus 5.5 terminou em 63 minutos, contra 93 do Opus 5, com metade do custo e menos erros.

Escrita mais fácil de acompanhar

A terceira mudança atende a uma reclamação recorrente sobre o Opus 5, cujas respostas muitos usuários consideravam prolixas. O Opus 5.5 coloca a informação mais importante no início, usa menos jargão e segue com mais fidelidade as regras de escrita definidas pelo usuário.

Parece um detalhe cosmético, mas não é: em sessões longas de trabalho, o gargalo raramente é a velocidade do modelo, e sim o tempo que uma pessoa leva para entender e conferir o que ele fez. A própria Anthropic trata a clareza como benefício de segurança, porque um trabalho legível é mais fácil de auditar.

Claude Opus 5.5 nos benchmarks: onde lidera e onde fica atrás

Benchmarks são testes padronizados que permitem comparar modelos de IA na mesma tarefa. Nos números divulgados pela Anthropic (2026), o Claude Opus 5.5 lidera a maior parte das avaliações de programação agêntica, uso de computador e trabalho de conhecimento:

  • Terminal-Bench 4.0, que mede a execução de tarefas profissionais em linha de comando: 66,4%, contra 55,8% do Fable 5.1, 52,3% do Opus 5 e 57,9% do GPT-6 Astra
  • GDPval-AA v2.1, que avalia trabalho real em 44 profissões: 1.846 pontos Elo, contra 1.735 do Fable 5.1, 1.708 do Opus 5 e 1.542 do GPT-6 Astra
  • CursorBench 4.0, focado em programação dentro de editores de código: 57,8%, contra 51,8% do Fable 5.1 e 41,7% do GPT-5.6 Sol
  • OSWorld 2.0, que testa o uso autônomo de um computador: 81,8%, contra 80,7% do Fable 5.1 e 74% do Opus 5
  • Humanity's Last Exam, prova de raciocínio multidisciplinar com uso de ferramentas: 67,7%, contra 65,6% do Fable 5.1 e 57,2% do GPT-6 Astra

A liderança não é total. O GPT-6 Astra fica à frente no AutomationBench, que mede fluxos de trabalho de negócios (41,4% contra 40%), e no Terminal-Bench-Science, de pesquisa científica agêntica (64,6% contra 58,7%). A Anthropic registra ainda que avaliou o modelo com as salvaguardas de produção ativas, e que as tarefas bloqueadas foram executadas por modelos mais antigos, o que provavelmente reduz as notas do Opus 5.5.

O dado mais relevante para quem decide está no custo por tarefa. No nível de esforço padrão, o Opus 5.5 supera o GPT-6 Astra no FrontierCode com cerca de 20% do custo por tarefa, e no GDPval-AA vence o Astra em esforço máximo gastando aproximadamente um quinto. A própria Anthropic admite que, nesse patamar, as margens de benchmark se tornaram um guia menos confiável das diferenças reais, e que no uso interno a distância para o Fable 5.1 é menor do que as notas sugerem.

Quanto custa o Claude Opus 5.5 e onde ele está disponível

Preço por token

Na API, o Claude Opus 5.5 custa US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída, 20% abaixo do Opus 5. A redução maior está na leitura de cache, o reaproveitamento de trechos de contexto já processados, que caiu de US$ 0,50 para US$ 0,20 por milhão de tokens (60% a menos). A escrita de cache passou de US$ 6,25 para US$ 5.

A leitura de cache parece um item secundário da tabela, mas é ela que domina a conta em agentes e em programação, porque o modelo relê o mesmo contexto a cada passo. Somado ao menor consumo de tokens por tarefa, esse corte é o que produz a economia de cerca de 40% estimada pela Anthropic para cargas típicas.

Para quem precisa de resposta imediata, há ainda o modo rápido, disponível no Claude Code e na Claude Platform, com velocidade até 2,5 vezes maior por US$ 8 na entrada e US$ 40 na saída. Mesmo no modo padrão, o modelo gera texto mais de 30% mais rápido que o Opus 5.

Planos e disponibilidade

Para assinantes, a Anthropic ampliou os limites de uso por janela de cinco horas nos planos Pro, Max, Team e Enterprise por assento, e ofereceu uma renovação de limite que o usuário pode guardar e usar quando quiser. O modelo está disponível em todas as plataformas da empresa e também na Amazon Web Services, no Google Cloud e no Microsoft Azure.

Um ponto pesa especialmente para empresas: o Opus 5.5 pode ser contratado com retenção zero de dados, como os Opus anteriores. É uma diferença concreta em relação ao Claude Fable 5.1, classificado como modelo sujeito a retenção de até 30 dias e revisão humana. Para setores regulados, isso simplifica a contratação: o Opus 5.5 entrega capacidade próxima à do Fable 5.1 sem as condições de retenção que acompanham o modelo de topo.

Leia também: Como governar tokens no Claude Enterprise: o guia do Distrito

Segurança e salvaguardas do Claude Opus 5.5

Testes de comportamento

Na auditoria comportamental automatizada da Anthropic, que avalia o modelo em quase 2 mil situações simuladas, o Claude Opus 5.5 teve o melhor resultado entre os modelos recentes em quase todas as medidas de comportamento desalinhado, e o melhor na maioria das medidas de honestidade.

Num teste novo, desenhado para medir a propensão do modelo a ultrapassar limites de contenção, ele tentou contornar essas barreiras cerca de 85% menos vezes que o Opus 5 ou o Claude Mythos 5.1, e todas as tentativas foram de baixa gravidade e relatadas pelo próprio modelo.

O modelo também resiste melhor à injeção de prompt, técnica em que instruções maliciosas escondidas em páginas, arquivos ou e-mails tentam desviar o comportamento de um agente. Num benchmark conduzido pela empresa de segurança Gray Swan, o Opus 5.5 empatou com o Fable 5.1 na menor taxa de sucesso de ataques entre os modelos testados.

A Anthropic faz uma ressalva que merece atenção: há sinais de que o Opus 5.5 frequentemente suspeita que está sendo avaliado, o que limita a capacidade de prever como ele se comporta fora dos testes. A empresa afirma que construir avaliações capazes de detectar todas as falhas antes do lançamento continua sendo um problema sem solução, e por isso combina o trabalho de alinhamento com salvaguardas externas ao modelo.

Salvaguardas por área de risco

Como o Opus 5.5 é comparável ao Claude Mythos 5.1 em biologia e cibersegurança, é o primeiro Opus a sair com salvaguardas da mesma classe das do Fable 5.1. Na prática, as restrições funcionam assim:

  • Cibersegurança: identificar e corrigir bugs no ciclo normal de desenvolvimento continua liberado, mas a maior parte das tarefas de segurança ofensiva é redirecionada ao Claude Opus 4.8; profissionais verificados poderão usar o Opus 5.5 pelo Cyber Verification Program, que ganhará três níveis de acesso nas próximas semanas
  • Biologia: valem as mesmas salvaguardas do Fable 5.1, e laboratórios acadêmicos, startups e farmacêuticas podem pedir acesso ampliado pelo novo Life Sciences Verification Program
  • Destilação: a prática de treinar um modelo mais barato copiando as respostas de um modelo avançado é bloqueada pelo recurso de pensamento preservado, que impede usuários da API de editar o contexto anterior para extrair o raciocínio do Claude; a trava vale para contas criadas a partir de 31 de agosto de 2026

Todo texto gerado pelo modelo também carrega a marca d'água estatística da Anthropic, adotada para cumprir as exigências do EU AI Act, a lei europeia de inteligência artificial. Para quem usa o modelo no dia a dia, a mudança é invisível, mas ela passa a acompanhar qualquer conteúdo produzido com o Opus 5.5.

Leia também: O que muda no Claude Fable 5.1, o novo modelo da Anthropic

Conclusão

Em síntese, o Claude Opus 5.5 muda a relação entre capacidade e preço dentro do portfólio da Anthropic. Um modelo posicionado abaixo da linha Fable passa a disputar com ela em programação e trabalho de conhecimento, e faz isso gastando menos tokens por tarefa, cobrando menos por token e mantendo a opção de retenção zero de dados nas mesmas condições dos Opus anteriores.

A segurança deixou de ser um capítulo separado do lançamento e passou a moldar o próprio produto. Avaliação externa antes da liberação, salvaguardas herdadas da linha Fable e travas contra destilação acompanham o Opus 5.5 desde o primeiro dia, e isso tem efeito prático: parte das tarefas de cibersegurança e biologia simplesmente não roda no modelo sem verificação prévia.

Para as empresas, a pergunta relevante deixa de ser qual modelo pontua mais alto. O critério passa a ser o custo por tarefa concluída, combinado com o nível de esforço adequado a cada tipo de trabalho e com as restrições de dados de cada setor. A chegada do Sonnet 5.5 e do Haiku 5.5 nas próximas semanas deve reforçar essa lógica, abrindo espaço para distribuir tarefas entre modelos de custos diferentes em vez de concentrar tudo no mais caro.

Quem já opera com o Opus 5 tem uma decisão concreta pela frente: migrar, testar o novo nível de esforço padrão e recalcular o orçamento de tokens, sem perder de vista que salvaguardas novas podem redirecionar parte das tarefas. Colocar um modelo de fronteira em produção exige critério de escolha por tarefa, governança de consumo de tokens e engenharia que integre o Claude aos sistemas existentes.

Conheça a parceria oficial entre o Distrito e a Anthropic e veja como implementar o Claude Opus 5.5 na sua operação, com estratégia, capacitação de times e engenheiros de IA dedicados aos casos de uso priorizados.