Claude Opus 5.5 reduz o preço de saída para 20 dólares por milhão
A Anthropic lançou o Claude Opus 5.5 em 22 de setembro de 2026, a 4 dólares de entrada e 20 de saída por milhão de tokens, com o raciocínio sempre ligado.
3 min de leitura

Em números
- output price per million tokens, down from $25
- $20
- less to run than Opus 5, Anthropic says
- 40%
- tokens in the context window
- 1M
A Anthropic lançou o Claude Opus 5.5 em 22 de setembro de 2026. O modelo custa 4 dólares por milhão de tokens de entrada e 20 dólares por milhão de tokens de saída. A sala de imprensa da Anthropic diz que ele "rende no nível do Claude Fable 5.1 na maior parte do trabalho e custa 40% menos para executar do que o Opus 5". Para equipes que mantêm agentes de código rodando por horas, os tokens de saída são a linha da conta que cresce. Por isso a notícia é o preço.
O TechCrunch informou que esse preço de saída de 20 dólares cai dos 25 dólares da versão anterior. O TechCrunch também escreveu que o modelo é mais rápido e precisa de menos computação para isso.
Quanto custa o Opus 5.5
| Item | Preço por milhão de tokens |
|---|---|
| Entrada | 4 dólares |
| Saída | 20 dólares |
| Escrita em cache, 5 minutos | 5 dólares |
| Escrita em cache, 1 hora | 8 dólares |
| Leitura em cache | 0,20 dólar |
O cache de prompts guarda parte de uma requisição para que ela não seja enviada nem cobrada por inteiro a cada vez. Aqui uma leitura em cache custa 0,20 dólar por milhão de tokens. A API Batch tira 50% da entrada e da saída, em troca de respostas mais lentas.
O que diz a ficha do modelo
A documentação da plataforma da Anthropic dá o identificador claude-opus-5-5. No Amazon Bedrock ele é anthropic.claude-opus-5-5. O modelo está disponível pela API da Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry e a Claude Platform na AWS.
A janela de contexto comporta 1 milhão de tokens. É tudo o que o modelo consegue ler e escrever em uma conversa. Uma única resposta síncrona pode chegar a 128 mil tokens. Pela API Batch, com um cabeçalho beta, esse teto sobe para 300 mil tokens.
A documentação indica um corte de conhecimento em junho de 2026. Ela também diz que o modelo não será desativado antes de 22 de setembro de 2027. Essa segunda data importa para quem fixa um identificador de modelo em código de produção.
Quatro mudanças que podem quebrar código em uso
A documentação lista quatro diferenças em relação ao Opus 5 que não são retrocompatíveis.
- O raciocínio estendido está sempre ligado e não pode ser desligado. Raciocinar é o modelo percorrer um problema antes de responder.
- O uso forçado de ferramentas agora devolve um erro em vez de ser aceito.
- Os blocos de raciocínio ficam presos ao modelo e à conversa que os produziu.
- A versão anterior da ferramenta
computer_20251124não é mais aceita.
O ajuste de esforço padrão é médio. No Claude Fable 5.1 ele é alto. O esforço controla o quanto o modelo trabalha uma resposta. Um prompt inalterado pode, portanto, se comportar de outro jeito.
O que isso significa para desenvolvedores
Leia essas quatro mudanças antes de trocar um identificador de modelo em um serviço no ar. O raciocínio sempre ligado é a armadilha. Código que passa uma flag para desligar o raciocínio, ou que move blocos de raciocínio entre modelos, precisa mudar antes. Uma queda de preço não vale uma indisponibilidade.
Rode de novo as suas próprias avaliações em vez de confiar na comparação com o Fable 5.1. A afirmação da Anthropic cobre a maior parte do trabalho, e a sua carga de trabalho não é a maior parte do trabalho. O TechCrunch informou que o modelo superou o Fable em muitos testes de conclusão de tarefas informais, e o colocou perto do Mythos em biologia e cibersegurança. São categorias amplas, não a sua suíte de testes.
Confira o esforço padrão se você está vindo do Fable 5.1. Ir de alto para médio muda custo e qualidade da resposta ao mesmo tempo. Isso torna fácil ler errado uma regressão.
Se o contexto repetido domina a sua conta, leia as linhas de cache antes das linhas de tokens. A Anthropic fez um movimento parecido nos preços de cache do Claude Fable 5.1 no início do mês. Equipes que enviam o mesmo prompt de sistema longo em cada chamada sentem uma mudança de cache mais do que uma mudança de token.
Existe um motivo para esperar. O TechCrunch informou que o Sonnet 5.5 e o Haiku 5.5 chegam nas próximas semanas. A maior parte do tráfego de produção não precisa do maior modelo. Um nível mais barato pode servir melhor à sua carga de trabalho ainda neste mês.
Fontes
- Anthropic releases Opus 5.5 with lower prices and Fable-level performance - TechCrunch
- Claude Opus 5.5 overview - Claude Platform Docs
- Anthropic newsroom - Anthropic
Artigos relacionados

O Jev, da TypeSafe, devolve decisões tipadas, não texto
O Jev responde em 70 a 500 milissegundos e custa 0,042 dólar por milhão de tokens de entrada, com saída grátis. Ele não gera texto de jeito nenhum.

GPT-6 Astra entra em disponibilidade geral no Bedrock e no Copilot
O GPT-6 Astra está em disponibilidade geral no Amazon Bedrock a US$ 10 por milhão de tokens de entrada, e no GitHub Copilot para os planos Pro+, Max, Business e Enterprise.

Claude Fable 5.1 corta 75% no custo de leitura de cache
O Fable 5.1 mantém entrada e saída em 10 e 50 dólares por milhão de tokens e baixa a leitura de cache de 1,00 para 0,25 dólar. O Mythos 5.1 segue por convite.