Pular para o conteúdo

Claude Opus 5.5 reduz o preço de saída para 20 dólares por milhão

A Anthropic lançou o Claude Opus 5.5 em 22 de setembro de 2026, a 4 dólares de entrada e 20 de saída por milhão de tokens, com o raciocínio sempre ligado.

Por Tech AI Wire Team

3 min de leitura

XLinkedIn
The Claude Platform Docs page for Claude Opus 5.5, showing a 1M-token context window, 128K maximum output, and input and output prices of $4 and $20 per million tokens.

Em números

output price per million tokens, down from $25
$20
less to run than Opus 5, Anthropic says
40%
tokens in the context window
1M

A Anthropic lançou o Claude Opus 5.5 em 22 de setembro de 2026. O modelo custa 4 dólares por milhão de tokens de entrada e 20 dólares por milhão de tokens de saída. A sala de imprensa da Anthropic diz que ele "rende no nível do Claude Fable 5.1 na maior parte do trabalho e custa 40% menos para executar do que o Opus 5". Para equipes que mantêm agentes de código rodando por horas, os tokens de saída são a linha da conta que cresce. Por isso a notícia é o preço.

O TechCrunch informou que esse preço de saída de 20 dólares cai dos 25 dólares da versão anterior. O TechCrunch também escreveu que o modelo é mais rápido e precisa de menos computação para isso.

Quanto custa o Opus 5.5

ItemPreço por milhão de tokens
Entrada4 dólares
Saída20 dólares
Escrita em cache, 5 minutos5 dólares
Escrita em cache, 1 hora8 dólares
Leitura em cache0,20 dólar

O cache de prompts guarda parte de uma requisição para que ela não seja enviada nem cobrada por inteiro a cada vez. Aqui uma leitura em cache custa 0,20 dólar por milhão de tokens. A API Batch tira 50% da entrada e da saída, em troca de respostas mais lentas.

O que diz a ficha do modelo

A documentação da plataforma da Anthropic dá o identificador claude-opus-5-5. No Amazon Bedrock ele é anthropic.claude-opus-5-5. O modelo está disponível pela API da Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry e a Claude Platform na AWS.

A janela de contexto comporta 1 milhão de tokens. É tudo o que o modelo consegue ler e escrever em uma conversa. Uma única resposta síncrona pode chegar a 128 mil tokens. Pela API Batch, com um cabeçalho beta, esse teto sobe para 300 mil tokens.

A documentação indica um corte de conhecimento em junho de 2026. Ela também diz que o modelo não será desativado antes de 22 de setembro de 2027. Essa segunda data importa para quem fixa um identificador de modelo em código de produção.

Quatro mudanças que podem quebrar código em uso

A documentação lista quatro diferenças em relação ao Opus 5 que não são retrocompatíveis.

  • O raciocínio estendido está sempre ligado e não pode ser desligado. Raciocinar é o modelo percorrer um problema antes de responder.
  • O uso forçado de ferramentas agora devolve um erro em vez de ser aceito.
  • Os blocos de raciocínio ficam presos ao modelo e à conversa que os produziu.
  • A versão anterior da ferramenta computer_20251124 não é mais aceita.

O ajuste de esforço padrão é médio. No Claude Fable 5.1 ele é alto. O esforço controla o quanto o modelo trabalha uma resposta. Um prompt inalterado pode, portanto, se comportar de outro jeito.

O que isso significa para desenvolvedores

Leia essas quatro mudanças antes de trocar um identificador de modelo em um serviço no ar. O raciocínio sempre ligado é a armadilha. Código que passa uma flag para desligar o raciocínio, ou que move blocos de raciocínio entre modelos, precisa mudar antes. Uma queda de preço não vale uma indisponibilidade.

Rode de novo as suas próprias avaliações em vez de confiar na comparação com o Fable 5.1. A afirmação da Anthropic cobre a maior parte do trabalho, e a sua carga de trabalho não é a maior parte do trabalho. O TechCrunch informou que o modelo superou o Fable em muitos testes de conclusão de tarefas informais, e o colocou perto do Mythos em biologia e cibersegurança. São categorias amplas, não a sua suíte de testes.

Confira o esforço padrão se você está vindo do Fable 5.1. Ir de alto para médio muda custo e qualidade da resposta ao mesmo tempo. Isso torna fácil ler errado uma regressão.

Se o contexto repetido domina a sua conta, leia as linhas de cache antes das linhas de tokens. A Anthropic fez um movimento parecido nos preços de cache do Claude Fable 5.1 no início do mês. Equipes que enviam o mesmo prompt de sistema longo em cada chamada sentem uma mudança de cache mais do que uma mudança de token.

Existe um motivo para esperar. O TechCrunch informou que o Sonnet 5.5 e o Haiku 5.5 chegam nas próximas semanas. A maior parte do tráfego de produção não precisa do maior modelo. Um nível mais barato pode servir melhor à sua carga de trabalho ainda neste mês.

Fontes

  1. Anthropic releases Opus 5.5 with lower prices and Fable-level performance - TechCrunch
  2. Claude Opus 5.5 overview - Claude Platform Docs
  3. Anthropic newsroom - Anthropic

Artigos relacionados