Aller au contenu

Claude Opus 5.5 abaisse le prix de sortie à 20 dollars le million

Anthropic a publié Claude Opus 5.5 le 22 septembre 2026, à 4 dollars en entrée et 20 dollars en sortie par million de jetons, avec le raisonnement toujours actif.

Par Tech AI Wire Team

3 min de lecture

XLinkedIn
The Claude Platform Docs page for Claude Opus 5.5, showing a 1M-token context window, 128K maximum output, and input and output prices of $4 and $20 per million tokens.

En chiffres

output price per million tokens, down from $25
$20
less to run than Opus 5, Anthropic says
40%
tokens in the context window
1M

Anthropic a publié Claude Opus 5.5 le 22 septembre 2026. Le modèle coûte 4 dollars par million de jetons en entrée et 20 dollars par million de jetons en sortie. La salle de presse d'Anthropic indique qu'il "atteint le niveau de Claude Fable 5.1 sur la plupart des travaux et coûte 40 % de moins à exécuter qu'Opus 5". Pour les équipes qui font tourner des agents de code pendant des heures, les jetons de sortie sont la ligne de facture qui grossit. C'est donc le prix qui fait l'actualité.

TechCrunch a rapporté que ce prix de sortie de 20 dollars descend de 25 dollars sur la version précédente. TechCrunch a également écrit que le modèle est plus rapide et demande moins de calcul pour y parvenir.

Ce que coûte Opus 5.5

PostePrix par million de jetons
Entrée4 dollars
Sortie20 dollars
Écriture en cache, 5 minutes5 dollars
Écriture en cache, 1 heure8 dollars
Lecture en cache0,20 dollar

La mise en cache des invites conserve une partie d'une requête pour ne pas l'envoyer ni la facturer en entier à chaque fois. Une lecture en cache coûte ici 0,20 dollar par million de jetons. L'API Batch retire 50 % sur l'entrée et la sortie, en échange de réponses plus lentes.

Ce que dit la fiche du modèle

La documentation de la plateforme d'Anthropic donne l'identifiant claude-opus-5-5. Sur Amazon Bedrock, il s'agit de anthropic.claude-opus-5-5. Le modèle est disponible via l'API Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry et la Claude Platform sur AWS.

La fenêtre de contexte contient 1 million de jetons. C'est tout ce que le modèle peut lire et écrire dans une même conversation. Une seule réponse synchrone peut atteindre 128 000 jetons. Via l'API Batch, avec un en-tête bêta, ce plafond monte à 300 000 jetons.

La documentation indique une date de connaissance arrêtée à juin 2026. Elle précise aussi que le modèle ne sera pas retiré avant le 22 septembre 2027. Cette seconde date compte pour quiconque fige un identifiant de modèle dans du code de production.

Quatre changements qui peuvent casser du code en service

La documentation liste quatre différences avec Opus 5 qui ne sont pas rétrocompatibles.

  • Le raisonnement étendu est toujours actif et ne peut pas être désactivé. Raisonner, c'est le modèle qui déroule un problème avant de répondre.
  • L'usage forcé d'un outil renvoie désormais une erreur au lieu d'être accepté.
  • Les blocs de raisonnement sont liés au modèle et à la conversation qui les a produits.
  • L'ancienne version d'outil computer_20251124 n'est plus acceptée.

Le réglage d'effort par défaut est moyen. Sur Claude Fable 5.1, il est élevé. L'effort détermine à quel point le modèle travaille une réponse. Une invite inchangée peut donc se comporter autrement.

Ce que cela signifie pour les développeurs

Lisez ces quatre changements avant de remplacer un identifiant de modèle dans un service en production. Le raisonnement toujours actif est le piège. Le code qui passe un drapeau pour désactiver le raisonnement, ou qui déplace des blocs de raisonnement entre modèles, doit d'abord changer. Une baisse de prix ne vaut pas une panne.

Relancez vos propres évaluations plutôt que de vous fier à la comparaison avec Fable 5.1. L'affirmation d'Anthropic couvre la plupart des travaux, et votre charge de travail n'est pas la plupart des travaux. TechCrunch a rapporté que le modèle devance Fable sur de nombreux tests de réalisation de tâches informelles, et le situe près de Mythos en biologie et en cybersécurité. Ce sont de larges catégories, pas votre suite de tests.

Vérifiez l'effort par défaut si vous migrez depuis Fable 5.1. Passer d'élevé à moyen change le coût et la qualité des réponses en même temps. Une régression devient alors facile à mal interpréter.

Si le contexte répété domine votre facture, lisez les lignes de cache avant les lignes de jetons. Anthropic a fait un geste comparable sur les prix du cache de Claude Fable 5.1 plus tôt ce mois-ci. Les équipes qui envoient la même longue invite système à chaque appel ressentent un changement de cache plus qu'un changement de jeton.

Il existe une raison d'attendre. TechCrunch a rapporté que Sonnet 5.5 et Haiku 5.5 arrivent dans les semaines qui viennent. La plupart du trafic de production n'a pas besoin du plus gros modèle. Un palier moins cher pourrait donc mieux convenir à votre charge de travail avant la fin du mois.

Sources

  1. Anthropic releases Opus 5.5 with lower prices and Fable-level performance - TechCrunch
  2. Claude Opus 5.5 overview - Claude Platform Docs
  3. Anthropic newsroom - Anthropic

Articles liés