Claude Opus 5.5 abaisse le prix de sortie à 20 dollars le million
Anthropic a publié Claude Opus 5.5 le 22 septembre 2026, à 4 dollars en entrée et 20 dollars en sortie par million de jetons, avec le raisonnement toujours actif.
3 min de lecture

En chiffres
- output price per million tokens, down from $25
- $20
- less to run than Opus 5, Anthropic says
- 40%
- tokens in the context window
- 1M
Anthropic a publié Claude Opus 5.5 le 22 septembre 2026. Le modèle coûte 4 dollars par million de jetons en entrée et 20 dollars par million de jetons en sortie. La salle de presse d'Anthropic indique qu'il "atteint le niveau de Claude Fable 5.1 sur la plupart des travaux et coûte 40 % de moins à exécuter qu'Opus 5". Pour les équipes qui font tourner des agents de code pendant des heures, les jetons de sortie sont la ligne de facture qui grossit. C'est donc le prix qui fait l'actualité.
TechCrunch a rapporté que ce prix de sortie de 20 dollars descend de 25 dollars sur la version précédente. TechCrunch a également écrit que le modèle est plus rapide et demande moins de calcul pour y parvenir.
Ce que coûte Opus 5.5
| Poste | Prix par million de jetons |
|---|---|
| Entrée | 4 dollars |
| Sortie | 20 dollars |
| Écriture en cache, 5 minutes | 5 dollars |
| Écriture en cache, 1 heure | 8 dollars |
| Lecture en cache | 0,20 dollar |
La mise en cache des invites conserve une partie d'une requête pour ne pas l'envoyer ni la facturer en entier à chaque fois. Une lecture en cache coûte ici 0,20 dollar par million de jetons. L'API Batch retire 50 % sur l'entrée et la sortie, en échange de réponses plus lentes.
Ce que dit la fiche du modèle
La documentation de la plateforme d'Anthropic donne l'identifiant claude-opus-5-5. Sur Amazon Bedrock, il s'agit de anthropic.claude-opus-5-5. Le modèle est disponible via l'API Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry et la Claude Platform sur AWS.
La fenêtre de contexte contient 1 million de jetons. C'est tout ce que le modèle peut lire et écrire dans une même conversation. Une seule réponse synchrone peut atteindre 128 000 jetons. Via l'API Batch, avec un en-tête bêta, ce plafond monte à 300 000 jetons.
La documentation indique une date de connaissance arrêtée à juin 2026. Elle précise aussi que le modèle ne sera pas retiré avant le 22 septembre 2027. Cette seconde date compte pour quiconque fige un identifiant de modèle dans du code de production.
Quatre changements qui peuvent casser du code en service
La documentation liste quatre différences avec Opus 5 qui ne sont pas rétrocompatibles.
- Le raisonnement étendu est toujours actif et ne peut pas être désactivé. Raisonner, c'est le modèle qui déroule un problème avant de répondre.
- L'usage forcé d'un outil renvoie désormais une erreur au lieu d'être accepté.
- Les blocs de raisonnement sont liés au modèle et à la conversation qui les a produits.
- L'ancienne version d'outil
computer_20251124n'est plus acceptée.
Le réglage d'effort par défaut est moyen. Sur Claude Fable 5.1, il est élevé. L'effort détermine à quel point le modèle travaille une réponse. Une invite inchangée peut donc se comporter autrement.
Ce que cela signifie pour les développeurs
Lisez ces quatre changements avant de remplacer un identifiant de modèle dans un service en production. Le raisonnement toujours actif est le piège. Le code qui passe un drapeau pour désactiver le raisonnement, ou qui déplace des blocs de raisonnement entre modèles, doit d'abord changer. Une baisse de prix ne vaut pas une panne.
Relancez vos propres évaluations plutôt que de vous fier à la comparaison avec Fable 5.1. L'affirmation d'Anthropic couvre la plupart des travaux, et votre charge de travail n'est pas la plupart des travaux. TechCrunch a rapporté que le modèle devance Fable sur de nombreux tests de réalisation de tâches informelles, et le situe près de Mythos en biologie et en cybersécurité. Ce sont de larges catégories, pas votre suite de tests.
Vérifiez l'effort par défaut si vous migrez depuis Fable 5.1. Passer d'élevé à moyen change le coût et la qualité des réponses en même temps. Une régression devient alors facile à mal interpréter.
Si le contexte répété domine votre facture, lisez les lignes de cache avant les lignes de jetons. Anthropic a fait un geste comparable sur les prix du cache de Claude Fable 5.1 plus tôt ce mois-ci. Les équipes qui envoient la même longue invite système à chaque appel ressentent un changement de cache plus qu'un changement de jeton.
Il existe une raison d'attendre. TechCrunch a rapporté que Sonnet 5.5 et Haiku 5.5 arrivent dans les semaines qui viennent. La plupart du trafic de production n'a pas besoin du plus gros modèle. Un palier moins cher pourrait donc mieux convenir à votre charge de travail avant la fin du mois.
Sources
- Anthropic releases Opus 5.5 with lower prices and Fable-level performance - TechCrunch
- Claude Opus 5.5 overview - Claude Platform Docs
- Anthropic newsroom - Anthropic
Articles liés

Jev, de TypeSafe, renvoie des décisions typées, pas du texte
Jev répond en 70 à 500 millisecondes et coûte 0,042 dollar par million de tokens d'entrée, sortie gratuite. Il ne sait pas produire de texte du tout.

GPT-6 Astra est en disponibilité générale sur Bedrock et dans Copilot
GPT-6 Astra est en disponibilité générale sur Amazon Bedrock à 10 dollars par million de tokens d'entrée, et dans GitHub Copilot pour les forfaits Pro+, Max, Business et Enterprise.

Claude Fable 5.1 réduit de 75% le coût des lectures de cache
Fable 5.1 maintient l'entrée et la sortie à 10 et 50 dollars par million de jetons, et fait passer la lecture de cache de 1,00 à 0,25 dollar. Mythos 5.1 reste sur invitation.