Zum Inhalt springen

Claude Opus 5.5 senkt den Ausgabepreis auf 20 Dollar pro Million

Anthropic hat Claude Opus 5.5 am 22. September 2026 veröffentlicht, zu 4 Dollar Eingabe und 20 Dollar Ausgabe pro Million Token, mit dauerhaft aktivem Nachdenken.

Von Tech AI Wire Team

3 Min. Lesezeit

XLinkedIn
The Claude Platform Docs page for Claude Opus 5.5, showing a 1M-token context window, 128K maximum output, and input and output prices of $4 and $20 per million tokens.

Die Zahlen

output price per million tokens, down from $25
$20
less to run than Opus 5, Anthropic says
40%
tokens in the context window
1M

Anthropic hat Claude Opus 5.5 am 22. September 2026 veröffentlicht. Das Modell kostet 4 Dollar pro Million Eingabe-Token und 20 Dollar pro Million Ausgabe-Token. Anthropics Newsroom schreibt, es "arbeitet bei den meisten Aufgaben auf dem Niveau von Claude Fable 5.1 und kostet im Betrieb 40 % weniger als Opus 5". Für Teams, die Coding-Agenten stundenlang laufen lassen, sind Ausgabe-Token der Posten auf der Rechnung, der wächst. Deshalb ist der Preis die Nachricht.

TechCrunch berichtete, dass der Ausgabepreis von 20 Dollar gegenüber 25 Dollar bei der Vorversion gesunken ist. TechCrunch schrieb außerdem, das Modell arbeite schneller und brauche dafür weniger Rechenleistung.

Was Opus 5.5 kostet

PostenPreis pro Million Token
Eingabe4 Dollar
Ausgabe20 Dollar
Cache-Schreiben, 5 Minuten5 Dollar
Cache-Schreiben, 1 Stunde8 Dollar
Cache-Lesen0,20 Dollar

Prompt-Caching speichert einen Teil einer Anfrage, damit er nicht jedes Mal vollständig gesendet und berechnet wird. Ein Cache-Lesevorgang kostet hier 0,20 Dollar pro Million Token. Die Batch-API zieht 50 % auf Eingabe und Ausgabe ab, im Tausch gegen langsamere Antworten.

Was die Modellkarte sagt

Anthropics Plattform-Dokumentation nennt als Modellkennung claude-opus-5-5. Auf Amazon Bedrock lautet sie anthropic.claude-opus-5-5. Das Modell ist über die Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry und die Claude Platform auf AWS verfügbar.

Das Kontextfenster fasst 1 Million Token. Das ist alles, was das Modell in einem Gespräch lesen und schreiben kann. Eine einzelne synchrone Antwort kann 128.000 Token erreichen. Über die Batch-API steigt diese Grenze mit einem Beta-Header auf 300.000 Token.

Die Dokumentation nennt einen Wissensstand von Juni 2026. Sie sagt außerdem, das Modell werde nicht vor dem 22. September 2027 abgeschaltet. Dieses zweite Datum zählt für alle, die eine Modellkennung im Produktivcode festschreiben.

Vier Änderungen, die funktionierenden Code brechen können

Die Dokumentation nennt vier Unterschiede zu Opus 5, die nicht abwärtskompatibel sind.

  • Erweitertes Nachdenken ist immer an und lässt sich nicht abschalten. Nachdenken heißt: Das Modell arbeitet ein Problem durch, bevor es antwortet.
  • Erzwungene Werkzeugnutzung gibt jetzt einen Fehler zurück, statt akzeptiert zu werden.
  • Denkblöcke sind an das Modell und das Gespräch gebunden, die sie erzeugt haben.
  • Die frühere Werkzeugversion computer_20251124 wird nicht mehr akzeptiert.

Die Voreinstellung für den Aufwand ist mittel. Bei Claude Fable 5.1 ist sie hoch. Der Aufwand steuert, wie hart das Modell an einer Antwort arbeitet. Ein unveränderter Prompt kann sich also anders verhalten.

Was das für Entwickler bedeutet

Lesen Sie diese vier Änderungen, bevor Sie eine Modellkennung in einem laufenden Dienst austauschen. Das dauerhaft aktive Nachdenken ist die Falle. Code, der ein Flag zum Abschalten des Nachdenkens übergibt oder Denkblöcke zwischen Modellen verschiebt, muss zuerst geändert werden. Eine Preissenkung ist keinen Ausfall wert.

Führen Sie Ihre eigenen Auswertungen erneut aus, statt dem Vergleich mit Fable 5.1 zu vertrauen. Anthropics Aussage deckt die meisten Aufgaben ab, und Ihre Arbeitslast ist nicht die meisten Aufgaben. TechCrunch berichtete, das Modell habe Fable in vielen Benchmarks zur Erledigung informeller Aufgaben übertroffen und liege bei Biologie und Cybersicherheit nahe an Mythos. Das sind breite Kategorien, nicht Ihre Testsuite.

Prüfen Sie die Aufwands-Voreinstellung, wenn Sie von Fable 5.1 wechseln. Der Schritt von hoch auf mittel ändert Kosten und Antwortqualität zugleich. Das macht eine Verschlechterung leicht misszuverstehen.

Wenn wiederholter Kontext Ihre Rechnung dominiert, lesen Sie die Cache-Zeilen vor den Token-Zeilen. Anthropic hat einen ähnlichen Schritt bei den Cache-Preisen für Claude Fable 5.1 Anfang des Monats gemacht. Teams, die bei jedem Aufruf denselben langen Systemprompt senden, spüren eine Cache-Änderung stärker als eine Token-Änderung.

Es gibt einen Grund zu warten. TechCrunch berichtete, Sonnet 5.5 und Haiku 5.5 seien in den kommenden Wochen fällig. Der meiste Produktivverkehr braucht nicht das größte Modell. Eine günstigere Stufe könnte also noch in diesem Monat besser zu Ihrer Arbeitslast passen.

Quellen

  1. Anthropic releases Opus 5.5 with lower prices and Fable-level performance - TechCrunch
  2. Claude Opus 5.5 overview - Claude Platform Docs
  3. Anthropic newsroom - Anthropic

Ähnliche Artikel