Zum Inhalt springen

OpenAI Decisions API öffnet sich in der Beta für alle Entwickler

OpenAIs Decisions API ist jetzt in der öffentlichen Beta. Sie liefert statt Text eine Wahrscheinlichkeit, eine Auswahl oder einen Score, läuft auf GPT-6 Luna und kostet 0,10 US-Dollar pro 1 Mio. Input-Tokens.

Von Tech AI Wire Team

3 Min. Lesezeit

XLinkedIn
Screenshot der Dokumentation zu OpenAIs Decisions API mit einem Hinweis, dass die API in der öffentlichen Beta ist und auf gpt-6-luna läuft.

Die Zahlen

per 1M input tokens, with no output charge
$0.10
per request in OpenAI's demo, vs 1.6 s via the Responses API
~150 ms
answer types: predicate, choice and score
3
steps right in Every's preview test, vs 73 for Jev
76 of 78

OpenAI hat seine Decisions API am 6. Oktober 2026 als öffentliche Beta für alle Entwickler geöffnet, berichtet AlphaSignal. Die API schreibt keinen Text. Sie beantwortet eine feste Frage mit einer Wahrscheinlichkeit, einer Auswahl aus einer Liste oder einem Score. Laut OpenAI ist sie dadurch etwa zehnmal schneller, als wenn man dieselbe Frage über die Responses API stellt. Für Apps, die Tausende kleiner Entscheidungen treffen, etwa beim Routing von Support-Tickets, sind Geschwindigkeit und Preis der eigentliche Punkt.

Was die Decisions API tut

Die meisten KI-Apps lassen ein großes Sprachmodell, kurz LLM, den ganzen Tag kleine Entscheidungen treffen. Ist diese Nachricht Spam? Welches Team soll dieses Ticket bekommen? Das Modell schreibt seine Antwort als Text, Wort für Wort, und die App liest sie anschließend wieder ein.

Die Decisions API überspringt das Schreiben. Man schickt ihr Belege, die aus Text, Bildern oder beidem bestehen können, dazu eine Frage. Sie gibt statt Fließtext eine typisierte Antwort zurück. OpenAIs Dokumentation nennt drei Antworttypen:

AntworttypWas zurückkommt
PredicateEine Wahrscheinlichkeit zwischen 0 und 1, für Ja-Nein-Fragen
ChoiceEine der vorgegebenen Optionen, mit Wahrscheinlichkeiten und einem Konfidenzwert
ScoreEin wahrscheinlichkeitsgewichteter Score über geordnete Stufen, mit Konfidenz

Aufrufe gehen an einen neuen Endpunkt, POST /v1/decisions. Laut der Dokumentation ist GPT-6 Luna derzeit das einzige Modell, das dort läuft.

Preis, Limits und Verfügbarkeit

Die Dokumentation nennt einen Preis von 0,10 US-Dollar pro 1 Million Input-Tokens. Tokens sind die kleinen Textstücke, die ein Modell liest. Für Output, Cache-Lesezugriffe und Cache-Schreibzugriffe fallen keine Kosten an. Regionale Verarbeitung und sehr lange Eingaben kosten extra, die Seite nennt dafür aber keine Preise. AlphaSignal berichtete am Starttag, dass noch keine eigenen Preise für Decisions veröffentlicht waren. Die Angabe könnte also seitdem ergänzt worden sein.

Weitere Details aus der Dokumentation:

  • Status: öffentliche Beta, die allgemeine Verfügbarkeit wird „in den kommenden Wochen“ erwartet
  • Bilder: müssen inline als base64-Data-URLs gesendet werden; Links zu gehosteten Bildern und Datei-IDs funktionieren nicht
  • Daten: Datenresidenz in den USA und in Europa, dazu Zero Data Retention und HIPAA-Unterstützung für berechtigte Kunden
  • SDKs: Python 3.26.0, JavaScript 7.30.0, Go 3.73.0, Ruby 0.101.0 und Java 4.78.0

Rate-Limits, die maximale Eingabegröße und die maximale Zahl an Optionen sind nicht angegeben.

Wie schnell ist sie?

Die Angabe zur Geschwindigkeit stammt aus OpenAIs eigener Demo. Sie verteilte 10.000 Kundenanfragen auf die Teams Abrechnung, Technik und Vertrieb. Jede Entscheidung dauerte etwa 150 Millisekunden, gegenüber 1,6 Sekunden über die Responses API, berichtet AlphaSignal. OpenAI hat keine Methodik für diesen Test veröffentlicht.

Die Publikation Every führte während der Vorschau erste Tests durch. In einer Offline-Wiederholung einer Computer-Use-Aufgabe lag die Decisions API bei 76 von 78 Schritten richtig, berichtet AlphaSignal. TypeSafes Jev, ein konkurrierender Entscheidungsdienst, kam auf 73. Beim Sortieren von Nachrichten-Threads lagen beide bei der Genauigkeit gleichauf, und Jev war schneller. Beide Stichproben waren klein.

Eine dicht besetzte neue Kategorie

OpenAI zeigte die API erstmals am 29. September als begrenzte Vorschau, berichtet XenoSpectrum. Sie kommt in ein dicht besetztes Feld. TypeSafes Jev startete im September und verspricht 70 bis 500 Millisekunden pro Antwort. Cloudflare folgte mit Clef, Entscheidungsmodellen mit offenen Gewichten, und AWS veröffentlichte Strands Decider 2B.

XenoSpectrum argumentiert, die Idee sei weniger neu, als sie aussehe. Structured Outputs können ein Modell schon heute zwingen, aus festen Optionen zu wählen. Neu ist eine eigene API, die für viele schnelle, wiederholte Aufrufe gebaut ist.

Was das für Entwickler bedeutet

  • Verlagern Sie zuerst Ihre Aufrufe mit festen Auswahlmöglichkeiten. Routing, Spam-Prüfungen, Guardrails und Werkzeugwahl passen zu den drei Antworttypen. Schreiben und Schlussfolgern überlassen Sie einem normalen Modell.
  • Nutzen Sie die Wahrscheinlichkeit als Schranke. Handeln Sie nach Antworten mit hoher Konfidenz und geben Sie solche mit niedriger Konfidenz an ein größeres Modell oder einen Menschen weiter.
  • Führen Sie Ihren eigenen Latenztest durch. Die 150 ms stammen von OpenAI, ohne veröffentlichte Methodik. Messen Sie mit Ihrem echten Traffic, bevor Sie etwas darum herum neu entwerfen.
  • Planen Sie das Budget nur nach Input. Bei 0,10 US-Dollar pro Million Input-Tokens und ohne Kosten für Output hängen die Kosten davon ab, wie viele Belege Sie mitschicken. Kürzen Sie lange Prompts und verkleinern Sie Bilder.
  • Kodieren Sie Bilder vorab. Gehostete Bild-URLs werden abgelehnt, wandeln Sie sie also vor dem Aufruf in base64 um.
  • Behandeln Sie es als Beta. Fixieren Sie Ihre SDK-Version und halten Sie einen Ausweichpfad bereit, bis die allgemeine Verfügbarkeit erreicht ist.

Spielen Sie zunächst einen Tag protokollierter Entscheidungen über die API ab. Vergleichen Sie dann ihre Antworten mit der Wahl Ihres aktuellen Modells und prüfen Sie, wie oft sie übereinstimmen.

Quellen

  1. Decisions API guide - OpenAI
  2. OpenAI's Decisions API Promises Routing Answers 10x Faster for Developers - AlphaSignal
  3. OpenAI Decisions API preview on GPT-6 Luna - XenoSpectrum

Ähnliche Artikel