本文へスキップ

OpenAIのDecisions API、ベータ版ですべての開発者に公開

OpenAIのDecisions API(ディシジョンズAPI)がパブリックベータになりました。テキストの代わりに確率、選択、スコアを返します。GPT-6 Lunaで動き、料金は入力100万トークンあたり0.10ドルです。

著者 Tech AI Wire Team

3 分で読めます

OpenAIのDecisions APIのドキュメントのスクリーンショット。APIがパブリックベータであり、gpt-6-lunaで動くという告知が表示されている。

数字で見る

per 1M input tokens, with no output charge
$0.10
per request in OpenAI's demo, vs 1.6 s via the Responses API
~150 ms
answer types: predicate, choice and score
3
steps right in Every's preview test, vs 73 for Jev
76 of 78

AlphaSignalによると、OpenAIは2026年10月6日、Decisions APIをパブリックベータとしてすべての開発者に公開しました。このAPIはテキストを書きません。決まった質問に対して、確率、リストからの1つの選択、またはスコアで答えます。OpenAIによると、そのため、同じ質問をResponses APIで尋ねるより約10倍速くなります。サポートチケットの振り分けのように、何千もの小さな選択をするアプリにとっては、速度と価格こそが要点です。

Decisions APIの機能

多くのAIアプリは、大規模言語モデル、つまりLLMに、小さな判断を一日中させています。このメッセージはスパムか。このチケットはどのチームに回すべきか。モデルは答えをテキストとして一語ずつ書き、アプリがそれを読み取ります。

Decisions APIは、書く工程を省きます。送るのは、証拠と質問です。証拠はテキスト、画像、またはその両方にできます。すると、文章の代わりに型付きの答えが返ってきます。OpenAIのドキュメントには、3種類の回答タイプが載っています。

回答タイプ返ってくるもの
Predicateはい・いいえで答える質問に対する、0から1の間の確率
Choice指定した選択肢のうちの1つと、確率および確信度の値
Score順序のあるレベル全体にわたる、確率で重み付けしたスコアと確信度

呼び出しは、新しいエンドポイントPOST /v1/decisionsに送ります。ドキュメントによると、現在動くモデルはGPT-6 Lunaだけです。

料金、制限、提供状況

ドキュメントに載っている料金は、入力100万トークンあたり0.10ドルです。トークンとは、モデルが読むテキストの小さな断片です。出力、キャッシュの読み取り、キャッシュの書き込みには料金がかかりません。リージョン指定の処理や、非常に長い入力には追加料金がかかりますが、ページにはその料金が書かれていません。AlphaSignalは公開当日、Decisions専用の料金はまだ公開されていないと報じていました。そのため、この数字はその後に追加された可能性があります。

ドキュメントには、ほかにも次の詳細があります。

  • 状況: パブリックベータです。一般提供は「今後数週間のうちに」予定されています
  • 画像: base64のデータURLとしてインラインで送る必要があります。ホストされた画像へのリンクやファイルIDは使えません
  • データ: 米国と欧州のデータレジデンシーに対応します。対象となる顧客には、Zero Data RetentionとHIPAAへの対応もあります
  • SDK: Python 3.26.0、JavaScript 7.30.0、Go 3.73.0、Ruby 0.101.0、Java 4.78.0

レート制限、入力の最大サイズ、選択肢の最大数は明記されていません。

どれくらい速いのか

速度の主張は、OpenAI自身のデモに基づいています。デモでは、1万件の顧客リクエストをBilling(請求)、Technical(技術)、Sales(営業)の各チームに振り分けました。AlphaSignalによると、1件の判断にかかった時間は約150ミリ秒で、Responses APIを通した場合は1.6秒でした。OpenAIは、このテストの方法を公開していません。

メディアのEveryは、プレビュー期間中に初期のチェックを行いました。AlphaSignalによると、コンピューター操作タスクをオフラインで再現したテストで、Decisions APIは78ステップ中76ステップで正解しました。競合する判断サービスであるTypeSafeのJevは73ステップでした。メッセージのスレッドを仕分けるテストでは、両者の精度は同じで、Jevのほうが速くなりました。どちらのサンプルも小規模でした。

混み合う新しいカテゴリー

XenoSpectrumによると、OpenAIは9月29日に、このAPIを限定プレビューとして初めて公開しました。このAPIは、すでに競争の激しい分野に加わります。TypeSafeのJevは9月に登場し、回答1件あたり70から500ミリ秒をうたっています。Cloudflareはオープンウェイトの判断モデルClefで続き、AWSはStrands Decider 2Bを公開しました。

XenoSpectrumは、この発想は見た目ほど新しくないと論じています。Structured Outputsでも、すでにモデルに決まった選択肢から選ばせることができます。変わるのは、高速で繰り返される大量の呼び出し向けに作られた、独立したAPIがあるという点です。

開発者にとっての意味

  • 選択肢が決まっている呼び出しから移すこと。 ルーティング、スパムチェック、ガードレール、ツールの選択は、3つの回答タイプに合います。文章の作成と推論は、通常のモデルに任せてください。
  • 確率を関門として使うこと。 確信度の高い答えに基づいて動き、確信度の低い答えはより大きなモデルか人に回してください。
  • 自分でレイテンシを測ること。 150ミリ秒という数字はOpenAIのもので、方法は公開されていません。それを前提に何かを設計し直す前に、実際のトラフィックで時間を測ってください。
  • 予算は入力だけで考えること。 入力100万トークンあたり0.10ドルで出力は無料なので、費用は送る証拠の量で決まります。長いプロンプトを削り、画像を縮小してください。
  • 先に画像をエンコードすること。 ホストされた画像のURLは受け付けられないので、呼び出しの前にbase64に変換してください。
  • ベータ版として扱うこと。 一般提供までは、SDKのバージョンを固定し、代替の経路を残しておいてください。

まず、記録した1日分の判断をAPIで再生してみてください。次に、その答えを現在のモデルの選択と比べて、どれくらいの頻度で一致するかを確認してください。

出典

  1. Decisions API guide - OpenAI
  2. OpenAI's Decisions API Promises Routing Answers 10x Faster for Developers - AlphaSignal
  3. OpenAI Decisions API preview on GPT-6 Luna - XenoSpectrum

関連記事

Visual Studio CodeのGitHub Copilotモデル選択画面が開かれ、選択できるモデルの中にGPT-6 Astraが表示されている様子。
AI・LLM

GPT-6 Astra、Amazon BedrockとGitHub Copilotで一般提供に

GPT-6 AstraがAmazon Bedrock(ベッドロック)で100万入力トークンあたり10ドルで一般提供(GA)に。GitHub Copilot(コパイロット)ではPro+、Max、Business、Enterpriseの各プランで使えます。