OpenAIのDecisions API、ベータ版ですべての開発者に公開
OpenAIのDecisions API(ディシジョンズAPI)がパブリックベータになりました。テキストの代わりに確率、選択、スコアを返します。GPT-6 Lunaで動き、料金は入力100万トークンあたり0.10ドルです。
3 分で読めます

数字で見る
- per 1M input tokens, with no output charge
- $0.10
- per request in OpenAI's demo, vs 1.6 s via the Responses API
- ~150 ms
- answer types: predicate, choice and score
- 3
- steps right in Every's preview test, vs 73 for Jev
- 76 of 78
AlphaSignalによると、OpenAIは2026年10月6日、Decisions APIをパブリックベータとしてすべての開発者に公開しました。このAPIはテキストを書きません。決まった質問に対して、確率、リストからの1つの選択、またはスコアで答えます。OpenAIによると、そのため、同じ質問をResponses APIで尋ねるより約10倍速くなります。サポートチケットの振り分けのように、何千もの小さな選択をするアプリにとっては、速度と価格こそが要点です。
Decisions APIの機能
多くのAIアプリは、大規模言語モデル、つまりLLMに、小さな判断を一日中させています。このメッセージはスパムか。このチケットはどのチームに回すべきか。モデルは答えをテキストとして一語ずつ書き、アプリがそれを読み取ります。
Decisions APIは、書く工程を省きます。送るのは、証拠と質問です。証拠はテキスト、画像、またはその両方にできます。すると、文章の代わりに型付きの答えが返ってきます。OpenAIのドキュメントには、3種類の回答タイプが載っています。
| 回答タイプ | 返ってくるもの |
|---|---|
| Predicate | はい・いいえで答える質問に対する、0から1の間の確率 |
| Choice | 指定した選択肢のうちの1つと、確率および確信度の値 |
| Score | 順序のあるレベル全体にわたる、確率で重み付けしたスコアと確信度 |
呼び出しは、新しいエンドポイントPOST /v1/decisionsに送ります。ドキュメントによると、現在動くモデルはGPT-6 Lunaだけです。
料金、制限、提供状況
ドキュメントに載っている料金は、入力100万トークンあたり0.10ドルです。トークンとは、モデルが読むテキストの小さな断片です。出力、キャッシュの読み取り、キャッシュの書き込みには料金がかかりません。リージョン指定の処理や、非常に長い入力には追加料金がかかりますが、ページにはその料金が書かれていません。AlphaSignalは公開当日、Decisions専用の料金はまだ公開されていないと報じていました。そのため、この数字はその後に追加された可能性があります。
ドキュメントには、ほかにも次の詳細があります。
- 状況: パブリックベータです。一般提供は「今後数週間のうちに」予定されています
- 画像: base64のデータURLとしてインラインで送る必要があります。ホストされた画像へのリンクやファイルIDは使えません
- データ: 米国と欧州のデータレジデンシーに対応します。対象となる顧客には、Zero Data RetentionとHIPAAへの対応もあります
- SDK: Python 3.26.0、JavaScript 7.30.0、Go 3.73.0、Ruby 0.101.0、Java 4.78.0
レート制限、入力の最大サイズ、選択肢の最大数は明記されていません。
どれくらい速いのか
速度の主張は、OpenAI自身のデモに基づいています。デモでは、1万件の顧客リクエストをBilling(請求)、Technical(技術)、Sales(営業)の各チームに振り分けました。AlphaSignalによると、1件の判断にかかった時間は約150ミリ秒で、Responses APIを通した場合は1.6秒でした。OpenAIは、このテストの方法を公開していません。
メディアのEveryは、プレビュー期間中に初期のチェックを行いました。AlphaSignalによると、コンピューター操作タスクをオフラインで再現したテストで、Decisions APIは78ステップ中76ステップで正解しました。競合する判断サービスであるTypeSafeのJevは73ステップでした。メッセージのスレッドを仕分けるテストでは、両者の精度は同じで、Jevのほうが速くなりました。どちらのサンプルも小規模でした。
混み合う新しいカテゴリー
XenoSpectrumによると、OpenAIは9月29日に、このAPIを限定プレビューとして初めて公開しました。このAPIは、すでに競争の激しい分野に加わります。TypeSafeのJevは9月に登場し、回答1件あたり70から500ミリ秒をうたっています。Cloudflareはオープンウェイトの判断モデルClefで続き、AWSはStrands Decider 2Bを公開しました。
XenoSpectrumは、この発想は見た目ほど新しくないと論じています。Structured Outputsでも、すでにモデルに決まった選択肢から選ばせることができます。変わるのは、高速で繰り返される大量の呼び出し向けに作られた、独立したAPIがあるという点です。
開発者にとっての意味
- 選択肢が決まっている呼び出しから移すこと。 ルーティング、スパムチェック、ガードレール、ツールの選択は、3つの回答タイプに合います。文章の作成と推論は、通常のモデルに任せてください。
- 確率を関門として使うこと。 確信度の高い答えに基づいて動き、確信度の低い答えはより大きなモデルか人に回してください。
- 自分でレイテンシを測ること。 150ミリ秒という数字はOpenAIのもので、方法は公開されていません。それを前提に何かを設計し直す前に、実際のトラフィックで時間を測ってください。
- 予算は入力だけで考えること。 入力100万トークンあたり0.10ドルで出力は無料なので、費用は送る証拠の量で決まります。長いプロンプトを削り、画像を縮小してください。
- 先に画像をエンコードすること。 ホストされた画像のURLは受け付けられないので、呼び出しの前にbase64に変換してください。
- ベータ版として扱うこと。 一般提供までは、SDKのバージョンを固定し、代替の経路を残しておいてください。
まず、記録した1日分の判断をAPIで再生してみてください。次に、その答えを現在のモデルの選択と比べて、どれくらいの頻度で一致するかを確認してください。
出典
- Decisions API guide - OpenAI
- OpenAI's Decisions API Promises Routing Answers 10x Faster for Developers - AlphaSignal
- OpenAI Decisions API preview on GPT-6 Luna - XenoSpectrum
関連記事

OpenAI Agents API、ホスト型ブラウザーでのコンピューター操作に対応
9月10日からパブリックベータのOpenAIのAgents API(エージェントAPI)は、2026年9月29日のDevDayでコンピューター操作に対応し、OpenAIがホストするブラウザーをエージェントが操作できるようになりました。

GPT-6 Astra、Amazon BedrockとGitHub Copilotで一般提供に
GPT-6 AstraがAmazon Bedrock(ベッドロック)で100万入力トークンあたり10ドルで一般提供(GA)に。GitHub Copilot(コパイロット)ではPro+、Max、Business、Enterpriseの各プランで使えます。

OpenAIのモデルで動くAmazon Bedrock Managed Agentsがプレビュー開始
AWSは2026年9月29日、Bedrock(ベッドロック)Managed Agentsのパブリックプレビューを開始しました。OpenAIのモデルで動くエージェントが、米国の3リージョンで、自社のAWSアカウント内で動作します。