Saltar al contenido

La Decisions API de OpenAI se abre en beta a todos los desarrolladores

La Decisions API de OpenAI ya está en beta pública. Devuelve una probabilidad, una elección o una puntuación en lugar de texto, funciona con GPT-6 Luna y cuesta 0,10 dólares por 1 millón de tokens de entrada.

Por Tech AI Wire Team

3 min de lectura

XLinkedIn
Captura de pantalla de la documentación de la Decisions API de OpenAI, con un aviso de que la API está en beta pública y funciona con gpt-6-luna.

En cifras

per 1M input tokens, with no output charge
$0.10
per request in OpenAI's demo, vs 1.6 s via the Responses API
~150 ms
answer types: predicate, choice and score
3
steps right in Every's preview test, vs 73 for Jev
76 of 78

OpenAI abrió su Decisions API a todos los desarrolladores como beta pública el 6 de octubre de 2026, según AlphaSignal. La API no escribe texto. Responde a una pregunta fija con una probabilidad, una elección de una lista o una puntuación. OpenAI dice que eso la hace unas 10 veces más rápida que hacer la misma pregunta a través de su Responses API. Para las aplicaciones que toman miles de pequeñas decisiones, como enrutar tickets de soporte, la velocidad y el precio son lo esencial.

Qué hace la Decisions API

La mayoría de las aplicaciones de IA piden a un modelo de lenguaje grande, o LLM, que tome pequeñas decisiones todo el día. ¿Este mensaje es spam? ¿Qué equipo debe recibir este ticket? El modelo escribe su respuesta como texto, palabra a palabra, y luego la aplicación la lee.

La Decisions API se salta la escritura. Se le envían pruebas, que pueden ser texto, imágenes o ambas cosas, junto con una pregunta. Devuelve una respuesta tipada en lugar de prosa. La documentación de OpenAI enumera tres tipos de respuesta:

Tipo de respuestaQué se recibe
Predicate (predicado)Una probabilidad entre 0 y 1, para preguntas de sí o no
Choice (elección)Una de las opciones suministradas, con probabilidades y un valor de confianza
Score (puntuación)Una puntuación ponderada por probabilidad en niveles ordenados, con confianza

Las llamadas van a un nuevo endpoint, POST /v1/decisions. El único modelo con el que funciona hoy es GPT-6 Luna, dice la documentación.

Precio, límites y disponibilidad

La documentación indica un precio de 0,10 dólares por 1 millón de tokens de entrada. Los tokens son los pequeños fragmentos de texto que lee un modelo. No se cobra la salida, ni las lecturas ni las escrituras de caché. El procesamiento regional y las entradas muy largas cuestan más, aunque la página no da esas tarifas. AlphaSignal informó el día del lanzamiento de que aún no se había publicado un precio específico para Decisions, así que la cifra puede haberse añadido después.

Otros detalles de la documentación:

  • Estado: beta pública, con disponibilidad general prevista «en las próximas semanas»
  • Imágenes: deben enviarse en línea como data URL en base64; los enlaces a imágenes alojadas y los ID de archivo no funcionan
  • Datos: residencia de datos en EE. UU. y Europa, además de Zero Data Retention y compatibilidad con HIPAA para los clientes que cumplan los requisitos
  • SDK: Python 3.26.0, JavaScript 7.30.0, Go 3.73.0, Ruby 0.101.0 y Java 4.78.0

No se indican los límites de uso, el tamaño máximo de entrada ni el número máximo de opciones.

¿Qué velocidad tiene?

La afirmación sobre la velocidad procede de una demostración de la propia OpenAI. Enrutó 10 000 solicitudes de clientes entre los equipos de Facturación, Soporte técnico y Ventas. Cada decisión tardó unos 150 milisegundos, frente a 1,6 segundos con la Responses API, informa AlphaSignal. OpenAI no ha publicado ningún método para esa prueba.

La publicación Every hizo comprobaciones tempranas durante la versión preliminar. En una reproducción sin conexión de una tarea de uso del ordenador, la Decisions API acertó 76 de 78 pasos, informa AlphaSignal. Jev, de TypeSafe, un servicio de decisión rival, acertó 73. Al clasificar hilos de mensajes, los dos empataron en precisión y Jev fue más rápido. Ambas muestras eran pequeñas.

Una categoría nueva y concurrida

OpenAI mostró la API por primera vez como versión preliminar limitada el 29 de septiembre, informa XenoSpectrum. Llega a un campo muy activo. Jev, de TypeSafe, se lanzó en septiembre y afirma tardar entre 70 y 500 milisegundos por respuesta. Cloudflare siguió con Clef, modelos de pesos abiertos para decisiones, y AWS lanzó Strands Decider 2B.

XenoSpectrum sostiene que la idea es menos nueva de lo que parece. Structured Outputs ya puede obligar a un modelo a elegir entre opciones fijas. Lo que cambia es una API independiente creada para muchas llamadas rápidas y repetidas.

Qué significa para los desarrolladores

  • Traslade primero sus llamadas de opción fija. El enrutamiento, la detección de spam, las barreras de seguridad y la elección de herramientas encajan en los tres tipos de respuesta. Deje la escritura y el razonamiento a un modelo normal.
  • Use la probabilidad como filtro. Actúe según las respuestas de alta confianza y envíe las de baja confianza a un modelo mayor o a una persona.
  • Haga su propia prueba de latencia. La cifra de 150 ms es de OpenAI, sin método publicado. Mídala con su tráfico real antes de rediseñar nada en torno a ella.
  • Presupueste solo la entrada. A 0,10 dólares por millón de tokens de entrada y sin coste de salida, el gasto depende de cuántas pruebas envíe. Recorte las instrucciones largas y reduzca el tamaño de las imágenes.
  • Codifique primero las imágenes. Las URL de imágenes alojadas se rechazan, así que conviértalas a base64 antes de la llamada.
  • Trátela como una beta. Fije la versión de su SDK y mantenga una ruta alternativa hasta la disponibilidad general.

Empiece por reproducir a través de la API un día de decisiones registradas. Después compare sus respuestas con lo que eligió su modelo actual y compruebe con qué frecuencia coinciden.

Fuentes

  1. Decisions API guide - OpenAI
  2. OpenAI's Decisions API Promises Routing Answers 10x Faster for Developers - AlphaSignal
  3. OpenAI Decisions API preview on GPT-6 Luna - XenoSpectrum

Artículos relacionados