OpenAI DevDay 2026 · Guía para desarrolladores

Deja que el software tome las pequeñas decisiones rápidamente.

OpenAI Decisions API se describe como una interfaz de baja latencia para elegir una respuesta dentro de un conjunto definido por el desarrollador. Está orientada a clasificación, routing y a la siguiente acción acotada de un agente, no a la generación de texto abierto.

Esta página resume la información del preview limitado publicada alrededor del DevDay 2026. El esquema público de la solicitud, los precios y las garantías de rendimiento pueden cambiar cuando se amplíe el acceso.

Resumen del preview
Preview limitado

Motor reportado

Variante de GPT-6 Luna

Velocidad reportada

~150 ms

Contexto

Texto + imágenes

Resultado

Una respuesta acotada

La cobertura describe un flujo de decisión especializado aproximadamente diez veces más rápido que una llamada normal a la API de GPT-6 Luna.

Estado de disponibilidad

OpenAI Decisions API todavía no está disponible

El servicio sigue en preview limitado y todavía no puede utilizarse desde la plataforma pública de OpenAI.

Estado actual · No disponible

En cuanto se abra, estará disponible primero en thejevai.

Para qué sirve

Una capa de decisión entre el contexto y la acción

Un modelo general puede explicar muchas posibilidades. Una API de decisiones resulta útil cuando tu aplicación ya conoce las ramas permitidas y necesita un resultado compacto que el código pueda consumir.

Clasificar el contexto recibido

Elige una etiqueta para una solicitud de soporte, un documento, un evento de moderación u otra entrada de texto o imagen.

Enrutar por el camino correcto

Envía una solicitud a billing, sales, un modelo especializado, una cola o una revisión humana sin analizar primero un párrafo.

Elegir el siguiente movimiento del agente

Usa una elección acotada para seleccionar una herramienta, un reintento, una escalada o la siguiente acción de un bucle de agente más grande.

Diferencias frente a una llamada LLM normal

El modelo debe elegir, no escribir.

Una solicitud de generación normal puede devolver un párrafo útil, pero después tu aplicación debe interpretarlo. Decisions API mueve el espacio de respuestas a la solicitud para hacer explícito el siguiente paso.

Forma del prompt

Generación general

Una instrucción abierta con espacio para explicaciones, alternativas y lenguaje libre.

Decisions API

Una pregunta acompañada de un conjunto finito de respuestas definido por el desarrollador.

Forma de salida

Generación general

Texto o contenido estructurado que todavía puede necesitar validación y parsing.

Decisions API

Una respuesta seleccionada y una confianza reportada para que la consuma la aplicación.

Trabajo de la aplicación

Generación general

Leer la respuesta, extraer la intención, manejar formulaciones inesperadas y decidir si es seguro actuar.

Decisions API

Mapear la respuesta a una rama conocida y aplicar comprobaciones de política deterministas.

Mejor encaje

Generación general

Planificación, explicación, síntesis, orquestación de herramientas y tareas cuyo resultado no se conoce de antemano.

Decisions API

Decisiones pequeñas y repetidas como enrutar, permitir, escalar, reintentar o elegir la siguiente herramienta.

Su lugar en el stack de OpenAI

Usa el contexto de Luna con cuidado.

La documentación pública de modelos de OpenAI ayuda a entender la plataforma que la rodea, pero el preview de Decisions API debe tratarse como una superficie de producto propia hasta que se publiquen su endpoint y sus reglas de facturación.

Luna es la capa de eficiencia

OpenAI posiciona GPT-6 Luna para cargas de trabajo focalizadas y de alto volumen. Eso la convierte en una base plausible para decisiones rápidas y repetidas, mientras Decisions API añade un contrato de respuestas acotado.

El contexto incluye texto e imágenes

La documentación actual de modelos de OpenAI describe entradas de texto e imagen para la familia GPT-6. Las publicaciones del preview también describen el contexto de Decisions API como texto o imagen.

No copies el precio estándar de Luna

La API normal de GPT-6 Luna aparece con un precio de 0,10 dólares por millón de tokens de entrada y 0,50 dólares por millón de tokens de salida. Es una referencia para llamadas estándar a Luna, no un precio publicado de Decisions API.

El límite del preview importa

El endpoint exacto, la superficie del SDK, los límites de respuestas, las cuotas, los errores y los controles de datos de Decisions API siguen siendo preguntas separadas. Encápsulalos tras una interfaz de provider pequeña.

Contexto del DevDay

OpenAI optimiza tanto al agente como sus decisiones.

Decisions API se anunció junto con un impulso más amplio para hacer más útil el trabajo de los agentes en producción: los agentes pueden operar software, el trabajo de seguridad puede continuar en la nube y la generación de tokens puede acelerarse para los equipos que pagan el nivel premium.

Agents API

Del razonamiento al Computer Use

Agents API añade Computer Use para que un agente opere software en lugar de limitarse a describir qué debería pulsar una persona. Así gana valor la pequeña decisión de routing previa a la acción.

Decisions API

Una rama rápida dentro del bucle

La nueva superficie de decisión gestiona la elección acotada—clasificar, enrutar o elegir la siguiente acción—mientras el agente principal sigue entendiendo la tarea.

Ultrafast

La latencia se convierte en un nivel de producto

OpenAI también anunció Ultrafast para aumentar la velocidad de generación de tokens con un precio premium. Decisions API aborda otro cuello de botella: elegir dentro de unos límites sin generar una respuesta larga.

Una arquitectura útil

Mantén abierto el razonamiento y acotada la ejecución.

Decisions API se entiende mejor como una puerta rápida dentro de una aplicación. Tu orquestador plantea la tarea; el código determinista sigue siendo dueño de los permisos y de las acciones de alto impacto.

01

Enmarcar la tarea

Usa un agente o un modelo general para entender la solicitud e identificar la pequeña decisión que hace falta a continuación.

02

Pasar el contexto relevante

Envía el estado de texto o imagen necesario para esa decisión en lugar de repetir toda la conversación o el historial de herramientas.

03

Hacer una pregunta acotada

Define las respuestas permitidas—enrutar, permitir, bloquear, puntuar o elegir la siguiente acción—y deja que el modelo seleccione una.

04

Aplicar la política en código

Aplica umbrales, permisos, límites de frecuencia y aprobación humana antes de que el resultado active una acción real.

El contrato

Entrada pequeña. Espacio de respuestas explícito.

Las descripciones públicas apuntan a una solicitud formada por contexto, una pregunta y una lista finita de respuestas aceptables. La respuesta está pensada para que la consuma directamente el código de la aplicación.

Se describe como compatible con contexto de texto e imagen. Los límites multimodales exactos y la forma estable del SDK todavía deben confirmarse en la documentación oficial del preview.

Solicitud conceptual
{
  "context": "I was charged twice and need a refund.",
  "question": "Which team should handle this?",
  "answers": ["billing", "technical", "other"]
}
Respuesta conceptual
{
  "answer": "billing",
  "confidence": 0.94
}

Los fragmentos son deliberadamente conceptuales. Ilustran el contrato de decisión descrito públicamente y no son un cuerpo de solicitud garantizado del SDK de OpenAI.

Antes de construir alrededor de ella

Las afirmaciones del preview son un punto de partida, no un contrato de producción.

El trabajo de ingeniería más importante es medir el límite alrededor del modelo: el esquema, la puntuación, los fallos y la política que decide qué ocurre después.

Verificar el esquema

Confirma el endpoint, el soporte del SDK, los límites de respuestas, el formato de errores y cómo se representan la abstención o las respuestas inválidas.

Esperar el precio

Las publicaciones del preview no incluían una lista pública de precios. Define una base de costes clara para las decisiones de routing antes del lanzamiento.

Probar la confianza

Una puntuación de confianza no es automáticamente una probabilidad calibrada. Compara los rangos de puntuación con resultados observados en datos etiquetados.

Planificar el cambio

El acceso limitado y un contrato en evolución requieren un feature flag, un camino de fallback y un límite de provider en el código.

Preguntas de los desarrolladores

¿Qué se sabe y qué sigue siendo un detalle del preview?

¿Puede usar Decisions API cualquier desarrollador ahora?+

No. Las publicaciones públicas describen un preview limitado por invitación, con una ampliación posterior. Trata el acceso y las cuotas como variables y conserva un fallback de provider hasta que estén documentados.

¿Existe un precio público para Decisions API?+

Los informes del preview no publicaron una lista de precios específica. Calcula el valor de la ruta de decisión rápida, pero no fijes una hipótesis de costes en el plan de producto antes del precio oficial.

¿Se puede usar el valor de confianza como probabilidad?+

No automáticamente. Los análisis públicos lo describen como un valor reportado por el modelo y no calibrado de forma independiente. Mide los rangos de puntuación frente a resultados etiquetados y usa umbrales, abstención o revisión humana para acciones importantes.

¿El JSON conceptual es un payload oficial del SDK?+

No. Solo muestra la idea pública—contexto, pregunta y respuestas permitidas—sin asumir que el cuerpo de la solicitud, los nombres de campos, los límites o los errores del preview sean estables.

¿Quieres probar hoy un modelo de decisiones?

Prototipa clasificación tipada, routing, scoring y comprobaciones de seguridad con Jev mientras evoluciona el preview de Decisions API.

Probar Jev