OpenAI DevDay 2026 · Guía para desarrolladores
Deja que el software tome las pequeñas decisiones rápidamente.
OpenAI Decisions API se describe como una interfaz de baja latencia para elegir una respuesta dentro de un conjunto definido por el desarrollador. Está orientada a clasificación, routing y a la siguiente acción acotada de un agente, no a la generación de texto abierto.
Esta página resume la información del preview limitado publicada alrededor del DevDay 2026. El esquema público de la solicitud, los precios y las garantías de rendimiento pueden cambiar cuando se amplíe el acceso.
Motor reportado
Variante de GPT-6 Luna
Velocidad reportada
~150 ms
Contexto
Texto + imágenes
Resultado
Una respuesta acotada
La cobertura describe un flujo de decisión especializado aproximadamente diez veces más rápido que una llamada normal a la API de GPT-6 Luna.
Estado de disponibilidad
OpenAI Decisions API todavía no está disponible
El servicio sigue en preview limitado y todavía no puede utilizarse desde la plataforma pública de OpenAI.
En cuanto se abra, estará disponible primero en thejevai.
Para qué sirve
Una capa de decisión entre el contexto y la acción
Un modelo general puede explicar muchas posibilidades. Una API de decisiones resulta útil cuando tu aplicación ya conoce las ramas permitidas y necesita un resultado compacto que el código pueda consumir.
Clasificar el contexto recibido
Elige una etiqueta para una solicitud de soporte, un documento, un evento de moderación u otra entrada de texto o imagen.
Enrutar por el camino correcto
Envía una solicitud a billing, sales, un modelo especializado, una cola o una revisión humana sin analizar primero un párrafo.
Elegir el siguiente movimiento del agente
Usa una elección acotada para seleccionar una herramienta, un reintento, una escalada o la siguiente acción de un bucle de agente más grande.
Diferencias frente a una llamada LLM normal
El modelo debe elegir, no escribir.
Una solicitud de generación normal puede devolver un párrafo útil, pero después tu aplicación debe interpretarlo. Decisions API mueve el espacio de respuestas a la solicitud para hacer explícito el siguiente paso.
Forma del prompt
Una instrucción abierta con espacio para explicaciones, alternativas y lenguaje libre.
Una pregunta acompañada de un conjunto finito de respuestas definido por el desarrollador.
Forma de salida
Texto o contenido estructurado que todavía puede necesitar validación y parsing.
Una respuesta seleccionada y una confianza reportada para que la consuma la aplicación.
Trabajo de la aplicación
Leer la respuesta, extraer la intención, manejar formulaciones inesperadas y decidir si es seguro actuar.
Mapear la respuesta a una rama conocida y aplicar comprobaciones de política deterministas.
Mejor encaje
Planificación, explicación, síntesis, orquestación de herramientas y tareas cuyo resultado no se conoce de antemano.
Decisiones pequeñas y repetidas como enrutar, permitir, escalar, reintentar o elegir la siguiente herramienta.
Su lugar en el stack de OpenAI
Usa el contexto de Luna con cuidado.
La documentación pública de modelos de OpenAI ayuda a entender la plataforma que la rodea, pero el preview de Decisions API debe tratarse como una superficie de producto propia hasta que se publiquen su endpoint y sus reglas de facturación.
Luna es la capa de eficiencia
OpenAI posiciona GPT-6 Luna para cargas de trabajo focalizadas y de alto volumen. Eso la convierte en una base plausible para decisiones rápidas y repetidas, mientras Decisions API añade un contrato de respuestas acotado.
El contexto incluye texto e imágenes
La documentación actual de modelos de OpenAI describe entradas de texto e imagen para la familia GPT-6. Las publicaciones del preview también describen el contexto de Decisions API como texto o imagen.
No copies el precio estándar de Luna
La API normal de GPT-6 Luna aparece con un precio de 0,10 dólares por millón de tokens de entrada y 0,50 dólares por millón de tokens de salida. Es una referencia para llamadas estándar a Luna, no un precio publicado de Decisions API.
El límite del preview importa
El endpoint exacto, la superficie del SDK, los límites de respuestas, las cuotas, los errores y los controles de datos de Decisions API siguen siendo preguntas separadas. Encápsulalos tras una interfaz de provider pequeña.
Contexto del DevDay
OpenAI optimiza tanto al agente como sus decisiones.
Decisions API se anunció junto con un impulso más amplio para hacer más útil el trabajo de los agentes en producción: los agentes pueden operar software, el trabajo de seguridad puede continuar en la nube y la generación de tokens puede acelerarse para los equipos que pagan el nivel premium.
Agents API
Del razonamiento al Computer Use
Agents API añade Computer Use para que un agente opere software en lugar de limitarse a describir qué debería pulsar una persona. Así gana valor la pequeña decisión de routing previa a la acción.
Decisions API
Una rama rápida dentro del bucle
La nueva superficie de decisión gestiona la elección acotada—clasificar, enrutar o elegir la siguiente acción—mientras el agente principal sigue entendiendo la tarea.
Ultrafast
La latencia se convierte en un nivel de producto
OpenAI también anunció Ultrafast para aumentar la velocidad de generación de tokens con un precio premium. Decisions API aborda otro cuello de botella: elegir dentro de unos límites sin generar una respuesta larga.
Una arquitectura útil
Mantén abierto el razonamiento y acotada la ejecución.
Decisions API se entiende mejor como una puerta rápida dentro de una aplicación. Tu orquestador plantea la tarea; el código determinista sigue siendo dueño de los permisos y de las acciones de alto impacto.
Enmarcar la tarea
Usa un agente o un modelo general para entender la solicitud e identificar la pequeña decisión que hace falta a continuación.
Pasar el contexto relevante
Envía el estado de texto o imagen necesario para esa decisión en lugar de repetir toda la conversación o el historial de herramientas.
Hacer una pregunta acotada
Define las respuestas permitidas—enrutar, permitir, bloquear, puntuar o elegir la siguiente acción—y deja que el modelo seleccione una.
Aplicar la política en código
Aplica umbrales, permisos, límites de frecuencia y aprobación humana antes de que el resultado active una acción real.
El contrato
Entrada pequeña. Espacio de respuestas explícito.
Las descripciones públicas apuntan a una solicitud formada por contexto, una pregunta y una lista finita de respuestas aceptables. La respuesta está pensada para que la consuma directamente el código de la aplicación.
Se describe como compatible con contexto de texto e imagen. Los límites multimodales exactos y la forma estable del SDK todavía deben confirmarse en la documentación oficial del preview.
{
"context": "I was charged twice and need a refund.",
"question": "Which team should handle this?",
"answers": ["billing", "technical", "other"]
}{
"answer": "billing",
"confidence": 0.94
}Los fragmentos son deliberadamente conceptuales. Ilustran el contrato de decisión descrito públicamente y no son un cuerpo de solicitud garantizado del SDK de OpenAI.
Antes de construir alrededor de ella
Las afirmaciones del preview son un punto de partida, no un contrato de producción.
El trabajo de ingeniería más importante es medir el límite alrededor del modelo: el esquema, la puntuación, los fallos y la política que decide qué ocurre después.
Verificar el esquema
Confirma el endpoint, el soporte del SDK, los límites de respuestas, el formato de errores y cómo se representan la abstención o las respuestas inválidas.
Esperar el precio
Las publicaciones del preview no incluían una lista pública de precios. Define una base de costes clara para las decisiones de routing antes del lanzamiento.
Probar la confianza
Una puntuación de confianza no es automáticamente una probabilidad calibrada. Compara los rangos de puntuación con resultados observados en datos etiquetados.
Planificar el cambio
El acceso limitado y un contrato en evolución requieren un feature flag, un camino de fallback y un límite de provider en el código.
Preguntas de los desarrolladores
¿Qué se sabe y qué sigue siendo un detalle del preview?
¿Puede usar Decisions API cualquier desarrollador ahora?+
No. Las publicaciones públicas describen un preview limitado por invitación, con una ampliación posterior. Trata el acceso y las cuotas como variables y conserva un fallback de provider hasta que estén documentados.
¿Existe un precio público para Decisions API?+
Los informes del preview no publicaron una lista de precios específica. Calcula el valor de la ruta de decisión rápida, pero no fijes una hipótesis de costes en el plan de producto antes del precio oficial.
¿Se puede usar el valor de confianza como probabilidad?+
No automáticamente. Los análisis públicos lo describen como un valor reportado por el modelo y no calibrado de forma independiente. Mide los rangos de puntuación frente a resultados etiquetados y usa umbrales, abstención o revisión humana para acciones importantes.
¿El JSON conceptual es un payload oficial del SDK?+
No. Solo muestra la idea pública—contexto, pregunta y respuestas permitidas—sin asumir que el cuerpo de la solicitud, los nombres de campos, los límites o los errores del preview sean estables.
¿Quieres probar hoy un modelo de decisiones?
Prototipa clasificación tipada, routing, scoring y comprobaciones de seguridad con Jev mientras evoluciona el preview de Decisions API.