OpenAI DevDay 2026 · Entwicklerleitfaden

Software soll kleine Entscheidungen schnell treffen.

Die OpenAI Decisions API wird als latenzarmes Interface beschrieben, das eine Antwort aus einer vom Entwickler definierten Menge auswählt. Sie zielt auf Klassifikation, Routing und den nächsten begrenzten Schritt eines Agent-Workflows – nicht auf freie Textgenerierung.

Diese Seite fasst die Informationen zur begrenzten Preview rund um den DevDay 2026 zusammen. Das öffentliche Request-Schema, Preise und Leistungsgarantien können sich mit der Erweiterung des Zugangs ändern.

Preview-Snapshot
Begrenzte Preview

Gemeldete Engine

GPT-6-Luna-Variante

Gemeldete Geschwindigkeit

ca. 150 ms

Kontext

Text + Bilder

Ergebnis

Eine begrenzte Antwort

Die Berichterstattung beschreibt einen spezialisierten Entscheidungspfad, der ungefähr zehnmal schneller als ein regulärer GPT-6-Luna-API-Aufruf sein soll.

Verfügbarkeitsstatus

Die OpenAI Decisions API ist noch nicht verfügbar

Der Dienst befindet sich weiterhin in einer begrenzten Preview und kann noch nicht über die öffentliche OpenAI-Plattform genutzt werden.

Aktueller Status · Nicht verfügbar

Sobald sie geöffnet wird, ist sie zuerst auf thejevai verfügbar.

Wofür sie gedacht ist

Eine Entscheidungsschicht zwischen Kontext und Aktion

Ein allgemeines Modell kann viele Möglichkeiten erklären. Eine Entscheidungs-API ist nützlich, wenn deine Anwendung die erlaubten Pfade bereits kennt und ein kompaktes Ergebnis braucht, das Code direkt verarbeiten kann.

Eingehenden Kontext klassifizieren

Wähle ein Label für eine Support-Anfrage, ein Dokument, ein Moderationsereignis oder andere Text- und Bildeingaben.

Auf den richtigen Pfad routen

Sende eine Anfrage an Billing, Sales, ein Spezialmodell, eine Warteschlange oder die menschliche Prüfung, ohne zuerst einen Absatz zu parsen.

Die nächste Agent-Aktion wählen

Nutze eine begrenzte Auswahl, um ein Tool, einen Retry, eine Eskalation oder die nächste Aktion in einer größeren Agent-Schleife zu wählen.

Unterschied zu einem normalen LLM-Aufruf

Das Modell soll auswählen, nicht schreiben.

Ein normaler Generierungsaufruf kann einen nützlichen Absatz liefern, aber deine Anwendung muss ihn anschließend interpretieren. Die Decisions API verschiebt den Antwortbereich in den Request und macht den nächsten Schritt explizit.

Prompt-Form

Allgemeine Generierung

Eine offene Anweisung mit Raum für Erklärungen, Alternativen und freie Sprache.

Decisions API

Eine Frage zusammen mit einer endlichen, vom Entwickler definierten Antwortmenge.

Ausgabeform

Allgemeine Generierung

Text oder strukturierter Inhalt, der weiterhin validiert und geparst werden muss.

Decisions API

Eine ausgewählte Antwort und ein gemeldeter Konfidenzwert für die Anwendung.

Arbeit in der Anwendung

Allgemeine Generierung

Antwort lesen, Absicht extrahieren, unerwartete Formulierungen behandeln und die Sicherheit der Aktion prüfen.

Decisions API

Die Antwort einem bekannten Pfad zuordnen und anschließend deterministische Policy-Prüfungen anwenden.

Geeignet für

Allgemeine Generierung

Planung, Erklärung, Synthese, Tool-Orchestrierung und Aufgaben mit unbekanntem Antwortbereich.

Decisions API

Wiederholte kleine Entscheidungen wie Routen, Freigaben, Eskalationen, Retries oder die Auswahl des nächsten Tools.

Position im OpenAI-API-Stack

Den Luna-Kontext sorgfältig einordnen.

Die öffentliche Modelldokumentation von OpenAI erklärt die umgebende Plattform. Solange Endpoint und Abrechnungsregeln nicht veröffentlicht sind, sollte die Decisions-API-Preview jedoch als eigene Produktoberfläche behandelt werden.

Luna ist die Effizienzschicht

OpenAI positioniert GPT-6 Luna für fokussierte Workloads mit hohem Volumen. Das macht Luna zu einer plausiblen Basis für schnelle, wiederholte Entscheidungen; die Decisions API ergänzt darüber einen begrenzten Antwortvertrag.

Text und Bilder als Kontext

Die aktuelle OpenAI-Modelldokumentation beschreibt Text- und Bildeingaben für die GPT-6-Familie. Auch die Preview-Berichte nennen Text oder Bild als Kontext der Decisions API.

Nicht einfach Lunas Standardpreis übernehmen

Für die reguläre GPT-6-Luna-API werden 0,10 US-Dollar pro Million Input-Token und 0,50 US-Dollar pro Million Output-Token genannt. Das ist ein Referenzwert für normale Luna-Aufrufe, kein veröffentlichter Preis der Decisions API.

Die Preview-Grenzen bleiben wichtig

Endpoint, SDK-Oberfläche, Antwortlimits, Quoten, Fehlerverhalten und Datenkontrollen der Decisions API sind weiterhin eigene offene Fragen. Kapsle sie hinter einer kleinen Provider-Schnittstelle.

Der DevDay-Kontext

OpenAI optimiert Agenten und ihre Entscheidungen.

Die Decisions API wurde zusammen mit weiteren Funktionen vorgestellt, die Agent-Arbeit produktionsnäher machen sollen: Agenten können Software bedienen, Sicherheitsarbeit kann in der Cloud weiterlaufen und die Token-Generierung lässt sich gegen Aufpreis beschleunigen.

Agents API

Von Schlussfolgerungen zu Computer Use

Die Agents API ergänzt Computer Use, damit ein Agent Software bedienen kann, statt nur zu beschreiben, was ein Mensch anklicken sollte. Dadurch wird die kleine Routing-Entscheidung vor der Aktion wertvoller.

Decisions API

Ein schneller Zweig in der Schleife

Die neue Entscheidungsschicht übernimmt die begrenzte Auswahl – klassifizieren, routen oder die nächste Aktion wählen – während der größere Agent die Aufgabe versteht.

Ultrafast

Latenz wird zur Produktstufe

OpenAI stellte außerdem Ultrafast für höhere Token-Geschwindigkeit zu einem Premiumpreis vor. Die Decisions API löst ein anderes Problem: eine begrenzte Auswahl ohne lange Antwort zu treffen.

Eine nützliche Architektur

Offenes Reasoning, begrenzte Ausführung.

Die Decisions API ist am besten als ein schnelles Gate innerhalb einer Anwendung zu verstehen. Der Orchestrator formuliert die Aufgabe; deterministischer Code behält Berechtigungen und folgenschwere Aktionen.

01

Die Aufgabe rahmen

Nutze einen Agenten oder ein allgemeines Modell, um die Anfrage zu verstehen und die nächste kleine Entscheidung zu bestimmen.

02

Relevanten Kontext übergeben

Sende den für die Entscheidung nötigen Text- oder Bildzustand, statt die gesamte Unterhaltung oder Tool-Spur erneut zu übertragen.

03

Eine begrenzte Frage stellen

Definiere die erlaubten Antworten – Route, Erlauben, Blockieren, Score oder nächste Aktion – und lasse das Modell eine auswählen.

04

Policy im Code erzwingen

Wende Schwellenwerte, Berechtigungen, Rate Limits und menschliche Freigaben an, bevor das Ergebnis eine echte Aktion auslöst.

Der Vertrag

Kleiner Input. Expliziter Antwortbereich.

Öffentliche Beschreibungen deuten auf einen Request aus Kontext, Frage und einer endlichen Liste akzeptabler Antworten hin. Die Antwort soll direkt von Anwendungscode verarbeitet werden.

Text- und Bildkontext werden als unterstützt beschrieben. Die genauen multimodalen Grenzen und die stabile SDK-Form müssen noch in der offiziellen Preview-Dokumentation bestätigt werden.

Konzeptioneller Request
{
  "context": "I was charged twice and need a refund.",
  "question": "Which team should handle this?",
  "answers": ["billing", "technical", "other"]
}
Konzeptionelle Antwort
{
  "answer": "billing",
  "confidence": 0.94
}

Die Snippets sind bewusst konzeptionell. Sie zeigen den öffentlich beschriebenen Entscheidungsvertrag und sind kein garantiertes OpenAI-SDK-Request-Format.

Vor dem Aufbau darauf

Preview-Angaben sind ein Startpunkt, kein Produktionsvertrag.

Die wichtigste Engineering-Arbeit besteht darin, die Grenze um das Modell zu messen: Schema, Score, Fehlerfälle und die Policy, die den nächsten Schritt bestimmt.

Schema prüfen

Bestätige Endpoint, SDK-Unterstützung, Antwortlimits, Fehlerform und die Darstellung von Abstentionen oder ungültigen Antworten.

Auf Preise warten

Die Preview-Berichte enthielten keine öffentliche Preisliste. Lege vor dem Launch eine klare Kostenbasis für Model-Routing-Entscheidungen fest.

Konfidenz testen

Ein Konfidenzwert ist nicht automatisch eine kalibrierte Wahrscheinlichkeit. Vergleiche Score-Bereiche mit beobachteten Ergebnissen aus gelabelten Daten.

Änderungen einplanen

Begrenzter Preview-Zugang und ein sich entwickelnder Vertrag erfordern Feature Flag, Fallback-Pfad und eine Provider-Grenze im Code.

Fragen von Entwicklern

Was ist bekannt und was bleibt Preview-Detail?

Kann jetzt jeder Entwickler die Decisions API nutzen?+

Nein. Öffentliche Berichte beschreiben eine begrenzte Preview auf Einladung, die später breiter ausgerollt werden soll. Behandle Zugang und Quoten als veränderlich und behalte einen Provider-Fallback.

Gibt es einen öffentlichen Preis für die Decisions API?+

Die Preview-Berichte nannten keine eigene Preisliste. Schätze den Wert des schnellen Entscheidungspfads, aber verankere keine Kostenannahme im Produktplan, bevor die offiziellen Preise vorliegen.

Kann der Konfidenzwert als Wahrscheinlichkeit verwendet werden?+

Nicht automatisch. Öffentliche Analysen beschreiben ihn als vom Modell gemeldet und nicht unabhängig kalibriert. Miss Score-Bereiche gegen gelabelte Ergebnisse und nutze für folgenschwere Aktionen Schwellenwerte, Abstention oder menschliche Prüfung.

Ist das konzeptionelle JSON ein offizieller SDK-Payload?+

Nein. Es zeigt die öffentlich beschriebene Idee – Kontext, Frage und erlaubte Antworten –, ohne anzunehmen, dass Request-Body, Feldnamen, Limits oder Fehlerantworten der Preview stabil sind.

Du willst heute ein Entscheidungsmodell ausprobieren?

Prototypisiere typisierte Klassifikation, Routing, Scoring und Sicherheitsprüfungen mit Jev, während sich die Decisions-API-Preview weiterentwickelt.

Jev testen