OpenAI DevDay 2026 · Entwicklerleitfaden
Software soll kleine Entscheidungen schnell treffen.
Die OpenAI Decisions API wird als latenzarmes Interface beschrieben, das eine Antwort aus einer vom Entwickler definierten Menge auswählt. Sie zielt auf Klassifikation, Routing und den nächsten begrenzten Schritt eines Agent-Workflows – nicht auf freie Textgenerierung.
Diese Seite fasst die Informationen zur begrenzten Preview rund um den DevDay 2026 zusammen. Das öffentliche Request-Schema, Preise und Leistungsgarantien können sich mit der Erweiterung des Zugangs ändern.
Gemeldete Engine
GPT-6-Luna-Variante
Gemeldete Geschwindigkeit
ca. 150 ms
Kontext
Text + Bilder
Ergebnis
Eine begrenzte Antwort
Die Berichterstattung beschreibt einen spezialisierten Entscheidungspfad, der ungefähr zehnmal schneller als ein regulärer GPT-6-Luna-API-Aufruf sein soll.
Verfügbarkeitsstatus
Die OpenAI Decisions API ist noch nicht verfügbar
Der Dienst befindet sich weiterhin in einer begrenzten Preview und kann noch nicht über die öffentliche OpenAI-Plattform genutzt werden.
Sobald sie geöffnet wird, ist sie zuerst auf thejevai verfügbar.
Wofür sie gedacht ist
Eine Entscheidungsschicht zwischen Kontext und Aktion
Ein allgemeines Modell kann viele Möglichkeiten erklären. Eine Entscheidungs-API ist nützlich, wenn deine Anwendung die erlaubten Pfade bereits kennt und ein kompaktes Ergebnis braucht, das Code direkt verarbeiten kann.
Eingehenden Kontext klassifizieren
Wähle ein Label für eine Support-Anfrage, ein Dokument, ein Moderationsereignis oder andere Text- und Bildeingaben.
Auf den richtigen Pfad routen
Sende eine Anfrage an Billing, Sales, ein Spezialmodell, eine Warteschlange oder die menschliche Prüfung, ohne zuerst einen Absatz zu parsen.
Die nächste Agent-Aktion wählen
Nutze eine begrenzte Auswahl, um ein Tool, einen Retry, eine Eskalation oder die nächste Aktion in einer größeren Agent-Schleife zu wählen.
Unterschied zu einem normalen LLM-Aufruf
Das Modell soll auswählen, nicht schreiben.
Ein normaler Generierungsaufruf kann einen nützlichen Absatz liefern, aber deine Anwendung muss ihn anschließend interpretieren. Die Decisions API verschiebt den Antwortbereich in den Request und macht den nächsten Schritt explizit.
Prompt-Form
Eine offene Anweisung mit Raum für Erklärungen, Alternativen und freie Sprache.
Eine Frage zusammen mit einer endlichen, vom Entwickler definierten Antwortmenge.
Ausgabeform
Text oder strukturierter Inhalt, der weiterhin validiert und geparst werden muss.
Eine ausgewählte Antwort und ein gemeldeter Konfidenzwert für die Anwendung.
Arbeit in der Anwendung
Antwort lesen, Absicht extrahieren, unerwartete Formulierungen behandeln und die Sicherheit der Aktion prüfen.
Die Antwort einem bekannten Pfad zuordnen und anschließend deterministische Policy-Prüfungen anwenden.
Geeignet für
Planung, Erklärung, Synthese, Tool-Orchestrierung und Aufgaben mit unbekanntem Antwortbereich.
Wiederholte kleine Entscheidungen wie Routen, Freigaben, Eskalationen, Retries oder die Auswahl des nächsten Tools.
Position im OpenAI-API-Stack
Den Luna-Kontext sorgfältig einordnen.
Die öffentliche Modelldokumentation von OpenAI erklärt die umgebende Plattform. Solange Endpoint und Abrechnungsregeln nicht veröffentlicht sind, sollte die Decisions-API-Preview jedoch als eigene Produktoberfläche behandelt werden.
Luna ist die Effizienzschicht
OpenAI positioniert GPT-6 Luna für fokussierte Workloads mit hohem Volumen. Das macht Luna zu einer plausiblen Basis für schnelle, wiederholte Entscheidungen; die Decisions API ergänzt darüber einen begrenzten Antwortvertrag.
Text und Bilder als Kontext
Die aktuelle OpenAI-Modelldokumentation beschreibt Text- und Bildeingaben für die GPT-6-Familie. Auch die Preview-Berichte nennen Text oder Bild als Kontext der Decisions API.
Nicht einfach Lunas Standardpreis übernehmen
Für die reguläre GPT-6-Luna-API werden 0,10 US-Dollar pro Million Input-Token und 0,50 US-Dollar pro Million Output-Token genannt. Das ist ein Referenzwert für normale Luna-Aufrufe, kein veröffentlichter Preis der Decisions API.
Die Preview-Grenzen bleiben wichtig
Endpoint, SDK-Oberfläche, Antwortlimits, Quoten, Fehlerverhalten und Datenkontrollen der Decisions API sind weiterhin eigene offene Fragen. Kapsle sie hinter einer kleinen Provider-Schnittstelle.
Der DevDay-Kontext
OpenAI optimiert Agenten und ihre Entscheidungen.
Die Decisions API wurde zusammen mit weiteren Funktionen vorgestellt, die Agent-Arbeit produktionsnäher machen sollen: Agenten können Software bedienen, Sicherheitsarbeit kann in der Cloud weiterlaufen und die Token-Generierung lässt sich gegen Aufpreis beschleunigen.
Agents API
Von Schlussfolgerungen zu Computer Use
Die Agents API ergänzt Computer Use, damit ein Agent Software bedienen kann, statt nur zu beschreiben, was ein Mensch anklicken sollte. Dadurch wird die kleine Routing-Entscheidung vor der Aktion wertvoller.
Decisions API
Ein schneller Zweig in der Schleife
Die neue Entscheidungsschicht übernimmt die begrenzte Auswahl – klassifizieren, routen oder die nächste Aktion wählen – während der größere Agent die Aufgabe versteht.
Ultrafast
Latenz wird zur Produktstufe
OpenAI stellte außerdem Ultrafast für höhere Token-Geschwindigkeit zu einem Premiumpreis vor. Die Decisions API löst ein anderes Problem: eine begrenzte Auswahl ohne lange Antwort zu treffen.
Eine nützliche Architektur
Offenes Reasoning, begrenzte Ausführung.
Die Decisions API ist am besten als ein schnelles Gate innerhalb einer Anwendung zu verstehen. Der Orchestrator formuliert die Aufgabe; deterministischer Code behält Berechtigungen und folgenschwere Aktionen.
Die Aufgabe rahmen
Nutze einen Agenten oder ein allgemeines Modell, um die Anfrage zu verstehen und die nächste kleine Entscheidung zu bestimmen.
Relevanten Kontext übergeben
Sende den für die Entscheidung nötigen Text- oder Bildzustand, statt die gesamte Unterhaltung oder Tool-Spur erneut zu übertragen.
Eine begrenzte Frage stellen
Definiere die erlaubten Antworten – Route, Erlauben, Blockieren, Score oder nächste Aktion – und lasse das Modell eine auswählen.
Policy im Code erzwingen
Wende Schwellenwerte, Berechtigungen, Rate Limits und menschliche Freigaben an, bevor das Ergebnis eine echte Aktion auslöst.
Der Vertrag
Kleiner Input. Expliziter Antwortbereich.
Öffentliche Beschreibungen deuten auf einen Request aus Kontext, Frage und einer endlichen Liste akzeptabler Antworten hin. Die Antwort soll direkt von Anwendungscode verarbeitet werden.
Text- und Bildkontext werden als unterstützt beschrieben. Die genauen multimodalen Grenzen und die stabile SDK-Form müssen noch in der offiziellen Preview-Dokumentation bestätigt werden.
{
"context": "I was charged twice and need a refund.",
"question": "Which team should handle this?",
"answers": ["billing", "technical", "other"]
}{
"answer": "billing",
"confidence": 0.94
}Die Snippets sind bewusst konzeptionell. Sie zeigen den öffentlich beschriebenen Entscheidungsvertrag und sind kein garantiertes OpenAI-SDK-Request-Format.
Vor dem Aufbau darauf
Preview-Angaben sind ein Startpunkt, kein Produktionsvertrag.
Die wichtigste Engineering-Arbeit besteht darin, die Grenze um das Modell zu messen: Schema, Score, Fehlerfälle und die Policy, die den nächsten Schritt bestimmt.
Schema prüfen
Bestätige Endpoint, SDK-Unterstützung, Antwortlimits, Fehlerform und die Darstellung von Abstentionen oder ungültigen Antworten.
Auf Preise warten
Die Preview-Berichte enthielten keine öffentliche Preisliste. Lege vor dem Launch eine klare Kostenbasis für Model-Routing-Entscheidungen fest.
Konfidenz testen
Ein Konfidenzwert ist nicht automatisch eine kalibrierte Wahrscheinlichkeit. Vergleiche Score-Bereiche mit beobachteten Ergebnissen aus gelabelten Daten.
Änderungen einplanen
Begrenzter Preview-Zugang und ein sich entwickelnder Vertrag erfordern Feature Flag, Fallback-Pfad und eine Provider-Grenze im Code.
Fragen von Entwicklern
Was ist bekannt und was bleibt Preview-Detail?
Kann jetzt jeder Entwickler die Decisions API nutzen?+
Nein. Öffentliche Berichte beschreiben eine begrenzte Preview auf Einladung, die später breiter ausgerollt werden soll. Behandle Zugang und Quoten als veränderlich und behalte einen Provider-Fallback.
Gibt es einen öffentlichen Preis für die Decisions API?+
Die Preview-Berichte nannten keine eigene Preisliste. Schätze den Wert des schnellen Entscheidungspfads, aber verankere keine Kostenannahme im Produktplan, bevor die offiziellen Preise vorliegen.
Kann der Konfidenzwert als Wahrscheinlichkeit verwendet werden?+
Nicht automatisch. Öffentliche Analysen beschreiben ihn als vom Modell gemeldet und nicht unabhängig kalibriert. Miss Score-Bereiche gegen gelabelte Ergebnisse und nutze für folgenschwere Aktionen Schwellenwerte, Abstention oder menschliche Prüfung.
Ist das konzeptionelle JSON ein offizieller SDK-Payload?+
Nein. Es zeigt die öffentlich beschriebene Idee – Kontext, Frage und erlaubte Antworten –, ohne anzunehmen, dass Request-Body, Feldnamen, Limits oder Fehlerantworten der Preview stabil sind.
Du willst heute ein Entscheidungsmodell ausprobieren?
Prototypisiere typisierte Klassifikation, Routing, Scoring und Sicherheitsprüfungen mit Jev, während sich die Decisions-API-Preview weiterentwickelt.