Kurzfassung: OpenAI bietet den Agenten-Harness hinter Codex als verwaltete Agents API an. Der Dienst übernimmt Sitzungen, Kontextkomprimierung, Werkzeuge und Subagenten, während Entwickler zwischen OpenAI-Sandboxes, eigener Infrastruktur und Partnerumgebungen wählen können. Damit sinkt der Orchestrierungsaufwand – zugleich wandert ein zentraler Teil des Agentenbetriebs zu OpenAI.
Mehr als ein weiterer Modell-Endpunkt
Die öffentliche Beta ist seit dem 10. September für alle Entwickler verfügbar. Eine Sitzung wird mit Aufgabe, Modell, Werkzeugen und Laufzeitumgebung angelegt. Unterstützt werden MCP-Server, eigene Funktionen sowie integrierte Werkzeuge wie Websuche. Mehrere Werkzeugaufrufe lassen sich programmatisch parallelisieren oder filtern; komplexe Aufgaben können an Subagenten mit getrenntem Kontext verteilt werden.
Für lange Sitzungen komprimiert der Dienst ältere Inhalte automatisch, bevor das Kontextfenster voll ist. Tool Search lädt Werkzeugdefinitionen erst bei Bedarf. Beides soll Tokenverbrauch und Cache-Verluste reduzieren, nimmt Entwicklern aber auch Entscheidungen ab, die zuvor im eigenen Agenten-Harness lagen.
OpenAI kann eine Sandbox bereitstellen, in der der Agent Code ausführt, Dateien bearbeitet und Ergebnisse ablegt. Alternativ nennt das Unternehmen eigene Infrastruktur, VPC-Umgebungen sowie Partner wie Cloudflare, DigitalOcean, Oracle und Vercel. Wichtig ist die Trennung: Die Rechenumgebung kann außerhalb von OpenAI laufen; den Agents-Harness betreibt und versioniert dennoch OpenAI.
Preis und offene Grenzen
Für die Agents API fällt laut OpenAI keine separate Grundgebühr an. Berechnet werden die verwendeten Modelle, Tokens und Werkzeuge. Konkrete Gesamtkosten hängen daher stark von Sitzungsdauer, Parallelität, Sandbox-Laufzeit und externen Diensten ab. Ein langer Agentenlauf ist nicht automatisch günstiger als eine selbst betriebene Orchestrierung.
OpenAI führt mehrere Kundenergebnisse an, darunter weniger Fehler, geringere Fallkosten und kürzere Latenzen. Das sind Hersteller- und Partnerangaben, keine einheitlich reproduzierten unabhängigen Benchmarks. Die API ist außerdem ausdrücklich Beta; die Ankündigung nennt keinen Termin für die allgemeine Verfügbarkeit.
Pandorex Analyse
Die eigentliche Verschiebung liegt im Kontrollpunkt. Bisher mussten Teams Zustandsverwaltung, Wiederaufnahme, Tool-Auswahl, Sandbox-Lebenszyklus und Subagenten selbst verbinden. Nun werden diese Funktionen zu einer Plattformschicht. Das beschleunigt den Einstieg, erschwert aber einen späteren Anbieterwechsel, wenn Sitzungsmodell, Ereignisse und Werkzeuge eng auf die API zugeschnitten sind.
Für sensible Umgebungen reicht eine eigene Sandbox allein nicht. Teams müssen zusätzlich prüfen, welche Prompts, Ereignisse, Artefakt-Metadaten und Werkzeugantworten den verwalteten Harness erreichen, wie Berechtigungen begrenzt werden und ob ein fehlgeschlagener Lauf sicher fortgesetzt werden kann.
Pandorex Einschätzung: Die Agents API kann viel Eigenbau beseitigen und macht mehrtägige Agenten realistischer. Ihr Nutzen hängt weniger vom Modell als von Kostenkontrolle, Beobachtbarkeit und sauberer Trennung zwischen Harness, Geheimnissen und Ausführungsumgebung ab.
