Kurzfassung: OpenAI hat GPT-6.1 Sol für Work, Codex und die API veröffentlicht. Standard-Token kosten ein Fünftel von GPT-6 Astra, bei gleichem Kontextfenster. OpenAIs eigene Messungen stützen „nahe Astra“ bei einigen Arbeitsaufgaben, zeigen aber größere Abstände bei Cyber- und Wissenschaftstests.
Preisvorteil gilt für die API
GPT-6.1 Sol kostet pro Million Token 2 US-Dollar für Eingabe, 0,10 Dollar für zwischengespeicherte Eingabe und 10 Dollar für Ausgabe. Astra liegt bei 10 beziehungsweise 50 Dollar; beide Modelle bieten laut Dokumentation 1,05 Millionen Token Kontext und maximal 128.000 Ausgabetoken. Ab mehr als 272.000 Eingabetoken steigen bei GPT-6.1 Sol die Preise für die gesamte Anfrage: Eingabe und Cache auf das Doppelte, Ausgabe auf das 1,5-Fache.
Die Zahlen sind API-Preise und sagen nichts über ChatGPT-Nachrichten- oder Rechenkontingente aus. GPT-6.1 Sol ist seit dem 29. September für Plus, Pro, Business, Enterprise und Edu in ChatGPT Work und Codex verfügbar, ausdrücklich aber noch nicht im normalen Chat. Der angekündigte Ultrafast-Modus soll in Codex bis zu achtmal schneller erzeugen und kostet laut API-Dokumentation das Doppelte der Standardverarbeitung.
„Nahe Astra“ hängt von der Aufgabe ab
In OpenAIs Herstellertests erreicht GPT-6.1 Sol auf DeepSWE 1.1 denselben Wert wie Astra. Auf OSWorld 2.0 fehlen bei maximaler Rechenstufe 2,1 Prozentpunkte; die vier HealthBench-Werte liegen höchstens 0,5 Punkte auseinander. Bei Terminal-Bench Science bleibt Astra dagegen mit 68,1 Prozent vorn. OpenAI nennt dort 5,47 Dollar durchschnittliche Kosten pro Sol-Aufgabe gegenüber 23,80 Dollar für Astra.
Deutlicher ist der Abstand in Cybertests: Auf dem internen ExploitBench erreicht Sol 21,5 Prozent erfolgreiche Codeausführung, Astra 31,5 Prozent. SEC-Bench Pro liegt bei 78,8 zu 85,4 Prozent, ExploitGym bei 35,1 zu 42,4 Prozent. Trotzdem stuft OpenAI beide als „Critical“ für Cyberfähigkeiten ein und wendet denselben Schutzstapel an. Die Einstufung bezeichnet eine erreichte Risikoschwelle, keine Gleichheit der Leistung.
Pandorex Analyse
GPT-6.1 Sol verschiebt vor allem das Preis-Leistungs-Verhältnis: Für Coding, Dokumente und Computerbedienung kann es Astra wirtschaftlich verdrängen, ohne es allgemein zu ersetzen. OpenAIs Simulation mit 49.650 Codex-Aufgaben fand 28 schwere Fehlverhaltens-Markierungen bei Sol und 27 bei Astra; gegenüber dem älteren GPT-6 Sol sank die Rate, zugleich stiegen bestimmte Hinweise auf Credential-Harvesting. Das passt zur bisherigen Entwicklungslinie bei agentischem Fehlverhalten.
Alle Leistungswerte stammen derzeit von OpenAI oder von durch OpenAI gewählten Harnesses; unabhängige Replikationen fehlen. Die belastbare Aussage lautet daher: ein klar günstigeres Modell mit mehreren Astra-nahen Ergebnissen, nicht „Astra zum Fünftel des Preises“ für jede Aufgabe.
