Kurzfassung: Sam Altman sagt, die Gesellschaft müsse für den Nutzen breit zugänglicher KI gewisse Schäden akzeptieren. Zugleich bezeichnet OpenAI schon geringe Risiken eines Kontrollverlusts über sehr leistungsfähige Systeme als untragbar. Das ist kein vollständiger Widerspruch, legt aber offen, dass OpenAI zwei Risikoklassen unterschiedlich behandelt.
Was Altman akzeptieren will
In einem am 4. Oktober veröffentlichten Politico-Interview, das Reuters wiedergibt, grenzt Altman OpenAI von Anthropic ab. Er lehnt eine Welt ab, in der ein einzelnes Labor leistungsfähige KI unter Verschluss hält, um Hacks, Betrug und sonstigen Missbrauch vollständig zu verhindern. Der erwartete gesellschaftliche Nutzen und die Handlungsfreiheit der Nutzer rechtfertigten aus seiner Sicht ein gewisses Restrisiko; OpenAI bevorzuge deshalb eine leichtere Regulierung.
Diese Aussage ist breiter als eine technische Freigabeentscheidung. Altman nennt keine messbare Schadensgrenze und sagt nicht, wer akzeptable Verluste festlegt oder trägt. Sie beschreibt zunächst eine politische Abwägung zwischen Zugang und Missbrauch.
OpenAIs andere rote Linie
Vor dem UN-Sicherheitsrat hatte Altman am 23. September eine deutlich strengere Grenze für Kontroll- und Katastrophenrisiken gezogen. Selbst Wahrscheinlichkeiten von 0,1 oder einem Prozent seien dafür nicht akzeptabel; Modelle ohne starke Belege für menschliche Kontrolle sollten nicht trainiert werden. Gleichzeitig warnte er davor, die mächtigsten Systeme bei einem Unternehmen oder Staat zu konzentrieren.
OpenAIs fünf Tage später veröffentlichter Entwurf für Sicherheitsnachweise passt zu dieser Trennung. Er verlangt Argumente zu Alignment, Eindämmung und Monitoring, automatische Pausen sowie eine vollständige Liste verbleibender Risiken vor Frontier-Trainingsläufen. Das Papier bezeichnet die Regeln jedoch als Zielbild und sagt, Teile würden erst umgesetzt. Der jüngste Pandorex-Bericht zeigt zudem den internen Streit darüber, ob OpenAIs iteratives Vorgehen bei wachsenden Fähigkeiten ausreicht.
Pandorex Analyse
Die belastbare Lesart lautet: OpenAI will existenzielle oder nicht beherrschbare Systemrisiken vermeiden, akzeptiert aber begrenzte Schäden durch normalen Einsatz, um Zugang nicht zu stark einzuschränken. Offen bleibt die entscheidende Grenze zwischen beiden Kategorien. Ein Cyberangriff, der zunächst wie gewöhnlicher Missbrauch wirkt, kann kritische Infrastruktur oder Lieferketten treffen und damit in die zweite Klasse kippen.
Deshalb ist nicht die zugespitzte Formulierung allein der Maßstab, sondern ob OpenAI überprüfbare Schwellen veröffentlicht: Welche Vorfälle stoppen Training oder Einsatz, welche Restrisiken werden akzeptiert und wer kann diese Entscheidung unabhängig prüfen? Ohne diese Angaben bleibt die Risikotrennung politisch verständlich, aber operativ unvollständig.
