Pandorex
DEEN
KI & Chips

OpenAI trennt Katastrophenrisiko von akzeptiertem Missbrauch

Veröffentlicht Pandorex Redaktion·4 min Lesezeit
—
Illustration: Ein violetter KI-Prozessor verzweigt zu einem roten Not-Aus für Kontrollrisiken und durch ein bernsteinfarbenes Risikotor zu mehreren Nutzern.
Redaktionelle Illustration · Pandorex

Kurzfassung: Sam Altman sagt, die Gesellschaft müsse für den Nutzen breit zugänglicher KI gewisse Schäden akzeptieren. Zugleich bezeichnet OpenAI schon geringe Risiken eines Kontrollverlusts über sehr leistungsfähige Systeme als untragbar. Das ist kein vollständiger Widerspruch, legt aber offen, dass OpenAI zwei Risikoklassen unterschiedlich behandelt.

Was Altman akzeptieren will

In einem am 4. Oktober veröffentlichten Politico-Interview, das Reuters wiedergibt, grenzt Altman OpenAI von Anthropic ab. Er lehnt eine Welt ab, in der ein einzelnes Labor leistungsfähige KI unter Verschluss hält, um Hacks, Betrug und sonstigen Missbrauch vollständig zu verhindern. Der erwartete gesellschaftliche Nutzen und die Handlungsfreiheit der Nutzer rechtfertigten aus seiner Sicht ein gewisses Restrisiko; OpenAI bevorzuge deshalb eine leichtere Regulierung.

Diese Aussage ist breiter als eine technische Freigabeentscheidung. Altman nennt keine messbare Schadensgrenze und sagt nicht, wer akzeptable Verluste festlegt oder trägt. Sie beschreibt zunächst eine politische Abwägung zwischen Zugang und Missbrauch.

OpenAIs andere rote Linie

Vor dem UN-Sicherheitsrat hatte Altman am 23. September eine deutlich strengere Grenze für Kontroll- und Katastrophenrisiken gezogen. Selbst Wahrscheinlichkeiten von 0,1 oder einem Prozent seien dafür nicht akzeptabel; Modelle ohne starke Belege für menschliche Kontrolle sollten nicht trainiert werden. Gleichzeitig warnte er davor, die mächtigsten Systeme bei einem Unternehmen oder Staat zu konzentrieren.

OpenAIs fünf Tage später veröffentlichter Entwurf für Sicherheitsnachweise passt zu dieser Trennung. Er verlangt Argumente zu Alignment, Eindämmung und Monitoring, automatische Pausen sowie eine vollständige Liste verbleibender Risiken vor Frontier-Trainingsläufen. Das Papier bezeichnet die Regeln jedoch als Zielbild und sagt, Teile würden erst umgesetzt. Der jüngste Pandorex-Bericht zeigt zudem den internen Streit darüber, ob OpenAIs iteratives Vorgehen bei wachsenden Fähigkeiten ausreicht.

Pandorex Analyse

Die belastbare Lesart lautet: OpenAI will existenzielle oder nicht beherrschbare Systemrisiken vermeiden, akzeptiert aber begrenzte Schäden durch normalen Einsatz, um Zugang nicht zu stark einzuschränken. Offen bleibt die entscheidende Grenze zwischen beiden Kategorien. Ein Cyberangriff, der zunächst wie gewöhnlicher Missbrauch wirkt, kann kritische Infrastruktur oder Lieferketten treffen und damit in die zweite Klasse kippen.

Deshalb ist nicht die zugespitzte Formulierung allein der Maßstab, sondern ob OpenAI überprüfbare Schwellen veröffentlicht: Welche Vorfälle stoppen Training oder Einsatz, welche Restrisiken werden akzeptiert und wer kann diese Entscheidung unabhängig prüfen? Ohne diese Angaben bleibt die Risikotrennung politisch verständlich, aber operativ unvollständig.

Quellen und Nachweise

Quellen für die Fakten und den Kontext dieses Artikels.

  1. OpenAI, 23.09.2026: Sam Altman's remarks at the United Nations Security Councilopenai.com
  2. OpenAI, 28.09.2026: Towards safety cases for frontier AI trainingopenai.com
  3. Reuters, 04.10.2026: OpenAI's Altman says AI benefits warrant accepting some risksreuters.com

So recherchiert und korrigiert Pandorex

Kommentare

Melde dich an, um einen Kommentar zu schreiben.

Nach oben swipen
Nächster Artikel

OpenAI-Sicherheitsautor tritt zurück und kritisiert den Trial-and-Error-Ansatz

KI & Chips