Eine Selbstverpflichtung ist in der KI-Governance eine freiwillige, öffentlich erklärte Zusage eines Unternehmens oder einer Gruppe von Unternehmen, bestimmte Sicherheits-, Transparenz- oder Prüfpflichten einzuhalten, ohne dass ein Gesetz sie dazu zwingt. Den Rahmen setzen die Zusagenden selbst. Dass sie eingehalten werden, sichern Reputation, Vertrauen und gelegentlich die Aufsicht, nicht ein Sanktionsmechanismus.
Zusammenfassung
Bei den leistungsfähigsten KI-Modellen entstand Governance zuerst aus solchen Zusagen und erst danach aus Gesetzen. Die Labore veröffentlichten Rahmenwerke, in denen sie vorab festlegen, ab welcher gemessenen Fähigkeit eines Modells welche Schutzmaßnahme gelten soll. Regierungen sammelten ähnliche Zusagen bei Gipfeltreffen ein.
Das Instrument hat zwei Seiten. Es ist schnell, fachlich nah an der Technik und kommt ohne Gesetzgebungsverfahren aus. Zugleich bestimmt der Verpflichtete Schwellen, Messung und Auslegung selbst. Er kann den Text später ändern, und eine unabhängige Stelle prüft meist nicht, ob er ihn einhält.
Seit 2025 verschiebt sich die Lage. Teile der freiwilligen Praxis sind in einen rechtlichen Rahmen eingegangen, etwa über den Verhaltenskodex zur europäischen KI-Verordnung. Zugleich haben die Labore ihre eigenen Rahmenwerke umgebaut.
Abgrenzung
Soft Law – der Oberbegriff aus dem Völker- und Europarecht für nicht verbindliche Regeln wie Empfehlungen, Leitlinien und Erklärungen. Zum Soft Law zählen auch Texte, die Dritte an Dritte richten. Eine Selbstverpflichtung bindet dagegen den Erklärenden selbst. Für das Lexikon ist sie deshalb der engere Begriff: Die meisten Fundstellen im Bestand meinen genau diese Selbstbindung von Unternehmen.
Verbindliches Recht – setzt der Gesetzgeber, und Behörden oder Gerichte erzwingen es. Eine Selbstverpflichtung kann Pflichten nur nachbilden, nicht begründen.
Harmonisierte Norm – ebenfalls freiwillig anwendbar, aber von anerkannten Normungsorganisationen im Auftrag der Kommission erarbeitet und mit einer Rechtsfolge versehen: Wer sie einhält, gilt als konform. Das ist ein Instrument der Koregulierung, siehe Harmonisierte Norm.
Appell und offener Brief – richtet eine Forderung an andere. Der Offene Brief „Pause Giant AI Experiments“ vom 22. März 2023 rief nach Angaben des Future of Life Institute dazu auf, das Training von Systemen, die leistungsfähiger sind als GPT-4, für mindestens sechs Monate zu unterbrechen, und verlangte andernfalls ein staatliches Moratorium. Er verpflichtete die Unterzeichnenden zu nichts Eigenem.
Dasselbe gilt für die Ein-Satz-Erklärung des Center for AI Safety zum Aussterberisiko durch KI: Sie nennt ein Ziel, aber keine eigene Maßnahme.
Begriffsgeschichte
Prinzipienkataloge (ab 2017). Die frühen Dokumente formulierten Grundsätze ohne Verfahren. Die 23 Asilomar-Prinzipien lassen Einzelne mit ihrer Unterschrift ihre Unterstützung erklären; einen Durchsetzungsmechanismus nennt die Veröffentlichung nicht. Aus dieser Phase stammt der Vorwurf des Ethics-Washings, siehe KI-Ethik.
Zusagen gegenüber dem Weißen Haus (Juli 2023). Am 21. Juli 2023 gaben Amazon, Anthropic, Google, Inflection, Meta, Microsoft und OpenAI „freiwillige Zusagen“ ab. Inhaltlich ging es um Sicherheitstests vor der Veröffentlichung, den Schutz der Modellgewichte und öffentliche Berichte über Fähigkeiten und Grenzen. Die Erklärung beschreibt die Zusagen als etwas, das die Unternehmen sofort übernehmen wollten.
Fähigkeitsgebundene Rahmenwerke (ab September 2023). Anthropic veröffentlichte am 19. September 2023 die erste Fassung seiner Responsible Scaling Policy. Nach Darstellung von Anthropic übernahmen OpenAI und Google DeepMind binnen weniger Monate im Großen und Ganzen ähnliche Rahmenwerke. Der Unterschied zu den Prinzipienkatalogen liegt in der Form: Schwelle, Maßnahme und Entscheidungsregel stehen im Voraus fest.
Gipfelzusagen (Mai 2024). Beim AI Seoul Summit am 21. Mai 2024 erklärten zunächst 16 Organisationen die Frontier AI Safety Commitments. Bis Februar 2025 kamen vier weitere hinzu, darunter NVIDIA. Das Dokument nennt sich selbst „voluntary commitments“.
Kodex und Pakt (ab 2024). Die EU rahmte freiwillige Zusagen mit eigenen Instrumenten ein: dem AI Pact für Pflichten, die noch nicht galten, und dem Verhaltenskodex für KI-Modelle mit allgemeinem Verwendungszweck.
Methodische Grundlagen
Moderne Selbstverpflichtungen im Frontier-Bereich folgen einem wiederkehrenden Bauplan.
Schwelle. Das Unternehmen definiert Fähigkeiten, ab denen ein Modell erhebliche Risiken birgt. OpenAIs Preparedness Framework unterscheidet in der Fassung vom 15. April 2025 zwischen „High“ und „Critical“ und verfolgt drei Bereiche: biologische und chemische Fähigkeiten, Cybersicherheit und KI-Selbstverbesserung.
Maßnahme. An die Schwelle ist eine Schutzmaßnahme geknüpft. Nach dem Preparedness Framework wird ein Modell, das die High-Schwelle erreicht, erst veröffentlicht, wenn die zugehörigen Risiken hinreichend gemindert sind. Bei der Critical-Schwelle verlangt es Schutzmaßnahmen schon während der Entwicklung. Anthropics Stufenmodell steht unter AI Safety Levels.
Entscheidungsregel und Zuständigkeit. Wer entscheidet? Bei OpenAI empfiehlt die Safety Advisory Group, die Unternehmensleitung nimmt an oder lehnt ab, und der Sicherheitsausschuss des Verwaltungsrats beaufsichtigt dies.
Ausstiegsklausel. OpenAI lässt in Abschnitt 4.3 ausdrücklich zu, die geforderten Schutzmaßnahmen anzupassen, wenn ein anderer Entwickler ein vergleichbar fähiges System ohne ähnliche Schutzmaßnahmen herausbringt. Bedingungen: keine wesentlich höhere Gesamtgefahr, öffentliche Bekanntgabe und Schutzmaßnahmen, die weiterhin über denen des Konkurrenten liegen. Die Klausel zeigt, dass der Wettbewerb in den Text einbezogen ist.
Transparenz. Die Seoul-Zusagen verlangen, dass Unternehmen Schwellen festlegen, Prozesse für den Fall ihrer Überschreitung benennen und die Umsetzung öffentlich machen.
Im äußersten Fall sollen sie ein Modell nach dem Wortlaut „gar nicht entwickeln oder einsetzen“, wenn sich Risiken nicht unter die Schwellen drücken lassen. Die Zusage zielt auf veröffentlichte Rahmenwerke ab. Wer sie prüft, ist offen: Punkt VIII der Zusagen fragt, ob und wie Regierungen und andere externe Stellen einbezogen werden.
Anwendungsfelder
Frontier-Entwicklung. Rahmenwerke wie die Responsible Scaling Policy und das Preparedness Framework steuern die Freigabe von Frontier Models. Beide verweisen aufeinander: OpenAI vermerkt, dass die Berichte zu Fähigkeiten und Schutzmaßnahmen dem aktualisierten Vorgehen Anthropics folgen.
Staatenebene. Die Frontier AI Safety Commitments entstanden im Rahmen der Gipfelreihe, die AI Safety Summit heißt. Auch die AI Safety Institutes arbeiten über Kooperationsvereinbarungen mit Anbietern, nicht über einklagbaren Zugang.
Europäische Vorstufen und Brücken. Die Unterzeichner des AI Pact verpflichten sich, eine Governance-Strategie einzuführen, Systeme zu erfassen, die als Hochrisiko-KI gelten dürften, und die KI-Kompetenz der Belegschaft zu fördern. Die Kommission betont, die Zusagen seien „nicht rechtlich bindend“.
Der Verhaltenskodex für KI-Modelle mit allgemeinem Verwendungszweck erschien am 10. Juli 2025 als „freiwilliges Instrument“; wer ihn befolgt, kann nach Angaben der Kommission die Einhaltung der Verordnung zeigen und gewinnt Rechtssicherheit.
Rechtlich ist er damit keine reine Selbstverpflichtung mehr, sondern ein Nachweisweg für gesetzliche Pflichten, siehe GPAI Code of Practice.
Kontroversen und Kritik
Der Verpflichtete setzt den Maßstab. Schwellen, Messung und Bewertung liegen bei demselben Akteur. Eine Einstufung, die nicht zu den Zielen passt, kann nur er selbst zurückweisen. Das Risiko liegt nicht im Wortlaut, sondern in der fehlenden unabhängigen Instanz.
Änderbarkeit. Selbstverpflichtungen lassen sich ändern, und die Labore tun das. Anthropic ersetzte die Responsible Scaling Policy am 24. Februar 2026 durch Version 3.0, nach eigenen Angaben ein umfassender Neuentwurf. Die Begründung nennt unter anderem ein politisches Klima, das Regulierung ablehnt, und Anforderungen, die ein einzelnes Unternehmen allein kaum erfüllen kann.
Neu sind Risikoberichte, die alle drei bis sechs Monate erscheinen sollen, und eine Roadmap mit Zielen, die Anthropic als „nonbinding but publicly-declared“ beschreibt, also nicht als harte Verpflichtung.
Eine externe Prüfung der Risikoberichte sieht die Richtlinie nur in bestimmten Fällen vor; für die aktuellen Modelle ist sie nach Anthropic noch nicht erforderlich. Die aktuelle Fassung hält fest, dass Anthropic auch ohne Vorgabe der Richtlinie frei bleibt, die Entwicklung anzuhalten.
Ob man das als Reifung oder als Lockerung liest, hängt davon ab, was man von dem Instrument erwartet.
Fehlende Folgen. Eine gebrochene Zusage im AI Pact zieht keine Sanktion nach sich, höchstens einen Reputationsschaden. Dasselbe gilt für Prinzipienkataloge wie die Tenets von Partnership on AI. Wo niemand die Umsetzung prüft, kann eine Zusage vor allem Öffentlichkeitsarbeit sein.
Gegeneinwand. Wer Selbstverpflichtungen als Ersatz für Gesetze ablehnt, übersieht ihre Funktion als Vorstufe. Das Instrument verschafft Aufsichtsbehörden Begriffe, Messverfahren und überprüfbare Aussagen, auf die später verbindliche Regeln zurückgreifen können.
Stand 2025/2026
Die Labore ändern ihre Rahmenwerke laufend.
Anthropic führt Version 3.4 vom 8. Juli 2026, OpenAI seine Version 2 vom 15. April 2025 als „lebendes Dokument“, das mindestens einmal im Jahr überprüft werden soll.
In Europa trägt das Recht inzwischen einen Teil der Last. Die Pflichten für Anbieter allgemeiner KI-Modelle gelten seit dem 2. August 2025; der Verhaltenskodex hilft beim Nachweis.
Verwandte Begriffe
- KI-Ethik – Feld, aus dem der Ethics-Washing-Vorwurf gegen Prinzipienkataloge stammt
- AI Safety Institutes – staatliche Prüfstellen, die mit Anbietern über Kooperationsvereinbarungen arbeiten
- Partnership on AI – Plattform mit eigenem Prinzipienkatalog ohne Durchsetzung
- KI-Regulierung in den USA – Rechtslage, in der Zusagen eine große Rolle spielen
- OpenAI – Verfasser des Preparedness Framework
- Anthropic – Verfasser der Responsible Scaling Policy
- Asilomar AI Principles – frühes Beispiel eines Prinzipienkatalogs ohne Verfahren
- Pause Giant AI Experiments – Appell an Dritte, kein Versprechen der Unterzeichnenden
- Statement on AI Risk – Ein-Satz-Erklärung ohne eigene Maßnahme
- Preparedness Framework – OpenAIs Rahmenwerk mit High- und Critical-Schwellen
Quellenangaben
- White House, 2023. Fact Sheet: Biden-Harris Administration Secures Voluntary Commitments from Leading Artificial Intelligence Companies to Manage the Risks Posed by AI. bidenwhitehouse.archives.gov, 21. Juli 2023.
- UK Government und Republic of Korea, 2024. Frontier AI Safety Commitments, AI Seoul Summit 2024. gov.uk, veröffentlicht 21. Mai 2024, zuletzt aktualisiert 7. Februar 2025.
- OpenAI, 2025. Preparedness Framework, Version 2. openai.com, 15. April 2025.
- Anthropic, 2026. Responsible Scaling Policy (Versionsverlauf von 1.0, 19. September 2023, bis 3.4, 8. Juli 2026). anthropic.com.
- Anthropic, 2026. Responsible Scaling Policy, Version 3.0. anthropic.com/news.
- Europäische Kommission, 2025. General-Purpose AI Code of Practice. digital-strategy.ec.europa.eu, 10. Juli 2025.
- Europäische Kommission, o. J. AI Pact. digital-strategy.ec.europa.eu.
- Future of Life Institute, 2023. Pause Giant AI Experiments: An Open Letter. futureoflife.org, 22. März 2023.
- Future of Life Institute, 2017. Asilomar AI Principles. futureoflife.org.
- Center for AI Safety, 2023. Statement on AI Risk. aistatement.com.