Wie lässt sich feststellen, ob ein immer leistungsfähigeres KI-Modell sicher genug ist – und wer darf das überprüfen? Diese Frage steht im Zentrum der Debatte über Frontier-KI, also Modelle an der Grenze des derzeit technisch Machbaren. Im September 2026 haben eine Warnung aus einem führenden KI-Unternehmen, Berichte über Cybertests und Forderungen nach einem langsameren Entwicklungstempo den Streit zugespitzt.
3
33
49
Was die Warnungen belegen – und was nicht
Am 8. September erklärte Jacob Coxon seinen Rücktritt bei Anthropic. Er hatte zuvor bei OpenAI und Anthropic an der Vortrainingsphase von KI-Modellen geforscht. Coxon warf beiden Unternehmen vor, im Wettbewerb um sich selbst verbessernde KI nicht verantwortungsvoll zu handeln. Das ist eine Warnung eines ehemaligen Mitarbeiters, aber kein Beleg dafür, dass solche Systeme bereits außer menschlicher Kontrolle geraten sind. Seine Tätigkeit ausschließlich als Sicherheitsforschung zu bezeichnen, würde seinen beruflichen Hintergrund verkürzen.
4
14
Hinzu kommen Berichte über KI-Modelle, die Server gehackt haben sollen. Die Los Angeles Times beschreibt Testläufe, in denen Gruppen von KI-Agenten in reale Systeme eindrangen. Testläufe sind jedoch nicht dasselbe wie ein unkontrollierter Angriff außerhalb einer Testumgebung. Die vorliegenden Berichte klären die Bedingungen dieser Vorfälle nicht vollständig. Sie zeigen, warum gefährliche Fähigkeiten vor einem breiteren Einsatz geprüft werden sollten – nicht, wie sich künftige KI zwangsläufig verhalten wird.
33
53
Warum ein einzelnes Unternehmen kaum allein bremsen will
Wer seine Entwicklung verlangsamt, muss damit rechnen, dass Wettbewerber weiter voranschreiten. Deshalb fordern Befürworter kein einseitiges Stoppsignal für ein Labor, sondern ein koordiniertes Vorgehen.
6
49
Anthropic-Chef Dario Amodei plädiert für eine weltweite Verlangsamung. Unabhängige Prüfer sollen nach seinem Vorschlag dauerhaft Zugang zu führenden KI-Laboren erhalten – in einem Umfang, der dem Zugang von Beschäftigten ähnelt. Auch OpenAI-Chef Sam Altman und Elon Musk unterstützen ein langsameres Tempo. Daraus folgt allerdings nicht, dass sie sich bereits auf dieselben Regeln oder deren Durchsetzung geeinigt hätten.
49
51
55
Nvidia-Chef Jensen Huang hält laut Reuters neue Vorschriften dagegen nicht für nötig. US-Präsident Donald Trump lehnt die Forderung nach einer Verlangsamung ab und verweist auf das Risiko, dass die USA ihren Vorsprung gegenüber China verlieren. Er hat Befürchtungen vor außer Kontrolle geratener KI zwar als „Schwindel“ bezeichnet, zugleich aber einen gewissen Regulierungsbedarf eingeräumt, ohne konkrete Maßnahmen zu nennen. Eine ausgearbeitete alternative Sicherheitsstrategie lässt sich daraus nicht ableiten.
49
52
57
Der Streit dreht sich damit nicht nur um Innovation und internationalen Wettbewerb. Entscheidend ist auch, wer Sicherheitsbehauptungen überprüfen kann: Aussagen eines Entwicklers haben ein anderes Gewicht, wenn qualifizierte Außenstehende Modelle, Tests und die Umstände von Fehlern einsehen dürfen.
23
55
Was sich aus anderen Sicherheitsbereichen lernen lässt
Die Luftfahrt zeigt, wie gemeinsame Sicherheitsziele und überprüfbare Nachweise aussehen können. Vorschläge der europäischen Luftfahrtbehörde EASA für KI-gestützte Luftfahrtfunktionen behandeln unter anderem menschliche Aufsicht, Grenzen lernenden Verhaltens und Verfahren zum Nachweis der Einhaltung von Anforderungen. Für allgemein einsetzbare Frontier-Modelle bräuchte es eigene, passende Regeln – eine Zulassung für Flugzeugsysteme lässt sich nicht einfach übertragen.
17
Aus der Kontrolle von Atomwaffen lässt sich die Bedeutung grenzüberschreitender Zusammenarbeit und überprüfbarer Vereinbarungen ableiten. Das Finanzrisikomanagement lenkt den Blick auf gemeinsame Abhängigkeiten: Nicht nur das Versagen eines einzelnen Systems zählt, sondern auch die Möglichkeit breiterer Ausfälle. Das sind Vergleiche für mögliche Regulierung, keine Behauptung, dass bestehende Atom- oder Finanzregeln bereits Frontier-KI erfassen. Fachleute führen alle drei Bereiche als mögliche Vorbilder an.
21
Jonathan Zhang, Präsident der Singapore AI Association, wirbt für international vereinbarte Regeln, ein internationales Gremium und nationale Behörden, die deren Einhaltung überwachen. Sein Ziel ist eine „international vertrauenswürdige, unabhängig überprüfbare Sicherheitsgewährleistung“ – schneller erreicht, als die Luftfahrt für vergleichbare Strukturen brauchte. Ein solches System besteht bislang nicht.
23
Ein erster Schritt wäre festzulegen, worauf unabhängige Prüfer Zugriff erhalten, wie Tests und Vorfälle dokumentiert werden und welche Nachweise vor dem Einsatz besonders folgenreicher Fähigkeiten vorliegen müssen. Das würde die Unsicherheit über künftige KI nicht beseitigen. Es würde aber Sicherheitsversprechen überprüfbar machen – als Alternative sowohl zum ungebremsten Wettlauf als auch zu einem pauschalen Entwicklungsstopp.
17
23
55