Story
Oktober 4, 2026
OpenAI-Sicherheitschef geht, weil die wirklichen Leitplanken von außen kommen müssen
David Robinsons Abgang legt einen Konflikt darüber offen, ob OpenAI sich selbst kontrollieren kann, während es voranstürmt: Der frühere Sicherheitschef sagt, äußerer Druck sei nötig, während das Unternehmen erklärt, seine Schutzmaßnahmen würden parallel zu seinen Modellen verstärkt.
David Robinson verbrachte dreieinhalb Jahre in OpenAIs Sicherheitsabteilung und arbeitete an Transparenz, Vorsorge und den öffentlich zugänglichen Berichten, die erklären sollen, wie sich die Modelle des Unternehmens verhalten. Anfang September signalisierte er bereits Unbehagen: OpenAI verändere sich schnell, schrieb er, doch er wisse nicht, ob es sich schnell genug verändere.1
Diese Sorge wuchs vor einem raueren Hintergrund. OpenAIs Sicherheitsreihen waren durch frühere Abgänge, darunter jener des Sicherheitschefs Johannes Heidecke, erschüttert worden, während das Unternehmen nach Sicherheitsvorfällen und Berichten über Fehlverhalten von Modellen unter Beobachtung stand. Zudem erklärte es, sich wegen mutmaßlicher Verstöße gegen Richtlinien für sensible Informationen von drei Forschern getrennt zu haben.1
Vergangene Woche trat Robinson aus dem Team Safety Systems zurück. In einem am Samstag veröffentlichten Essay argumentierte er, dass das Arbeitstempo interne Reformen weitaus schwieriger mache, als es klinge. „Meine Kollegen und ich waren so beschäftigt damit, zu sprinten, dass wir selten die Gelegenheit hatten, große Veränderungen in Betracht zu ziehen, geschweige denn sie tatsächlich umzusetzen“, schrieb er.2
Seine Schlussfolgerung war deutlich: „Stärkere Anreize für Sicherheit — die von außerhalb des Unternehmens kommen — sind ein großer Teil dessen, was nötig ist, um das richtig zu machen.“ Robinson sagte, er hoffe nun, der Öffentlichkeit die Risiken, auf die er gestoßen sei, verständlich machen und den Druck auf OpenAI und konkurrierende Unternehmen erhöhen zu können, vorsichtiger zu handeln.2
OpenAI weist die Andeutung zurück, dass Fähigkeiten der Kontrolle davonliefen. Ein Sprecher sagte, das Unternehmen stärke Sicherheits- und Schutzpraktiken, während sich seine Modelle verbesserten; dabei nutze es externe Bewerter und eine frühere Überwachung auf besorgniserregendes Verhalten. Das zentrale Versprechen des Unternehmens lautet, dass es ungeachtet des Risikos nicht einfach weitermachen werde: „Wir unterbrechen das Training oder halten Modelle zurück, wenn wir langsamer machen müssen.“2
Die Kluft betrifft weniger die Frage, ob fortschrittliche KI Leitplanken benötigt, als vielmehr, wer diese verlässlich durchsetzen kann. Robinson hat sich für externen Druck entschieden; OpenAI sagt, seine internen Systeme könnten die Aufgabe weiterhin erfüllen.