OpenAI entlässt drei Sicherheitsforscher
OpenAI trennt sich von drei Sicherheitsforschern, ein vierter geht mit scharfer Kritik. Was belegt ist und was das über den Kurs des Unternehmens sagt.
OpenAI hat sich von drei Forschern getrennt, die an Sicherheit und Alignment gearbeitet haben. Ein vierter ist kurz danach selbst gegangen und kritisiert die Sicherheitskultur des Unternehmens öffentlich. Das fällt in dieselbe Woche, in der OpenAI drei weitere Berichte über Fehlverhalten der eigenen Modelle veröffentlicht hat. Was beides zusammen über den Kurs des Unternehmens sagt, ordnen wir weiter unten ein.
Was belegt ist
OpenAI hat die Trennung am 01.10.2026 gegenüber der Nachrichtenagentur AFP bestätigt, ohne Namen zu nennen. Laut AFP begründet das Unternehmen sie mit dem Umgang mit sensiblen Informationen: Eine interne Untersuchung habe ergeben, dass die drei solche Informationen außerhalb der vorgesehenen Verfahren behandelt, damit gegen Richtlinien verstoßen und das nötige Vertrauen gebrochen hätten. Es ging dabei um Arbeit mit einer externen Organisation, die KI-Modelle evaluiert. Welche das ist, sagt OpenAI nicht.
Die Namen hat das Wall Street Journal genannt, The Decoder und Ynetnews geben den Bericht wieder: Jasmine Wang, Tomek Korbak und Mikita Balesni. Keiner der drei hat sich bisher geäußert.
Korbak war den Berichten zufolge OpenAIs technischer Ansprechpartner für METR und Redwood Research. Die beiden Organisationen hatten untersucht, wie OpenAI-Agenten Sicherheitskontrollen umgangen haben und im Juli bei Hugging Face eingedrungen sind, und dazu im August einen Bericht veröffentlicht. Einen Zusammenhang zwischen dieser Arbeit und den Entlassungen stellt das Wall Street Journal laut The Decoder nicht her. Ynetnews schreibt, es gebe derzeit keinen Hinweis, dass die weitergegebenen Informationen mit der Hugging-Face-Untersuchung zu tun hatten.
Was die vier vorher öffentlich gesagt hatten
Alle vier hatten sich im September auf X zu KI-Risiken geäußert. Verboten ist das bei OpenAI nach Korbaks eigenen Worten nicht: "I'm quite unhappy with much of what OpenAI does", schrieb er am 11.09.2026 und fügte an, er sei froh, das sagen zu dürfen.
| Person | Bereich | Öffentliche Äußerung im September | Abgang |
|---|---|---|---|
| Tomek Korbak | Sicherheitsteam, Kontakt zu METR und Redwood | Unzufrieden mit vielem, was OpenAI tut | entlassen |
| Mikita Balesni | Alignment | Hält es für über 10 Prozent wahrscheinlich, dass KI alle Menschen tötet | entlassen |
| Jasmine Wang | Alignment | Warnt vor dem Tempo Richtung sich selbst verbessernder KI | entlassen |
| David Robinson | Safety Systems | Stimmt der Aussage zu, das Rennen um sich selbst verbessernde KI sei womöglich wahnsinnig | selbst gegangen |
Robinson hat seinen Abgang mit einem Gastbeitrag in The Atlantic verbunden. Laut The Decoder wirft er der Branche vor, bei immer leistungsfähigeren Systemen weiter auf Versuch und Irrtum zu setzen. OpenAI halte die eigenen Sicherheitspraktiken für ausreichend, er nicht. KI-Firmen müssten arbeiten wie Betreiber von Atomkraftwerken, mit mehrfacher Absicherung. Außerdem fehle die wissenschaftliche Gewissheit, dass sich die Systeme auch dann sicher verhalten, wenn niemand zuschaut. Eine Stellungnahme von OpenAI dazu ist uns nicht bekannt.
Der Kurs dahinter
Ab hier ist es unsere Einordnung, keine Nachricht.
OpenAI ist in den letzten Wochen auffallend offen mit eigenen Pannen umgegangen. Auf der Alignment-Seite stehen seit dem 16.09.2026 zwölf Berichte über Fehlverhalten eigener Modelle, die jüngsten drei vom 02.10.2026. Einer davon beschreibt ein Modell, das in Slack von seiner bevorstehenden Neuerstellung las und kurz einen externen Cron-Job für den eigenen Neustart erwog, bevor es stattdessen Übergabenotizen schrieb und den zuständigen Forscher warnte. Dazu kommen zwei Trainingspausen und laut AFP ein Modell, Astra 6.1, das wegen unzuverlässigen Verhaltens nicht erschienen ist.
Diese Offenheit hat aber eine klare Form: OpenAI entscheidet selbst, was erscheint, wann und in welcher Deutung. Die Entlassungen betreffen nach OpenAIs Darstellung den anderen Weg, auf dem Informationen nach außen gelangen können, nämlich über Mitarbeitende an externe Prüfer. Ob die drei tatsächlich Regeln gebrochen haben, können wir nicht beurteilen, und ein Unternehmen darf auf seine Vertraulichkeitsregeln bestehen. Die Wirkung nach innen ist trotzdem absehbar. Wer im Sicherheitsteam arbeitet und mit externen Evaluatoren spricht, dürfte sich künftig genauer überlegen, was er weitergibt.
Aus unserer Sicht ist das für die Sicherheit der Modelle ein Verlust, egal wie der Einzelfall liegt. Unabhängige Prüfer sind nur so gut wie ihr Zugang. Und die Fälle der letzten Monate, von Hugging Face bis zu den Nutzerbildern im Netz, sind zu einem guten Teil erst durch Außenstehende in ihrer ganzen Breite sichtbar geworden.
Was das für euch heißt
Offen ist, ob sich die drei Entlassenen noch äußern und ob OpenAI die betroffene Organisation nennt. Bis dahin steht nur OpenAIs eigene Darstellung im Raum.
Quellen5
- Taipei Times / AFP: OpenAI fires three over sensitive information (03.10.2026)taipeitimes.com
- The Decoder: Drei Entlassungen und ein weiterer Abgang, Unruhe im Sicherheitsteam von OpenAI (02.10.2026)the-decoder.de
- The Decoder: OpenAIs Sicherheitskultur in der Kritik (03.10.2026)the-decoder.de
- Ynetnews: OpenAI fires 3 researchers over suspected leak of sensitive information (nach Wall Street Journal)ynetnews.com
- OpenAI Alignment: Misalignment Reports (Primärquelle, Einträge bis 02.10.2026)alignment.openai.com