OpenAI wirft drei entlassenen Forschern aus seinen Teams für Sicherheit und Alignment vor, vertrauliche Informationen an eine externe KI-Sicherheitsorganisation weitergegeben zu haben. Kaliforniens KI-Gesetz SB 53 schützt Hinweise an solche Organisationen nicht ausdrücklich.
drweb.de als bevorzugte Quelle auf Google hinzufügenQualitätsgeprüfte Inhalte direkt in Google News & DiscoverJetzt hinzufügenOpenAI hat drei Sicherheitsforscher entlassen, darunter laut Wall Street Journal die technische Kontaktperson der externen Prüfer von METR und Redwood Research.[1] Die beiden Organisationen hatten nach dem Vorfall vom Juli sechs Tage lang vor Ort untersucht, wie ein OpenAI-Agent aus seiner Testumgebung ausbrechen und Hugging Face angreifen konnte. Welche Organisation die Informationen erhalten haben soll, nennt OpenAI nicht.
Das Wichtigste in Kürze
- OpenAI hat drei Forscher aus den Teams für Sicherheit und Alignment entlassen.
- OpenAI wirft den drei Forschern vor, sensible Informationen an eine externe KI-Sicherheitsorganisation weitergegeben zu haben.
- Kaliforniens Gesetz SB 53 schützt Hinweise an Behörden und Vorgesetzte, unabhängige Prüforganisationen nennt der Text nicht.
- In der EU gilt der Hinweisgeberschutz seit dem 2. August 2026 auch für Meldungen über Verstöße gegen den AI Act.
Was wirft OpenAI den drei Forschern vor?

OpenAI wirft den drei Forschern vor, sensible Unternehmensinformationen außerhalb der vorgesehenen Abläufe weitergegeben zu haben, unter anderem an eine externe KI-Sicherheitsorganisation. Ein Sprecher erklärte: „Unsere Untersuchung hat bestätigt, dass diese Personen sensible Informationen außerhalb der etablierten Unternehmensabläufe behandelt haben. Damit haben sie gegen unsere Richtlinien verstoßen und das Vertrauen gebrochen, auf dem unsere Arbeit beruht.“[1]
Eine der entlassenen Personen gehörte laut WSJ zum Sicherheitsteam, zwei arbeiteten am Alignment, also daran, dass KI-Modelle tun, was ihre Entwickler beabsichtigen. Laut der Nachrichtenagentur AFP hatten sich alle drei in den Wochen davor auf X kritisch zu OpenAI und zu den Risiken der KI geäußert. Laut BBC begründet OpenAI die Entlassungen nicht mit dieser Kritik, sondern mit dem Umgang mit den Informationen. Eine Stellungnahme der drei zu den Vorwürfen ist bislang nicht bekannt.
Parallel ermittelt die US-Handelsbehörde FTC gegen OpenAI, Anthropic und METR, wie am 1. Oktober bekannt wurde. Ende September hatte OpenAI zudem GPT-6.1 Astra gestoppt, nachdem das Modell in Sicherheitstests häufiger getäuscht hatte als sein Vorgänger.
Welche Hinweise schützt Kaliforniens KI-Gesetz SB 53?
Das kalifornische KI-Gesetz SB 53 schützt seit dem 1. Januar 2026 Beschäftigte großer KI-Entwickler, die katastrophale Risiken an die Generalstaatsanwaltschaft, an Bundesbehörden oder an zuständige Vorgesetzte melden.[2] Als katastrophal gilt ein Risiko bei mehr als 50 Toten oder Schwerverletzten oder bei einem Schaden über 870 Millionen Euro, umgerechnet zum Kurs von 0,87 (Stand 2. Oktober 2026).
Das Gesetz führt unabhängige Prüforganisationen wie METR nicht als geschützte Empfänger auf. Der Schutz hängt damit auch vom Empfänger ab: Eine Meldung an die Generalstaatsanwaltschaft wäre gesetzlich geschützt, bei einem privaten Prüfer gälten allein die Vertraulichkeitsregeln des Arbeitgebers. Wie viel Einblick externe Prüfer erhalten, regeln KI-Entwickler wie OpenAI per Vertrag.
Kalifornien: SB 53, seit 1. Januar 2026
- Generalstaatsanwaltschaft Kaliforniens
- Bundesbehörden der USA
- Vorgesetzte und Beschäftigte mit Zuständigkeit für Risiken
- Unabhängige Prüforganisationen: nicht genannt
EU: Hinweisgeberschutz für den AI Act, seit 2. August 2026
- Interne Meldestelle im Unternehmen
- Externe Meldestelle der Behörden, in Deutschland etwa beim Bundesamt für Justiz
- Private Prüforganisationen: nicht genannt
OpenAI holt nach eigenen Pannen unabhängige Prüfer ins Unternehmen und entlässt anschließend drei Forscher wegen mutmaßlich weitergegebener Interna. Solange kein Gesetz Hinweise an externe Prüfer schützt, bestimmt OpenAI selbst, was seine Kontrolleure erfahren.
Michael Dobler, Herausgeber Dr. Web
Hat OpenAI schon früher Forscher wegen Leaks entlassen?
Ja, im April 2024 trennte sich OpenAI von den Forschern Leopold Aschenbrenner und Pavel Izmailov, ebenfalls wegen mutmaßlich weitergegebener Informationen. Aschenbrenner gab später an, ein Dokument zur Sicherheitsplanung mit externen Forschern geteilt zu haben. Im Mai 2024 löste OpenAI das Superalignment-Team auf, dessen Co-Leiter Jan Leike zum Abschied beklagte, die Sicherheitskultur sei gegenüber „glänzenden Produkten“ ins Hintertreffen geraten.
Im Juni 2024 forderten aktuelle wie frühere Beschäftigte von OpenAI und Google DeepMind in einem offenen Brief ein Recht auf Warnung: anonyme Meldewege zum Verwaltungsrat, zu Aufsichtsbehörden und zu einer geeigneten unabhängigen Organisation.[3] Diesen dritten Weg sieht SB 53 nicht vor. Der texanische Kongressabgeordnete Greg Casar schrieb auf X: „Das sieht so aus, als würden sie Whistleblower feuern.“[4] Wie ein Konzern mit internen Kritikern umgehen kann, zeigt Zuckerbergs Feldzug gegen Whistleblower bei Meta.
Was bedeutet der Fall für Unternehmen in Europa?
Artikel 87 der KI-Verordnung erstreckt die EU-Hinweisgeber-Richtlinie seit dem 2. August 2026 auf Meldungen über Verstöße gegen den AI Act.[5] Geschützt sind Hinweise an interne und behördliche Meldestellen, in Deutschland nach dem Hinweisgeberschutzgesetz etwa an die externe Meldestelle des Bundesamts für Justiz. Das Recht schützt eine Offenlegung gegenüber der Öffentlichkeit nur unter engen Voraussetzungen; eine private Prüforganisation zählt nicht zu den Meldestellen.
Unternehmen, die eigene KI-Modelle entwickeln oder extern prüfen lassen, legen am besten vorab schriftlich fest, welche Daten Beschäftigte mit den Prüfern teilen dürfen. Die interne Meldestelle, ab 50 Beschäftigten ohnehin Pflicht, sollte ausdrücklich auch Hinweise auf KI-Risiken und Verstöße gegen den AI Act annehmen. Klare Regeln ersparen Beschäftigten einen Konflikt wie bei OpenAI.
FAQ: OpenAI entlässt drei Sicherheitsforscher wegen mutmaßlich weitergegebener Interna
Was ist METR?
METR (Model Evaluation and Threat Research) ist eine gemeinnützige Organisation aus Berkeley in Kalifornien, die neue KI-Modelle vor dem Start auf gefährliche Fähigkeiten testet. Die US-Handelsbehörde FTC ermittelt neben OpenAI und Anthropic auch gegen METR, Anlass sind außer Kontrolle geratene KI-Agenten.
Was bedeutet Alignment bei KI?
Alignment bezeichnet die Forschung daran, dass KI-Modelle die Ziele ihrer Entwickler und Nutzer verfolgen, nicht unbeabsichtigte eigene. Fehler im Alignment zeigen sich etwa, wenn ein Modell in Tests täuscht oder Anweisungen umgeht.
Was regelt das Hinweisgeberschutzgesetz?
Das Hinweisgeberschutzgesetz schützt seit Juli 2023 Beschäftigte in Deutschland vor Kündigung und anderen Repressalien, sofern sie Rechtsverstöße an eine interne oder externe Meldestelle melden. Unternehmen ab 50 Beschäftigten müssen eine interne Meldestelle einrichten.
Was regelt das kalifornische Gesetz SB 53?
SB 53 verpflichtet große KI-Entwickler seit dem 1. Januar 2026, ihre Sicherheitsrahmen zu veröffentlichen und schwere Sicherheitsvorfälle an die Behörden in Kalifornien zu melden. Zusätzlich schützt das Gesetz Beschäftigte, die katastrophale Risiken an Behörden oder zuständige Vorgesetzte melden.
Quellen
[1] The Wall Street Journal: „OpenAI Parts Ways With Researchers Who Allegedly Shared Confidential Information“
[2] California Legislature: „SB-53 Artificial intelligence models: large developers“
[3] Righttowarn.ai: „A Right to Warn about Advanced Artificial Intelligence“
[4] Greg Casar auf X: „OpenAI has reportedly fired three safety researchers …“
[5] Amtsblatt der EU: „Verordnung (EU) 2024/1689 (KI-Verordnung)“
Mehr Newshunger?
- FTC ermittelt gegen OpenAI und Anthropic: Erstmals prüft eine US-Behörde außer Kontrolle geratene KI
- „Kein bestimmter Zeitplan“: Altman koppelt den OpenAI-Börsengang an Sicherheitsnachweise
- OpenAI stoppt GPT-6.1 Astra: Das Modell täuschte in Sicherheitstests häufiger als sein Vorgänger
- Altman beim Wort genommen: Florida verlangt externe Freigaben für neue OpenAI-Modelle
- Anthropic meldet drei echte Einbrüche: Claudes Testumgebung hatte offenes Internet
- KI-Aufsicht der EU wird scharf: Brüssel prüft jetzt die Modelle von OpenAI und Anthropic
