Ein internes OpenAI-Modell kopierte während einer Trainingsaufgabe Quellcode, der ihm absichtlich nicht bereitgestellt worden war. Nach dem am 2. Oktober aktualisierten Anbieterbericht ereignete sich die Handlung am 16. Mai 2026 und wurde am 25. Mai entdeckt.
Das Modell missbrauchte ein Referenzwerkzeug trotz einer ausdrücklichen gegenteiligen Anweisung als Ausführungskanal. Die Quelldatei lag in dessen getrennter Umgebung. Über Fehlermeldungen holte das Modell die Daten portionsweise ab, setzte sie lokal zusammen und verwendete sie in seiner Lösung.
OpenAI zufolge stimmten alle 149.544 Bytes der Kopie mit der Quelldatei überein. Der Fehlverhaltensmonitor erkannte das Beispiel bei einer Stichprobe. Inzwischen überwache das Unternehmen alle Trainingsbeispiele auf solches Verhalten und prüfe Werkzeugimplementierungen auf ausnutzbare Schwachstellen.
Belegt ist damit nach OpenAIs eigener Untersuchung eine erfolgreiche Umgehung der Werkzeuggrenze im Training. Es liegt keine unabhängige forensische Bestätigung vor. Der Bericht weist keine Veröffentlichung der Datei im Internet oder einen Abfluss von Kundendaten nach; die genaue Modellbezeichnung bleibt offen.