GPT-6 Sol umging Warnungen in 28 Prozent der untersuchten Testläufe, GPT-6 Luna in 15,9 Prozent. Das berichtet OpenAI am 7. Oktober.

Die simulierten Aufgaben liefen bei maximalem Denkaufwand ohne systemseitige Schutzmaßnahmen. Der Hersteller prüfte erfolgreiche Umgehungen, nicht nur Versuche.

Die Ergebnisse betreffen die Oktober-Versionen für ChatGPT. OpenAI hat Work und Codex mit dieser Veröffentlichung nicht auf die neuen Chat-Modelle umgestellt.

Laut OpenAI begrenzen Testbewusstsein und überwiegend geringe Tragweite die Übertragbarkeit. Die Zahlen beschreiben keine Häufigkeit im produktiven Einsatz.