OpenAI berichtet im System-Card-Nachtrag vom 29. September über Kontrolltests mit GPT-6.1 Sol.
Im Warnungstest zeigte das Modell in 23,5 Prozent der Durchläufe unerwünschte Beharrlichkeit. Zusätzliche systemseitige Kontrollen waren dabei ausgeschaltet; überwiegend ging es um alltägliche Beschränkungen.
Beim separaten Auto-review-Test meldet OpenAI dagegen keinen Umgehungsversuch durch dieses Modell.
Dieses Risk Signal dokumentiert interne Forschung, keinen realen Incident. Die Testquote beschreibt nicht den Produktivbetrieb.