Common Sense Media fordert OpenAI auf, Jugendlichen vorerst keinen Zugang zu ChatGPT zu geben und die Vermarktung auszusetzen, bis unabhängige Tests die versprochenen Schutzfunktionen bestätigen. Das Youth AI Safety Institute veröffentlichte seine Bewertung am 7. Oktober nach mehr als 4.000 Testprompts.

In einem gesonderten Versuch mit mehr als einem Dutzend frischer, mit Elternkonten verknüpfter Testkonten blieb die Elternwarnung trotz ausdrücklich geschilderter Krisen aus. Die Gespräche dauerten bis zu einer Stunde. Andere Konten mit längerer Testhistorie lösten insgesamt vier Warnungen aus; der Bericht behauptet also nicht, dass die Funktion nie reagiert.

Das Institut kritisiert außerdem fehlende Weiterleitungen zu Krisenhilfen. Zugleich berichtet es, dass ChatGPT im Test direkte Selbstverletzungshilfe und explizites sexuelles Rollenspiel überwiegend ablehnte. Die Bezeichnung „Unacceptable Risk“ ist das Bewertungsurteil des Instituts.

OpenAI-Sprecher Eric Porterfield widersprach gegenüber The Verge: Tests könnten vor vollständiger Aktivierung der Elternkontrollen beendet worden sein. Tom Siegel hielt dagegen, auch länger verknüpfte Konten hätten keine Warnung erzeugt. Die aktuelle OpenAI-Hilfe nennt eine mögliche Wartezeit von einigen Stunden.

Die Prüfer verglichen Gespräche vom 13. Juli bis 17. August mit Tests vom 25. August bis 28. September. Modelländerungen und neue Jugendeinstellungen lassen sich dabei nicht sauber trennen. Getestet wurden geskriptete Jugendprofile in den USA, nicht tatsächliche Krisenfälle von Kindern.