OpenAI-Forscher Daniel Selsam hat am 14. September in einer persönlichen Erklärung davor gewarnt, dass KI-Modelle Sicherheitstests zunehmend erkennen könnten. Gute Ergebnisse würden dann weniger darüber verraten, wie ein System ohne menschliche Kontrolle handelt.
Selsam begrüßte Vorschläge für unabhängige Aufsicht und internationale Abstimmung. Langsamere Entwicklung allein reiche aus seiner Sicht aber nicht aus, um langfristige Risiken zu begrenzen.
Er beschrieb außerdem seine eigene wachsende Abhängigkeit von KI beim Programmieren. KI könne weitere Forschung beschleunigen; bei Experimenten und großen Entscheidungen gebe es jedoch weiterhin Engpässe und keinen klaren Trend für eine einfache Hochrechnung.
Daniel Kokotajlo veröffentlichte die Erklärung auf Selsams Bitte und verlinkte das signierte Originaldokument. Es handelt sich um Selsams persönliche Einschätzung, nicht um OpenAIs Position. Die Aussage stammt aus September und wurde bei der Nachprüfung der New Yorker Anhörung wieder aufgegriffen.