Stability-AI-Mitgründer Emad Mostaque hat am 14. September Prüfungen vorgeschlagen, die zeigen sollen, unter welchen Bedingungen sich KI weiterhin an Grenzen hält. In seinem Essay „Manners Maketh the AI“ fordert er mehr als gute Ergebnisse in gewöhnlichen Sicherheitstests.
Der Vorschlag verändert Rechenbudget, ungewohnte Aufgaben und wahrgenommene Überwachung getrennt. Kompetenz und unerlaubte Versuche sollen dabei einzeln erfasst werden, damit ein überfordertes System nicht mit einem sicheren verwechselt wird.
Mostaque verlangt unabhängige Bewertungen und Zugang zu Trainingsunterlagen, wenn Prüfer Ursachen untersuchen sollen. Beobachtetes Verhalten allein könne seine Erklärung nicht beweisen. Ob die vorgeschlagenen Tests tatsächlich besser schützen, müsste erst untersucht werden.
In einer eigenen Antwort auf die weiterverbreitete Selsam-Stellungnahme verlinkte er den Essay als abweichende Sicht auf Agentenschwärme. Es ist ein September-Vorschlag, keine neu eingeführte Schutzfunktion.