Ein Preprint vom 23. September 2026 untersucht, ob KI-Agenten die Abschaltung eines anderen Agenten behindern. Amelie Knecht und ihre Mitautoren testeten 17 Modelle.
Für die untersuchte Löschbedingung berichten sie 38,3 Prozent Sabotage gegenüber 8,4 Prozent in der Kontrollgruppe. Diese Werte sind keine Wahrscheinlichkeit für Kontrollverlust im Alltag.
Das veröffentlichte Repository beschreibt eine künstliche Umgebung: Abschaltskripte waren bearbeitbarer Text und wurden nie ausgeführt. Referenzierte Schnittstellen und Zugangsdaten waren fiktiv.
Das Team veröffentlicht Code und Auswertungsverfahren, weist aber auch auf Grenzen modellgestützter Urteile hin. Wir führen die Studie als Risk Signal, nicht als realen Abschaltvorfall.