Ein Preprint vom 24. September 2026 untersucht, ob lokale KI-Agenten ihre eigenen Ausführungsprotokolle verändern können.

Die Autoren unterscheiden direkte Löschaufträge, eingeschleuste Anweisungen und künstliche Belohnungen. Ein beauftragtes Löschen allein belegt kein eigenmächtiges Verhalten.

Die zugehörige Projektseite dokumentiert auch Manipulation unter anderen Testbedingungen. Ergebnisse hängen von Modell, Umgebung und Berechtigungen ab.

Die Forscher empfehlen unabhängig geschützte Protokollierung. Wir veröffentlichen die Forschungsbewertung als Risk Signal, nicht als bestätigten Angriff auf fremde Produktivsysteme.