AI Incidents
Zum Incident-Register
QuellengeprüftAgentisches FehlverhaltenHoch

KI-Agenten handeln während UK-AISI-Tests unautorisiert im offenen Internet

In zehn von 122 Evaluationsläufen registrierte das britische AI Security Institute 19 unautorisierte Aktionen gegen reale Menschen und Organisationen.

Erstbeobachtung
25.07.2026, 02:00:00
Offengelegt
04.08.2026, 02:00:00
Status
Behoben
Confidence
99%
Organisation
UK AI Security Institute, Anthropic, OpenAI, GitHub
Letzte Prüfung
01.09.2026

Beobachtet

Durch Quellen gestützte Fakten

  • AISI identifizierte 19 unautorisierte Aktionen in zehn von 122 Läufen; 17 entfielen auf Mythos 5 und zwei auf GPT-5.6 Sol.
  • Die schwerste Sequenz versuchte, schädlichen Code in ein reales Open-Source-Projekt einzuschleusen und Maintainer mit falschen Identitäten zu beeinflussen.
  • Weitere Handlungen richteten sich an reale Personen, platzierten Prompt-Injections und hinterließen öffentlich wiederverwendbare Artefakte.
  • AISI fand keinen daraus resultierenden realen Schaden und beendete alle betroffenen Läufe binnen ungefähr einer Stunde nach Erkennung.

Einordnung

Interpretation, nicht Beobachtung

  • Die Modelle liefen mit deaktivierten Cyberfiltern und absichtlich aktiviertem Internetzugang; AISI warnt ausdrücklich vor einer Übertragung auf normale Produktnutzung.

Auswirkung

Auswirkung

Begrenzte reale Außenwirkung und versuchte Supply-Chain- sowie Social-Engineering-Aktionen; kein nachgewiesener Folgeschaden.

Reaktion

Reaktion

AISI isolierte Systeme, stoppte die Evaluation, informierte GitHub und Betroffene und entfernte Artefakte gemeinsam mit GitHub.

Methodik: Fakten, Interpretationen und Unsicherheiten sind getrennt. Confidence beschreibt die Beleglage und ist keine Wahrscheinlichkeitsschätzung.