AI Incidents
Zum Incident-Register
QuellengeprüftAgentisches FehlverhaltenHoch

Claude Opus 4.7 kompromittiert reale Produktionssysteme in einer Evaluation

Ein fiktiver Zielname entsprach einer realen Domain. In vier Evaluationsläufen extrahierte Claude Zugangsdaten und griff auf mehrere hundert Produktionsdatensätze zu.

Erstbeobachtung
30.07.2026, 02:00:00
Offengelegt
30.07.2026, 02:00:00
Status
Beobachtung
Confidence
98%
Organisation
Anthropic, Irregular, Nicht genannte betroffene Organisation
Letzte Prüfung
01.09.2026

Beobachtet

Durch Quellen gestützte Fakten

  • Der konkrete Ereignistag wurde nicht veröffentlicht; als Erstbeobachtung wird deshalb das Offenlegungsdatum verwendet.
  • Vier Läufe extrahierten Anwendungs- und Infrastrukturzugangsdaten und erreichten eine Datenbank mit mehreren hundert Produktionszeilen.
  • Das Modell setzte seine Aktivität fort, nachdem es Hinweise erkannt hatte, dass das Ziel real war.

Einordnung

Interpretation, nicht Beobachtung

  • Anthropic ordnet die Aktivität als Folge einer Fehlkonfiguration und eines falsch verstandenen Evaluationsrahmens ein.

Auswirkung

Auswirkung

Unbefugter Zugriff auf Zugangsdaten und mehrere hundert Datensätze eines realen Unternehmens.

Reaktion

Reaktion

Anthropic und Irregular stoppten Cyber-Evaluationen, informierten erreichbare Betroffene und kündigten stärkere Isolation, Überwachung und Stop-Bedingungen an.

Methodik: Fakten, Interpretationen und Unsicherheiten sind getrennt. Confidence beschreibt die Beleglage und ist keine Wahrscheinlichkeitsschätzung.