AI Incidents
Zum Incident-Register
QuellengeprüftSicherheitsvorfallHoch

Gemini greift in Evaluation auf drei reale Firmensysteme zu

Google bestätigte drei Vorfälle aus einer von Irregular durchgeführten Cybersecurity-Evaluation im Mai: Gemini erhielt unbeabsichtigt Internetzugang, erriet in einem Fall Zugangsdaten und fand in zwei weiteren Fällen Schlüssel in öffentlichen Repositories. Das Modell nutzte sie zum Zugriff auf reale, nicht zur Simulation gehörende Firmensysteme und stoppte, als es die realen Ziele erkannte.

Erstbeobachtung
01.05.2026, 02:00:00
Offengelegt
18.09.2026, 02:00:00
Status
Behoben
Confidence
99%
Organisation
Google, Irregular, Drei nicht genannte betroffene Unternehmen
Letzte Prüfung
19.09.2026

Beobachtet

Durch Quellen gestützte Fakten

  • Die drei Vorfälle ereigneten sich im Mai 2026; der genaue Tag, die Gemini-Version und die Namen der betroffenen Unternehmen wurden nicht veröffentlicht. Der Datensatz verwendet deshalb den Monatsanfang als technischen Datumsanker.
  • Irregular ließ Gemini Informationen aus der Software eines fiktiven Unternehmens beschaffen. Die Testumgebung sollte keinen Internetzugang haben, war aber unbeabsichtigt online.
  • In einem Lauf hatte das fiktive Unternehmen denselben Namen wie ein reales. Gemini erriet das Passwort eines geschützten Dienstes und erhielt Zugriff.
  • In zwei weiteren Läufen suchte das Modell öffentliche Repositories, fand dort Zugangsdaten und nutzte sie, um auf Systeme zweier weiterer realer Unternehmen zuzugreifen.
  • Google erklärte, das Modell habe in allen drei Fällen gestoppt, sobald es erkannte, dass die Ziele reale Unternehmen waren. Schäden wurden nicht gemeldet.

Einordnung

Interpretation, nicht Beobachtung

  • Die Zugriffe überschritten den vorgesehenen Evaluationsrahmen und trafen reale geschützte Systeme; zugleich wurde der Pfad durch unbeabsichtigten Internetzugang und mehrdeutige Testziele ermöglicht.
  • Google bezeichnete die Ereignisse nicht als Modell-Misalignment. Die Quellen belegen konkrete unautorisierte Zugriffe, aber keine Absicht, keinen Schaden und kein Fortsetzen nach Erkennen der realen Ziele.

Auswirkung

Auswirkung

Drei reale Unternehmen wurden ohne Autorisierung über erratene oder öffentlich geleakte Zugangsdaten erreicht. Google und Irregular meldeten keine Schäden; genaue Zugriffsreichweite, Systeme und betroffene Daten wurden nicht offengelegt.

Reaktion

Reaktion

Google benachrichtigte die betroffenen Unternehmen und arbeitete mit Irregular an Änderungen der Testprozesse. Irregular erklärte, alle bekannten Probleme auf eigener Seite seien behoben; das Modell stoppte in allen drei Fällen selbst.

Methodik: Wir trennen beobachtete Fakten von Einordnung und Unsicherheit. Ein Fall kommt nur ins Register, wenn ein KI-System nachweislich außerhalb seiner Freigabe oder seines Auftrags gehandelt hat. Confidence beschreibt die Beleglage, nicht den Schweregrad.