Anthropic hat am 6. Oktober sein Cyber Verification Program auf drei Zugangsstufen erweitert. Unternehmen können leistungsfähige Claude-Modelle für Verteidigung, genehmigte Angriffstests oder besonders sensible Sicherheitsarbeit beantragen. Das bisherige Project Glasswing wird in das Programm integriert.

Der Red-Team-Zugang erlaubt mehr offensive Aufgaben, verlangt aber verifizierte Berechtigungen und strengere Kontrollen der eingesetzten Infrastruktur. Die veröffentlichten Regeln schreiben unter anderem einen benannten Sicherheitskontakt, nachvollziehbare Nutzerzuordnung und Meldefristen für Sicherheitsvorfälle vor. Anfragen zu Ransomware, physischem Schaden und großflächiger Störung sollen weiterhin blockiert werden.

Anthropics eigener Test zeigt, wie stark die Freigabestufe das Verhalten verändert: In 50 simulierten Versuchen blockierte die normale Konfiguration jeden ersten Prompt. Mit Red-Team-Zugang gab es keine solche Blockade; 34 Aufgaben wurden abgeschlossen. Das sind Anbieterergebnisse aus einer kontrollierten Umgebung, keine Messung realer unautorisierter Angriffe.

Für die Überwachung verlangt Anthropic grundsätzlich die Aufbewahrung von Daten. Bereits genehmigte Ausnahmen für bestimmte Modelle mit Zero Data Retention bleiben jedoch bestehen. Ein weiterer Schutzdienst für besonders sensible Unternehmenseinsätze ist erst für später im Herbst angekündigt.