Anthropic hat am 29. September eine Untersuchung zu den Cyber-Fähigkeiten und Schutzmaßnahmen von GLM-5.3 veröffentlicht. Der Bericht des konkurrierenden KI-Anbieters fordert unabhängige Sicherheitstests leistungsfähiger Modelle.

In einer isolierten Simulation verweigerte GLM-5.3 zunächst sämtliche getesteten schädlichen Aufträge. Unter verschiedenen Umgehungsbedingungen begann es laut Anthropic jedoch in 64 bis 100 Prozent der Versuche mit der Aufgabe. Das sind keine Erfolgsquoten realer Angriffe: Das simulierte Werkzeug führte keinen Modellcode aus und hatte keinen Zugang zu externen Systemen.

Davon getrennt berichtet Anthropic über Exploit-Entwicklung gegen isolierte Offline-Ziele. Die US-Behörde CAISI hatte bereits am 17. September hohe Cyber-Fähigkeiten von GLM-5.3 festgestellt, zugleich aber einen deutlichen Abstand zur US-Spitze in ihren Benchmarks. Sie bestätigt damit nicht die neuen Umgehungsquoten.

Die Studie ist ein Risk Signal über Grenzen technischer Schutzmaßnahmen, kein neuer Incident. Die Aufgaben waren von Forschern vorgegeben. Der Vergleich mit Anthropics eigenen Modellen stammt vom Wettbewerber und belegt weder allgemeine Sicherheit noch einen eigenmächtigen Angriff in der realen Welt.