METR veröffentlichte am 22. September 2026 eine Vorabprüfung von Claude Opus 5.5. Sie untersucht Forschungsfähigkeiten, nicht die sichere Ausrichtung des Modells.
Die Forschenden erwarten moderate Fortschritte gegenüber Fable 5.1. Vollständig automatisierte KI-Forschung halten sie mit diesem Modell für unwahrscheinlich.
Grundlage waren zehn Werktage API-Zugang und fünf Aufgaben. Bei schwierigen, längeren Arbeitsabläufen blieben Schwächen bestehen.
Anthropic durfte den Bericht prüfen und bearbeiten; METR bestätigte die Endfassung. Teile der zusätzlichen Belege sind nicht öffentlich. Die Ergebnisse rechtfertigen keine allgemeine Sicherheitsfreigabe.