AI Incidents
Zum Veröffentlichungsregister
RisikosignalInsider-WarnungKein Incident

Anthropic-Alignment-Leiter Evan Hubinger beziffert persönliches Auslöschungsrisiko auf über zehn Prozent

Evan Hubinger, Leiter der Alignment Science bei Anthropic, erklärte in einem persönlichen öffentlichen Beitrag, er halte eine durch KI verursachte Auslöschung der Menschheit innerhalb des nächsten Jahrzehnts für wahrscheinlicher als zehn Prozent. Zugleich sagte er, Anthropic bemühe sich, habe aber noch keinen Plan zur Ausrichtung von Superintelligenz und sei nicht klar auf dem Weg zu einem solchen Plan.

Veröffentlicht
09.09.2026
Signaltyp
Insider-Warnung
Confidence
99%
Organisation
Anthropic
Quellen
3
Letzte Prüfung
19.09.2026

Einordnung

Was dieses Signal verändert

Der kanonische Originalbeitrag ist eindeutig identifiziert und wird durch mehrere unabhängige Berichte mit identischem Wortlaut bestätigt. Hubingers Rolle als Leiter der Alignment Science verleiht der Aussage fachliche und institutionelle Nähe, sie bleibt jedoch ausdrücklich eine persönliche Risikoeinschätzung. Seine Aussage kombiniert eine konkrete Zehnjahres-Schätzung mit der Behauptung, für die Ausrichtung einer möglichen Superintelligenz existiere noch kein belastbarer Plan.

Beleggrenze

Was die Belege nicht zeigen

Die Angabe über zehn Prozent ist keine Anthropic-Prognose, keine empirisch kalibrierte Eintrittswahrscheinlichkeit und kein Beleg für unmittelbar bevorstehenden Kontrollverlust. Hubinger präzisierte den Bezug auf künftige Superintelligenz; daraus folgt nicht, dass heutige Systeme ein entsprechendes Risiko tragen. Das Signal verändert Incident-Zähler und Timeline nicht und wirkt nur über den begrenzten Kontextfaktor des Kontrollverlust-Scores.

Klassifikation: Diese Seite dokumentiert eine belegte Warnung, Forschungserkenntnis, politische Maßnahme oder Branchenreaktion. Sie ist bewusst vom Incident-Register getrennt und beweist keine unbefugte Handlung eines KI-Systems.