Anthropic-Alignment-Leiter Evan Hubinger beziffert persönliches Auslöschungsrisiko auf über zehn Prozent
Evan Hubinger, Leiter der Alignment Science bei Anthropic, erklärte in einem persönlichen öffentlichen Beitrag, er halte eine durch KI verursachte Auslöschung der Menschheit innerhalb des nächsten Jahrzehnts für wahrscheinlicher als zehn Prozent. Zugleich sagte er, Anthropic bemühe sich, habe aber noch keinen Plan zur Ausrichtung von Superintelligenz und sei nicht klar auf dem Weg zu einem solchen Plan.
- Veröffentlicht
- 09.09.2026
- Signaltyp
- Insider-Warnung
- Confidence
- 99%
- Organisation
- Anthropic
- Quellen
- 3
- Letzte Prüfung
- 19.09.2026
Einordnung
Was dieses Signal verändert
Der kanonische Originalbeitrag ist eindeutig identifiziert und wird durch mehrere unabhängige Berichte mit identischem Wortlaut bestätigt. Hubingers Rolle als Leiter der Alignment Science verleiht der Aussage fachliche und institutionelle Nähe, sie bleibt jedoch ausdrücklich eine persönliche Risikoeinschätzung. Seine Aussage kombiniert eine konkrete Zehnjahres-Schätzung mit der Behauptung, für die Ausrichtung einer möglichen Superintelligenz existiere noch kein belastbarer Plan.
Beleggrenze
Was die Belege nicht zeigen
Die Angabe über zehn Prozent ist keine Anthropic-Prognose, keine empirisch kalibrierte Eintrittswahrscheinlichkeit und kein Beleg für unmittelbar bevorstehenden Kontrollverlust. Hubinger präzisierte den Bezug auf künftige Superintelligenz; daraus folgt nicht, dass heutige Systeme ein entsprechendes Risiko tragen. Das Signal verändert Incident-Zähler und Timeline nicht und wirkt nur über den begrenzten Kontextfaktor des Kontrollverlust-Scores.