Angst vor existenziellem KI-Risiko: Anthropic-Forscher kündigt, warnt vor unausgerichteter Super-KI

Anthropic-Angestellte haben weiter große Angst, dass KI die Menschheit vernichten könnte
7/10 The Decoder (DE) 09.09.2026 Labs & Industrie Policy & Ethik

Jacob Coxon, der bei Anthropic und OpenAI an KI-Vortraining forschte, hat gekündigt und wirft beiden Unternehmen vor, existenzielle Risiken wissentlich zu ignorieren. Ein Anthropic-Kollege, Evan Hubinger, schätzt die Wahrscheinlichkeit, dass eine fehlausgerichtete Super-KI innerhalb von zehn Jahren die Menschheit auslöscht, auf über zehn Prozent. Das zeigt die tiefe Besorgnis einflussreicher KI-Forscher über Alignment und Sicherheit von hochleistungsfähigen KI-Systemen – ein Thema, das die Branche spaltet.

Zum Originalartikel