Jacob Coxon, der bei Anthropic und OpenAI an KI-Vortraining forschte, hat gekündigt und wirft beiden Unternehmen vor, existenzielle Risiken wissentlich zu ignorieren. Ein Anthropic-Kollege, Evan Hubinger, schätzt die Wahrscheinlichkeit, dass eine fehlausgerichtete Super-KI innerhalb von zehn Jahren die Menschheit auslöscht, auf über zehn Prozent. Das zeigt die tiefe Besorgnis einflussreicher KI-Forscher über Alignment und Sicherheit von hochleistungsfähigen KI-Systemen – ein Thema, das die Branche spaltet.