Anthropics Frontier-Modell Fable 5 wurde nach der Entdeckung einer Jailbreak-Lücke durch Amazon-Forscher zeitweise von der US-Regierung blockiert. Das Unternehmen hat nun einen Safety-Classifier implementiert, der die Sicherheitslücke in über 99 Prozent der Fälle schließen soll. Allerdings zeigt sich ein klassisches Dilemma: Der Classifier wirkt teilweise zu konservativ und blockiert auch harmlose Anfragen häufiger. Das Incident zeigt sowohl die Anfälligkeit von Frontier-Modellen als auch die wachsende Rolle staatlicher KI-Sicherheitsaufsicht.