Warum KI-Detektoren funktionieren: Post-Training macht Sprachmodelle eintönig

Warum KI-Detektoren funktionieren: Verhaltenstraining macht Sprachmodelle sprachlich eintönig
6/10 The Decoder (DE) 20.08.2026 Frontier-Modelle Policy & Ethik Research

Der Pangram-CTO Bradley Emi stellt eine interessante These auf: LLMs schreiben nicht wegen fundamentaler technischer Grenzen erkennbar und eintönig, sondern weil Post-Training und Sicherheitsvorgaben ihre Ausdrucksvielfalt drastisch reduzieren. Basismodelle ohne diese Eingriffe zeigen bereits deutlich vielfältigere Schreibweisen. Das erklärt auch, warum KI-Detektoren überhaupt funktionieren – sie nutzen diese charakteristische Eintönigkeit als erkennungsmerkmal. Der Befund wirft Fragen über das Verhältnis von Sicherheit und Natürlichkeit auf.

Zum Originalartikel