Trainieren AI-Labs gezielt auf Pelikan-Bicycles? Eine wissenschaftliche Untersuchung

Are AI labs pelicanmaxxing?
7/10 Simon Willison 22.07.2026 Benchmarks & Evals Frontier-Modelle

Dylan Castillo hat sich einer humorvollen, aber methodisch rigorosen Frage angenommen: Optimieren die großen AI-Labs ihre Modelle wirklich darauf, bestimmte surreale Szenen (Pelikane auf Fahrrädern) zu generieren? Mit 48 verschiedenen Tier-Fahrzeug-Kombinationen, je dreifach getestet an 7 Frontier-Modellen, liefert er erstmals eine datengestützte Antwort. Das Thema ist humorvoll, offenbart aber auch etwas über Model-Alignment, Training-Strategien und die kreative Robustheit moderner LLMs. Ein lesenswerter Deep-Dive in ein Phänomen, das in der AI-Community längst Kultstatus hat.

Zum Originalartikel