Anthropic-Forscher haben Claude Mythos erfolgreich eingesetzt, um mathematische Schwachstellen in den Kryptographie-Verfahren HAWK und einer schwächeren AES-Variante zu entdecken. Das Modell brauchte dabei extensive Prompting durch Menschen, die es zur Ausdauer ermutigten und vor zu einfachen Lösungen bewahrten – insgesamt etwa 100.000 Dollar Rechenkosten über 60 Stunden. Parallel entstand mit Universitäten (ETH Zürich, Tel Aviv, Haifa) ein neuer Benchmark namens CryptanalysisBench zur Bewertung von KI-Fähigkeiten in der Kryptoanalyse. Das Projekt zeigt sowohl das Potenzial von LLMs bei hochspezialisierten Forschungsaufgaben als auch die praktische Bedeutung von iterativen Prompting-Strategien.