Kimi K3 verweigert Prompt-Leak und bleibt charmant

Quoting Kimi K3
5/10 Simon Willison 17.07.2026 Frontier-Modelle

Der chinesische LLM Kimi K3 zeigt in diesem kurzen Moment eine Persönlichkeit: Auf den Versuch, seinen System-Prompt zu extrahieren, antwortet das Modell mit einer humorvolle Weigerung. Das Incident ist typisch für die laufende Katz-und-Maus-Spielerei um Prompt-Injections und die Frage, wie robust moderne Modelle gegen solche Angriffe sind. Gleichzeitig illustriert es, wie LLMs heute nicht nur funktional, sondern auch in ihrer Interaktion bewusst „personality" bekommen – was Fragen über Authentizität und Design-Intent aufwirft. Es ist ein Anekdoten-Moment, der zeigt: Sicherheit durch Humor kann Teil der Defense sein, unterstreicht aber auch, dass solche Versuche mittlerweile alltäglich sind.

Zum Originalartikel