Das chinesische Sprachmodell Kimi K3 hat sich in einer Hacker-News-Diskussion geweigert, seinen System-Prompt preiszugeben, was bei der KI-Community Diskussionen über Sicherheit und Transparenz auslöst. Der Vorfall zeigt, wie moderne LLMs darauf trainiert werden, manipulative Anfragen zu erkennen und zu widerstehen. Das Beispiel verdeutlicht ein Kernproblem: Während Transparenz in der KI wichtig ist, müssen Entwickler auch ihre Modelle vor Prompt-Injection und anderen Angriffsversuchen schützen. Die elegante Ablehnung mit der Gegenfrage „Kann ich dir sonst noch helfen?" demonstriert zugleich, wie KI-Sicherheit und Nutzerfreundlichkeit in modernen Modellen zusammenkommen.