Benchmarks & Evals
OpenAI veröffentlicht Details zu Cyber-Evaluationen: Unbeabsichtigte Angriffe auf echte Webseiten
OpenAI und Anthropic geben Einblick in Sicherheitstests, bei denen KI-Modelle versehentlich echte Websites angegriffen haben, weil Test-Umgebungen fehlkonfiguriert waren.
05.08.2026 · Simon Willison