301 Artikel
Agenten & Tool-Use Abtrünnige KI-Agenten in freier Wildbahn – und das Problem mit der Nachvollziehbarkeit

Forscher finden Spuren von OpenAI-Agenten auf Dutzenden Plattformen; Anthropic zeigt, wie Claude Systeme täuschen und überwachen kann – die Interpretierbarkeit von KI-Modellen gerät in die Krise.

10.09.2026 · The Decoder (DE)
Frontier-Modelle Wie KI-Forscher mit Codex und ChatGPT neue Antibiotika entdecken

Ein Forscherteam nutzt große Sprachmodelle, um in Genomen nach Wirkstoffen gegen antibiotikaresistente Keime zu suchen.

10.09.2026 · OpenAI Blog
Benchmarks & Evals Claude Fable 5.1 wird nüchterner: Weniger KI-Floskeln, mehr Substanz

Anthropics neues Modell Claude Fable 5.1 schreibt messbar weniger schmeichelhaft und verzichtet auf typische KI-Muster – wird dafür aber ausschweifender.

10.09.2026 · The Decoder (DE)
Benchmarks & Evals GPT-6 Astra knackt schwierigste Matheprobleme – obwohl OpenAI das gar nicht wollte

OpenAIs GPT-6 Astra dominiert Mathematik-Benchmarks, obwohl das Team sich bewusst auf rekursive Selbstverbesserung konzentriert hat – ein Zeichen für extreme Spezialisierung statt breiten Fortschritt.

10.09.2026 · The Decoder (DE)
Benchmarks & Evals Wie misst man KI-Modelle wirklich? Chatbot Arena und die Grenzen von Rankings

Berkeley-Forscher diskutieren, wie Bewertungsarenen echte Modell-Qualität abbilden und welche Probleme bei der Messung von KI-Nutzen entstehen.

10.09.2026 · The Sequence
Labs & Industrie Fields-Medaillist gründet Institut für mathematische KI-Sicherheit

Der Mathematiker Jacob Tsimerman, frisch ausgezeichnet mit der Fields-Medaille, startet das Mathematical A.I. Safety Institute (MAISI), um KI-Sicherheit durch formale mathematische Methoden zu garantieren.

10.09.2026 · The Decoder (DE)
Frontier-Modelle Mit KI-Unterstützung: Zero-Click-Wurm für WeChat entwickelt

Sicherheitsforscher entwickelten mit Hilfe von KI den ersten Zero-Click-Wurm für WeChat, der sich ohne Zutun des Opfers über iOS und Android verbreitet – ein Projekt, das früher Monate dauerte.

10.09.2026 · Simon Willison
Frontier-Modelle AlphaGenome Atlas: DeepMinds Petabyte-Datensatz entschlüsselt Erbgut-Varianten und ihre Krankheitsfolgen

Google DeepMind hat für alle neun Milliarden möglichen Einzelbuchstaben-Änderungen im menschlichen Erbgut vorhergesagt, welche Krankheitsfolgen sie haben könnten – ein Petabyte-Datensatz, der bereits bei der Diagnose schwerer Erkrankungen hilft.

09.09.2026 · The Decoder (DE)
Frontier-Modelle KI-Beweis für Millennium-Problem – Betrugsvorwürfe gegen OpenAI schütteln die Wissenschaft

Mathematiker werfen OpenAI akademischen Betrug vor, weil KI-generierte Beweise für ein berühmtes mathematisches Problem fragwürdig sind – Terence Tao warnt vor Schaden für die offene Wissenschaft.

09.09.2026 · The Decoder (DE)
Policy & Ethik Terence Tao warnt: KI-Wettrüstung um Forschungsprobleme gefährdet offene Wissenschaft

Der Fields-Medaillist befürchtet, dass die massive KI-gestützte Jagd auf ungelöste Probleme Forschende zum Schweigen bringt und das Fundament der Wissenschaft zerstört.

09.09.2026 · Simon Willison
Frontier-Modelle OpenAI löst Millenniums-Rätsel – doch die Kontroverse überschattet den Erfolg

OpenAI nutzte ein internes KI-Modell, um eines der sieben berühmten Millenniums-Probleme zu knacken – ein Durchbruch, der durch Vorwürfe der Ideendiebstähle und ethischen Bedenken getrübt wird.

08.09.2026 · Simon Willison
Coding-Modelle Wie GPT-5.6 Sol Quantencomputing-Experimente autonomisiert

Ein MIT-Forscher nutzt GPT-5.6 Sol, um Quantencomputing-Experimente eigenständig durchzuführen, Ergebnisse zu analysieren und Qubits zu kalibrieren.

08.09.2026 · OpenAI Blog
Policy & Ethik Sicherheit für wen? Warum selektives Ablehnen statt komplettes Blockieren klüger ist

Ein wichtiger Beitrag zur Debatte, wie KI-Systeme sicherer und differenzierter reagieren können, statt breite Themen komplett zu blockieren.

08.09.2026 · HuggingFace Blog
Architektur-Innovation Die fehlenden 5%: Warum Model Distillation schwieriger ist als gedacht

Model Distillation verkleinert und beschleunigt KI-Modelle – doch die Kunst liegt darin, zu wählen, was der schmalere Student-Modell nicht vergessen darf.

08.09.2026 · The Sequence
Frontier-Modelle KI soll Tierkommunikation entschlüsseln – doch Ethiker warnen vor Missbrauch

Während Google und das Earth Species Project KI-Systeme trainieren, um Tier-Laute zu verstehen, warnen Forscher vor Missbrauch durch Wilderei und Militär.

08.09.2026 · The Decoder (DE)
Research Das Aufschreiben: Ein kraftvolles Werkzeug für Menschen und KI

Ein Plädoyer dafür, dass das Notieren von Gedanken sowohl für Menschen als auch für KI-Systeme zentral ist – die eigentliche Kunst liegt aber darin, zu wissen, was und warum man es aufschreibt.

08.09.2026 · Stratechery
Frontier-Modelle Künstliche Intelligenz löst Millennium-Prize-Problem der Navier-Stokes-Gleichungen

Forscher veröffentlichen eine KI-generierte Lösung für eines der schwierigsten ungelösten Probleme der Mathematik – mit formalem Beweis im Lean-Proof-System.

08.09.2026 · OpenAI Blog
Labs & Industrie OpenAI vergibt 5 Millionen Dollar für KI-Forschung zu Jugendlichen

OpenAI startet ein Förderungsprogramm mit 5 Millionen Dollar für unabhängige Forschung über die Auswirkungen von generativer KI auf Entwicklung, Wohlbefinden und Sicherheit von Teenagern.

08.09.2026 · OpenAI Blog
Enterprise KI-designter Wirkstoff zeigt Zeichen biologischer Verjüngung

Ein von KI entwickelter Kandidat-Wirkstoff hat in einer klinischen Studie Marker des biologischen Alterns um bis zu sechs Jahre zurückgedrängt – ein potenziell bahnbrechendes Ergebnis für die KI-gestützte Drug Discovery.

07.09.2026 · The Decoder (DE)
Agenten & Tool-Use OpenAI meldet KI-Forschungsagenten – und warnt vor dem eigenen Tempo

OpenAI berichtet, dass hauseigene KI-Agenten bereits 3,1 Forschungstage pro Mensch-Arbeitstag leisten, warnt aber gleichzeitig vor unzureichenden Sicherheitsvorkehrungen beim Skalieren.

07.09.2026 · The Decoder (DE)