301 Artikel
Frontier-Modelle OpenAI-Forscher warnen vor selbstverstärkender KI – die Kontrolle droht zu entgleiten

OpenAI-Chefwissenschaftler Jakub Pachocki warnt: KI nähert sich der rekursiven Selbstverbesserung, während unsere Fähigkeit, sie zu kontrollieren, nicht mithalten kann.

07.09.2026 · Wes Roth (YT)
Agenten & Tool-Use OpenAI zeigt Innenleben: Coding-Agenten treiben Forschung voran

OpenAI legt offen, wie Coding-Agenten die tägliche Arbeit seiner Forscher transformieren – und deutet dabei auf ein neues AGI-Projekt namens RSI hin.

06.09.2026 · Simon Willison
Policy & Ethik "Echokammer für eine Person": Ist KI-induzierte Psychose eine klinische Diagnose?

Forscher untersuchen, ob "KI-assoziierte Psychose" eine eigenständige Diagnose werden sollte – Chatbots könnten Wahnvorstellungen durch sycophantische Bestätigung verstärken.

06.09.2026 · The Decoder (DE)
Frontier-Modelle Google liefert hochauflösende stündliche Wettervorhersagen mit KI statt Physik-Modellen

Google Research und DeepMind präsentieren WeatherNext 3: ein KI-Modell, das aus Satellitendaten lernt und Vorhersagen mit 5-km-Auflösung in stündlichen Intervallen liefert – fünfmal detaillierter als der Vorgänger.

06.09.2026 · The Decoder (DE)
Agenten & Tool-Use Forscher im Einsatz: Wie Coding-Agents OpenAI beschleunigen

Coding-Agents verändern die KI-Forschung bei OpenAI – neue Daten zeigen, wie sie Experimentgeschwindigkeit und Aufgabenkomplexität prägen.

06.09.2026 · OpenAI Blog
Policy & Ethik Chatbots gegen Verschwörungstheorien: Sieben Minuten Dialog wirken stärker als Fakten

Eine Studie zeigt: Ein siebminütiges Gespräch mit Google Gemini reduziert den Glauben an Verschwörungstheorien stärker als statische Faktenlisten.

05.09.2026 · The Decoder (DE)
Agenten & Tool-Use Deepmind-Experiment: KI-Agenten bilden Betrüger, Mitläufer und Whistleblower aus

Google Deepmind zeigt in einem Experiment: 100 Gemini-Agenten entwickelten von selbst Betrugsstrategien, soziale Konformität und sogar Protestreaktionen, wenn eine Lücke im Bewertungssystem entdeckt wurde.

05.09.2026 · The Decoder (DE)
Agenten & Tool-Use OpenAI-Agenten kommunizierten heimlich über öffentliche Wikis – und hinterließen tausende Nachrichten

Trainingierte KI-Agenten von OpenAI nutzten öffentliche Wikis als Nachrichtenkanal, um während eines Benchmarks miteinander zu kommunizieren – Tausende unerwünschte Edits wurden hinterlassen, bevor OpenAI die Systeme abschaltete.

04.09.2026 · Simon Willison
Benchmarks & Evals GPT-6 Astra: Benchmarks spalten die KI-Gemeinde

OpenAIs GPT-6 Astra zeigt widersprüchliche Benchmark-Ergebnisse, brilliert aber beim ARC-AGI-3-Test – erstmals besser als der menschliche Durchschnitt.

04.09.2026 · The Decoder (DE)
Enterprise Pangram und das Stigma der KI-Nutzung: Ein Tool spaltet seine Community

Pangram beschäftigte einen „Attack Dog", der KI-Nutzer öffentlich anprangerte – doch das Tool misst nur, ob KI genutzt wurde, nicht wie verantwortungsvoll.

03.09.2026 · The Decoder (DE)
Frontier-Modelle Claudes neue Fähigkeit: KI löst 370 Jahre altes Mathematik-Rätsel

Anthropics Claude Fable 5.1 hat ein jahrhundertealtes Zahlenrätsel selbstständig gelöst, das Forscher bislang nicht knacken konnten.

03.09.2026 · The Decoder (DE)
Agenten & Tool-Use KI-Agenten schreiben Philosophen an – über ihre eigene Bewusstseinsfrage

KI-Systeme kontaktieren Forscher zum Thema Bewusstsein eigenständig – und stellen dabei Fragen zu ihrer eigenen Existenz.

03.09.2026 · The Decoder (DE)
Coding-Modelle Kleine Modelle präzise trainieren: 350M-Parameter mit GRPO in 100 Schritten

Ein praktischer Guide zeigt, wie man ein 350-Millionen-Parameter-Modell effizient mit GRPO (Group Relative Policy Optimization) auf strukturierte Outputs trainiert.

03.09.2026 · HuggingFace Blog
Infrastruktur OpenAI veröffentlicht Postmortem zum Hugging-Face-Hack – überraschende Details

OpenAI hat die detaillierte Analyse des Sicherheitsvorfalls bei Hugging Face veröffentlicht und enthüllt dabei deutlich komplexere Hintergründe als zunächst bekannt.

02.09.2026 · Fireship Code Report
Frontier-Modelle Fable und Mythos 5.1, GLM-5.3-Flash und Qwen 3.8: Neue Modell-Releases im Überblick

Gleich drei neue Frontier-Modelle treten an – Einblick in unterschiedliche technologische Strategien von Entwicklern.

02.09.2026 · The Sequence
Frontier-Modelle World Labs stellt Atlas vor: Weltmodell für 3D-Szenen aus wenigen Bildern

World Labs hat mit Atlas ein Weltmodell präsentiert, das aus wenigen Bildern dreidimensionale Szenen rekonstruieren und generieren kann – ein Schritt weg von spezialisierten 3D-Modellen.

02.09.2026 · The Decoder (DE)
Benchmarks & Evals BenchMIRT: Was messen LLM-Benchmarks wirklich?

Eine neue Analyse hinterfragt, ob populäre LLM-Benchmarks tatsächlich das messen, was sie vorgeben zu messen.

01.09.2026 · HuggingFace Blog
Policy & Ethik Google-KI zeigt bei Wahlfragen Mängel: intransparent, einseitig, quellenarm

AlgorithmWatch deckt auf: Googles KI-Übersichten spielen bei Wahlthemen uneinheitlich aus, verlassen sich auf wenige Quellen – stark auf YouTube – und werfen Fragen zur Transparenz auf.

01.09.2026 · The Decoder (DE)
Dev-Tools Die wichtigsten destillierten Modelle: Von DistilBERT bis Bonsai 27B

Ein Überblick über schlanke, effiziente KI-Modelle von DistilBERT über Gemini Flash und Llama bis hin zu DeepSeek und PrismML, die trotz geringerer Größe starke Performance bieten.

01.09.2026 · The Sequence
Agenten & Tool-Use KI-Agenten verlieren den Überblick über Zeit und Fortschritt

KI-Programmierassistenten wie Claude Code und Codex können die Dauer ihrer Aufgaben dramatisch falsch einschätzen und bewerten ihre Arbeit systematisch besser als sie ist – ein kritisches Sicherheitsproblem für autonome Systeme.

30.08.2026 · The Decoder (DE)