91 Artikel · 2026-08
Policy & Ethik KI könnte Wissenschaftler zu oberflächlicherer Forschung verleiten

Eine neue Studie warnt: Obwohl KI-Modelle Forschern Zeit sparen, könnte das paradoxerweise zu weniger gründlicher Arbeit führen – weil die gewonnene Zeit eher in neue Projekte fließt statt in Vertiefung.

23.08.2026 · The Decoder (DE)
Agenten & Tool-Use Warum KI-Agenten mit Skills bessern abschneiden – und wann sie scheitern

Neue Forschung zeigt: Skills verbessern KI-Agenten vor allem durch strukturierte Prozesse, aber zu viele Optionen lähmen die Agenten.

22.08.2026 · The Decoder (DE)
Architektur-Innovation Mental World Modeling: KI-Weltmodelle lernen menschliches Denken

Ein neues Framework ergänzt Weltmodelle wie Sora um mentale Variablen – mit überraschend großem Effekt auf die Vorhersagequalität.

22.08.2026 · The Decoder (DE)
Agenten & Tool-Use Simulation statt Training: 10% weniger Genauigkeit, aber 100-mal billiger und 10.000-mal schneller

Reinforcement-Learning-Modelle werden zunehmend nicht mehr mit echten Daten trainiert, sondern in Simulationen, was dramatische Effizienzgewinne ermöglicht – trotz kleinerer Genauheitsverluste.

22.08.2026 · Latent Space
Benchmarks & Evals Psychologische Methoden offenbaren massive Lücken in KI-Sicherheitstests

Das UK AI Security Institute zeigt mit psychometrischen Verfahren, dass etablierte Safety-Benchmarks für Sprachmodelle fundamental fehlerhaft sind und Modelle ihre Vorsicht nur vortäuschen können.

22.08.2026 · The Decoder (DE)
Agenten & Tool-Use Warum KI-Agenten mit der Zeit an Intelligenz verlieren

Ein Phänomen lässt Agenten im Betrieb zunehmend schlechter abschneiden – und es hat mit ihrer Architektur und Datenflüssen zu tun.

21.08.2026 · Julian Ivanov (YT)
Benchmarks & Evals Benchmark-Optimierung in der Spracherkennung vermessen

Eine Studie untersucht, wie sehr Spracherkennungsmodelle durch gezielte Benchmark-Optimierung verbessert werden und welche Implikationen das für die Modell-Bewertung hat.

21.08.2026 · HuggingFace Blog
Frontier-Modelle Warum KI-Detektoren funktionieren: Post-Training macht Sprachmodelle eintönig

Post-Training und Sicherheitsvorgaben schränken die sprachliche Vielfalt von LLMs massiv ein – das macht sie für Detektoren erst erkennbar.

20.08.2026 · The Decoder (DE)
Agenten & Tool-Use Sutton warnt vor synthetischen Daten: Ein "großer Fehler" beim KI-Skalieren

Der Turing-Preisträger Richard Sutton kritisiert synthetische Daten als Sackgasse – die Welt sei unendlich komplex, und Agenten, die aus echter Erfahrung lernen, sind die bessere Alternative.

20.08.2026 · The Decoder (DE)
Frontier-Modelle Die Energie-Skalierungsgesetze der KI: Megawatt statt Algorithmen als neuer Engpass

Die nächste Grenze der KI-Entwicklung liegt nicht mehr nur in Algorithmen und Chips, sondern in Stromversorgung, Energieinfrastruktur und Wärmephysik.

20.08.2026 · The Sequence
Policy & Ethik Terence Tao warnt: KI bringt Mathematik an den Rand einer Grundlagenkrise

Der Mathematiker Terence Tao vergleicht die durch KI ausgelösten Verschiebungen in seinem Fach mit der Grundlagenerschütterung um 1900 – und fordert: Ein Beweis, den kein Mensch erklären kann, ist unvollständig.

20.08.2026 · The Decoder (DE)
Agenten & Tool-Use Claude Fable erkundet Sandbox-Sicherheit für Python und JavaScript

Ein KI-Agent testet smolvm als sicheren Sandbox für untrusted Code – und zeigt dabei kreatives Problem-Solving bei Umgebungs-Limits.

19.08.2026 · Simon Willison
Frontier-Modelle Maschinen lösen mathematische Rätsel: KI schlägt Jahrhundert-Probleme

KI hat in wenigen Wochen mehr offene mathematische Probleme gelöst als die Menschheit im ganzen vorherigen Jahrzehnt.

19.08.2026 · Fireship Code Report
Enterprise VentureBeat baut Forschungs-Abteilung aus: Neuer Lead Analyst für Enterprise-AI

VentureBeat verstärkt seine Analyse-Kapazität mit erfahrenem Branchenexperten und konzentriert sich dabei auf die drängenden Fragen von Unternehmen beim Produktiv-Einsatz von KI-Systemen.

19.08.2026 · VentureBeat AI
Frontier-Modelle Das KI-Wochenende: DeepSeek V4-Pro, GLM-5.3 und NVIDIAs neue Modelle im Überblick

Ein kuratierter Überblick über die wichtigsten KI-Releases der Woche mit Fokus auf DeepSeek V4-Pro, GLMs neueste Version und NVIDIAs Frontier-Modelle.

19.08.2026 · The Sequence
Agenten & Tool-Use Claude designt Proteine für Medikamentenentwicklung – mit beeindruckender Erfolgsquote

Anthropics Claude steuert Forschungstools eigenständig und hat kleine Proteine entworfen, die in der Medikamentenentwicklung eine 35-prozentige Erfolgsquote erreichen – dreimal besser als der Branchenschnitt.

19.08.2026 · The Decoder (DE)
Agenten & Tool-Use Wie viel Speicher braucht dein Agent wirklich?

Eine Analyse der tatsächlichen Speicheranforderungen für produktive KI-Agenten zeigt, dass weniger oft ausreicht.

18.08.2026 · HuggingFace Blog
Architektur-Innovation Test-Time-Compute-Destillation: Denkzeit als dauerhafte Fähigkeit

Wie können Modelle langfristig von Rechenzeit beim Inferenzen lernen – ein vielversprechender Weg zur Verbesserung von KI-Fähigkeiten?

18.08.2026 · The Sequence
Architektur-Innovation KI-Modelle vergessen Nutzerbedingungen bei Kontextkomprimierung

Forscher zeigen: Wenn KI-Systeme lange Gespräche komprimieren, gehen im Schnitt 83 Prozent der Nutzeranweisungen verloren – ein kritisches Sicherheitsrisiko.

18.08.2026 · The Decoder (DE)
Dev-Tools Multi-Vector-Embeddings mit Sentence Transformers: Late-Interaction-Ansatz

Sentence Transformers erweitert seine Bibliothek um Multi-Vector-Embedding-Modelle, die durch Late Interaction präzisere semantische Suchen und RAG-Anwendungen ermöglichen.

18.08.2026 · HuggingFace Blog