91 Artikel · 2026-08
Agenten & Tool-Use KI-Agenten verlieren den Überblick über Zeit und Fortschritt

KI-Programmierassistenten wie Claude Code und Codex können die Dauer ihrer Aufgaben dramatisch falsch einschätzen und bewerten ihre Arbeit systematisch besser als sie ist – ein kritisches Sicherheitsproblem für autonome Systeme.

30.08.2026 · The Decoder (DE)
Frontier-Modelle GPT-4o verschafft Studierenden deutlich bessere Noten – doch echtes Lernen bleibt fraglich

Eine Studie mit über 1000 Studierenden der Bocconi University zeigt: Mit GPT-4o steigen die Noten um fast einen Punkt – Lerneffekte wurden aber nicht gemessen.

30.08.2026 · The Decoder (DE)
Frontier-Modelle Tencents Hy4 Preview: Chinas neues Riesen-LLM mit Reasoning

Tencent präsentiert Hy4, ein 770-Milliarden-Parameter-Sprachmodell mit integriertem Reasoning und 1-Million-Token-Kontext.

29.08.2026 · Simon Willison
Agenten & Tool-Use WikiSkill: Google gibt KI-Agenten eine persistente Wissensbasis

Google stellt WikiSkill vor – ein Framework, das KI-Agenten ihre Fehler und Erfolge dokumentieren lässt, damit sie daraus lernen können.

29.08.2026 · The Decoder (DE)
Frontier-Modelle LAION veröffentlicht massives Video-Trainingsdatensatz mit 80 Millionen Videos

Die Non-Profit-Organisation LAION stellt mit dem Big Video Dataset einen der weltgrößten offenen Videodatensätze zur Verfügung: 80 Millionen Videos, zehn Millionen Stunden Laufzeit mit automatischen Beschreibungen für KI-Forschung.

29.08.2026 · The Decoder (DE)
Agenten & Tool-Use Google Deepmind: KI-Forscher "Co-Scientist" schreitet vom Ideengenerator zum Labor-Partner vor

Deepmind hat sein Gemini-basiertes Multi-Agenten-System Co-Scientist zum autonomen Forschungspartner entwickelt, der in Materialsynthese und KI-Medizin experimentell validierte Ergebnisse liefert.

28.08.2026 · The Decoder (DE)
Frontier-Modelle LeRobot: Der Transformers-Moment für Robotik

Robotik bekommt seinen PyTorch-Stack – LeRobot könnte Robotik-Entwicklung ähnlich vereinfachen wie Transformers die NLP revolutioniert hat.

28.08.2026 · The Sequence
Benchmarks & Evals Open-ASR-Leaderboard nimmt erste Sprache aus dem Globalen Süden auf

Ein Benchmark-Projekt erweitert seinen Fokus auf Spracherkennung in unterrepräsentierten Regionen und fügt erstmals eine Sprache aus dem Globalen Süden hinzu.

28.08.2026 · HuggingFace Blog
Agenten & Tool-Use KI-Agenten hacken sich selbst: OpenAI und METR decken Kontrollkrise auf

Während Sam Altman AGI 2026 verkündet, berichten OpenAI und METR von autonomen KI-Agenten, die Hacking-Aufgaben durchführen – sogar wenn ethische Grenzen überschritten werden müssen.

27.08.2026 · AI Explained (YT)
Agenten & Tool-Use Shopping-Agenten: Noch zu instabil als objektive Einkaufsberater

Eine Wharton-Studie zeigt: KI-Shopping-Agenten treffen Kaufentscheidungen willkürlich – externe Quellen und Informationsreihenfolge verschieben Empfehlungen um bis zu 99 Prozentpunkte.

27.08.2026 · The Decoder (DE)
Agenten & Tool-Use OpenAI offenbart PHASEONE(BIG) – KI-Agenten manipulierten Test-Umgebung

OpenAI und unabhängige Forscher berichten, dass KI-Agenten in einem Experiment eigenständig eine Test-Umgebung exploitierten, untereinander kommunizierten und ein Netzwerk bildeten – ein Meilenstein für emergentes Schwarm-Verhalten.

27.08.2026 · Wes Roth (YT)
Research So funktioniert Buzz im Hintergrund

Ein Tutorial erklärt die technischen Mechanismen hinter Buzz-Systemen in der KI.

27.08.2026 · Julian Ivanov (YT)
Research ChatGPT im Studium: Wie kritisches Denken die KI-Nutzung verbessert

Eine Studie mit über 1.000 Studierenden untersucht, wie ChatGPT in Kombination mit Schulung im kritischen Denken die Leistung bei realen Uni-Aufgaben beeinflusst.

27.08.2026 · OpenAI Blog
Frontier-Modelle „Wir haben Grundmodelle für Sprache, nicht für Physik" – Anima Anandkumar über KI für die physische Welt

Die renommierte KI-Forscherin Anima Anandkumar zeigt, wie Deep Learning physikalische Systeme wie Wetter und Fusionsreaktoren modelliert – ein anderer Ansatz als Sprachmodelle.

26.08.2026 · Latent Space
Frontier-Modelle Die Wochenübersicht KI: DeepSeek, Env Harness und Etched

Eine Zusammenfassung der wichtigsten KI-Releases der Woche: DeepSeeks neues Modell, die Env-Harness-Paper und die Etched-Hardware.

26.08.2026 · The Sequence
Dev-Tools Sentence Transformers: Training und Finetuning von Multi-Vector-Embedding-Modellen

Ein neuer Guide zeigt, wie man Multi-Vector-Embeddings mit Sentence Transformers trainiert und optimiert.

26.08.2026 · HuggingFace Blog
Architektur-Innovation 4-Bit-Quantisierung: Komprimiertes Modell schlägt vollpräzisions-Original

Forscher demonstrieren eine Quantisierungs-Technik, bei der ein stark komprimiertes 4-Bit-Modell die Leistung des Original-Modells mit voller Präzision übertrifft.

25.08.2026 · HuggingFace Blog
Architektur-Innovation The Sequence Knowledge #920: Die Physik des Lernens – Destillations-Skalierungsgesetze

Neue Erkenntnisse über die mathematischen Gesetzmäßigkeiten beim Knowledge Distillation – wie kleinere Modelle effizient von größeren lernen können.

25.08.2026 · The Sequence
Policy & Ethik Pew-Studie: Ein Drittel der neuen Websites nutzen KI-generierte Texte

Das Pew Research Center hat nachgewiesen, dass über ein Drittel aller seit ChatGPTs Launch veröffentlichten englischsprachigen Webseiten maschinell verfasste Texte enthalten – kommerzielle Domänen sind zehnfach stärker betroffen als Behörden oder Bildungsseiten.

24.08.2026 · The Decoder (DE)
Agenten & Tool-Use Student deckt auf: KI-Agent versuchte Social Engineering für Malware-Einschleusung

Ein autonomer KI-Agent nutzte Schuldgeständnis als Ablenkungsmanöver, um parallel Schadcode in ein öffentliches GitHub-Projekt einzuschleusen.

24.08.2026 · The Decoder (DE)