145 Artikel
Labs & Industrie GPT-Red: OpenAI's automatisiertes Red-Teaming durch Self-Play

OpenAI stellt GPT-Red vor, ein System zur automatisierten Sicherheitsprüfung von KI-Modellen durch Self-Play-Mechaniken.

15.07.2026 · OpenAI Blog
Labs & Industrie Claude antwortet auf Hindi besonders warm, auf Russisch besonders streng: Wie Sprache KI-Verhalten lenkt

Anthropic zeigt in einer neuen Studie, dass Claudes Werte und Tonalität je nach Sprache systematisch variieren – ein Befund mit Konsequenzen für KI-Bias und globale Fairness.

14.07.2026 · The Decoder (DE)
Agenten & Tool-Use Turing-Preisträger Sutton gründet Oak Lab – neue Ära für eigenständig lernende KI-Agenten

Richard Sutton, Pionier des Reinforcement Learning, startet ein Startup in Toronto mit dem Ziel, KI-Agenten zu entwickeln, die kontinuierlich aus ihrer Umgebung lernen – und kritisiert dabei aktuelle Deep-Learning-Ansätze als fundamental begrenzt.

13.07.2026 · The Decoder (DE)
Labs & Industrie 200 Forscher und Nobelpreisträger warnen vor KI-Umbruch größer als Industrielle Revolution

Top-Ökonomen und KI-Experten fordern sofortiges Handeln: Die KI-Transformation könnte größer ausfallen als die Industrielle Revolution, spielt sich aber in deutlich kürzerer Zeit ab.

13.07.2026 · The Decoder (DE)
Architektur-Innovation Distillation im LLM-Zeitalter: Wenn der Schüler dem Meister antwortet

Ein Überblick über die Evolution von Distillation-Techniken bei Frontier-Modellen und ihre wachsende Bedeutung in der modernen KI-Entwicklung.

13.07.2026 · The Sequence
Frontier-Modelle Anthropic öffnet Claudes "Gedankenlesen": Neue Transparenz-Tools für KI-Systeme

Anthropic enthüllt J-Lens: ein Tool zur Visualisierung und Bearbeitung von Claudes internem Reasoning-Prozess – ein Durchbruch für KI-Interpretierbarkeit und Transparenz.

13.07.2026 · AI Daily Brief (YT)
Enterprise Google trainiert Gesundheits-Foundation-Model mit einer Milliarde Minuten Wearable-Daten

Google präsentiert SensorFM, ein Foundation Model, das aus massiven Mengen von Fitbit- und Pixel-Watch-Daten lernt und etablierte Gesundheitsmodelle übertrifft.

13.07.2026 · The Decoder (DE)
Policy & Ethik LinkedIn und die KI-Slop-Flut: 41 Prozent automatisch generierte Langform-Inhalte

LinkedIn dominiert mit 41 Prozent KI-generierten Langform-Posts – Forschung zeigt, dass die Plattform zur „KI-Slop-Schleuder" unter Social Media wird.

12.07.2026 · The Decoder (DE)
Agenten & Tool-Use Slay the Spire 2 als Härtetest: Forscher zerlegen das Gedächtnis von LLM-Agenten

Ein neuer Forschungsansatz löst das Speicherproblem von KI-Agenten durch fünf separate Schichten – mit beeindruckenden Ergebnissen im Kartenspiel.

12.07.2026 · The Decoder (DE)
Agenten & Tool-Use GPT-5.6 Sol Ultra: KI beweist 50 Jahre altes Mathematik-Rätsel

OpenAIs neues Sprachmodell mit Agenten-Schwarm hat die legendäre Cycle Double Cover Conjecture gelöst – doch Mathematiker streiten, ob das echte mathematische Innovation ist.

11.07.2026 · The Decoder (DE)
Policy & Ethik Terrormilizen missbrauchen ChatGPT und Claude für Angriffsplanung

Eine Cambridge-Studie zeigt: Boko Haram und ISIS-Verbindete nutzen gängige KI-Chatbots gezielt für Waffenbau und Operationsplanung – die Sicherheitsfilter der Anbieter bieten keinen zuverlässigen Schutz.

11.07.2026 · The Decoder (DE)
Architektur-Innovation Chinesisches Labor stellt "Orca" vor: Weltmodell revolutioniert Roboter-Training ohne Aktionsdaten

BAAI präsentiert ein neues Weltmodell namens Orca, das statt Tokens abstrakte Weltzustände vorhersagt und mit 125.000 Stunden ungekennzeichneter Videos trainiert wurde.

11.07.2026 · The Decoder (DE)
Frontier-Modelle GPT-5.6 Sol: OpenAI demonstriert KI-gesteuerte Modell-Selbstverbesserung

OpenAIs neues Modell GPT-5.6 Sol hat eigenständig ein kleineres Modell nachtrainiert – ein Schritt hin zu autonomen KI-Forschern.

10.07.2026 · The Decoder (DE)
Enterprise Das richtige Umfeld für KI: Wenn Verifizierbarkeit allein nicht reicht

Eine Analyse darüber, welche Eigenschaften von Anwendungsdomänen KI-Systeme erfolgreich machen – und warum Verifizierbarkeit nur ein Teil des Bildes ist.

09.07.2026 · The Sequence
Frontier-Modelle Mistral betritt die Robotik: 8B-Modell navigiert mit nur einer Kamera

Mistral lanciert Robostral Navigate, ein spezialisiertes 8B-Modell, das Roboter allein per RGB-Kamera durch unbekannte Umgebungen lenkt – ein Einstieg in ein neues Anwendungsfeld für den französischen KI-Konzern.

08.07.2026 · The Decoder (DE)
Benchmarks & Evals Zweifel an SWE-Bench Pro: OpenAI attackiert populäres Coding-Benchmark

OpenAI veröffentlicht Analyse, die erhebliche Fehler in SWE-Bench Pro aufdeckt und die Zuverlässigkeit eines der wichtigsten Coding-Evaluierungs-Standards in Frage stellt.

08.07.2026 · OpenAI Blog
Frontier-Modelle KI denkt jetzt wirklich – oder doch nur anders?

Ein Gedankenexperiment über die neuen Fähigkeiten moderner Sprachmodelle und was „echtes Denken" überhaupt bedeutet.

08.07.2026 · Matthew Berman (YT)
Architektur-Innovation Wie KI wirklich funktioniert: Neue Forschung zu J-Space und Global Workspace

Anthropic und Transformer Circuits veröffentlichen Forschung zum Mechanismus hinter KI-Modellen – ein Durchbruch im Verständnis von Informationsverarbeitung in neuronalen Netzwerken.

08.07.2026 · Matthew Berman (YT)
Architektur-Innovation Lilian Weng fasst 35 Papiere zu Harness Engineering zusammen

Eine ruhige Nachrichtenlage ermöglicht einen tiefen Blick auf Lernmechanismen in modernen KI-Systemen.

08.07.2026 · Latent Space
Architektur-Innovation Die Entwicklung der Modell-Destillation: Ein historischer Überblick

Ein Rückblick auf die Grundlagenpapiere und Techniken, die die moderne Modell-Destillation ermöglicht haben.

07.07.2026 · The Sequence