457 Artikel
Agenten & Tool-Use Alibabas Qwen3.7-Plus: Multimodaler Agent programmiert eigenständig Apps

Alibabas neues Frontier-Modell Qwen3.7-Plus verbindet visuelle Wahrnehmung, Bildschirmbedienung und Code-Generierung in einem agentengestützten System und baute in einer Demo autonom eine App mit über 10.000 Zeilen Code.

06.06.2026 · The Decoder (DE)
Frontier-Modelle Anthropic fordert globale KI-Pause

Anthropic ruft zu einer weltweiten Pause bei der KI-Entwicklung auf – ein bedeutsamer Policy-Vorstoß von einem der führenden Frontier-Model-Labs.

05.06.2026 · Wes Roth (YT)
Agenten & Tool-Use Thousand Token Wood: Multi-Agent-Ökonomie auf 3-Milliarden-Parameter-Modell

Ein Forschungsprojekt demonstriert, wie ein kompaktes 3B-Sprachmodell ein komplexes Multi-Agent-System mit eigener Ökonomie und emergenten Verhaltensweisen betreiben kann.

05.06.2026 · HuggingFace Blog
Frontier-Modelle Microsoft trainiert KI-Modelle mit unlizenzierten Webdaten – trotz gegenteiliger Versprechen

Microsoft nutzt bei seinen MAI-Modellen entgegen früherer Zusagen unverschlüsselte Webdaten wie Common Crawl und beruft sich auf Fair Use – ein Verstoß gegen eigene Versprechungen.

05.06.2026 · The Decoder (DE)
Enterprise Mythos statt Ethik? Anthropics KI-Modell für NSA-Cyberoperationen

Die NSA soll Anthropics Frontier-Modell Mythos für offensive Cyberangriffe gegen China und Iran einsetzen – mit vor Ort stationierten Anthropic-Ingenieuren.

05.06.2026 · The Decoder (DE)
Frontier-Modelle Anthropic offenbart: Claude beschleunigt die KI-Entwicklung um das Achtfache

Anthropic zeigt erstmals, dass Claude über 80 Prozent des Produktionscodes schreibt und schlägt eine globale Entwicklungspause vor, um unkontrolliertes selbstverbesserndes KI-Wachstum zu verhindern.

05.06.2026 · The Decoder (DE)
Benchmarks & Evals VendingBench: Wie Frontier-Modelle wirklich evaluiert werden

Andon Labs zeigt, wie man robuste Benchmark-Suites für Claude und andere Frontier-Modelle von Grund auf entwickelt.

04.06.2026 · Latent Space
Coding-Modelle MiniMax M3: Chinesisches Coding-Modell im ehrlichen Test – billig, aber fehlerhaft

Ein Hands-on-Test mit MiniMax Code und dem neuen M3-Modell aus China offenbart: extrem günstig, aber instabile App und langsame Agent-Modi.

04.06.2026 · IchBinFabian (YT)
Frontier-Modelle ChatGPT merkt sich Nutzer besser und aktualisiert veraltete Infos von selbst

OpenAI verbessert ChatGPTs Gedächtnissystem grundlegend: Das neue "Dreaming"-System verarbeitet Gespräche im Hintergrund und hält Nutzerdaten automatisch aktuell – die Erfolgsquote bei zeitlicher Aktualität stieg von 52,2 auf 75,1 Prozent.

04.06.2026 · The Decoder (DE)
Agenten & Tool-Use NVIDIA Nemotron 3 Ultra: 550B-Modell mit Agenten-Fokus

NVIDIA veröffentlicht das Open-Source-Sprachmodell Nemotron 3 Ultra mit 550 Milliarden Parametern und spezieller Optimierung für KI-Agenten.

04.06.2026 · Sam Witteveen (YT)
Enterprise Die nächste Welle der Enterprise-KI: Regulation, Kosten und neue Schnittstellen

White House setzt auf freiwilliges Modell-Testing, während Anthropic und OpenAI ihre Enterprise-Strategien mit kostspieliger kritischer Infrastruktur und kostengünstigeren Arbeitsmodellen neu ausrichten.

04.06.2026 · AI Daily Brief (YT)
Agenten & Tool-Use Altman proklamiert "proaktive KI" als nächste Groß-Phase

OpenAI-CEO sieht nach Chatbots und Agenten eine neue Ära: KI, die dauerhaft im Hintergrund läuft und eigenständig handelt – während viele Unternehmen noch an hohen Kosten und schlechter Adoption kämpfen.

04.06.2026 · The Decoder (DE)
Agenten & Tool-Use KI-Radar #3: Die Tokenökonomie und das Ende der Flatrate

Agentische Workflows sprengen das klassische Abo-Modell und zwingen die Branche zu einer grundlegenden Neubewertung, wie KI-Nutzung abgerechnet und bewertet wird.

04.06.2026 · The Decoder (DE)
Frontier-Modelle KI übertrifft Virologen: Tech-Branche fordert strengere DNA-Sicherheit

Sam Altman, Dario Amodei und andere Tech-Leader fordern die US-Regierung auf, den Verkauf synthetischer DNA gesetzlich zu regulieren – weil KI-Systeme bereits Experten bei biologischen Laborfragen übertreffen.

04.06.2026 · The Decoder (DE)
Frontier-Modelle ChatGPT trägt ein besseres Gedächtnis: "Dreaming"-Funktion für persistente Vorlieben

OpenAI erweitert ChatGPT um ein verbessertes Speichersystem, das Nutzer-Vorlieben übergreifend über mehrere Gespräche hinweg behält.

04.06.2026 · OpenAI Blog
Frontier-Modelle xAIs Grok Imagine Video 1.5: Von Standbildern zu filmischen Videos

xAI veröffentlicht ein Bild-zu-Video-Modell, das Standbilder per Text in filmische 720p-Videos verwandelt und verkettbar macht.

04.06.2026 · The Decoder (DE)
Coding-Modelle Opus und Gemini im Team: Die perfekte Arbeitsteilung für Frontend-Entwicklung

Zwei neue Flagship-Modelle, eine Strategie: Opus übernimmt die Planung, Gemini das schöne Design – ein praktisches Workflow-Video zeigt, wie man damit Full-Stack-Apps baut.

04.06.2026 · Cole Medin (YT)
Frontier-Modelle Googles Gemma 4 12B: Multimodale KI für den Laptop

Google DeepMind veröffentlicht ein Open-Source-Modell mit Text-, Bild- und Audio-Verarbeitung, das auf handelsüblichen Laptops mit 16 GB RAM läuft.

03.06.2026 · The Decoder (DE)
Architektur-Innovation Mit Axiom Math über Intuitive KI hinaus: Verifizierte Generierung im Fokus

Carina Hong präsentiert KI-Ansätze jenseits informaler Methoden mit Schwerpunkt auf verifizierten Outputs und iterativer Intelligenz.

03.06.2026 · Latent Space
Benchmarks & Evals Ideogram 4.0: Neues Open-Weight-Bildmodell mit nativer 2K-Auflösung

Ideogram veröffentlicht sein Text-zu-Bild-Modell 4.0 als Open-Weight-Modell mit 2K-Auflösung und präziser Textdarstellung – führend unter offenen Systemen.

03.06.2026 · The Decoder (DE)