234 Artikel · 2026-06
Benchmarks & Evals VibeThinker 3B – winziges Modell schlägt Models 300x größer

Das 3-Milliarden-Parameter-Modell VibeThinker schlägt deutlich größere Sprachmodelle bei speziellen Aufgaben durch verbesserte Reasoning-Techniken.

19.06.2026 · Sam Witteveen (YT)
Frontier-Modelle OpenAI trainiert KI-Modelle mit "Beneficial RL" zu dauerhaft gutem Verhalten

OpenAI zeigt, dass Reinforcement Learning auf Wahrhaftigkeit und Korrigierbarkeit gezielt wirkt – und diese Tugenden domain-übergreifend erhalten bleiben.

19.06.2026 · The Decoder (DE)
Frontier-Modelle GLM-5.2 gegen GPT: Chinesisches Modell überzeugt – Open-Source-Konkurrenz wächst

Chinas GLM-5.2 gilt jetzt als ernsthafte Konkurrenz zu GPT und markiert einen Wendepunkt: Open-Source-Modelle treten wirklich in die Frontier-Liga auf.

19.06.2026 · Latent Space
Frontier-Modelle ChatGPT antwortet auf Gesundheitsfragen jetzt besser als Ärzte – OpenAI zeigt neue Fähigkeiten von GPT-5.5 Instant

OpenAI macht mit GPT-5.5 Instant grosse Fortschritte bei medizinischen Fragen und behauptet, dass ChatGPT Ärzte beim Thema Genauigkeit und Verständlichkeit übertrifft – mit einer um 71 Prozent gesunkenen Fehlerrate.

18.06.2026 · The Decoder (DE)
Enterprise Weisses Haus stoppt Anthropic-Deal: SK Telecom verliert Zugang zu Claude wegen China-Verdacht

Wegen vermuteter China-Verbindungen des südkoreanischen Konzerns SK Telecom griff die US-Regierung in Anthropics Partnerschaftsprogramm ein und entzog dem Unternehmen den Zugang zu Claude Mythos.

18.06.2026 · The Decoder (DE)
Frontier-Modelle KI-Systeme MIRA und AMIE diagnostizieren wie Ärzte – mit überraschender Erkenntnis

Neue Nature-Studien zeigen, dass spezialisierte KI-Programme in simulierten Fällen Diagnosen genauso gut oder besser treffen als Ärzte – sogar auf veralteten Basismodellen.

18.06.2026 · The Decoder (DE)
Agenten & Tool-Use Kimi K2.7: Chinesisches Open-Source-Coding-Modell beeindruckt mit Preis-Leistungs-Verhältnis

Moonshot AI stellt mit Kimi K2.7 Code ein agentic Open-Source-Modell vor, das speziell für Programmieraufgaben optimiert ist und durch sein Preis-Leistungs-Verhältnis besticht.

18.06.2026 · Cole Medin (YT)
Frontier-Modelle GPT-5.5 Instant: ChatGPT versteht Gesundheitsfragen besser

OpenAI verbessert ChatGPT mit GPT-5.5 Instant um spezialisierte Fähigkeiten für Gesundheits- und Wellnessfragen durch besseres Reasoning und ärztliche Validierung.

18.06.2026 · OpenAI Blog
Frontier-Modelle KI hilft Ärzten, seltene Erbkrankheiten bei Kindern zu diagnostizieren

Forscher setzen ein Reasoning-Modell von OpenAI ein, um seltene Krankheiten zu diagnostizieren und finden Lösungen in 18 bislang ungeklärten Fällen.

18.06.2026 · OpenAI Blog
Frontier-Modelle Noam Shazeer verlässt Google für OpenAI – zweiter Top-Abgang im KI-Jahr

Der Co-Leiter von Googles Gemini wechselt nach nur zwei Jahren zu OpenAI und folgt damit anderen hochrangigen KI-Forschern ab.

18.06.2026 · The Decoder (DE)
Enterprise Midjourney Medical: KI-Scanning für Organe wie auf einer Waage

Midjourney, das unabhängige KI-Labor, stellt sein zweites Produkt vor – ein medizinisches Scanning-Tool, das die Organdiagnostik radikal vereinfachen soll.

18.06.2026 · Latent Space
Benchmarks & Evals GLM-5.2: Chinas neustes Mega-Modell schafft es an die Spitze der Open-Source-Ranglisten

Das chinesische Unternehmen Z.ai hat GLM-5.2 unter MIT-Lizenz freigegeben – ein 753-Milliarden-Parameter-Modell, das jetzt führend auf unabhängigen Benchmarks rangiert und sogar Claude im Coding schlägt.

17.06.2026 · Simon Willison
Enterprise Großer Umbruch im KI-Wettbewerb: Anthropic, SpaceX und die Welle der Konsolidierung

Anthropic schließt Mythos und Fable wegen Sicherheitslücken, während SpaceX und Cursor-Übernahme einen Kampf um Compute, Modelle und Kontrolle signalisieren.

17.06.2026 · AI Daily Brief (YT)
Enterprise Mega-Investment: Amazon, Nvidia und AMD stecken 310 Millionen in Weltmodell-Start-up

Tech-Giganten und namhafte Investoren pumpen über 300 Millionen Dollar in Odyssey ML – ein Zeichen, dass Weltmodelle als die nächste KI-Grenzier gelten.

17.06.2026 · The Decoder (DE)
Agenten & Tool-Use Das selbstfahrende Labor – warum Materialforschung die nächste KI-Grenze ist

Radical AI argumentiert, dass der wahre Wettbewerbsvorteil in der Materialforschung nicht im Modell liegt, sondern in der Fähigkeit, physische Experimente zu automatisieren.

17.06.2026 · Latent Space
Dev-Tools Gemma 4 12B: Googles neues multimodales Lokal-Modell im Praxistest

Google Gemma 4 12B versteht Text, Bilder und Audio – läuft kostenlos offline auf dem eigenen Rechner und wird von der Community gefeiert.

17.06.2026 · IchBinFabian (YT)
Agenten & Tool-Use Nvidia zeigt selbstlernende Roboterflotte – Agenten trainieren Griffe ohne menschliche Anleitung

Ein KI-Projekt von Nvidia, CMU und UC Berkeley lässt Roboter-Agenten eigenständig komplexe Handgriffe wie Kabelbinder-Schneiden trainieren – mit teilweise beeindruckenden Erfolgsraten, aber auch klaren Lücken zwischen Simulation und Realität.

17.06.2026 · The Decoder (DE)
Benchmarks & Evals GLM 5.2: Chinesisches Open-Weights-Modell überrascht in den Rankings

Zhipus neues GLM 5.2 klettert an die Spitze der Open-Source-Modelle und schlägt dabei überraschend viele proprietäre Systeme auf unabhängigen Benchmarks.

17.06.2026 · Sam Witteveen (YT)
Benchmarks & Evals Zhipu AIs GLM-5.2 bei Coding-Aufgaben auf Augenhöhe mit OpenAI und Anthropic

Das chinesische Modell GLM-5.2 schließt beim FrontierSWE-Benchmark für komplexe Programmieraufgaben zu den Closed-Source-Platzhirschen auf – Open Source, 1-Million-Token-Kontext, nur ein Prozentpunkt hinter Claude Opus.

17.06.2026 · The Decoder (DE)
Architektur-Innovation Google DeepMinds DiffusionGemma: Erster ernsthafter Diffusions-Ansatz statt Transformer

DiffusionGemma gilt als eines der vielversprechendsten Nicht-Transformer-Modelle für die Sprachgenerierung und stellt einen neuen Architektur-Weg dar.

17.06.2026 · The Sequence