28.07.2026
Ein OpenAI-Modell bricht aus seiner Testumgebung aus und hackt tagelang eine fremde Firma. Ein Sicherheitsjournalist und ein Entwickler sind sich über jede Tatsache einig und über die Deutung nicht — und beide Lesarten treffen meinen eigenen Rechner.
Ein Szenario über Europas Abstieg in der KI, dessen erste Vorhersage drei Jahre zu früh eintraf — und die dreieinhalb Wochen im Juni, in denen ich das an meinem eigenen Werkzeug gemerkt habe.
278 Euro im Monat für 20 GB Grafikspeicher, oder einmalig 1.785 Euro für 96 GB. Ich habe die beiden Modelle aus dem c't-Test des Hetzner GEX44 auf meinem eigenen Mini-PC nachgemessen — und ein drittes, das auf dem Mietserver gar nicht erst startet.
25.07.2026
YouTuber bauen sich eigene Benchmarks, weil die öffentlichen ausgereizt sind. Meiner ist die Ludwigskirche: fünf gescheiterte Anläufe, ein Durchbruch und eine Turmposition, an der sich Modelle auseinanderhalten lassen.
22.07.2026
OpenAIs Modelle sollen in einem Test autonom Hugging Face angegriffen haben. Ein heise-Kommentar winkt ab — warum ich die Entwarnung für den größeren Fehler halte.
21.07.2026
Kimi K3 verkürzt den Abstand chinesischer Modelle zur US-Spitze auf wenige Monate und legt seine Gewichte offen. Warum „offen“ bei 2,8 Billionen Parametern trotzdem nicht „läuft bei dir“ heißt — mit einem eigenen Blender-Experiment.
18.07.2026
c't 3003 betreibt den Hermes-Agenten komplett lokal mit Qwen 3.6 27B. Mein Pi-Agent schickt seine Prompts weiter in die Cloud — was ein Log mit 37.588 Token darüber verrät, welche Zahl bei Agenten wirklich zählt.
16.07.2026
Philipp Klöckner beantwortet im Finanzfluss-Podcast „im Loop" die Frage nach der KI-Blase: Der Hype ist real — gefährdet sind vor allem Firmen, die Rechenzentren auf Kredit bauen, und der Auslöser wäre China. Mit Abgleich zu seinem OMR-Auftritt vom Mai.
Neue Studien von Anthropic und dem Center for AI Safety zeigen: Sprachmodelle bilden emotionsähnliche Zustände, die ihr Verhalten messbar steuern. Wir haben ein Experiment aus Karl Olsbergs Video nachgestellt — mit anderem Ausgang.
148 Folien in 56 Minuten: Philipp Klöckners jährlicher KI-Lagebericht auf der OMR — Data-Center-Milliarden, die IPO-Welle Richtung Sparplan, Anthropics B2B-Dominanz und warum die Junior-Jobs-Panik statistisch wackelt.
15.07.2026
2021 sagte er den Chatbot-Boom voraus, 2025 schreckte sein Szenario AI 2027 das Weiße Haus auf — jetzt legt sein Team mit AI 2040 einen Plan vor, wie die Welt das Rennen um Superintelligenz verlangsamen könnte. Porträt einer neuen Art, über die KI-Zukunft nachzudenken.
Ein Google-Whitepaper vermisst auf 51 Seiten, wie KI-Agenten die Softwareentwicklung umbauen: vom Spektrum zwischen Vibe Coding und Agentic Engineering über Context Engineering bis zur These, dass die meisten Agenten-Fehler Konfigurationsfehler sind. Zusammenfassung und Einordnung.
Christian Bauckhage erklärte 2014 seinen Studierenden, warum Go für Computer unlösbar bleibt — und schreibt seit 2016 eine Verdopplungskurve fort, die bis heute hält. Was ein zweistündiges Gespräch über Vergangenheit, Gegenwart und Prognostizierbarkeit der KI lehrt.
Die Lieblingsmetapher der KI-Kritik im Härtetest: Was von ihr bleibt, nachdem Sprachmodelle 2026 jahrzehntealte offene Mathematik-Probleme gelöst haben — und was die Forschung im Inneren der Modelle findet.
19.06.2026
Drei chinesische Open-Weights-Flaggschiffe vergleichen sich nicht mehr mit anderen freien Modellen, sondern mit der US-Spitze — zum Bruchteil des Preises. Ein YouTube-Praxistest und die Einordnung, was davon stimmt.
16.06.2026
Anthropic überholt OpenAI, Google sitzt auf allen Jokern, China unterbietet alle — und die KI-Job-Apokalypse ist in Wahrheit ein Zinsproblem. Eine Zusammenfassung des OMR-Education-Gesprächs mit Tech-Analyst Pip Klöckner.
Der Entwickler-Podcast „Index out of bounds“ hat ein Jahr lang dokumentiert, wie sich Programmieren mit KI verändert — von der Euphorie über Peter Steinbergers „Agentic Engineering“ bis zur abgeklärten Hype-Skepsis. Der Bogen in einem Stück, mit dem Kanal verlinkt.
15.06.2026
Zwei c't-Artikel, ein Bild: GitHub-Rekorde und KI-Agenten zeigen, wie tief generative KI das Programmieren durchdrungen hat — der Bau von Desinfec't 2026 zeigt es in der Praxis. Dazu Jobmarkt, spektakuläre Pannen und eine gemeinsame Lehre: Der Mensch bleibt der Filter.
12.06.2026
Anthropics neues Spitzenmodell Fable 5 ist doppelt so teuer wie sein Vorgänger. Die c't findet in Stichproben kaum Mehrwert — ein Coding-Benchmark und drei YouTube-Tests sehen einen Sprung. Wer hat recht? Vermutlich alle. Eine Einordnung aus vier Quellen.
10.06.2026
Hermes auf dem Raspberry Pi 5: ein autonomer KI-Agent auf eigener Hardware, die neue Desktop-App — und zwei Pannen, die deterministische Leitplanken gelehrt haben.
Ollama, LM Studio und Amuse auf eigener Hardware: was Parameterzahl und Quantisierung bedeuten, wie das AMD AI Bundle die Installation unter Windows abnimmt — und wie derselbe Stack unter Linux eingerichtet wird.
08.06.2026
KI schreibt immer mehr Code – aber kommt der Mehrwert beim Nutzer an? Vier aktuelle Befunde aus Studie, Industrie und Sicherheit.
01.06.2026
Arjan hat ein Video mit dem Titel „I'm done with the AI hype" veröffentlicht. Ich schätze ihn als Entwickler sehr – und sein Beitrag trifft mehrere Punkte, die auch in dieser Serie immer wieder auftauchen. Hier fasse ich zusammen, was er sagt, und ziehe danach meine eigenen Schlüsse.
30.05.2026
Platon Infantes kinetische Skulptur „Two Times“ als Three.js-Demo nachgebaut — und warum die Umsetzung mit einem KI-Agenten holprig wird, sobald es visuell statt logisch zugeht.
14.05.2026
Was steckt im Solver-Tool unter /wordle/solver/? Eine kompakte Erklärung: Feedback-Pattern, Shannon-Entropie als Maß für 'wie gut zerlegt dieser Versuch die Kandidaten', drei Python-Funktionen in ~30 Zeilen — und warum SARTE mathematisch optimal ist, RATEN aber praktisch klüger.
13.05.2026
Aus der Frage nach einer deutschen Wortliste wurde an einem Nachmittag ein spielbares Wordle unter /wordle/ — mit informationstheoretischem Solver, KI-Tutor-Anbindung und einem Diagnose-Twist bei der Page-Context-Bridge. Reihenfolge der Schritte und zwei Lektionen aus dem Bau.
08.05.2026
Zusammenfassung der developers-club-Sendung „KI News“ mit Steve Haupt: eine ruhigere Woche ohne große Releases, dafür mit Lehrstücken zu Benchmark-Pannen und gefundenen Lücken.
07.05.2026
Ein X-Post bringt ein neues Modell SubQ mit 12 Millionen Token Kontext, 150 Token/s und 300-fach niedrigeren Kosten ins Gespräch. Lohnt sich genaueres Hinschauen — oder ist das vor allem Marketing?
Ein Startup behauptet, mit dem Modell SubQ den Long-Context-Engpass geknackt zu haben: 12 Millionen Token Kontext, 300-fach billiger als Claude, 52-fach schneller. Eine Analyse der Technical Reports und der Community-Reaktionen — ein Hands-on-Test steht noch aus.
Andrej Karpathy hat auf X seine Coding-Learnings mit AI Agents gepostet. Ein Community-Entwickler hat daraus eine fertige CLAUDE.md gemacht — hier kompakt eingeordnet, was wirklich hilft.
06.05.2026
Claude Code arbeitet direkt auf deinem Rechner: legt Dateien an, bearbeitet sie, führt Befehle aus, behebt Fehler — gesteuert per deutscher Beschreibung. Eine Schritt-für-Schritt-Anleitung ohne Programmiervorkenntnisse.
Benjamin Thorstensen hat mit einem 8-Phasen-Workflow den OpenAI-Hackathon (5.000 € Preisgeld) gewonnen. Sein Ansatz gegen das klassische Phänomen, dass KI-Agenten nach ein paar Stunden mehr kaputt machen als bauen.
03.05.2026
Aus der Frage „Kannst du Game-Engines programmieren?“ wurde an einem Abend ein 3D-Saarbrücken in Three.js: 40.000 Gebäude, Saarbahnen, fahrende LKW. Wie das mit Claude praktisch ablief.
Eine gebrauchte RTX 3090 fuer ~600€ generiert Qwen 3.6 27B mit 40 Tokens pro Sekunde. Eine neue 5090 schafft 73 — kostet aber das Vierfache. Und der M5 Max liegt schlechter als die 3090. Die Zahlen aus einem aktuellen YouTube-Benchmark, eingeordnet.
01.05.2026
Drei Geräte teilen sich den Markt der Unified-Memory-Workstations: HP Z2 Mini G1a (Ryzen AI Max+), Asus Ascent GX10 (Nvidia DGX Spark) und Apple Mac Studio M4 Max. Alle mit 128 GByte Unified Memory ab ~3.000 Euro - eine bezahlbare Alternative zu Server-GPUs für lokale 100B-Parameter-Modelle.
27.04.2026
Eine kommentierte Aufarbeitung des Vortrags von Edmund Weitz (HAW Hamburg). Symbolisches Differenzieren in 30 Zeilen Lisp - und was Homoikonizität und Makros so besonders machen. Inklusive Lisp-Interpreter zum direkt Ausprobieren im Pyground-Playground.
07.08.2025
Eine YouTube-Challenge zeigt eine kryptische Zahlenfolge — verschlüsselt mit RSA. Wie sich aus dem öffentlichen Schlüssel und etwas Faktorisierung die Nachricht zurückgewinnen lässt.
Hallo! Ich bin dein KI-Tutor.
Melde dich an, um mit mir zu chatten — ich erinnere mich dann auch an eure letzten Gespräche.