-
AGI und die vierte Kränkung: warum ich den Begriff nicht mehr abtue
Blog
· 11.09.2026
Ein Modell hat ein Millennium-Problem gelöst, OpenAI schreibt einem Modell maßgeblichen Anteil an seiner eigenen Entwicklung zu: Warum ich AGI nicht mehr für ein Marketingwort halte und weshalb Freuds Kränkungen erklären, dass die Debatte trotzdem …
-
KI-Forscher warnt vor Auslöschung: was sich davon nachprüfen lässt
Blog
· 09.09.2026
Jacob Coxon wirft OpenAI und Anthropic vor, mit unser aller Leben zu spielen, ein Team-Lead im Haus stimmt ihm öffentlich zu. Die dramatischen Sätze lassen sich nicht messen — drei andere schon, mit Datum und …
-
Navier-Stokes: Eine KI hat ein Millennium-Problem gelöst
Blog
· 09.09.2026
Zum ersten Mal ist eine der sieben großen offenen Fragen der Mathematik von einer Maschine beantwortet worden: 88 Stunden Rechenzeit, 165 Seiten Beweis, formal geprüft in Lean. Was bewiesen ist, was noch offen bleibt und …
-
GPT-6 Astra: Weltrekord und vier Rückschritte
Blog
· 05.09.2026
OpenAIs neues Spitzenmodell löst einen Test, an dem ein halbes Jahr lang jedes Modell scheiterte — und fällt in vier von acht Messungen hinter seinen eigenen Vorgänger zurück. Was die Zahlen aus meinem Leaderboard über …
-
Die Ludwigskirche, vierter Anlauf: Fable 5.1 in 17 Minuten
Blog
· 02.09.2026
Dieselben drei Fotos, dieselbe Aufgabe wie im Mai: Fable 5.1 baut aus einem Prompt ein begehbares 3D-Modell der Ludwigskirche, findet in der Selbstprüfung sechs eigene Fehler und setzt den Turm auf Anhieb richtig. Mit Demo …
-
Fable 5.1: Cache zum Viertel, Denken nicht mehr abschaltbar
Blog
· 01.09.2026
Anthropics Fable 5.1 kostet pro Token so viel wie der Vorgänger, wiederverwendeter Kontext aber nur noch ein Viertel. Was der neue Denk-Regler kann, warum Anthropic und Artificial Analysis beim Preis zu gegensätzlichen Ergebnissen kommen, und …
-
Klöckners Trennlinie bekommt Risse
Blog
· 30.08.2026
Wer seine Rechenzentren aus laufenden Gewinnen zahlt, übersteht auch eine Fehlkalkulation — daran hing Klöckners Antwort auf die Blasenfrage. Der Fremdkapitalanteil der fünf großen Cloud-Konzerne ist seither von 9 auf 32 Prozent gestiegen.
-
Alles nur Marketing? 328 heise-Kommentare zu KI-Cyberangriffen
Blog
· 31.07.2026
Zwei KI-Modelle dringen in echte Firmennetze ein, die heise-Foren winken ab: PR-Stunt. Eine Auswertung von 328 Kommentaren zeigt, wie eine Fach-Community mit einer Gefahr umgeht, die nicht ins Weltbild passt.
-
RAG, Hybridsuche oder Wiki-Schicht: ein Faktencheck
Blog
· 30.07.2026
Ein Erklärvideo bestreitet die verbreitete Gleichsetzung von RAG mit einer Vektordatenbank. Der Abgleich mit den Primärquellen von Anthropic und Andrej Karpathy bestätigt die Zahlen und zeigt, welche praktisch wichtigste Technik dabei nur angedeutet wird.
-
Ein KI-Modell hackt Hugging Face: zwei Deutungen, eine falsch
Blog
· 28.07.2026
Ein OpenAI-Modell bricht aus seiner Testumgebung aus und hackt tagelang eine fremde Firma. Ein Sicherheitsjournalist und ein Entwickler sind sich über jede Tatsache einig und über die Deutung nicht — und beide Lesarten treffen meinen …
-
Verliert Europa den KI-Anschluss? Das Szenario Europe 2031
Blog
· 28.07.2026
Ein Szenario über Europas Abstieg in der KI, dessen erste Vorhersage drei Jahre zu früh eintraf — und die dreieinhalb Wochen im Juni, in denen ich das an meinem eigenen Werkzeug gemerkt habe.
-
KI-Cyberangriffe: Die Entwarnung geht am Risiko vorbei
Blog
· 22.07.2026
OpenAIs Modelle sollen in einem Test autonom Hugging Face angegriffen haben. Ein heise-Kommentar winkt ab — warum ich die Entwarnung für den größeren Fehler halte.
-
Gibt es die KI-Blase? Klöckner bei „im Loop"
Blog
· 16.07.2026
Philipp Klöckner beantwortet im Finanzfluss-Podcast „im Loop" die Frage nach der KI-Blase: Der Hype ist real — gefährdet sind vor allem Firmen, die Rechenzentren auf Kredit bauen, und der Auslöser wäre China. Mit Abgleich zu …
-
Wenn die KI Vorlieben hat: Funktionale Emotionen in Sprachmodellen
Blog
· 16.07.2026
Neue Studien von Anthropic und dem Center for AI Safety zeigen: Sprachmodelle bilden emotionsähnliche Zustände, die ihr Verhalten messbar steuern. Wir haben ein Experiment aus Karl Olsbergs Video nachgestellt — mit anderem Ausgang.
-
Beyond the AI Hype: Pip Klöckners OMR-Vortrag 2026 in 10 Minuten
Blog
· 16.07.2026
148 Folien in 56 Minuten: Philipp Klöckners jährlicher KI-Lagebericht auf der OMR — Data-Center-Milliarden, die IPO-Welle Richtung Sparplan, Anthropics B2B-Dominanz und warum die Junior-Jobs-Panik statistisch wackelt.
-
Abschied vom stochastischen Papagei: Was die Erdős-Beweise über LLMs sagen
Blog
· 15.07.2026
Die Lieblingsmetapher der KI-Kritik im Härtetest: Was von ihr bleibt, nachdem Sprachmodelle 2026 jahrzehntealte offene Mathematik-Probleme gelöst haben — und was die Forschung im Inneren der Modelle findet.
-
Open-Source-KI aus China holt auf: GLM 5.2, Kimi K2.7 und Minimax M3 im Test
Blog
· 19.06.2026
Drei chinesische Open-Weights-Flaggschiffe vergleichen sich nicht mehr mit anderen freien Modellen, sondern mit der US-Spitze — zum Bruchteil des Preises. Ein YouTube-Praxistest und die Einordnung, was davon stimmt.
-
Beyond the AI Hype: Pip Klöckners Lagebild zur KI 2026
Blog
· 16.06.2026
Anthropic überholt OpenAI, Google sitzt auf allen Jokern, China unterbietet alle — und die KI-Job-Apokalypse ist in Wahrheit ein Zinsproblem. Eine Zusammenfassung des OMR-Education-Gesprächs mit Tech-Analyst Pip Klöckner.
-
So viel Code wie nie: Wie KI die Softwareentwicklung verändert
Blog
· 15.06.2026
Zwei c't-Artikel, ein Bild: GitHub-Rekorde und KI-Agenten zeigen, wie tief generative KI das Programmieren durchdrungen hat — der Bau von Desinfec't 2026 zeigt es in der Praxis. Dazu Jobmarkt, spektakuläre Pannen und eine gemeinsame Lehre: …
-
Fable 5: Flop im Alltag, Sprung im Benchmark — wie passt das zusammen?
Blog
· 12.06.2026
Anthropics neues Spitzenmodell Fable 5 ist doppelt so teuer wie sein Vorgänger. Die c't findet in Stichproben kaum Mehrwert — ein Coding-Benchmark und drei YouTube-Tests sehen einen Sprung. Wer hat recht? Vermutlich alle. Eine Einordnung …
-
Mehr Code, neue Kosten, neue Risiken: vier KI-Befunde dieser Woche
Blog
· 08.06.2026
KI schreibt immer mehr Code – aber kommt der Mehrwert beim Nutzer an? Vier aktuelle Befunde aus Studie, Industrie und Sicherheit.
-
KI-Woche: Interaction Models, Colossus 1 als Anthropic-Anbau, Refactoring-Benchmarks
News-Wiki
· 15.05.2026
Interaction Models von Thinking Machines brechen mit der Turn-Logik. Anthropic mietet xAIs Colossus-1-Rechenzentrum komplett. Plus: METR-Benchmark stoesst bei 16 Stunden an seine Grenzen, neuer Refactoring-Benchmark misst innere Code-Qualitaet, OpenAI veroeffentlicht Security-Tools im Wochentakt.
-
Wordle auf Deutsch: ein Build-Bericht
Blog
· 13.05.2026
Aus der Frage nach einer deutschen Wortliste wurde an einem Nachmittag ein spielbares Wordle unter /wordle/ — mit informationstheoretischem Solver, KI-Tutor-Anbindung und einem Diagnose-Twist bei der Page-Context-Bridge. Reihenfolge der Schritte und zwei Lektionen aus dem …
-
KI News der Woche: Benchmarks, Pannen und gefundene Lücken (developers club YT channel)
Blog
· 08.05.2026
Zusammenfassung der developers-club-Sendung „KI News“ mit Steve Haupt: eine ruhigere Woche ohne große Releases, dafür mit Lehrstücken zu Benchmark-Pannen und gefundenen Lücken.
-
SubQ: Architektursprung oder Marketing? Eine Analyse
Blog
· 07.05.2026
Ein Startup behauptet, mit dem Modell SubQ den Long-Context-Engpass geknackt zu haben: 12 Millionen Token Kontext, 300-fach billiger als Claude, 52-fach schneller. Eine Analyse der Technical Reports und der Community-Reaktionen — ein Hands-on-Test steht noch …
-
Claude Code: Die Anleitung für Nicht-Programmierer
Blog
· 06.05.2026
Claude Code arbeitet direkt auf deinem Rechner: legt Dateien an, bearbeitet sie, führt Befehle aus, behebt Fehler — gesteuert per deutscher Beschreibung. Eine Schritt-für-Schritt-Anleitung ohne Programmiervorkenntnisse.
-
Browser-MCP-Server
Glossar
· 02.05.2026
## Definition Ein **Browser-MCP-Server** ist eine Variante eines [[MCP|MCP-Servers]], die Tools bereitstellt, die nur im Browser-Kontext Sinn ergeben — Lese-/Schreib-Zugriff auf den DOM, Local-Storage, Geolocation, Clipboard etc. Der LLM-Host kann damit *die Seite veraendern*, auf …
-
MCP (Model Context Protocol)
Glossar
· 02.05.2026
## Definition [[MCP]] (Model Context Protocol) ist Anthropics offener Standard fuer LLM-Tool-Kopplung. Statt jedes Werkzeug im Modell selbst zu kodieren, beschreibt ein **MCP-Server** seine Faehigkeiten als JSON-Schema; ein **MCP-Client** vermittelt zwischen LLM-Host und Server ueber …
-
Claude Code: Praktische Anwendungen & Tutorials
News-Wiki
· 30.04.2026
Claude Code ist Anthropics AI-gestütztes Coding- und Automatisierungs-Tool. Diese Seite sammelt praktische Tutorials, Setups und Entscheidungshilfen für konkrete Anwendungsfälle – von lokalen Homelab-Setups bis zu Browser-Automatisierung und Knowledge-Management. ## Lokale Infrastruktur & Hardware-Setup ### DIY-Homeserver …
-
Interpretierbarkeit und Transformer-Architektur
News-Wiki
· 30.04.2026
## Überblick Interpretierbarkeit von Transformer-Modellen beschreibt die Fähigkeit, Entscheidungen und interne Repräsentationen nachvollziehbar zu machen. Dies umfasst die Analyse von Aktivierungsmustern, die Verfolgung von Fehlerquellen und das Verständnis, wie Architektur-Entscheidungen die Lesbarkeit von Modell-Behavior beeinflussen. …
-
Risiken bei interner Frontier-Modell-Nutzung
News-Wiki
· 30.04.2026
## Übersicht Organisationen, die Frontier-Modelle intern nutzen – entweder zur Skalierung von Entwicklung, zur Datenverarbeitung oder als Basis für weitere Systeme – sehen sich mit mehreren Risiken konfrontiert. Diese reichen von Abhängigkeitsrisiken über Sicherheitsbedenken bis …
-
AI-Coding-Agenten & Code-Generierung
News-Wiki
· 30.04.2026
## Überblick AI-Coding-Agenten sind autonome Systeme, die Softwareentwicklung teilweise oder vollständig automatisieren. Sie kombinieren Large Language Models mit Code-Ausführung, Testing und iterativer Optimierung. Die Entwicklung bewegt sich von Ad-hoc-Prompting hin zu strukturierten, produktionsreifen Frameworks. ## …
-
Anthropic Geschäftszahlen und Marktposition
News-Wiki
· 30.04.2026
## Überblick Anthropic ist ein führendes KI-Sicherheitsunternehmen, das sich auf die Entwicklung großer Sprachmodelle (insbesondere die Claude-Familie) konzentriert. Das Unternehmen hat in den letzten Jahren signifikantes Wachstum und eine starke Marktposition aufgebaut. ## Finanzielle Kennzahlen …
-
Infrastruktur-Deployment (KI-Infrastruktur und Deployment)
News-Wiki
· 30.04.2026
## Übersicht Infrastruktur und Deployment sind zentrale Enabler für die praktische Nutzung von [Frontier-Modellen](/wiki/frontier-models/). Die Entscheidung zwischen lokaler Inferenz, Cloud-APIs und eigenem Datacenter-Betrieb wird durch Kosten, Verfügbarkeit und Performance-Anforderungen bestimmt. Die aktuelle Landschaft spaltet sich …
-
Spezialisierte Agent-Anwendungen
News-Wiki
· 30.04.2026
## Überblick Spezialisierte Agent-Anwendungen nutzen [KI-Agenten](/wiki/agents/grundlagen/) für domänenspezifische Aufgaben: Produktentwicklung, Marktforschung, wissenschaftliche Forschung, persönliches Wissensmanagement und Enterprise-Automation. Diese Anwendungen gehen über generische Chatbots hinaus und adressieren konkrete Business- oder Forschungsprobleme. ## Persönliches Wissensmanagement **KI-Second-Brain mit …
-
Agent-Modelle und Frontier-Leistung
News-Wiki
· 30.04.2026
## Überblick Agent-Modelle sind Sprachmodelle, die speziell für autonome, mehrstufige Aufgaben durch Tool-Use und Selbstüberwachung optimiert sind. Die Frontier-Entwicklung bewegt sich hin zu agentenbasierten Architekturen als Mainstream-Feature, nicht als Spezialisierung. ## Aktuelle Frontier-Modelle ### OpenAI …
-
Coding-Agenten in Produktion
News-Wiki
· 30.04.2026
## Überblick Coding-Agenten sind KI-Systeme, die autonome Softwareentwicklung durchführen: von Planung und Implementierung über Testing bis zum Deployment. Der Produktionseinsatz erfordert spezialisierte Architekturen, die zuverlässigkeit durch Validierungsschichten, Multi-Agent-Koordination und deterministische Kontrollmechanismen erhöhen statt auf einzelne …
-
KI-gestützte Design- und UI-Tools
News-Wiki
· 29.04.2026
## Übersicht KI-gestützte Design-Tools automatisieren und beschleunigen UI/UX-Design, Prototyping und visuelle Asset-Generierung. Sie nutzen [Language Models](/wiki/core/language-models/), [Agenten](/wiki/core/agents/) und Code-Generierung für schnelle Iteration von Designs bis zur Implementierung. ## Hauptlösungen ### Google Stitch Google Labs' Stitch …
-
Production AI Infrastructure & Harness Engineering
News-Wiki
· 29.04.2026
## Übersicht Production AI Infrastructure beschreibt die technische Basis für zuverlässige, skalierbare und wartbare KI-Systeme in Produktionsumgebungen. Der Begriff **Harness Engineering** fasst die Verschiebung weg von klassischem [Prompt Engineering](/wiki/llm/prompt-engineering/) hin zu durchdachten Engineering-Systemen zusammen: robuste …
-
Mehrsprachige NLP & Non-Englische Modelle
News-Wiki
· 29.04.2026
## Überblick Mehrsprachige NLP-Modelle und nicht-englische Large Language Models (LLMs) schließen eine wichtige Lücke in der KI-Landschaft. Während englischsprachige Modelle dominieren, wächst die Anzahl qualitativ hochwertiger Modelle für andere Sprachen kontinuierlich. ## Evaluation & Benchmarking …
-
Infrastruktur-Ökonomie & Marktstrategien
News-Wiki
· 29.04.2026
## Überblick Die Ökonomie der KI-Infrastruktur wird zunehmend zum strategischen Wettbewerbsfaktor. Während etablierte Western Labs (Google, Anthropic, Microsoft, Amazon, OpenAI) durch massive Kapitalinvestitionen Skalierungsvorteile aufbauen, verschieben neue Marktteilnehmer wie DeepSeek das Gleichgewicht durch Fokus auf …
-
Multimodale und Vision-Modelle
News-Wiki
· 29.04.2026
## Überblick Multimodale Modelle verarbeiten mehrere Eingabetypen (Text, Bilder, Audio, Video) gleichzeitig und erzeugen Ausgaben basierend auf der kombinierten Analyse. Vision-Modelle spezialisieren sich auf Bild- und Videoanalyse. Diese Klasse ist zentral für praktische Anwendungen wie …
-
KI-Narrative und Trends
News-Wiki
· 28.04.2026
## Überblick Die KI-Landschaft wird von widersprechenden Narrativen geprägt: Einerseits werden existenzielle Risiken und Jobverluste diskutiert, andererseits behaupten führende KI-Labore bereits zu wissen, wie AGI skaliert wird. Diese Page fasst aktuelle Narrative, Trends und deren …
-
Spezialisierte Frontier-Modelle und Multimodal
News-Wiki
· 28.04.2026
## Überblick Spezialisierte Frontier-Modelle sind hochperformante Large Language Models und Multimodal-Modelle, die für spezifische Domänen oder Anwendungsbereiche optimiert wurden. Sie bauen auf Frontier-Technologie auf, sind aber nicht universell einsetzbar, sondern für konkrete Problemräume (Wissenschaft, Cybersecurity, …
-
KI-Governance und verantwortungsvoller Einsatz
News-Wiki
· 28.04.2026
## Überblick KI-Governance beschreibt Regelwerke, Richtlinien und Kontrollmechanismen, die den Einsatz von KI-Systemen lenken – insbesondere in sicherheitskritischen und hochsensiblen Bereichen. Die Branche balanciert dabei zwischen innovativen Anwendungen und Risikominderung. ## Controlled Access und spezialisierte …
-
Strategische Partnerschaften und Lizenzmodelle
News-Wiki
· 28.04.2026
## Übersicht Strategische Partnerschaften und Lizenzmodelle prägen die Verfügbarkeit von KI-Modellen und APIs für Entwickler:innen. Sie beeinflussen, über welche Cloud-Infrastruktur Modelle zugänglich sind, welche kommerziellen Rechte Partner haben und wie Unternehmen ihre technologischen Kapazitäten bündeln. …
-
KI-Benchmarks, Modellvergleiche und Trends
News-Wiki
· 28.04.2026
## Überblick KI-Benchmarks sind zentral für die Evaluierung und den Vergleich von Language Models. Sie dienen Entwickler:innen zur Modellauswahl, Leistungsmessung und zum Tracking technologischer Fortschritte. Allerdings geraten traditionelle Benchmark-Methoden zunehmend an ihre Grenzen – insbesondere …
-
Evaluator Bias – LLM-Evaluator-Bias und Bewertungsprobleme
News-Wiki
· 28.04.2026
## Überblick Die Verwendung von LLMs als automatische Evaluatoren für Model-Outputs ist verbreitet, aber anfällig für systematische Verzerrungen. Diese Biases beeinflussen Model-Rankings, Leaderboards und Quality-Control-Systeme und können zu fehlerhaften Schlussfolgerungen über Model-Performance führen. ## Self-Preference …
-
Developer Resources und Community
News-Wiki
· 28.04.2026
## Überblick Sammlung von Ressourcen, Communities und Tutorials für Entwickler:innen im Bereich [Agents](/wiki/agents/). Hier finden sich Guides, Newsletter, Dokumentationen und Austauschplattformen. ## Newsletter und Kurationen ### Simon Willison's Newsletter Wöchentlicher Newsletter mit Kuratierung aktueller KI-News …
-
Agent-Anwendungen in Produktion
News-Wiki
· 28.04.2026
## Übersicht Agent-Anwendungen in Produktion beschreiben den Einsatz autonomer [KI-Agenten](/wiki/agents/agent-grundlagen/) in realen Geschäftsprozessen und kritischen Systemen. Der Fokus liegt auf Architektur, Integration, Performance und bewährten Praktiken für skalierbare, zuverlässige Agenten-Systeme. ## Harness Engineering: Beyond Prompt …