58 Artikel · 2026-06
Infrastruktur Ahmad Osman: Lokale KI-Modelle holen schnell auf

Lokale KI-Systeme machen rasante Fortschritte und werden zunehmend reif für Laptops, Smartphones und Enterprise-Infrastrukturen.

30.06.2026 · Latent Space
Enterprise OpenAI halbiert Inferenzkosten für ChatGPT

OpenAI hat durch massive Optimierungen die Kosten für KI-Inferenz um über 50 Prozent reduziert – ein großer Schritt zur wirtschaftlichen Skalierung.

30.06.2026 · The Decoder (DE)
Frontier-Modelle Gemini Omni Flash jetzt über API nutzbar

Googles neues Spitzenmodell Gemini Omni Flash ist über eine API verfügbar und ermöglicht Entwicklern die Integration von Video-Verarbeitungs- und Conversational-Fähigkeiten in ihre Anwendungen.

30.06.2026 · Sam Witteveen (YT)
Frontier-Modelle Meituan trainiert Billionen-Parameter-Modell komplett auf chinesischen Chips

Chinesischer Lieferdienst Meituan trainiert ein 1,6-Billionen-Parameter-KI-Modell erfolgreich auf heimischen Chips ohne Nvidia-Abhängigkeit.

30.06.2026 · The Decoder (DE)
Infrastruktur Taiwan verstärkt Ermittlungen gegen illegalen KI-Chip-Export nach China

Taiwanische Behörden durchsuchen die Büros von Super Micro Computer und lokalen Partnern wegen des Verdachts auf Chip-Schmuggel – ein neuer Knotenpunkt im Technologie-Wettkampf zwischen USA und China.

30.06.2026 · The Decoder (DE)
Frontier-Modelle DeepSeeks DSpark: KI-Antworten bis zu 85 Prozent schneller

DeepSeek beschleunigt seine KI-Modelle durch ein Speculative-Decoding-Verfahren erheblich, was Chinas Unabhängigkeit von US-Chips weiter stärkt.

30.06.2026 · The Decoder (DE)
Infrastruktur Archäologie im Code: Wie OpenAI einen 18 Jahre alten Fehler aufspürte

OpenAI-Ingenieure kombinierten großflächige Core-Dump-Analysen mit Hardware-Debugging und entdeckten dabei einen seit fast zwei Jahrzehnten verborgenen Software-Bug.

30.06.2026 · OpenAI Blog
Enterprise Samsung und SK Hynix investieren 590 Milliarden Dollar in KI-Chipproduktion

Südkoreas Speicher-Giganten bauen mit Unterstützung der Regierung massiv in HBM-Chipfabriken aus, um die explodierende KI-Nachfrage zu bedienen.

29.06.2026 · The Decoder (DE)
Enterprise Linux Foundation gründet Allianz gegen KI-basierte Open-Source-Angriffe

Zwanzig Tech-Konzerne, KI-Labore und Banken schliessen sich zu Akrites zusammen, um Sicherheitslücken in kritischer Open-Source-Software zu schliessen, bevor KI-Werkzeuge sie ausnutzen.

26.06.2026 · The Decoder (DE)
Dev-Tools vLLM-Server auf Hugging Face mit einem Kommando starten

Hugging Face integriert vLLM-Deployment direkt in seine Jobs-Plattform, um das Starten von LLM-Servern zu vereinfachen.

26.06.2026 · HuggingFace Blog
Agenten & Tool-Use Qualcomm Dragonfly C1000: Neuer KI-Chip für Meta ab 2028

Qualcomm bringt mit dem Dragonfly C1000 seinen ersten Rechenzentrumsprocessor für KI-Agenten auf den Markt – Meta wird einer der ersten Abnehmer sein.

25.06.2026 · The Decoder (DE)
Dev-Tools NVIDIA NeMo AutoModel: Schnelleres Fine-Tuning von Transformern

NVIDIA stellt ein neues Tool vor, das das Fine-Tuning großer Sprachmodelle durch automatische Optimierungen beschleunigt.

24.06.2026 · HuggingFace Blog
Frontier-Modelle OpenAI und Broadcom zeigen Inferenz-Chip "Jalapeño"

OpenAI und Broadcom entwickeln gemeinsam einen speziellen Inferenz-Chip für große Sprachmodelle, der ab Ende 2026 in Produktion gehen soll.

24.06.2026 · The Decoder (DE)
Frontier-Modelle OpenAI und Broadcom stellen LLM-Inferenz-Chip vor

OpenAI und Broadcom präsentieren Jalapeño, einen speziell für die LLM-Inferenz optimierten Chip, der Performance und Effizienz von KI-Systemen verbessern soll.

24.06.2026 · OpenAI Blog
Frontier-Modelle Memory-Chips und China: Wer profitiert vom neuen Markt?

Während westliche Memory-Hersteller chinesischen Konkurrenten Chancen eröffnen, setzt Microsoft strategisch auf chinesische KI-Modelle.

23.06.2026 · Stratechery
Dev-Tools Transformers.js experimentiert mit neuer Cross-Origin Storage API

Die Transformers.js-Bibliothek erkundet eine neue Browser-API zur plattformübergreifenden Speicherung von Modellgewichten – für schnellere und effizientere KI-Inferenz im Web.

23.06.2026 · HuggingFace Blog
Enterprise Anthropic und Micron: Strategische Partnerschaft für KI-Speicherinfrastruktur

Micron investiert in Anthropics Serie-H-Finanzierungsrunde und wird Mehrjahres-Speicherlieferant für Claude – ein Deal, der die wachsende Verflechtung zwischen KI-Labs und Hardware-Herstellern zeigt.

22.06.2026 · The Decoder (DE)
Enterprise Microsoft baut 2-Gigawatt-Rechenzentrum in Texas – eine der größten Expansionen der Unternehmensgeschichte

Microsoft plant im texanischen Pecos einen massiven KI-Rechenzentrum-Campus mit 2 Gigawatt Kapazität und reagiert damit auf lokale Widerstände mit Versprechungen zu stabilen Strompreisen und minimalem Wasserverbrauch.

22.06.2026 · The Decoder (DE)
Agenten & Tool-Use Cloudflare ermöglicht temporäre Accounts für AI-Agenten und Entwickler

Cloudflare bietet jetzt ephemäre Workers-Projekte an, die 60 Minuten kostenfrei laufen – ohne Account-Erstellung, ideal für AI-Agenten und schnelle Prototypen.

21.06.2026 · Simon Willison
Agenten & Tool-Use MCP als Authentifizierungs-Gateway: Sean Lynch zur Zukunft der Model-Context-Protocol

Ein Kernvorteil von MCP liegt darin, Authentifizierungsabläufe außerhalb des Agent-Kontexts zu isolieren – möglicherweise sogar komplett außerhalb der Infrastruktur.

19.06.2026 · Simon Willison