79 Artikel · 2026-08
Enterprise China importiert H200-Chips – vorsichtige Öffnung im US-Rüstungswettlauf

Peking lässt begrenzte Mengen von Nvidias H200-Beschleunigern ins Land, um chinesische KI-Unternehmen im Wettbewerb mit der USA zu unterstützen.

19.08.2026 · The Decoder (DE)
Frontier-Modelle Das KI-Wochenende: DeepSeek V4-Pro, GLM-5.3 und NVIDIAs neue Modelle im Überblick

Ein kuratierter Überblick über die wichtigsten KI-Releases der Woche mit Fokus auf DeepSeek V4-Pro, GLMs neueste Version und NVIDIAs Frontier-Modelle.

19.08.2026 · The Sequence
Enterprise Speicherpreise explodieren: 500 Prozent Anstieg in 12 Monaten

Die galoppierenden Kosten für KI-Hardware gefährden die Entwicklung günstiger Modelle und setzen neue wirtschaftliche Grenzen für das Trainieren und Deployen von KI-Systemen.

19.08.2026 · Latent Space
Agenten & Tool-Use Wie viel Speicher braucht dein Agent wirklich?

Eine Analyse der tatsächlichen Speicheranforderungen für produktive KI-Agenten zeigt, dass weniger oft ausreicht.

18.08.2026 · HuggingFace Blog
Dev-Tools Qwen 3.8-27B: Hands-on Test und optimiertes Serving

Ein technischer Deep-Dive ins neue Qwen-Sprachmodell mit praktischer Anleitung zum schnellstmöglichen Deployment.

18.08.2026 · Sam Witteveen (YT)
Enterprise Nvidia investiert in OpenAI-Rechenzentren – Anthropic wächst, Google kauft Flugdaten

Nvidia finanziert OpenAIs Infrastruktur-Expansion mit; Anthropic meldet beeindruckende Umsatzzahlen; Google erkennt Daten als strategisches Gut.

18.08.2026 · Stratechery
Dev-Tools Multi-Vector-Embeddings mit Sentence Transformers: Late-Interaction-Ansatz

Sentence Transformers erweitert seine Bibliothek um Multi-Vector-Embedding-Modelle, die durch Late Interaction präzisere semantische Suchen und RAG-Anwendungen ermöglichen.

18.08.2026 · HuggingFace Blog
Enterprise Stripe kauft OpenRouter für 7 Milliarden Dollar

Der Payment-Riese Stripe akquiriert das KI-API-Routing-Startup OpenRouter in einem hochkarätigen Mega-Deal, um seine Infrastruktur für KI-Integrationen zu erweitern.

17.08.2026 · Latent Space
Enterprise Nvidia bürgt für OpenAIs 105-Milliarden-Dollar-Mega-Datenzentrum

OpenAI baut ein 8-Gigawatt-Rechenzentrum in Ohio, Nvidia garantiert die Finanzierung und wird exklusiver Chiplieferant – ein strategisches Schachspiel der KI-Giganten.

17.08.2026 · The Decoder (DE)
Enterprise Stripe übernimmt OpenRouter: Wette auf die Zukunft der KI-Modell-Aggregation

Stripe erwirbt OpenRouter und setzt damit auf ein zentrales Modell der KI-Zukunft: die Aggregation verschiedener Sprachmodelle unter einer Plattform.

17.08.2026 · Stratechery
Enterprise Stripe kauft KI-Plattform OpenRouter für über 7 Milliarden Dollar

Zahlungsdienstleister Stripe übernimmt OpenRouter, das als "Stripe für KI" 400+ Modelle für acht Millionen Nutzer verfügbar macht, für mehr als das fünffache seiner letzten Bewertung.

17.08.2026 · The Decoder (DE)
Agenten & Tool-Use Die „KI-Dark-Factory": Wie Agenten jetzt selbst Code schreiben und deployen

Automatisierte Coding-Agenten werden praktikabel: Ein Entwickler zeigt, wie man ein System baut, das Anforderungen automatisch in funktionierenden, getesteten und ausgerollten Code verwandelt.

14.08.2026 · Cole Medin (YT)
Infrastruktur Flock Safety: Wie eine Startup mit KI-Kameras zum Überwachungsnetzwerk wurde

Eine investigative Recherche zur Flock Safety und ihren Edge-ML-Kameras, die ein warrantloses Tracking-Netzwerk ermöglichen – und zum Gegenschlag aus der Open-Source-Community.

14.08.2026 · Fireship Code Report
Frontier-Modelle OpenAI startet "Ultrafast"-Modus für GPT-5.6 Sol – 14x schnellere Inferenz

OpenAI bringt einen neuen "Ultrafast"-Inferenz-Modus, der dank Cerebras-Hardware bis zu 750 Output-Tokens pro Sekunde erreicht und Geschwindigkeit zum preisstaffeligen Produkt-Feature macht.

14.08.2026 · The Decoder (DE)
Architektur-Innovation Von der Eingabe zum Token: Wie KI-Inference wirklich funktioniert

Ein Überblicks-Guide zu Prefill, Decode, KV-Caches und den Systemen hinter responsiven KI-Produkten.

14.08.2026 · The Sequence
Dev-Tools Strands Agents, LeRobot und Hugging Face Storage: Roboter trainieren und deployen aus einer Hand

Hugging Face integriert Robotik-Plattformen und Cloud-Storage zu einer einheitlichen Entwicklungs-Pipeline für Machine-Learning-Anwendungen.

13.08.2026 · HuggingFace Blog
Frontier-Modelle OpenAI stellt Ultrafast vor: GPT-5.6 Sol läuft bis zu 14× schneller

OpenAI bringt einen neuen API-Tarif namens Ultrafast auf den Markt, der GPT-5.6 Sol mit Cerebras-Hardware bis zu 14× schneller und mit bis zu 750 Tokens pro Sekunde ausführt.

13.08.2026 · OpenAI Blog
Infrastruktur LFM2.5-VL-3B: Schnelleres und besseres Sehen für Edge-Geräte

Ein neues 3-Milliarden-Parameter-Modell für Vision-Aufgaben bringt erweiterte Fähigkeiten auf ressourcenschwache Geräte.

12.08.2026 · HuggingFace Blog
Agenten & Tool-Use NVIDIAs Chris Alexiuk über Nemotron, GPUs und agentenbasierte KI

In einem Interview spricht NVIDIAs Chris Alexiuk über die neuen Nemotron-Modelle, deren Architektur und die Rolle von GPUs bei agentengestützten KI-Systemen.

12.08.2026 · The Sequence
Infrastruktur Qwen 3.8 kommt: YouTuber rüstet Home-Datacenter auf

Ein Technologie-Content-Creator dokumentiert den eiligen Umbau seines Homelab-Datacenters mit High-End-GPUs, um die kommende Qwen 3.8 27B lokal zu deployen.

11.08.2026 · Digital Spaceport (YT)