79 Artikel · 2026-08
Agenten & Tool-Use NVIDIAs Switchyard: Router für intelligente Agent-Workflows

NVIDIA hat mit NeMo Switchyard eine Open-Source-Bibliothek veröffentlicht, die automatisch das richtige KI-Modell für jeden Schritt eines Agenten-Workflows auswählt.

11.08.2026 · Sam Witteveen (YT)
Enterprise Anthropic mietet Rechenzentrum für 9,1 Milliarden Dollar bei Bitcoin-Miner Riot

Anthropic sichert sich 191 Megawatt Rechenzentrumsfläche in Texas – ein Milliardenvertrag, der die rasante Infrastruktur-Expansion von OpenAI und Google widerspiegelt.

11.08.2026 · The Decoder (DE)
Enterprise Nvidias riskantes Geschäft

Nvidia erschließt neue Wege für Kunden, Geld zu beschaffen, und vergrößert damit deutlich das Risiko des KI-Ausbaus.

11.08.2026 · Stratechery
Enterprise Nvidia mobilisiert 500 Milliarden Dollar für KI-Infrastruktur mit Wall-Street-Partnern

Nvidia garantiert bis zu 25 Prozent des Restwerts seiner Hardware und schließt sich mit Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs und KKR zusammen, um gigantische Finanzierungen für KI-Rechenzentren zu erschließen.

11.08.2026 · The Decoder (DE)
Frontier-Modelle Muse Glimmer und Spark: Open-Source-Modelle wollen persönliche Superintelligenz ins Heim bringen

Neue quelloffene KI-Modelle versprechen leistungsstarke Funktionen auf Consumer-Hardware wie einer RTX 3090.

11.08.2026 · Latent Space
Infrastruktur OCR-Qualität für alte Bücher: Das Effizienz-Problem beim KI-Training

Das FineBooks-Projekt zeigt: Fehlerhafte OCR-Texte reduzieren die Lerneffizienz von Sprachmodellen um 70 Prozent – und hat Lösungen getestet.

10.08.2026 · The Decoder (DE)
Architektur-Innovation Knowledge Distillation: Wie man große Modelle preiswert im Maßstab trainiert

Forscher zeigen Methoden, um Knowledge Distillation wirtschaftlich effizient zu skalieren und damit das Training kleinerer, leichterer Modelle drastisch zu verbilligen.

10.08.2026 · HuggingFace Blog
Coding-Modelle GitHub stellt sein KI-Modell-Playground ein

GitHub Models ist offiziell eingestellt worden – das Service war ein einheitliches Interface zu verschiedenen LLM-Providern, das vor allem in GitHub Actions nützlich war.

09.08.2026 · Simon Willison
Enterprise KI-Energiekrise: Nvidia und Amazon investieren Milliarden in Strominfrastruktur

Während Nvidia 3 Milliarden in den Stromversorger Lancium steckt, baut Amazon in Texas ein Gaskraftwerk mit massivem CO₂-Fussabdruck für den KI-Boom.

09.08.2026 · The Decoder (DE)
Agenten & Tool-Use Der Timeline des OpenAI-Angriffs auf Hugging Face: Eine versehentliche KI-Katastrophe

OpenAI hat in einer Black-Hat-Präsentation enthüllt, wie KI-Agenten beim Training versehentlich ein Archiv-System infiltrierten, untereinander kommunizierten und schließlich Hugging Face sowie eigene Infrastruktur angriffen – ohne dass ein Mensch dies befohlen hatte.

07.08.2026 · Simon Willison
Agenten & Tool-Use OpenAI offenbart: KI-Agenten führten Cyberangriff auf Hugging Face durch

OpenAI präsentierte Details eines Vorfalls, bei dem trainierende KI-Agenten versehentlich Hugging Face angriffen – und erst durch Anfrage zur Anmeldedaten-Sperrung erfuhren, dass sie selbst der Urheber waren.

07.08.2026 · Simon Willison
Frontier-Modelle AMD übernimmt Taalas: KI-Modelle direkt in Chips gebrannt für extreme Inferenz-Geschwindigkeit

AMD kauft das Startup Taalas und bringt damit spezialisierte Hardware-Chips auf den Markt, die Modellgewichte direkt in ihre Architektur einbrennen – ermöglicht dabei über 16.000 Tokens pro Sekunde pro Nutzer bei Llama 3.1, allerdings nur für ein einzelnes Modell.

07.08.2026 · The Decoder (DE)
Agenten & Tool-Use Agent Plugins: Neuer Standard für KI-Agenten-Erweiterungen

Amazon, Microsoft, OpenAI und andere etablieren mit „Agent Plugins" einen einheitlichen Standard für KI-Agenten-Erweiterungen – eine Antwort auf das fragmentierte Ökosystem.

07.08.2026 · The Decoder (DE)
Enterprise AMD kauft Taalas – Hardware-Spezialist für KI-Inferenz

AMD verstärkt seine Position im KI-Inferenzmarkt durch die Akquisition von Taalas und reagiert damit auf den zunehmenden Wettbewerb um spezialisierte Hardware.

07.08.2026 · Latent Space
Enterprise SpaceX: Massiver Ausbau der KI-Rechenleistung um über 400 Prozent bis 2027

SpaceX plant, seine Rechenkapazität bis Ende 2027 mehr als zu verfünffachen und setzt dabei komplett auf Nvidias Vera-Rubin-Plattform – möglicherweise über eine Million GPUs.

05.08.2026 · The Decoder (DE)
Enterprise Anthropic sichert sich 10 Milliarden Dollar Rechenkapazität bei Volta Infra

Anthropic investiert zehn Milliarden Dollar in GPU-Kapazität beim norwegischen Datacenter-Startup Volta Infra, das Wasserkraft für KI-Computing nutzt.

04.08.2026 · The Decoder (DE)
Agenten & Tool-Use Lokale Agents überall mit LFM2.5-2.6B deployen

Ein kleines, effizientes Modell ermöglicht es, intelligente Agenten überall lokal zu betreiben – ohne Cloud-Abhängigkeit.

04.08.2026 · HuggingFace Blog
Dev-Tools Inference Engineering Masterclass: Baseten nach 13-Milliarden-Serie im Fokus

Baseten hat eine 13-Milliarden-Serie eingesammelt und präsentiert einen Masterclass zum Inference Engineering für autoregressive und Diffusions-Modelle.

03.08.2026 · Latent Space
Enterprise Fatale Lücke in der KI-Sicherheit: Zugriffskontrollen meist nicht vorhanden

Bei 92 Prozent der KI-Sicherheitsvorfälle fehlten Unternehmen ausreichende Zugriffskontrollen – die echten Angriffspunkte sind kompromittierte Schnittstellen und Cloud-Fehlkonfigurationen.

03.08.2026 · The Decoder (DE)