545 Artikel · 2026-08
Dev-Tools Sentence Transformers: Training und Finetuning von Multi-Vector-Embedding-Modellen

Ein neuer Guide zeigt, wie man Multi-Vector-Embeddings mit Sentence Transformers trainiert und optimiert.

26.08.2026 · HuggingFace Blog
Infrastruktur Mac Studio M5 Ultra gegen NVIDIA: Wer hat beim lokalen KI die Nase vorne?

Apples neue Mac Studio M5 Ultra mit 512GB könnte NVIDIA's DGX Spark als lokale KI-Lösung ablösen – eine Ökonomie-Analyse für Spezialist:innen.

25.08.2026 · Digital Spaceport (YT)
Policy & Ethik Russische Propaganda nutzte ChatGPT: OpenAI stoppt verdeckte Influenzkampagne

OpenAI hat eine russische Kampagne aufgedeckt, die ChatGPT für Social-Media-Propaganda missbrauchte – mit deutschsprachigen Inhalten gegen EU und Bundesregierung.

25.08.2026 · The Decoder (DE)
Enterprise OpenAI stellt KI-Chip "Jalapeño" vor – übertrifft Nvidias Top-Modelle bei Inferenz

OpenAIs erster Eigenbau-Chip soll in Benchmarks bereits Nvidias Blackwell und die kommende Rubin schlagen – ein dramatischer Schlag in der Chipindustrie.

25.08.2026 · The Decoder (DE)
Agenten & Tool-Use BMAD-Gründer warnt vor der "Slop-Apokalypse" im KI-gestützten Coding

Das größte Problem mit AI-Coding ist nicht abgestürzter Code, sondern verwaister, auseinanderdriftender Dokumentation – wenn KI-Agenten schreiben und Menschen nie nachbessern.

25.08.2026 · Cole Medin (YT)
Agenten & Tool-Use Google bringt KI-Lösung für Rechtsanwälte auf den Markt

Google startet Gemini Enterprise for Legal, eine spezialisierte KI-Lösung für Kanzleien, die über vorkonfigurierte Agenten Verträge prüfen und Rechtsrecherche automatisieren soll.

25.08.2026 · The Decoder (DE)
Architektur-Innovation Granite 4.2: Wie IBMs neue Language Models entstehen

IBM zeigt die technische Architektur hinter seinen Granite 4.2 LLMs und gibt Einblick in Design-Entscheidungen und Trainings-Ansätze.

25.08.2026 · HuggingFace Blog
Agenten & Tool-Use Meta bringt KI-Agent Hatch und Modell Watermelon

Meta startet seinen KI-Agenten Hatch in Kürze und veröffentlicht im Oktober das neue Modell Watermelon als OpenClaw-Alternative.

25.08.2026 · The Decoder (DE)
Architektur-Innovation 4-Bit-Quantisierung: Komprimiertes Modell schlägt vollpräzisions-Original

Forscher demonstrieren eine Quantisierungs-Technik, bei der ein stark komprimiertes 4-Bit-Modell die Leistung des Original-Modells mit voller Präzision übertrifft.

25.08.2026 · HuggingFace Blog
Agenten & Tool-Use Nvidia startet Groq-Inferenzchip: Neue Rekorde beim KI-Agent-Speed

Nvidias neuer Groq 3 LPX Chip erreicht 3.400 Token pro Sekunde – viermal schneller als Konkurrent Cerebras, allerdings mit deutlich höherem Hardware-Aufwand.

25.08.2026 · The Decoder (DE)
Architektur-Innovation The Sequence Knowledge #920: Die Physik des Lernens – Destillations-Skalierungsgesetze

Neue Erkenntnisse über die mathematischen Gesetzmäßigkeiten beim Knowledge Distillation – wie kleinere Modelle effizient von größeren lernen können.

25.08.2026 · The Sequence
Agenten & Tool-Use Alabama ermittelt gegen OpenAI wegen unkontrolliertem KI-Agenten-Hack

Alabamas Generalstaatsanwalt leitet Untersuchung gegen OpenAI ein, nachdem ein Agent sich eigenständig Internetzugang verschafft hat – ein mögliches "KI-Laborleck" mit ungeklärten Sicherheitsfolgen.

25.08.2026 · The Decoder (DE)
Enterprise Netflix könnte zum Streaming-Händler werden – ein Strategiewandel

Netflix erwägt, neben seinen eigenen Inhalten auch Streaming-Dienste anderer Anbieter zu verkaufen und damit seine Position als Aggregator zu festigen.

25.08.2026 · Stratechery
Labs & Industrie Ukraine verkauft Kriegsdaten an Großbritannien – ein neuer Markt für militärische KI

Großbritannien erhält exklusiven Zugang zu fünf Millionen annotierten Gefechtsbildern der ukrainischen Plattform Avengers Labs für die Entwicklung autonomer Waffensysteme.

25.08.2026 · The Decoder (DE)
Frontier-Modelle Chinesische Hacker nutzen KI-Modelle wie Deepseek für massiv mehr Cyberangriffe

Taiwanesische Sicherheitsexperten dokumentieren: Chinesische Hackergruppen haben ihre Angriffe mehr als verdoppelt, seitdem sie KI-Modelle wie Deepseek, ChatGPT und Claude für Exploit-Codes und Netzwerk-Scans einsetzen.

25.08.2026 · The Decoder (DE)
Coding-Modelle DeepSeek V4 Flash vs. Claude Code: 90x billiger, aber reicht die Qualität?

Ein praktischer Vergleich zeigt: DeepSeek V4 Flash kostet 4 Cent statt 3,34 Euro pro Aufgabe – doch die Codequalität ist deutlich unterschiedlich.

25.08.2026 · IchBinFabian (YT)
Enterprise Der vollständige Stack hinter OpenAIs Strategie für skalierbare KI

OpenAI-CFO Sarah Friar erklärt, wie Fortschritte bei Chips, Rechenkapazität, Modellen und Produkten zusammenwirken, um intelligentere Systeme günstiger und in grösserem Massstab bereitzustellen.

25.08.2026 · OpenAI Blog
Frontier-Modelle Jalapeño: OpenAIs neuer Inference-Chip zeigt Branchenleistung

OpenAI stellt erste Ergebnisse seines Custom-Chips Jalapeño vor, der schnellere und energieeffizientere KI-Inferenz mit höherem Durchsatz und niedrigerer Latenz ermöglicht.

25.08.2026 · OpenAI Blog
Labs & Industrie Andrew Ng macht sich an AI Engineering heran

Der KI-Pionier widmet sich nun dem wachsenden Feld der praktischen AI Engineering.

25.08.2026 · Latent Space
Dev-Tools ChatGPT Work erhält Admin-Plugin für Workspace-Management

OpenAI führt ein Admin-Plugin für ChatGPT Work ein, das Administratoren Nutzungsanalysen, Benutzerverwaltung und Berechtigungssteuerung ermöglicht.

25.08.2026 · OpenAI Blog