-
GPU-Server mieten oder Mini-PC kaufen: c'ts Zahlen nachgemessen
Blog · 28.07.2026278 Euro im Monat für 20 GB Grafikspeicher, oder einmalig 1.785 Euro für 96 GB. Ich habe die beiden Modelle aus dem c't-Test des Hetzner GEX44 auf meinem eigenen Mini-PC nachgemessen — und ein drittes, …
-
Agent ohne Cloud: warum mein Hermes trotzdem nicht lokal rechnet
Blog · 18.07.2026c't 3003 betreibt den Hermes-Agenten komplett lokal mit Qwen 3.6 27B. Mein Pi-Agent schickt seine Prompts weiter in die Cloud — was ein Log mit 37.588 Token darüber verrät, welche Zahl bei Agenten wirklich zählt.
-
Lokale Model-Setups und Hardware-Guides
News-Wiki · 30.04.2026## Überblick Guides und Dokumentationen zum Setup lokaler LLM-Inferenz auf eigener Hardware. Fokus auf Self-Hosted-Szenarien, Hardware-Kombinationen und praktische Konfiguration mit gängigen Frameworks. ## Frameworks und Tools - **[OpenWebUI](/wiki/tutorial/openwebui/)**: Web-Interface für lokale Modelle, oft in Kombination …
-
Lokale Inference & Hardware-Setup
News-Wiki · 30.04.2026## Überblick Lokale KI-Inferenz auf eigener Hardware wird zunehmend praktikabel und wirtschaftlich. Für Entwickler:innen bietet sich ein vielfältiges Spektrum: von Consumer-Laptops mit Apple Silicon über DIY-Homelab-Server bis zu spezialisierter Enterprise-Hardware. Die Kostenrechnung gegen Cloud-APIs wird …
-
Autonome Agenten & Agentic AI (Open-Source)
News-Wiki · 28.04.2026## Überblick Autonome Agenten und Agentic AI beschreiben Systeme, die eigenständig Ziele verfolgen, Aufgaben planen und zielgerichtet handeln – typischerweise auf Basis von [Large Language Models](/wiki/llm-foundation/). Im Open-Source-Ökosystem entstehen spezialisierte Modelle, Frameworks und Werkzeuge für …
-
Developer-Tools und Praktiken
News-Wiki · 27.04.2026## Überblick Developer-Tools im KI-Kontext umfassen Code-Assistenten, APIs, lokale Modelle und Best-Practices beim Prompt Engineering. Der Markt verschiebt sich zunehmend zu agentic workflows, On-Device-Verarbeitung für bessere Latenz und Datenschutz, sowie zu Headless-Architekturen, die APIs über …
-
Edge Deployment & On-Device-Optimierung
News-Wiki · 27.04.2026## Überblick Edge Deployment bezeichnet die Ausführung von KI-Modellen direkt auf Grenzgeräten (edge devices) – Robotern, IoT-Hardware, eingebetteten Systemen – statt auf zentralen Servern. Ziele sind Latenzreduktion, Datenschutz durch lokale Verarbeitung, Offline-Betrieb und reduzierte Netzwerkabhängigkeit. …
-
Benchmarks: Coding-Performance und Modelleffizienz
News-Wiki · 27.04.2026Benchmark-Fokus auf Coding-Performance und Effizienzmetriken – wie schnell und ressourcenschonend Sprachmodelle Programmieraufgaben lösen. ## Efficiency-Sprünge bei Coding-Modellen Die Coding-Landschaft verschiebt sich stark in Richtung Effizienz: Kleinere Modelle erzielen inzwischen die Performance grösserer Vorgänger, während Inferenzkosten …