-
Lokale LLMs auf Strix Halo: was wirklich geht
Blog
· 30.07.2026
Mini-PCs mit AMDs Strix-Halo-Chip versprechen Sprachmodelle mit hunderten Milliarden Parametern im Wohnzimmer. Nachgemessen auf der eigenen Box: was in den Speicher passt, welche Token-Raten realistisch sind und welcher Hardware-Haken im Playbook fehlt.
-
GPU-Server mieten oder Mini-PC kaufen: c'ts Zahlen nachgemessen
Blog
· 28.07.2026
278 Euro im Monat für 20 GB Grafikspeicher, oder einmalig 1.785 Euro für 96 GB. Ich habe die beiden Modelle aus dem c't-Test des Hetzner GEX44 auf meinem eigenen Mini-PC nachgemessen — und ein drittes, …
-
Lokale KI-Modelle unter Windows und Linux einrichten
Blog
· 10.06.2026
Ollama, LM Studio und Amuse auf eigener Hardware: was Parameterzahl und Quantisierung bedeuten, wie das AMD AI Bundle die Installation unter Windows abnimmt — und wie derselbe Stack unter Linux eingerichtet wird.
-
Coding mit KI (1. Auflage)
Review
· 15.05.2026
*Coding mit KI* (Rheinwerk 2025) von Kofler, Öggl und Springer behandelt den Einsatz von Sprachmodellen in der Softwareentwicklung — solide für den Stand Ende 2024, aus heutiger Sicht in Teilen obsolet.
-
vLLM
Glossar
· 01.05.2026
## Definition vLLM ist ein High-Performance-Inference-Server für LLMs, der Batch-Processing und Memory-Optionen (PagedAttention, KV-Cache-Verwaltung) nutzt, um Inference-Durchsatz um ein Vielfaches zu erhöhen und Speicherverbrauch zu senken. Praktiker ersetzen damit langsame, speicherhungrige Standard-Inference durch eine produktionsreife …
-
Sprachmodell
Glossar
· 01.05.2026
## Definition Ein Sprachmodell ist ein trainiertes neuronales Netzwerk, das die nächste Sequenz von Text-Token basierend auf vorangegangenen Tokens vorhersagt – die Grundlage für ChatGPT, Claude, Llama und andere generative KI-Systeme. Das Trade-off: je größer …
-
Training
Glossar
· 01.05.2026
## Definition Training ist der Prozess, bei dem ein neuronales Netz durch iterative Anpassung seiner Gewichte auf Basis von Trainingsdaten lernt, Eingabe-Ausgabe-Muster vorherzusagen. Im modernen KI-Kontext (LLMs, Diffusion-Modelle) bedeutet dies: Millarden von Token oder Bildern …
-
Inference
Glossar
· 01.05.2026
## Definition Inference ist die Durchführung von Vorhersagen mit einem trainierten Modell auf neuen Daten — das typische "Produktions"-Szenario, bei dem ein LLM oder Diffusion-Modell praktisch arbeitet. Im Gegensatz zum Training (wo Gewichte angepasst werden) …
-
Modellgewichte
Glossar
· 01.05.2026
## Definition Modellgewichte sind die trainierten numerischen Parameter (Floating-Point-Werte oder Integers nach Quantisierung) eines neuronalen Netzes, die in einer Transformation y = W·x + b die Feature-Mappings definieren. Sie bestimmen fast vollständig, wie ein Modell …
-
Quantisierung
Glossar
· 01.05.2026
## Definition Quantisierung reduziert die numerische Präzision der [[Modellgewichte]] — meist von 32-Bit-Fließkommazahl (FP32) auf 8-Bit- (INT8) oder 4-Bit-Ganzzahl (INT4). Speicherverbrauch und [[Inference]]-Latenz sinken um den Faktor 4 bis 8, der Qualitätsverlust bleibt bei richtiger …
-
Lokale Model-Setups und Hardware-Guides
News-Wiki
· 30.04.2026
## Überblick Guides und Dokumentationen zum Setup lokaler LLM-Inferenz auf eigener Hardware. Fokus auf Self-Hosted-Szenarien, Hardware-Kombinationen und praktische Konfiguration mit gängigen Frameworks. ## Frameworks und Tools - **[OpenWebUI](/wiki/tutorial/openwebui/)**: Web-Interface für lokale Modelle, oft in Kombination …
-
Claude Code: Praktische Anwendungen & Tutorials
News-Wiki
· 30.04.2026
Claude Code ist Anthropics AI-gestütztes Coding- und Automatisierungs-Tool. Diese Seite sammelt praktische Tutorials, Setups und Entscheidungshilfen für konkrete Anwendungsfälle – von lokalen Homelab-Setups bis zu Browser-Automatisierung und Knowledge-Management. ## Lokale Infrastruktur & Hardware-Setup ### DIY-Homeserver …
-
Open-Source AI Frameworks & Libraries
News-Wiki
· 27.04.2026
## Übersicht Open-Source AI Frameworks sind die technologische Grundlage für KI-Entwicklung außerhalb proprietärer Plattformen. Sie decken ein breites Spektrum ab: von Sprachmodellen über Audio-Processing, Robotik-Plattformen bis zu Simulationsumgebungen und spezialisierte NLP-Libraries. ## Audio-Processing & Speech-to-Text …
-
Agent-Orchestrierung & Production-Ready Systeme
News-Wiki
· 27.04.2026
## Überblick Agent-Orchestrierung beschreibt die Koordination und Steuerung mehrerer KI-Agenten oder einzelner Agenten mit komplexen Task-Workflows. Sie umfasst die Verwaltung von Prompts, Tool-Integration, Workflow-Logic und Evaluierungskriterien – typischerweise für [Foundation Models](/wiki/model/foundation-models/). ## Automatische Optimierung Manuelle …