Published on2. August 2026Soofi S selbst hosten: welche GPU reicht wirklich?soofillmgpuself-hostedmittelstanddeutschlandSoofi S hat 3,2 Mrd. aktive Parameter, braucht aber VRAM für 31,6 Mrd. Was das für die GPU-Wahl heißt — mit offener Rechnung und Stand der Tools.
Published on2. August 2026Soofi S vs Llama 3 vs Qwen für deutschen Textllmopen-sourceself-hostedsoofimittelstanddeutschlandSoofi S, Llama 3.3 und Qwen3.5 im Vergleich für deutsche Texte: Lizenz, VRAM, Verfügbarkeit — und ein Testaufbau mit den eigenen Dokumenten.
Published on2. August 2026Souveräne KI: was der Begriff technisch heißtsouveraenitaetcompliancecloudself-hostedmittelstanddeutschlandDatenresidenz, Betriebssouveränität, Technologiewahl: was souveräne KI wirklich meint — mit Prüfliste für Anbieter und offener Kostenrechnung.
Published on29. Juli 2026KI-Server Kosten: die Rechnung nach dem Kaufki-serverkostentcoself-hostedmittelstanddeutschlandStrom, Kühlung, Wartung, Ersatzteile: was ein KI-Server über 36 Monate wirklich kostet — mit offengelegter Rechnung und Kipp-Punkt gegen Cloud-APIs.
Published on29. Juli 2026Ollama-Cluster über mehrere Rechner: Shardingollamallama-cppself-hostedgpumittelstanddeutschlandEin LLM über zwei Rechner verteilen: Ollama kann es nicht, llama.cpp schon. Befehle, echte Benchmarks — und warum meist eine größere GPU gewinnt.