Published on4. August 2026DeepSeek V4 Flash selbst hosten: VRAM, Setup, Durchsatzdeepseekopen-weightsvllmgpuon-premisemittelstanddeutschland284 Milliarden Parameter unter MIT-Lizenz. Was der Betrieb im eigenen Rechenzentrum wirklich kostet — Speicherrechnung, Konfiguration, Grenzen.
Published on4. August 2026GLM-5.2 im Unternehmen betreiben: Hardware und Grenzenglmz-aiopen-weightscodinggpumittelstanddeutschlandEin offenes Modell mit rund 743 Milliarden Parametern unter MIT-Lizenz, ausgelegt auf lange Coding-Aufgaben. Was der Eigenbetrieb realistisch verlangt.
Published on4. August 2026Welche GPU für welches Modell — Kosten je Million TokengpukostenvraminferenztcomittelstanddeutschlandDie Rechnung vor jedem GPU-Kauf: Vollkosten je Karte, realistischer Durchsatz, Kosten je Million Token — und der ehrliche Cloud-Vergleich.
Published on4. August 2026Vom Docker-Compose-Pilot auf Kubernetes: wann es fällig istkubernetesdocker-composeki-plattformbetriebgpumittelstanddeutschlandCompose trägt weiter als gedacht. Die vier Auslöser für den Umzug — und warum die meisten Mittelständler ihn nicht brauchen.
Published on4. August 2026LoRA-Feinabstimmung im eigenen Haus: wann sie sich lohntlorafinetuningon-premisegpuragmittelstanddeutschlandFeinabstimmung ist kein Ersatz für RAG — sie löst ein anderes Problem. Die drei Fälle, in denen sie hilft, und der Aufwand für die Datenaufbereitung.