Published on2. August 2026MoE erklärt: warum 30B nicht 30B VRAM brauchtmoellmgpuvrammittelstanddeutschlandEin 30B-MoE belegt die vollen 19 GB VRAM — sparsam ist nur die Rechenlast pro Token. Die Speicherrechnung Posten für Posten, mit Modelltabelle.
Published on2. August 2026Soofi S selbst hosten: welche GPU reicht wirklich?soofillmgpuself-hostedmittelstanddeutschlandSoofi S hat 3,2 Mrd. aktive Parameter, braucht aber VRAM für 31,6 Mrd. Was das für die GPU-Wahl heißt — mit offener Rechnung und Stand der Tools.
Published on2. August 2026Soofi S vs Llama 3 vs Qwen für deutschen Textllmopen-sourceself-hostedsoofimittelstanddeutschlandSoofi S, Llama 3.3 und Qwen3.5 im Vergleich für deutsche Texte: Lizenz, VRAM, Verfügbarkeit — und ein Testaufbau mit den eigenen Dokumenten.
Published on20. Juli 2026agree21 Protokolle LLM: Kundenabwanderung 15% früher erkennenfinanceagree21llmprotokollanalysekundenbindungcompliancemittelstanddeutschlandEntdecken Sie, wie LLMs agree21-Protokolle analysieren, um Kundenabwanderung bis zu 15% früher zu erkennen. Sparen Sie Compliance-Kosten und verbessern Sie die Datenqualität mit KI.
Published on18. Juli 2026GPT-4o on-premise: Ist das möglich?gpt4oopenaiproprietaryon-premisellmKann man GPT-4o on-premise betreiben? Die Antwort ist nein — aber es gibt Alternativen, die GPT-4o-Niveau für weniger als €10.000 Hardware erreichen.