Published on4. August 2026GLM-5.2 im Unternehmen betreiben: Hardware und Grenzenglmz-aiopen-weightscodinggpumittelstanddeutschlandEin offenes Modell mit rund 743 Milliarden Parametern unter MIT-Lizenz, ausgelegt auf lange Coding-Aufgaben. Was der Eigenbetrieb realistisch verlangt.
Published on4. August 2026Welche GPU für welches Modell — Kosten je Million TokengpukostenvraminferenztcomittelstanddeutschlandDie Rechnung vor jedem GPU-Kauf: Vollkosten je Karte, realistischer Durchsatz, Kosten je Million Token — und der ehrliche Cloud-Vergleich.
Published on4. August 2026Halluzinationen messbar machen: LLM-as-Judge im Betriebhalluzinationevaluationllm-as-judgequalitaetragmittelstanddeutschlandWie viele Antworten Ihres Systems sind erfunden? Ohne Messung ist die Antwort ein Gefühl. Drei Verfahren, die im laufenden Betrieb funktionieren.
Published on4. August 2026KI-Kosten pro Abteilung abrechnen: Budgets im Gatewaykostenkontrollelitellmllm-gatewaycontrollingmittelstanddeutschlandEine Sammelrechnung ohne Zuordnung überlebt keine zweite Budgetrunde. Wie Schlüssel, Teams und harte Obergrenzen im Gateway eingerichtet werden.
Published on4. August 2026Vom Docker-Compose-Pilot auf Kubernetes: wann es fällig istkubernetesdocker-composeki-plattformbetriebgpumittelstanddeutschlandCompose trägt weiter als gedacht. Die vier Auslöser für den Umzug — und warum die meisten Mittelständler ihn nicht brauchen.