Published on4. August 2026KI-Kosten pro Abteilung abrechnen: Budgets im Gatewaykostenkontrollelitellmllm-gatewaycontrollingmittelstanddeutschlandEine Sammelrechnung ohne Zuordnung überlebt keine zweite Budgetrunde. Wie Schlüssel, Teams und harte Obergrenzen im Gateway eingerichtet werden.
Published on4. August 2026LiteLLM mit LLM Guard und NeMo Guardrails verkettenlitellmllm-guardnemo-guardrailsguardrailsllm-gatewaymittelstanddeutschlandGuardrails gehören ins Gateway, nicht in jede Anwendung. Die Verkettung mit LiteLLM-Hooks, inklusive der Latenz, die das wirklich kostet.
Published on4. August 2026LLM-Gateway 2026: LiteLLM, Kong, Portkey, Azure APIMllm-gatewaylitellmkongportkeyazuremittelstanddeutschlandVier Wege, Modellzugriffe zu bündeln. Der Unterschied liegt nicht im Routing, sondern darin, wer Ihre Token zählt und wo die Daten dabei liegen.
Published on4. August 2026Modellwechsel ohne Neuentwicklung: das Gateway davorllm-gatewaylitellmarchitekturmodellwechselmittelstanddeutschlandModelle veralten in Monaten. Wie Sie den Wechsel zu einer Konfigurationsänderung machen — und welche vier Stellen trotzdem Arbeit bleiben.
Published on9. März 2026LiteLLM Proxy: 30-40 % API-Kosten sparenlitellmproxyllmself-hostedmittelstanddeutschlandLiteLLM Proxy bündelt OpenAI, Anthropic und Ollama unter einer API. Setup in unter 1 Stunde, 30-40 % weniger API-Kosten durch Routing.