MLflow auf Kubernetes betreiben: ML-Experimente zentral tracken, Modelle versionieren und die Registry self-hosted absichern. Setup mit echten Manifesten.
Ollama Monitoring mit Prometheus und Grafana einrichten: Tokens/s, Latenz, GPU-Auslastung und VRAM sichtbar machen — inklusive DCGM-Exporter und Alerting.