Thema
Betrieb
5 Artikel zu diesem Thema.
Zwei lokale KI-Modelle auf einem Server: was das für dein Unternehmen bedeutet
Warum auf meiner NVIDIA DGX Spark jetzt zwei KI-Modelle parallel unter vLLM laufen, wie die Arbeitsteilung aussieht und was Entscheider daraus für Datenschutz und Agenturwahl ableiten können.
Monitoring mit Signal statt Rauschen
Wie ich Monitoring so aufsetze, dass aus Metriken klare Entscheidungen werden und Teams nicht in Alarmflut untergehen.
CI/CD ohne Stress: reproduzierbar ausrollen und sauber zurückrollen
Wie ich eine CI/CD-Pipeline so aufbaue, dass Deployments reproduzierbar sind, Rollbacks funktionieren und Releases nicht vom Zufall abhängen.
Vom Release zur stabilen Delivery: warum Testing die Basis ist
Warum ich bei Delivery-Stabilität immer mit Testing starte, welche Signale auf fehlende Testbasis hindeuten und wie ein pragmatischer Einstieg aussieht.
Ollama-Tuning auf meinem Spark: lokale Coding-Modelle praxistauglich betreiben
Wie ich lokale Coding-Modelle mit Ollama auf meinem Spark betreibe, Kontextgrößen begrenze und zwischen Daily-Driver und Qualitätsmodell unterscheide.