Betrieb & Wartung

Lokale KI wartungsfrei? Nein – aber hier ist das realistische Wartungsmodell

Start  /  Artikel  /  Wartung & Updates für lokale KI: wer macht was, wie oft, und was es kostet

Die häufigste Sorge, die wir im Erstgespräch hören: «Und wer macht die Updates? Was passiert, wenn ein neues Modell kommt? Und wenn etwas kaputtgeht?» Das sind die richtigen Fragen – und die Antwort ist: lokale KI ist nicht wartungsfrei, aber sie ist auch nicht wartungsintensiv.

Im Folgenden erklären wir, was genau aktualisiert wird, wie oft, wer es macht, und was ein realistisches Wartungsmodell für Ihr Unternehmen aussieht. Am Ende wissen Sie, wofür Sie bei LokaleKI zahlen – und was Sie selbst (oder Ihre IT) in der Hand haben.

Was aktualisiert wird – die vier Ebenen

Eine lokale KI besteht aus vier Schichten, die jeweils eigene Updates haben:

SchichtWas sich ändertTypische FrequenzWer es macht
Modell (7B/14B/70B)Neue Modell-Generation (Llama, Qwen, Mistral)alle 2–6 Monate (nur, wenn es eine spürbare Verbesserung bringt)LokaleKI (empfohlen) oder eigene IT
Ollama / RuntimeSicherheitspatches, neue Features, PerformancemonatlichLokaleKI (im Wartungsvertrag)
Open WebUI / FrontendSicherheitspatches, neue Funktionen, BugfixesmonatlichLokaleKI (im Wartungsvertrag)
RAG / Vektor-IndexNeue Dokumente, Korpus-Änderungen, Re-Indexnach BedarfLokaleKI oder eigene IT (Upload)

Der wichtigste Punkt: Die häufigsten Updates sind Sicherheitspatches für Ollama, Open WebUI und das Betriebssystem. Die kommen monatlich und sind in der Regel 30–60 Minuten Arbeit pro Lauf. Modelle werden nicht «automatisch» aktualisiert – das passiert bewusst, wenn eine neue Version nachweislich besser ist und Sie es wollen.

Wie oft – das realistische Zeitbild

Hier die typische Wartungsrhythmik, wie wir sie bei unseren Kunden einrichten:

Das ist nicht «wartungsfrei», aber auch nicht «wartungsintensiv»: Im Tagesgeschäft merken Ihre Mitarbeiter nichts. Die Wartung läuft im Hintergrund, im Wartungsfenster, mit Benachrichtigung, wenn etwas auffällt.

Modelle: wie ein Update läuft (ohne dass Sie Angst haben müssen)

Die häufigste Angst: «Was passiert, wenn das neue Modell schlechter ist als das alte?» Die Antwort: Nichts. Wir machen Modell-Upgrades immer staged:

Das Modell ist Ihre Datei auf Ihrer Festplatte. Sie können jederzeit zwischen mehreren Modellen wechseln, ohne dass etwas umgebaut werden muss. Genau das ist der Vorteil eines lokalen Setups gegenüber einer Cloud-API, bei der der Anbieter den Modellwechsel vornimmt und Sie keinen Fallback haben.

Monitoring: was wir überwachen, und warum das wichtig ist

Eine lokale KI ist ein Server – und Server müssen überwacht werden. Unser Monitoring deckt:

Das Dashboard sehen Sie und wir. Sie bekommen eine wöchentliche Zusammenfassung (Uptime, Anfragen, Top-Fragen) und eine Benachrichtigung bei Auffälligkeiten. Sie müssen nie selbst auf einen Server schauen, um zu wissen, ob alles läuft.

Was Sie selbst (oder Ihre IT) machen – und was nicht

Ihre Rolle (oder die Ihrer IT) im Wartungsmodell:

Was Sie NICHT machen: Modell-Upgrades, Ollama-Patches, RAG-Re-Index, GPU-Treiber-Updates, Monitoring, Fehlerdiagnose. Das ist unser Job. Der Wartungsvertrag deckt genau das ab – zu festen, vorhersehbaren Konditionen (ca. 100–200 €/Monat), ohne dass Sie jedes Mal «mal schnell schauen» müssen.

So lösen Sie es – mit lokaler KI

Ein KI-Server direkt in Ihrem Unternehmen. Einmal investieren statt monatelang abonnieren – alle Daten bleiben im Haus.

1

KI-Check – kostenlos

In einem 30-Minuten-Gespräch klären wir Ihre Anforderungen, Ihre Daten und die passende Hardware.

2

Hardware zum günstigsten Preis

Vom kompakten NVIDIA DGX Spark (128 GB) bis zur RTX-5090-Maschine – wir beschaffen, liefern und installieren.

3

Ihr Wissen wird angebunden

Dokumente, Prozesse und Know-how werden lokal verbunden. Jeder Mitarbeiter bekommt eine sichere Chat-Oberfläche.

Installation & Setup ab 2.000 € zzgl. MwSt. · Hardware zum jeweils günstigsten verfügbaren Preis · laufende Wartung zu festen Konditionen

Mehr über die komplette Lösung, Preise und das Vorgehen: Startseite von LokaleKI →