Für Unternehmen in sicherheitsrelevanten Sektoren – Zulieferer für kritische Infrastruktur, Hersteller und Entwickler mit besonderen Zugangs- und Geheimhaltungsanforderungen – ist die Frage nie, ob KI hilft, sondern wo sie rechnet. Eine Cloud-KI schickt Daten, Code und Pläne auf Server, die Sie nicht einmal physisch prüfen dürfen.
Lokale KI löst das: Der Rechner steht in Ihrer Sicherheitszone, das Modell läuft offline-fähig, und nichts verlässt das Haus. Genau das setzen wir bei LokaleKI um.
Warum eine fremde Cloud hier kein Thema ist
Sobald Arbeit exportkontrollrechtlich relevant ist oder unter Geheimhaltung fällt, ist SaaS-KI per definitionem ausgeschlossen: Die Daten landen auf der Infrastruktur eines ausländischen Anbieters, unter fremdem Recht – und Sie können nicht einmal prüfen, wer physischen Zugriff auf die Rechenzentren hat. Für viele Unternehmen in diesem Segment ist das bereits an dieser Stelle ein No-Go.
Dazu kommt die Abhängigkeit: Der Anbieter kann Preise, Nutzungsbedingungen oder die Verfügbarkeit jederzeit ändern. Ein Tool, auf das Produktion oder Projektabläufe aufbauen, sollte man nicht von einem Dritten abschalten lassen können.
Daten, Code & Pläne bleiben in der eigenen Sicherheitszone
Der lokale Server steht im Gebäude – im Raum, in dem Ihre Sicherheitsordnung gilt. Das Modell (Ollama), die Oberfläche (Open WebUI) und die RAG-Wissensbasis laufen offline-fähig; es gibt keinen Datenabfluss in die Cloud. Sie entscheiden, wer Zugriff hat, was in die Wissensbasis und was nicht.
- Kein externer Transfer – nicht einmal ein „beiläufiger“ wie bei manchen Cloud-Tools
- Zugriff über Ihre Firewall, Zugriffsrechte über Ihre Systeme
- RAG über interne Spezifikationen, Pläne und Dokumentation – der Inhalt verlässt das Gebäude nicht
- Auf Wunsch air-gapped: ein Setup ohne jede Internetverbindung, für Zonen, in denen das ohnehin nicht vorgesehen ist
Wobei die lokale KI konkret hilft
In Konstruktion, Dokumentation und Entwicklung ersetzt der lokale Server die Routine, die man heute einer Cloud-KI übertrauen würde – nur ohne den Transfer:
- Technische Spezifikationen und Anforderungsprofile zusammenfassen und prüfen
- Technische Dokumentation, Prüfprotokolle und Berichte formulieren
- Code-Unterstützung für Firmware und Embedded-Software – auf Ihrem Rechner, nicht auf einem fremden
- RAG über dem Projektarchiv: alte Entscheidungen, Versionsstände und Spezifikationen in Sekunden finden
- Interne Teams bei Standardfragen unterstützen – ohne dass die Frage einen fremden Server verlässt
Hardware & Umsetzung
Der Server ist ein Standard-Rechenzentrumsrechner, abgestimmt auf die Größe Ihrer Wissensbasis: ein NVIDIA DGX Spark (ca. 5.000 €) oder ein Rechner mit NVIDIA RTX 5090 (ca. 3.000 €). Installation und Setup kosten ab 2.000 €, inklusive RAG-Aufbau; danach gibt es eine feste Wartungspauschale – kein Abo, keine Kosten pro Kopf.
| Komponente | Was es ist | Preis (ca.) |
|---|---|---|
| Standard-Rechner (NVIDIA RTX 5090) | Kompakt, ideal für die meisten Teams | ca. 7.000 € |
| NVIDIA DGX Spark | Leistungsstärker, für größere Wissensbasen | ca. 5.000 € |
| Installation & Setup (vor Ort, inkl. RAG) | Kompletter Aufbau, auf Wunsch air-gapped | ab 2.000 € |
| Feste Wartung | Pauschal, keine Kosten pro Kopf | feste Pauschale |
Die Rechnung ist übersichtlich: Cloud-Lizenzen für ein kleines Team kosten schnell 10.000–30.000 € pro Jahr (ca. 18–40 € pro Nutzer und Monat, Stand 2026). Der eigene Server ist in etwa 18–30 Monaten abgegolten – und danach ist nichts mehr im Haus, das draußen ist.
Diskret, regional, zuverlässig
Wir installieren den Server vor Ort – in Wien, Niederösterreich oder dem Burgenland, wo wir kurze Wege haben. Der Ablauf ist so unauffällig wie die Arbeit selbst: ein Rechner in Ihrem Serverraum, keine externe Anbindung, kein Abo. Wenn etwas erweitert oder gewartet werden muss, erreichen Sie uns telefonisch.
Im kostenlosen Erstgespräch besprechen wir, was die lokale KI konkret für Ihre Mannschaft leisten würde – telefonisch unter 0677 62 88 44 92 oder per Mail an office@gute-websehen.at.