IT & Software

Lokale KI im IT- & Softwarehaus:
Ihr Quellcode verlässt das Haus nicht

Start  /  Artikel  /  Lokale KI im Softwarehaus – Quellcode bleibt im Haus

Für ein Softwarehaus ist der Quellcode das Produkt. Das wissen Ihre Kunden, Ihre Vertragspartner, Ihre Investoren. Was viele Chefs nicht wissen: Der Code-Assistent, mit dem Ihr Team arbeitet, sendet diesen Code – samt Kontext, Projektstruktur und Prompt – an Server in den USA.

Lokale KI ändert das: Ein Code-Modell wie Qwen-Coder oder StarCoder läuft über Ollama auf einem Rechner in Ihrem Haus. VS Code, JetBrains, Terminal – alles funktioniert wie gewohnt, nur dass das Netzwerk nicht über das LAN hinausgeht. In diesem Artikel zeigen wir, was das konkret bedeutet, was es kostet und warum es für Softwarehäuser in Österreich der sauberere Weg ist.

Copilot, Cursor, Windsurf: Ihr Code wandert nach Amerika

GitHub Copilot (Microsoft), Cursor, Windsurf und Codeium sind die Standard-Tools in praktisch jedem Softwarehaus. Und alle tun dasselbe: Sie schicken den relevanten Teil Ihrer Codebasis – geöffnete Dateien, Projekt-Kontext, Prompt – an ihre Server. Bei GitHub Copilot sind das Microsoft-Server, bei Cursor und Windsurf US-Server.

Bei einer Open-Source-App ist das vielleicht egal. Aber wenn Sie Kunden-Code schreiben – eine Banking-API, ein Health-Tech-Dashboard, ein SCADA-System – dann ist es das nicht. Ein NDA sagt: „Keine Weitergabe an Dritte“. Und ein US-Code-Assistent ist ein Dritter. Genau genommen sind es mehrere.

Was die Cloud-Code-Assistenten kosten

ToolPreis (ca., Stand September 2026)Code wandert nach
GitHub Copilot Business (Microsoft)ca. 20 €/Nutzer/MonatMicrosoft-Server
Cursor Proca. 20 €/Nutzer/MonatUS-Server
Windsurfca. 15–30 €/Nutzer/MonatUS-Server
Codeium (Free/Pro)0–ca. 20 €/Nutzer/MonatUS-Server

Zehn Entwickler, die mit Cursor oder Copilot arbeiten, kosten damit 2.400–3.600 € im Jahr. Das ist nicht mal das Problem – das Problem ist, was bei diesem Preis noch oben drauf ist: Ihre IP. Ein Abo ist endlos, eine IP ist einmalig.

Der lokale Code-Assistent: Qwen-Coder & StarCoder via Ollama

Ollama läuft das Code-Modell lokal. Qwen-Coder und StarCoder sind zwei der stärksten offenen Code-Modelle und laufen auf einer RTX-5090 oder dem NVIDIA DGX Spark. In VS Code, in JetBrains, im Terminal – alles wie bei der Cloud, nur dass das Netzwerk im Haus bleibt.

Die ehrliche Einordnung: Der lokale Assistent ist bei der rohen Intelligenz schwächer als die Frontier-Modelle von OpenAI oder Anthropic. Für Alltags-Codetasks – Kompletierung, Tests, Refactoring, Dokumentation – ist der Unterschied für die meisten Teams vernachlässigbar. Für Code, der in keine fremde Cloud darf, ist der lokale Weg der einzige, der sauber ist.

Kostenrechnung: Abo pro Kopf versus lokaler Server

PostenCloud (Abo, 10 Entwickler)Lokal (eigener Server)
HardwareRTX-5090-PC ca. 7.000 € / DGX Spark ca. 5.000 €
Installation & Setupab 2.000 € (einmalig)
Laufende Kostenca. 2.400–3.600 €/Jahrfeste Wartung, keine pro Kopf & Monat
DatenstandortUS-Server100 % im Haus
Break-Evennieca. 18–30 Monate, danach reines Sparen

Ab dem Break-Even sparen Sie den vollen Abo-Betrag pro Jahr – und Ihre IP bleibt bei Ihnen. Für ein Softwarehaus mit 5–20 Entwicklern ist das die einzige KI-Strategie, die sich rechnet und rechtlich sauber ist.

IP-Schutz, NDAs & Compliance: Warum lokal der saubere Weg ist

Softwarehäuser haben drei Compliance-Schichten, die Cloud-KI reibt: die des Kunden-NDA (kein Code an Dritte), die der DSGVO (Kundendaten im Code, Art. 44 bei Drittstaatenübermittlung) und die von NIS2 (für Unternehmen, die kritische Infrastruktur versorgen). Eine lokale KI löst alle drei auf einmal: Kein Code verlässt das Haus, keine Kundendaten, keine Drittstaatenübermittlung.

Dazu kommt der Lizenzschutz: Ein lokales, offenes Code-Modell wie Qwen-Coder oder StarCoder hat klare Lizenzbedingungen. Kein „Wir behalten uns vor, Ihre Prompts zu trainieren“ im Kleingedruckten.

Für Softwarehäuser in Wien, Niederösterreich und Burgenland bedeutet das: Sie können jedem Kunden – vom Startup bis zum Bankenkunden – versprechen, dass sein Code nicht die Grenzen verlässt. Das ist ein Verkaufsargument, das kein Cloud-Anbieter liefern kann.

Lokale KI für Ihr Softwarehaus – Erstgespräch

Wenn Sie ein Softwarehaus in Österreich führen und Ihre Entwickler auf Copilot, Cursor oder Windsurf angewiesen sind, aber Ihren Code nicht in die US-Cloud schicken wollen: Booken Sie ein kostenloses Erstgespräch – Telefon 0677 62 88 44 92, E-Mail office@gute-webseiten.at.

Wir setzen den Server auf, konfigurieren Ollama mit Qwen-Coder/StarCoder, verbinden VS Code, und rechnen Ihnen den Break-Even auf Ihre Teamgröße. Vor Ort in Wien, Niederösterreich, Burgenland – mit kurzen Wegen.

So lösen Sie es – mit lokaler KI

Ein KI-Server direkt in Ihrem Unternehmen. Einmal investieren statt monatelang abonnieren – alle Daten bleiben im Haus.

1

KI-Check – kostenlos

In einem 30-Minuten-Gespräch klären wir Ihre Anforderungen, Ihre Daten und die passende Hardware.

2

Hardware zum günstigsten Preis

Vom kompakten NVIDIA DGX Spark (128 GB) bis zur RTX-5090-Maschine – wir beschaffen, liefern und installieren.

3

Ihr Wissen wird angebunden

Dokumente, Prozesse und Know-how werden lokal verbunden. Jeder Mitarbeiter bekommt eine sichere Chat-Oberfläche.

Installation & Setup ab 2.000 € zzgl. MwSt. · Hardware zum jeweils günstigsten verfügbaren Preis · laufende Wartung zu festen Konditionen

Mehr über die komplette Lösung, Preise und das Vorgehen: Startseite von LokaleKI →