Lösung Vorteile So funktioniert's Wissen Angebot FAQ Erstgespräch anfragen
Lokale KI für Klein- und Mittelbetriebe

Ihre Unternehmens-KI.
Lokal installiert. 100 % Ihre Daten.

Wir liefern einen KI-Server direkt in Ihr Unternehmen, installieren und binden ihn mit Ihrem IT Team ein. Jeder Mitarbeiter bekommt eine sichere Chat-Oberfläche, die mit Ihrem Firmenwissen antwortet. Ohne Cloud. Ohne Abo. Auch Einbindung in Visual Studio Code und andere Entwicklungsumgebungen ist möglich.

Hardware zum günstigsten verfügbaren Preis · Installation & Setup ab 2.000 €

Warum Cloud-KI für Ihr Unternehmen das falsche Werkzeug ist

Jeder Chat, jedes Dokument, jede Anfrage verlässt Ihr Haus – und Sie zahlen pro Kopf, pro Monat, für immer.

Ihre Daten fliehen ins Ausland

Cloud-KI sendet Dokumente, Angebote und Mitarbeiteranfragen auf fremde Server – oft in Drittstaaten.

Abo pro Kopf – für immer

20–30 € pro Mitarbeiter pro Monat, Token-Abrechnung, Preiserhöhungen jederzeit möglich.

Wissen geht verloren

Know-how sitzt in Köpfen und Postfächern – und verlässt das Unternehmen mit jedem Weggang.

Das bekommen Sie

Vom ersten Gespräch bis zum laufenden Betrieb – ein Ansprechpartner, alles aus einer Hand.

1

KI-Check – kostenlos

Wir analysieren Ihre Anforderungen, Daten und Mitarbeiterzahl in einem 30-Minuten-Gespräch.

2

Hardware beschaffen

Wir kaufen die passende KI-Hardware ein – vom kompakten NVIDIA DGX Spark bis zur größeren GPU-Maschine – zum günstigsten verfügbaren Preis.

3

Installieren & Wissen anbinden

Setup bei Ihnen vor Ort, Vernetzung, Absicherung – und Anbindung Ihrer Dokumente und Prozesse.

4

Nutzen & wachsen

Alle Mitarbeiter nutzen die Chat-Oberfläche. Das System lernt aus jeder Anfrage – wir warten und aktualisieren.

Ihre Vorteile

Einmal investieren statt monatelang abonnieren – und das Wissen bleibt bei Ihnen.

100 % Datenhoheit

Keine Anfrage, kein Dokument verlässt Ihr Gebäude. Kein Anbieter liest mit.

Kein Abo pro Kopf

Einmal-Investment plus feste Wartung – statt 20–30 € pro Mitarbeiter pro Monat.

Wissen bleibt im Haus

Das System wird mit jeder Anfrage besser – auch wenn Mitarbeiter ausscheiden.

Ein Ansprechpartner

Lokaler Service, feste Konditionen: Setup, Wartung, Updates, Support.

Lokale KI – wie funktioniert das überhaupt?

Sie müssen kein KI-Experte sein. Vier Bausteine, vom Modell bis zu Ihrem Arbeitsplatz – alles läuft bei Ihnen im Haus.

Modelldatei~60 GBQuantisierung~20 GB
Baustein 1

Das KI-Modell

Eine moderne KI ist im Kern eine Datei – ein Netzwerk aus Milliarden Zahlen, den „Gewichten“. Wir wählen ein Modell, das zu Ihrem Anwendungsfall passt (Gemma, Qwen, DeepSeek …) und komprimieren es – die sogenannte Quantisierung –, damit es auf Ihrer Hardware läuft: zum Beispiel von 60 GB auf rund 20 GB.

GemmaQwenDeepSeek
▸ ollama run qwenmodell geladen – bereit 24/7KI-Server – in Ihrem Büro
Baustein 2

Die Server-Software

Software wie Ollama oder vLLM lädt das Modell auf die Hardware und stellt es als dauerhaften Dienst in Ihrem Netzwerk bereit. Von diesem Moment an hat jeder Mitarbeiter Zugriff – 24/7, auch wenn das Internet ausfällt.

OllamaLM StudiovLLM
ChatVS CodeAIKI-Agent (Hermes)Sie wählen, wie Sie es nutzen
Baustein 3

Ihr Zugang

Genau so nutzen, wie Sie es mögen: Chat im Browser, KI-Agenten wie Hermes, die Aufgaben eigenständig erledigen – oder die KI direkt in Ihrem Arbeitsumfeld, etwa in Visual Studio Code.

ChatKI-AgentenVS Code
PC mit NVIDIA-GPU
Baustein 4

Die Hardware

Alles läuft auf einem PC mit moderner NVIDIA-Grafikkarte oder einem Spezialgerät wie dem NVIDIA DGX Spark. Sie kaufen das Gerät – wir legen fest, welches Sie wirklich brauchen, zum günstigsten verfügbaren Preis.

NVIDIA GPUDGX Spark

Ob Sie die Hardware selbst kaufen oder wir – wir liefern alles Drumherum.

Genau diese Klammer ist unser Leistungspaket: Wir wählen das richtige Modell, komprimieren und parametrisieren es, stimmen den Server auf Ihre Anforderungen ab, besorgen die Hardware zum günstigsten verfügbaren Preis – und übernehmen Installation, Einweisung und laufende Wartung. Ein Ansprechpartner, fixe Konditionen.

  • Modellwahl & Quantisierung – das passende Modell in der passenden Größe
  • Parametrisierung & Server-Tuning – Leistung, Sicherheit, Mitarbeiteranzahl
  • Hardware-Beschaffung – zum günstigsten verfügbaren Preis, ohne Aufschlag
  • Installation & Wartung – Setup, Einweisung, Updates, Support

Hintergrundwissen

Unsere Artikelreihe erklärt – ehrlich und ohne Buzzwords – alles, was Sie über lokale KI wissen müssen. Als Start: die wichtigsten Themen für Ihren Bereich.

Hardware-Pakete – drei Größen, ein Prinzip

Sie kaufen die Hardware zum jeweils günstigsten verfügbaren Preis – wir liefern alles drumherum: Lieferung, Setup, Anbindung Ihres Wissens, Einweisung und Wartung. Jedes Paket enthält die Installation & Setup ab 2.000 €.

14B – 32B-Modelle

Für den Arbeitsalltag

2× RTX 5060 Ti (16 GB) · 64 GB RAM

Der günstigste Einstieg: zwei Karten mit zusammen 32 GB VRAM. 14B-Modelle laufen flott, 32B-Modelle quantisiert über beide GPUs – ideal für Chat, Dokumente und Ihre Wissensbasis im Alltag.

ab ~1.800 € Hardware netto

+ 2.000 € Installation & Setup (netto)

Gesamt: ab ~3.800 € netto
30B – 70B-Modelle

Für höchste Ansprüche

RTX 5090 (32 GB) · 64 GB RAM

Gleiche 32 GB VRAM wie das Dual-5060-Ti-Setup – aber mit rund 4× mehr Speicherbandbreite (1.792 GB/s statt 448 GB/s). Modelle bis 70B laufen dadurch deutlich schneller und mit größerem Kontextfenster.

ab ~5.800 € Hardware netto

+ 2.000 € Installation & Setup (netto)

Gesamt: ab ~7.800 € netto
Bis 200B-Modelle

All-in-One mit maximalem Speicher

NVIDIA DGX Spark · 128 GB Unified Memory

Der einzige der drei, der Modelle über 100B Parameter lädt: dank 128 GB Unified Memory passen selbst die größten Modelle komplett ins Speicher. Etwa 8× langsamer als die 5090 – dafür in Modellgröße unerreicht. Bei vielen Beschäftigten lassen sich mehrere Systeme parallel aufstellen.

ab ~4.200 € Hardware netto

+ 2.000 € Installation & Setup (netto)

Gesamt: ab ~6.200 € netto

Richtwerte (09/2026) – die Hardware-Preise schwanken. Wir kalkulieren exakt zu Ihrem Anwendungsfall im kostenlosen Erstgespräch: Mitarbeiteranzahl, Modellauswahl, Strom, Platz und Absicherung.

Häufige Fragen

Kurz und ehrlich – alles Weitere klären wir im Erstgespräch.

Welche KI-Modelle laufen auf dem Gerät?

Moderne Open-Source-Modelle – auf dem DGX Spark bis zu 200 Mrd. Parameter. Wir wählen das Modell passend zu Ihrem Anwendungsfall und tauschen es bei Bedarf gegen neuere aus.

Funktioniert das ohne Internet?

Ja. Die KI läuft komplett im Hausnetz. Internet wird nur für Updates benötigt.

Was passiert, wenn ein Mitarbeiter geht?

Das Wissen bleibt im System. Genau das ist der Punkt: Ihr Know-how gehört Ihnen – nicht dem Einzelnen.

Wie aufwendig ist die Nutzung für die Mitarbeiter?

Wie ein Chat im Browser. Kein Training nötig – wir führen Ihre Mannschaft einmal ein.

Bereit für Ihre eigene KI?

Lassen Sie uns reden – unverbindlich und kostenlos.