Wir liefern einen KI-Server direkt in Ihr Unternehmen, installieren und binden ihn mit Ihrem IT Team ein. Jeder Mitarbeiter bekommt eine sichere Chat-Oberfläche, die mit Ihrem Firmenwissen antwortet. Ohne Cloud. Ohne Abo. Auch Einbindung in Visual Studio Code und andere Entwicklungsumgebungen ist möglich.
Hardware zum günstigsten verfügbaren Preis · Installation & Setup ab 2.000 €
Jeder Chat, jedes Dokument, jede Anfrage verlässt Ihr Haus – und Sie zahlen pro Kopf, pro Monat, für immer.
Cloud-KI sendet Dokumente, Angebote und Mitarbeiteranfragen auf fremde Server – oft in Drittstaaten.
20–30 € pro Mitarbeiter pro Monat, Token-Abrechnung, Preiserhöhungen jederzeit möglich.
Know-how sitzt in Köpfen und Postfächern – und verlässt das Unternehmen mit jedem Weggang.
Vom ersten Gespräch bis zum laufenden Betrieb – ein Ansprechpartner, alles aus einer Hand.
Wir analysieren Ihre Anforderungen, Daten und Mitarbeiterzahl in einem 30-Minuten-Gespräch.
Wir kaufen die passende KI-Hardware ein – vom kompakten NVIDIA DGX Spark bis zur größeren GPU-Maschine – zum günstigsten verfügbaren Preis.
Setup bei Ihnen vor Ort, Vernetzung, Absicherung – und Anbindung Ihrer Dokumente und Prozesse.
Alle Mitarbeiter nutzen die Chat-Oberfläche. Das System lernt aus jeder Anfrage – wir warten und aktualisieren.
Einmal investieren statt monatelang abonnieren – und das Wissen bleibt bei Ihnen.
Keine Anfrage, kein Dokument verlässt Ihr Gebäude. Kein Anbieter liest mit.
Einmal-Investment plus feste Wartung – statt 20–30 € pro Mitarbeiter pro Monat.
Das System wird mit jeder Anfrage besser – auch wenn Mitarbeiter ausscheiden.
Lokaler Service, feste Konditionen: Setup, Wartung, Updates, Support.
Sie müssen kein KI-Experte sein. Vier Bausteine, vom Modell bis zu Ihrem Arbeitsplatz – alles läuft bei Ihnen im Haus.
Eine moderne KI ist im Kern eine Datei – ein Netzwerk aus Milliarden Zahlen, den „Gewichten“. Wir wählen ein Modell, das zu Ihrem Anwendungsfall passt (Gemma, Qwen, DeepSeek …) und komprimieren es – die sogenannte Quantisierung –, damit es auf Ihrer Hardware läuft: zum Beispiel von 60 GB auf rund 20 GB.
Software wie Ollama oder vLLM lädt das Modell auf die Hardware und stellt es als dauerhaften Dienst in Ihrem Netzwerk bereit. Von diesem Moment an hat jeder Mitarbeiter Zugriff – 24/7, auch wenn das Internet ausfällt.
Genau so nutzen, wie Sie es mögen: Chat im Browser, KI-Agenten wie Hermes, die Aufgaben eigenständig erledigen – oder die KI direkt in Ihrem Arbeitsumfeld, etwa in Visual Studio Code.
Alles läuft auf einem PC mit moderner NVIDIA-Grafikkarte oder einem Spezialgerät wie dem NVIDIA DGX Spark. Sie kaufen das Gerät – wir legen fest, welches Sie wirklich brauchen, zum günstigsten verfügbaren Preis.
Unsere Artikelreihe erklärt – ehrlich und ohne Buzzwords – alles, was Sie über lokale KI wissen müssen. Als Start: die wichtigsten Themen für Ihren Bereich.
So läuft lokale KI in Ihrem Branchenumfeld – mit den konkreten Daten, die bei Ihnen im Spiel sind.
Die Bausteine verstehbar gemacht: Modelle, Software, Hardware, Kosten, Absicherung – bis zur Checkliste für Ihre Entscheidung.
Vor-Ort-Installation und Service – lokal in Ihrem Bundesland, mit den Gegebenheiten vor Ort.
Sie kaufen die Hardware zum jeweils günstigsten verfügbaren Preis – wir liefern alles drumherum: Lieferung, Setup, Anbindung Ihres Wissens, Einweisung und Wartung. Jedes Paket enthält die Installation & Setup ab 2.000 €.
2× RTX 5060 Ti (16 GB) · 64 GB RAM
Der günstigste Einstieg: zwei Karten mit zusammen 32 GB VRAM. 14B-Modelle laufen flott, 32B-Modelle quantisiert über beide GPUs – ideal für Chat, Dokumente und Ihre Wissensbasis im Alltag.
+ 2.000 € Installation & Setup (netto)
RTX 5090 (32 GB) · 64 GB RAM
Gleiche 32 GB VRAM wie das Dual-5060-Ti-Setup – aber mit rund 4× mehr Speicherbandbreite (1.792 GB/s statt 448 GB/s). Modelle bis 70B laufen dadurch deutlich schneller und mit größerem Kontextfenster.
+ 2.000 € Installation & Setup (netto)
NVIDIA DGX Spark · 128 GB Unified Memory
Der einzige der drei, der Modelle über 100B Parameter lädt: dank 128 GB Unified Memory passen selbst die größten Modelle komplett ins Speicher. Etwa 8× langsamer als die 5090 – dafür in Modellgröße unerreicht. Bei vielen Beschäftigten lassen sich mehrere Systeme parallel aufstellen.
+ 2.000 € Installation & Setup (netto)
Richtwerte (09/2026) – die Hardware-Preise schwanken. Wir kalkulieren exakt zu Ihrem Anwendungsfall im kostenlosen Erstgespräch: Mitarbeiteranzahl, Modellauswahl, Strom, Platz und Absicherung.
Kurz und ehrlich – alles Weitere klären wir im Erstgespräch.
Moderne Open-Source-Modelle – auf dem DGX Spark bis zu 200 Mrd. Parameter. Wir wählen das Modell passend zu Ihrem Anwendungsfall und tauschen es bei Bedarf gegen neuere aus.
Ja. Die KI läuft komplett im Hausnetz. Internet wird nur für Updates benötigt.
Das Wissen bleibt im System. Genau das ist der Punkt: Ihr Know-how gehört Ihnen – nicht dem Einzelnen.
Wie ein Chat im Browser. Kein Training nötig – wir führen Ihre Mannschaft einmal ein.
Lassen Sie uns reden – unverbindlich und kostenlos.