Die dritte häufigste Frage im Erstgespräch: «Wie viel Strom verbraucht das Ding? Wie laut ist es? Muss ich es kühlen?» Gute Frage – und die Antwort ist: deutlich weniger, als die meisten denken, aber nicht verschwindend.
Im Folgenden rechnen wir die Betriebskosten realistisch durch: Watt im Leerlauf, Watt im Lastfall, Jahreskosten bei österreichischen Strompreisen, Kühlung und Lärm – für die RTX-5090-Maschine und die DGX Spark. Am Ende wissen Sie, was Ihre Stromrechnung wirklich kostet und ob Sie zusätzliche Kühlung oder einen separaten Raum brauchen.
Die Ausgangszahlen: Strom in Österreich (2026)
Die Berechnung basiert auf dem typischen gewerblichen Strompreis von ~0,20–0,25 €/kWh (2026, ohne Netzgebühren, mit ca. 30 % Schwankung je nach Tarif und Region). Wir rechnen mit dem Mittelwert 0,22 €/kWh. Wenn Sie einen günstigeren Tarif haben, skaliert die Rechnung proportional nach unten. Die Werte sind Orientierungswerte – die genaue Rechnung machen wir im Erstgespräch auf Basis Ihrer realen Zählerdaten.
RTX-5090-Maschine: die Rechnung
Eine typische RTX-5090-Instanz (CPU, GPU, RAM, SSD, Netzteil) hat folgende Verbrauchswerte:
| Betriebszustand | Verbrauch | Wann |
|---|---|---|
| Idle (Modell geladen, keine Anfragen) | ~60–100 W | nachts, Wochenenden, wenn niemand fragt |
| Teillast (einzelne Anfragen) | ~200–400 W | typischer Arbeitstag, 1–5 gleichzeitige User |
| Vollast (mehrere User, 7B–14B) | ~500–800 W | Peak, viele gleichzeitige Anfragen |
Jahreskosten – 24/7-Betrieb (Server läuft immer):
- Durchschnitt ~350 W (Mischung aus Idle und Last, da die meisten Tage im Teillast-Bereich liegen).
- 350 W × 8.760 h = 3.066 kWh/Jahr
- × 0,22 €/kWh = ~675 €/Jahr an Strom.
Jahreskosten – nur im Büro (Mo–Fr, 8 h, ~250 Tage):
- Durchschnitt ~350 W × ~8 h/Tag × ~250 Tage = ~700 kWh/Jahr
- × 0,22 €/kWh = ~155 €/Jahr an Strom.
Die große Differenz: Ob die Maschine nachts und am Wochenende weiterläuft oder nicht. Wenn Sie sie abschalten, sparen Sie ~75 % Strom. Wenn Sie sie laufen lassen, kostet das ~600–700 €/Jahr – das ist weniger als ein einziger ChatGPT-Team-Seat pro Monat.
DGX Spark: die deutlich sparsamere Option
Die DGX Spark ist ein Desktop-Server mit integrierter CPU/GPU-Architektur und deutlich niedrigerem Grundverbrauch:
| Betriebszustand | Verbrauch | Wann |
|---|---|---|
| Idle (Modell geladen) | ~30–50 W | nachts, Wochenenden |
| Teillast | ~80–150 W | 1–5 User |
| Vollast (70B, mehrere User) | ~150–200 W | 10–20 User, Peak |
Jahreskosten – 24/7: Durchschnitt ~100 W × 8.760 h = 876 kWh → ~190 €/Jahr.
Jahreskosten – nur im Büro (Mo–Fr, 8 h): ~100 W × 2.000 h = 200 kWh → ~45 €/Jahr.
Der DGX Spark kostet in der Stromrechnung ein Drittel bis ein Fünftel so viel wie die RTX-5090-Maschine – und das bei viermal so viel Speicher. Das ist der Kompromiss, den die integrierte Architektur bringt: sparsamer, aber im Tokens-pro-Sekunde-Bereich langsamer.
Kühlung und Lärm: was Sie in der Praxis brauchen
Kühlung: Ein KI-Server erzeugt seine gesamte Leistung als Wärme. 500 W im Lastfall sind 500 W Wärme, die irgendwo abtransportiert werden müssen. In der Praxis:
- RTX-5090-Maschine: ~500–800 W Wärme im Lastfall. In einem normalen Büro: bemerkbar, aber nicht kritisch, wenn der Raum ~20 °C hat und belüftet ist. Im Sommer, bei 28 °C Raumtemperatur, spüren Sie es – die GPU dreht die Lüfter hoch, der Raum wird wärmer. Empfehlung: separater kleiner Raum oder Ecke mit guter Luftzirkulation, oder ein zusätzlicher Gebläselüfter.
- DGX Spark: ~150–200 W Wärme – das entspricht einem normalen Desktop-PC. Kühlung ist kein Thema; der Spark kann auf dem Schreibtisch stehen, ohne dass der Raum spürbar wärmer wird.
Lärm:
- RTX-5090: Die GPU hat drei Lüfter, die im Lastfall auf ~50–55 dB drehen (vergleichbar mit einem leisen Gespräch). Im offenen Büro: spürbar, aber nicht störend, wenn die Maschine 3–5 m entfernt steht. In direkter Nähe: hörbar. Empfehlung: kleiner Raum oder Ecke, nicht mitten im offenen Büro.
- DGX Spark: ~25–35 dB im Normalbetrieb – deutlich leiser als ein normaler Desktop-PC, unproblematisch auf dem Schreibtisch.
Der DGX Spark gewinnt hier klar: leiser, sparsamer, weniger Wärme – der Preis ist die geringere Rechenleistung im Tokens-pro-Sekunde-Bereich. Für die meisten KMU-Text- und RAG-Anwendungen ist das ein fairer Kompromiss.
Die Gesamtrechnung im ersten Jahr
RTX-5090-Maschine (~7.000 € Hardware):
- Hardware: ~3.000 € (einmalig)
- Installation & Setup: ab 2.000 € (einmalig)
- Wartung: ~100–200 €/Monat = ~1.200–2.400 €/Jahr
- Strom (24/7): ~675 €/Jahr
- Gesamt Jahr 1: ~6.900–8.700 € · Jahr 2+: ~1.900–3.100 €/Jahr (nur Wartung + Strom)
DGX Spark (~4.500 € Hardware):
- Hardware: ~4.500 € (einmalig)
- Installation & Setup: ab 2.000 € (einmalig)
- Wartung: ~100–200 €/Monat = ~1.200–2.400 €/Jahr
- Strom (24/7): ~190 €/Jahr
- Gesamt Jahr 1: ~7.700–8.900 € · Jahr 2+: ~1.400–2.600 €/Jahr
Im zweiten Jahr fallen nur noch Wartung und Strom an – bei der 5090 ~1.900–3.100 €, beim Spark ~1.400–2.600 €. Vergleichen Sie das mit den 15.000–30.000 €/Jahr an KI-Abos, die ein 30–50-Mann-Betrieb heute typischerweise zahlt: die lokale KI ist nach 18–30 Monaten amortisiert, danach sparen Sie jedes Jahr die kompletten Abo-Kosten.