GPU-Server-Angebote vergleichen: die Positionen hinter der Summe und die Kostenstruktur über fünf Jahre
Eurokommerz, Wien, seit 2006: Private AI/ML · IT Managed Services · Enterprise Training · KI-Hardware & Software
- Zwei Angebote für denselben Server mit acht GPUs können sich in GPU-Edition, Stromkabeln, Netzwerkkarten und Transceivern, Garantiestufe, Burn-in, Lizenzen, Lieferbedingungen und Rücknahme unterscheiden; vergleichen Sie sie deshalb Position für Position, bevor Sie die Summen vergleichen
- „RTX PRO 6000 96 GB“ steht für mehrere Editionen: NVIDIA gibt die Server Edition mit bis zu 600 W an und die Max-Q Workstation Edition mit 300 W und aktiver Kühlung, und nur die Server Edition steht auf NVIDIAs Liste der von vGPU unterstützten GPUs
- Lenovos Leitfaden zum SR675 V3 nennt eine Basisgarantie von drei Jahren oder einem Jahr mit Service 9x5 am nächsten Arbeitstag und bietet 4 oder 2 Stunden Reaktionszeit sowie Verlängerungen um 1 oder 2 Jahre an; ein Fünfjahresplan braucht die Verlängerung also im Angebot
- NVIDIA AI Enterprise wird pro GPU lizenziert; jede H200 NVL enthält fünf Jahre, gezählt ab der Auslieferung der Karte an den Serverhersteller zuzüglich 90 Tagen, während Lenovo das Softwarepaket für die RTX PRO 6000 Server Edition pro GPU für drei oder fünf Jahre führt
- Die Kostenkategorien über fünf Jahre sind Hardware, Garantieverlängerungen, Lizenzen und Verlängerungen, Strom in kWh, Kühlung, Support, Betriebsaufwand und Ende der Nutzung; acht 600-W-Karten verbrauchen in fünf Jahren höchstens etwa 210.000 kWh Kartenenergie
Geliefert von Eurokommerz: KI-Server, auf Bestellung gebaut Konfiguration anfragen →
Wie Sie GPU-Server-Angebote Position für Position vergleichen
Beim Vergleich von GPU-Server-Angeboten zeigt sich oft, dass zwei Angebote für den „gleichen“ Server mit acht GPUs verschiedene Maschinen und verschiedene Leistungen beschreiben. Bevor Sie Summen vergleichen, übertragen Sie beide Angebote in eine gemeinsame Liste von Positionen: die genaue GPU-Edition und ihre Stromkabel, Gehäuse und Netzteile, Prozessoren, Arbeitsspeicher, NVMe-Laufwerke, Netzwerkkarten mit Kabeln und Transceivern, Schienen und Netzkabel, Garantielaufzeit und Servicestufe, Burn-in, Inbetriebnahme und Softwareinstallation, NVIDIA-Lizenzpositionen, Lieferbedingungen und Rücknahme. Vergleichbar wird eine Summe, sobald jede Position entweder in beiden Angeboten steht oder dem Angebot hinzugefügt ist, das sie auslässt.
| POSITION | WAS ZU PRÜFEN IST | HÄUFIGE LÜCKE |
|---|---|---|
| GPU-Edition | Vollständiger Produktname, Speicher, Kartenleistung | eine Workstation-Karte, wo eine passive Serverkarte nötig ist |
| GPU-Stromkabel | ein Kabel je Karte, für die Karte ausgelegt | fehlende Kabel bei einer Nachrüstung im Feld |
| Gehäuse und Netzteile | unterstützte GPU-Zahl, Leistung und Redundanz der Netzteile | Netzteile für Leistungsbegrenzte Karten bemessen |
| CPU, Arbeitsspeicher, NVMe | Modell, Anzahl und Kapazität je Position | Storage nur als Summe angegeben |
| Netzwerkkarten, Kabel | Ports, Geschwindigkeit, Kabel oder Transceiver je Port | Transceiver und Kabel |
| Schienen und Netzkabel | Schienensatz, Kabeltyp je PDU-Ausgang | Kabel für den falschen Ausgang |
| Garantie und Service | Jahre, Reaktionszeit, vor Ort oder nur Teile | drei Jahre in einem Fünfjahresplan |
| Burn-in und Bericht | welcher Test, Bericht mit der Lieferung | kein genannter Test |
| Inbetriebnahme und OS | Arbeiten vor Ort, Betriebssystem, Treiberzweig | als optional geführt, ohne Umfang |
| NVIDIA AI Enterprise | GPU-Zahl, Laufzeit, Supportstufe | Verlängerung nach der ersten Laufzeit |
| vGPU-Lizenzen | Edition und gleichzeitige Nutzer | Editionen pro Nutzer, pro GPU gezählt |
| Lieferbedingungen | Incoterms®-Regel, Entladen, Aufstellung | Entladen am Standort |
| Rücknahme (WEEE) | wer abholt und das Ende der Nutzung finanziert | nicht erwähnt |
Unsere Checkliste. Angaben zu GPUs und Lizenzen aus NVIDIAs Produktseiten, der Liste der von vGPU unterstützten GPUs, dem Leitfaden zur vGPU-Lizenzierung und dem Lizenzierungsleitfaden für AI Enterprise, den Lenovo-Press-Leitfäden LP2263 und LP1611, der Seite der ICC zu Incoterms® 2020 und der Richtlinie 2012/19/EU, gelesen am 10. Oktober 2026.
Beginnt eine private KI-Plattform für mehrere Abteilungen mit zwei Servern zu je acht Karten, fehlt jede Position, die ein Angebot auslässt, zweimal, und eine fehlende Lizenzposition fehlt sechzehnmal. Die Formulierungen für eine förmliche Ausschreibung behandelt unser Leitfaden, wie Sie die technische Spezifikation für eine GPU-Server-Ausschreibung schreiben; dieser Artikel liest die Angebote, die daraufhin eingehen.
GPU-Edition, Netzteile und Kabel
Eine Zeile „RTX PRO 6000 96 GB“ sagt nicht, um welche Karte es sich handelt. NVIDIA führt die RTX PRO 6000 Blackwell Server Edition mit einer maximalen Leistung von „Up to 600W (configurable)“ und 1.597 GB/s Speicherbandbreite. Die RTX PRO 6000 Blackwell Max-Q Workstation Edition hat dieselben 96 GB mit 1.792 GB/s, eine Grenze von 300 W und eine Kühlung vom Typ „Active“, also eine Karte mit eigenem Lüfter für eine Workstation. NVIDIAs Liste der von vGPU unterstützten GPUs, aktualisiert am 2. Oktober 2026, nennt die Server Edition und keine Workstation- oder Max-Q-Edition dieser Karte. Soll der Server virtuelle Maschinen mit vGPU betreiben, ist eine Max-Q-Position ein anderes Produkt.
Lenovos Produktleitfaden zur Server Edition, aktualisiert am 28. Juli 2026, führt eine zweite Variante, auf 450 W begrenzt, „um den Einbau von 4 GPUs im SR650a V4 zu ermöglichen“. Außerdem hält er fest, dass die GPU-Option „nicht mit zusätzlichen Stromkabeln geliefert wird“ und dass „die Kabel wegen der Längenanforderungen serverspezifisch sind“. In einer Werkskonfiguration fügt der Konfigurator sie hinzu; bei einer Nachrüstung im Feld sind sie eigene Positionen. Prüfen Sie, dass jede Karte ihr Kabel hat und dass das Angebot sagt, ob die Karten mit voller Leistung oder begrenzt laufen.
Für die H200 NVL nennt NVIDIA „2- or 4-way NVIDIA NVLink bridge“ mit 900 GB/s je GPU. Die Bridges sind eigene Positionen, und das Angebot sollte sagen, wie viele es sind und welche Karten sie verbinden. Acht 600-W-Karten ziehen bis zu 4,8 kW, noch vor Prozessoren und Lüftern; fragen Sie deshalb jeden Lieferanten nach der Zahl der Netzteile, der Leistung je Netzteil und danach, ob der Server unter Volllast redundant bleibt. Unser Leitfaden, was Sie vor dem Angebot für einen KI-Server festlegen, behandelt Zuleitungen, Ausgänge und Luftstrom an der Rackposition.
CPU, Arbeitsspeicher, NVMe und Netzwerk als Positionen
Prozessoren, Speichermodule und Laufwerke sollten als Positionen mit Modell, Anzahl und Kapazität erscheinen, nicht als Zusammenfassung wie „1 TB RAM“. Größe und Zahl der Module zeigen, ob jeder Speicherkanal bestückt ist, und zwei Angebote mit derselben Summe können sich genau darin unterscheiden. Vergleichen Sie bei NVMe die Zahl der Laufwerke, die Kapazität und die Endurance-Klasse jedes Laufwerks sowie, welche Laufwerke den Spiegel des Betriebssystems tragen. Wenn Ihre Datenregeln es verlangen, fragen Sie, ob ein ausgefallenes Laufwerk im Rahmen der Garantie zurückgegeben werden muss oder vor Ort bleiben darf.
Netzwerkkarten werden oft ohne das angeboten, was sie anbindet. Führen Sie die Ports und ihre Geschwindigkeit auf und für jeden Port den Kabel- oder Transceivertyp und die Länge bis zu Ihren Switches, dazu den Out-of-Band-Management-Port. Schienen und Netzkabel vervollständigen die Positionsliste: der Schienensatz für Ihre Racktiefe und je Netzteil ein Netzkabel, das zu Ihren PDU-Ausgängen passt.
Garantielaufzeit und Servicestufe
Garantiepositionen unterscheiden sich in Laufzeit, Reaktion und dem, was vor Ort getauscht wird. Lenovos Produktleitfaden zum ThinkSystem SR675 V3, aktualisiert am 8. Oktober 2026, nennt eine „Three-year or one-year (model dependent) customer-replaceable unit and onsite limited warranty“ mit „9x5 next business day (NBD)“. Die optionalen Upgrades sind „4-hour or 2-hour response time, 6-hour fix time, 1-year or 2-year warranty extension“. Eine Reaktionszeit (response time) sagt, wann sich jemand meldet oder eintrifft, eine Reparaturzeit (fix time), wann der Server wieder läuft; vergleichen Sie deshalb in beiden Angeboten dieselbe Größe. Vom Kunden austauschbare Teile (customer-replaceable units) tauscht Ihr eigenes Personal, fragen Sie also, welche Teile das beim angebotenen Modell sind.
Ein Fünfjahresplan auf einer dreijährigen Basisgarantie braucht die Verlängerung jetzt als Position, nicht später als Verlängerungsauftrag. Klären Sie für die GPUs, wer eine Fehlermeldung entgegennimmt, der Serverhersteller, der Kartenlieferant oder der Händler, und ob eine Ersatzkarte versandt wird, bevor die defekte zurückgegeben ist.
Bei GPUs und Servern, die wir liefern, wird die Herstellergarantie über uns abgewickelt, und DOA-Geräte werden ersetzt. Schreiben Sie uns die Servicestufe, die Ihr Betrieb braucht, und wir nennen die Garantiebedingungen schriftlich mit der Konfiguration.
Burn-in, Inbetriebnahme und Softwareinstallation
Fragen Sie, ob der Server vor dem Versand montiert und unter Last getestet wird, welcher Test läuft und ob der Bericht mit der Lieferung kommt. Unser Leitfaden zu Abnahmetest und Burn-in von GPU-Servern führt die Prüfungen auf, die vor Ort zu wiederholen sind, und die Abnahmekriterien, die vorab zu vereinbaren sind. Inbetriebnahme vor Ort, Betriebssystem, NVIDIA-Treiberzweig, CUDA und eine Container-Runtime sind eigene Leistungen. Ein Angebot, das sie als optional führt, ohne zu sagen, was sie umfassen, lässt sich mit einem Angebot, das es sagt, nicht vergleichen.
Lizenzpositionen für NVIDIA AI Enterprise und vGPU
NVIDIAs Lizenzierungsleitfaden, aktualisiert am 2. September 2026, sagt, die Software „wird pro GPU lizenziert“ und „für jede GPU, die im Server oder in der Workstation installiert ist, ist eine Softwarelizenz erforderlich“. Zwei Server mit je acht Karten brauchen deshalb sechzehn Lizenzen, wo immer die Software benötigt wird: für NIM in der Produktion, für Compute-vGPU-Profile und für NVIDIA-Support, wie unser Artikel zur Lizenzierung von NVIDIA AI Enterprise erklärt. Eine Open-Source-Engine auf Bare Metal braucht keine.
Der Leitfaden hält fest: „Jede NVIDIA H200 NVL Tensor Core GPU enthält ein fünfjähriges Abonnement von NVIDIA AI Enterprise. Eine Aktivierung der Software ist erforderlich.“ Die Laufzeit beginnt mit der Auslieferung der Karte an den Serverhersteller „zuzüglich 90 Tagen für die Integration und die endgültige Lieferung an den Standort des Kunden“ und ist damit je Karte festgelegt. Die Aktivierung braucht die Seriennummern der Karten, fragen Sie also mit der Lieferung danach. Für die enthaltenen Abonnements sagt der Leitfaden, die Software „kann auf den NVIDIA-Certified Systems installiert werden, in denen die GPUs eingebaut sind“; prüfen Sie deshalb, dass das angebotene Servermodell mit Ihren Karten auf NVIDIAs Liste zertifizierter Systeme steht.
Für die RTX PRO 6000 Server Edition führt Lenovos Leitfaden ein „Software Kit (NVAIE, Run:ai, vGPU, Support), per GPU, 3Years“ und ein Paket „per GPU, 5 Years“. Abonnements müssen verlängert werden, „um aktiv zu bleiben“, ein dreijähriges Paket in einem Fünfjahresplan bringt also eine Verlängerung im vierten Jahr. Business-Standard-Support ist enthalten, und NVIDIA bietet Business Critical als Upgrade an.
Grafik-vGPU-Editionen werden pro gleichzeitigem Nutzer gezählt, nicht pro Karte. NVIDIAs Leitfaden zu Paketierung und Lizenzierung von vGPU, aktualisiert am 24. März 2026, hält fest: „NVIDIA vApps, NVIDIA vPC und NVIDIA RTX vWS sind in einem Modell pro gleichzeitigem Nutzer (Concurrent User, CCU) erhältlich.“ Vergleichen Sie die Zahl der gleichzeitigen Nutzer in beiden Angeboten.
NVIDIA-AI-Enterprise- und vGPU-Lizenzen liefern wir auf derselben Rechnung wie die Hardware. Nennen Sie uns die Karten, die virtuellen Maschinen und die Nutzer je Karte im Formular unten, und die Lizenzpositionen kommen mit der Konfiguration.
Lieferbedingungen und Rücknahme nach der WEEE-Richtlinie
Die Internationale Handelskammer (ICC) beschreibt die Incoterms®-Regeln als „einen Satz von Standards, die in internationalen und inländischen Verträgen über die Lieferung von Waren verwendet werden“; Incoterms® 2020 sind am 1. Januar 2020 in Kraft getreten. Die im Angebot genannte Regel entscheidet, wer das Transportrisiko trägt und bis zu welchem Punkt. Die Seite der ICC merkt an: „Bei DAP entlädt der Verkäufer die Ware nicht, bei DPU entlädt der Verkäufer die Ware.“ Ein Server mit acht GPUs muss trotzdem entladen, in den Raum getragen und eingebaut werden; prüfen Sie also, welches Angebot diese Schritte enthält, und die Anlieferungsregeln des Rechenzentrums.
Für das Ende der Nutzung bestimmt Artikel 13 Absatz 1 der Richtlinie 2012/19/EU, dass die Finanzierung der Sammlung, Behandlung, Verwertung und umweltgerechten Beseitigung von Elektro- und Elektronik-Altgeräten anderer Nutzer als privater Haushalte bei Produkten, die nach dem 13. August 2005 in Verkehr gebracht wurden, von den Herstellern zu tragen ist. Nach Artikel 13 Absatz 2 können Hersteller und diese Nutzer Vereinbarungen über andere Finanzierungsmodalitäten treffen. Lassen Sie im Angebot oder im Vertrag die Rücknahmebedingungen festhalten und wer die Laufwerke vor der Abholung löscht. Wie die Richtlinie auf einen bestimmten Kauf anzuwenden ist, ist eine rechtliche Bewertung für die Rechtsabteilung des Unternehmens.
Kostenstruktur eines GPU-Servers über fünf Jahre
Eine Angebotssumme deckt den Kauf ab. Über fünf Jahre verteilen sich die Kosten auf Kategorien, die jeweils einen Kostentreiber und eine Quelle für die Zahl haben.
| KOSTENKATEGORIE | KOSTENTREIBER | DATENQUELLE |
|---|---|---|
| Hardware | Server, Karten, Ersatzteile | die Angebote, Position für Position |
| Garantieverlängerungen | Basislaufzeit, Reaktionszeit, zusätzliche Jahre | Serviceoptionen des Serverherstellers |
| Lizenzen und Verlängerungen | lizenzierte GPUs, Laufzeit, Jahr der Verlängerung | NVIDIA-Lizenzierungsleitfaden, Angebot |
| Strom in kWh | Aufnahme unter Last und im Leerlauf, Stunden | BMC, messende PDU, DCGM-Energiezähler |
| Kühlung und Rackplatz | Wärmelast, Rackpositionen | Haustechnik oder Rechenzentrumsvertrag |
| Support | Servicestufe, erste Anlaufstelle | Supportvertrag |
| Betriebsaufwand | Updates, Monitoring, Modellwechsel | Personalstunden oder ein Servicevertrag |
| Ende der Nutzung | Rücknahme, Löschen der Laufwerke | WEEE-Bedingungen im Vertrag |
Kategorien von uns; Lizenzbedingungen aus NVIDIAs Lizenzierungsleitfaden für AI Enterprise (2. September 2026) und Lenovo Press LP2263, Garantieoptionen aus Lenovo Press LP1611, gelesen am 10. Oktober 2026.
Strom ist die Kategorie, die sich vor dem Kauf nach oben begrenzen lässt. Fünf Jahre sind etwa 43.800 Stunden. Acht Karten mit 600 W ziehen höchstens 4,8 kW Kartenleistung, die Karten eines Servers verbrauchen in fünf Jahren also höchstens etwa 210.000 kWh und die von zwei Servern etwa 420.000 kWh, noch vor Prozessoren, Lüftern, Netzteilverlusten und Kühlung. Server ziehen weniger, während sie auf Anfragen warten, und unser Artikel zur GPU-Energie pro Token zeigt, wie Sie die Aufnahme mit DCGM- und vLLM-Zählern messen; multiplizieren Sie die gemessenen kWh mit Ihrem eigenen Tarif.
Die übrigen Kategorien ergeben sich aus den Angebotspositionen oben. Eine dreijährige Garantie und ein dreijähriges Lizenzpaket bringen innerhalb der fünf Jahre jeweils eine Verlängerung, sofern das Angebot nicht die Garantieverlängerung oder das Fünfjahrespaket enthält, während das Abonnement der H200 NVL ab einem je Karte festgelegten Datum läuft. Der Betriebsaufwand hängt davon ab, wer die Server nach der Lieferung betreibt, Ihr eigenes Personal oder ein beauftragter Dienstleister, und gehört in den Vergleich, auch wenn ihn kein Angebot ausweist.
Was wir liefern
Wir bauen KI-Server auf Bestellung rund um den Workload, montiert und im Burn-in getestet, mit Testbericht auf Wunsch, mit Herstellergarantie auf jede Komponente und Lieferung in die ganze EU, unter einem EU-Vertrag und auf einer Rechnung. Zu den Karten gehören die RTX PRO 6000 Server Edition, die H200 NVL mit NVLink-Bridges, die L40S und die L4, aufgeführt auf unserer Seite zu professionellen NVIDIA-GPUs. NVIDIA-AI-Enterprise- und vGPU-Lizenzen kommen auf dieselbe Rechnung wie die Hardware. Betriebssystem, Treiber, CUDA und eine Container-Runtime installieren wir auf Wunsch, und die Inbetriebnahme vor Ort ist auf Anfrage möglich. Wir prüfen Rack, Strom und Luftstrom vor dem Angebot, und Konfiguration und Angebot folgen innerhalb eines Werktages.
FAQ
Wie vergleiche ich Angebote für GPU-Server?
Welche Positionen gehören in ein Angebot für einen KI-Server?
Woraus setzen sich die Gesamtkosten (TCO) eines KI-Servers zusammen?
Welche Garantieoptionen gibt es für GPU-Server?
Ist NVIDIA AI Enterprise in einem KI-Server enthalten?
Wer zahlt in der EU die Rücknahme eines Servers am Ende der Nutzung?
Schicken Sie uns den Workload, die Zahl der Server und Karten, die benötigte Garantielaufzeit und Servicestufe, die Lizenzen und den Lieferort. Wir prüfen Rack, Strom und Luftstrom und antworten innerhalb eines Werktages mit einer Konfiguration und einem schriftlichen Angebot, das die Garantiebedingungen nennt.
Mit einem Experten sprechenWir antworten innerhalb eines Werktages