BLOG · GUIDE ·

GPU-Server-Angebote vergleichen: die Positionen hinter der Summe und die Kostenstruktur über fünf Jahre

Eurokommerz, Wien, seit 2006: Private AI/ML · IT Managed Services · Enterprise Training · KI-Hardware & Software

IN KÜRZE
  • Zwei Angebote für denselben Server mit acht GPUs können sich in GPU-Edition, Stromkabeln, Netzwerkkarten und Transceivern, Garantiestufe, Burn-in, Lizenzen, Lieferbedingungen und Rücknahme unterscheiden; vergleichen Sie sie deshalb Position für Position, bevor Sie die Summen vergleichen
  • „RTX PRO 6000 96 GB“ steht für mehrere Editionen: NVIDIA gibt die Server Edition mit bis zu 600 W an und die Max-Q Workstation Edition mit 300 W und aktiver Kühlung, und nur die Server Edition steht auf NVIDIAs Liste der von vGPU unterstützten GPUs
  • Lenovos Leitfaden zum SR675 V3 nennt eine Basisgarantie von drei Jahren oder einem Jahr mit Service 9x5 am nächsten Arbeitstag und bietet 4 oder 2 Stunden Reaktionszeit sowie Verlängerungen um 1 oder 2 Jahre an; ein Fünfjahresplan braucht die Verlängerung also im Angebot
  • NVIDIA AI Enterprise wird pro GPU lizenziert; jede H200 NVL enthält fünf Jahre, gezählt ab der Auslieferung der Karte an den Serverhersteller zuzüglich 90 Tagen, während Lenovo das Softwarepaket für die RTX PRO 6000 Server Edition pro GPU für drei oder fünf Jahre führt
  • Die Kostenkategorien über fünf Jahre sind Hardware, Garantieverlängerungen, Lizenzen und Verlängerungen, Strom in kWh, Kühlung, Support, Betriebsaufwand und Ende der Nutzung; acht 600-W-Karten verbrauchen in fünf Jahren höchstens etwa 210.000 kWh Kartenenergie

Geliefert von Eurokommerz: KI-Server, auf Bestellung gebaut  Konfiguration anfragen →

Wie Sie GPU-Server-Angebote Position für Position vergleichen

Beim Vergleich von GPU-Server-Angeboten zeigt sich oft, dass zwei Angebote für den „gleichen“ Server mit acht GPUs verschiedene Maschinen und verschiedene Leistungen beschreiben. Bevor Sie Summen vergleichen, übertragen Sie beide Angebote in eine gemeinsame Liste von Positionen: die genaue GPU-Edition und ihre Stromkabel, Gehäuse und Netzteile, Prozessoren, Arbeitsspeicher, NVMe-Laufwerke, Netzwerkkarten mit Kabeln und Transceivern, Schienen und Netzkabel, Garantielaufzeit und Servicestufe, Burn-in, Inbetriebnahme und Softwareinstallation, NVIDIA-Lizenzpositionen, Lieferbedingungen und Rücknahme. Vergleichbar wird eine Summe, sobald jede Position entweder in beiden Angeboten steht oder dem Angebot hinzugefügt ist, das sie auslässt.

POSITIONWAS ZU PRÜFEN ISTHÄUFIGE LÜCKE
GPU-EditionVoll­ständiger Produktname, Speicher, Karten­leistungeine Workstation-Karte, wo eine passive Serverkarte nötig ist
GPU-Stromkabelein Kabel je Karte, für die Karte ausgelegtfehlende Kabel bei einer Nachrüstung im Feld
Gehäuse und Netzteileunterstützte GPU-Zahl, Leistung und Redundanz der NetzteileNetzteile für Leistungs­begrenzte Karten bemessen
CPU, Arbeits­speicher, NVMeModell, Anzahl und Kapazität je PositionStorage nur als Summe angegeben
Netzwerk­karten, KabelPorts, Geschwindigkeit, Kabel oder Transceiver je PortTransceiver und Kabel
Schienen und NetzkabelSchienensatz, Kabeltyp je PDU-AusgangKabel für den falschen Ausgang
Garantie und ServiceJahre, Reaktions­zeit, vor Ort oder nur Teiledrei Jahre in einem Fünfjahres­plan
Burn-in und Berichtwelcher Test, Bericht mit der Lieferungkein genannter Test
Inbetriebnahme und OSArbeiten vor Ort, Betriebs­system, Treiberzweigals optional geführt, ohne Umfang
NVIDIA AI EnterpriseGPU-Zahl, Laufzeit, SupportstufeVerlängerung nach der ersten Laufzeit
vGPU-LizenzenEdition und gleichzeitige NutzerEditionen pro Nutzer, pro GPU gezählt
Liefer­bedingungenIncoterms®-Regel, Entladen, AufstellungEntladen am Standort
Rücknahme (WEEE)wer abholt und das Ende der Nutzung finanziertnicht erwähnt

Unsere Checkliste. Angaben zu GPUs und Lizenzen aus NVIDIAs Produktseiten, der Liste der von vGPU unterstützten GPUs, dem Leitfaden zur vGPU-Lizenzierung und dem Lizenzierungsleitfaden für AI Enterprise, den Lenovo-Press-Leitfäden LP2263 und LP1611, der Seite der ICC zu Incoterms® 2020 und der Richtlinie 2012/19/EU, gelesen am 10. Oktober 2026.

Beginnt eine private KI-Plattform für mehrere Abteilungen mit zwei Servern zu je acht Karten, fehlt jede Position, die ein Angebot auslässt, zweimal, und eine fehlende Lizenzposition fehlt sechzehnmal. Die Formulierungen für eine förmliche Ausschreibung behandelt unser Leitfaden, wie Sie die technische Spezifikation für eine GPU-Server-Ausschreibung schreiben; dieser Artikel liest die Angebote, die daraufhin eingehen.

GPU-Edition, Netzteile und Kabel

Eine Zeile „RTX PRO 6000 96 GB“ sagt nicht, um welche Karte es sich handelt. NVIDIA führt die RTX PRO 6000 Blackwell Server Edition mit einer maximalen Leistung von „Up to 600W (configurable)“ und 1.597 GB/s Speicherbandbreite. Die RTX PRO 6000 Blackwell Max-Q Workstation Edition hat dieselben 96 GB mit 1.792 GB/s, eine Grenze von 300 W und eine Kühlung vom Typ „Active“, also eine Karte mit eigenem Lüfter für eine Workstation. NVIDIAs Liste der von vGPU unterstützten GPUs, aktualisiert am 2. Oktober 2026, nennt die Server Edition und keine Workstation- oder Max-Q-Edition dieser Karte. Soll der Server virtuelle Maschinen mit vGPU betreiben, ist eine Max-Q-Position ein anderes Produkt.

Lenovos Produktleitfaden zur Server Edition, aktualisiert am 28. Juli 2026, führt eine zweite Variante, auf 450 W begrenzt, „um den Einbau von 4 GPUs im SR650a V4 zu ermöglichen“. Außerdem hält er fest, dass die GPU-Option „nicht mit zusätzlichen Stromkabeln geliefert wird“ und dass „die Kabel wegen der Längenanforderungen serverspezifisch sind“. In einer Werkskonfiguration fügt der Konfigurator sie hinzu; bei einer Nachrüstung im Feld sind sie eigene Positionen. Prüfen Sie, dass jede Karte ihr Kabel hat und dass das Angebot sagt, ob die Karten mit voller Leistung oder begrenzt laufen.

Für die H200 NVL nennt NVIDIA „2- or 4-way NVIDIA NVLink bridge“ mit 900 GB/s je GPU. Die Bridges sind eigene Positionen, und das Angebot sollte sagen, wie viele es sind und welche Karten sie verbinden. Acht 600-W-Karten ziehen bis zu 4,8 kW, noch vor Prozessoren und Lüftern; fragen Sie deshalb jeden Lieferanten nach der Zahl der Netzteile, der Leistung je Netzteil und danach, ob der Server unter Volllast redundant bleibt. Unser Leitfaden, was Sie vor dem Angebot für einen KI-Server festlegen, behandelt Zuleitungen, Ausgänge und Luftstrom an der Rackposition.

CPU, Arbeitsspeicher, NVMe und Netzwerk als Positionen

Prozessoren, Speichermodule und Laufwerke sollten als Positionen mit Modell, Anzahl und Kapazität erscheinen, nicht als Zusammenfassung wie „1 TB RAM“. Größe und Zahl der Module zeigen, ob jeder Speicherkanal bestückt ist, und zwei Angebote mit derselben Summe können sich genau darin unterscheiden. Vergleichen Sie bei NVMe die Zahl der Laufwerke, die Kapazität und die Endurance-Klasse jedes Laufwerks sowie, welche Laufwerke den Spiegel des Betriebssystems tragen. Wenn Ihre Datenregeln es verlangen, fragen Sie, ob ein ausgefallenes Laufwerk im Rahmen der Garantie zurückgegeben werden muss oder vor Ort bleiben darf.

Netzwerkkarten werden oft ohne das angeboten, was sie anbindet. Führen Sie die Ports und ihre Geschwindigkeit auf und für jeden Port den Kabel- oder Transceivertyp und die Länge bis zu Ihren Switches, dazu den Out-of-Band-Management-Port. Schienen und Netzkabel vervollständigen die Positionsliste: der Schienensatz für Ihre Racktiefe und je Netzteil ein Netzkabel, das zu Ihren PDU-Ausgängen passt.

Garantielaufzeit und Servicestufe

Garantiepositionen unterscheiden sich in Laufzeit, Reaktion und dem, was vor Ort getauscht wird. Lenovos Produktleitfaden zum ThinkSystem SR675 V3, aktualisiert am 8. Oktober 2026, nennt eine „Three-year or one-year (model dependent) customer-replaceable unit and onsite limited warranty“ mit „9x5 next business day (NBD)“. Die optionalen Upgrades sind „4-hour or 2-hour response time, 6-hour fix time, 1-year or 2-year warranty extension“. Eine Reaktionszeit (response time) sagt, wann sich jemand meldet oder eintrifft, eine Reparaturzeit (fix time), wann der Server wieder läuft; vergleichen Sie deshalb in beiden Angeboten dieselbe Größe. Vom Kunden austauschbare Teile (customer-replaceable units) tauscht Ihr eigenes Personal, fragen Sie also, welche Teile das beim angebotenen Modell sind.

Ein Fünfjahresplan auf einer dreijährigen Basisgarantie braucht die Verlängerung jetzt als Position, nicht später als Verlängerungsauftrag. Klären Sie für die GPUs, wer eine Fehlermeldung entgegennimmt, der Serverhersteller, der Kartenlieferant oder der Händler, und ob eine Ersatzkarte versandt wird, bevor die defekte zurückgegeben ist.

Bei GPUs und Servern, die wir liefern, wird die Herstellergarantie über uns abgewickelt, und DOA-Geräte werden ersetzt. Schreiben Sie uns die Servicestufe, die Ihr Betrieb braucht, und wir nennen die Garantiebedingungen schriftlich mit der Konfiguration.

Burn-in, Inbetriebnahme und Softwareinstallation

Fragen Sie, ob der Server vor dem Versand montiert und unter Last getestet wird, welcher Test läuft und ob der Bericht mit der Lieferung kommt. Unser Leitfaden zu Abnahmetest und Burn-in von GPU-Servern führt die Prüfungen auf, die vor Ort zu wiederholen sind, und die Abnahmekriterien, die vorab zu vereinbaren sind. Inbetriebnahme vor Ort, Betriebssystem, NVIDIA-Treiberzweig, CUDA und eine Container-Runtime sind eigene Leistungen. Ein Angebot, das sie als optional führt, ohne zu sagen, was sie umfassen, lässt sich mit einem Angebot, das es sagt, nicht vergleichen.

Lizenzpositionen für NVIDIA AI Enterprise und vGPU

NVIDIAs Lizenzierungsleitfaden, aktualisiert am 2. September 2026, sagt, die Software „wird pro GPU lizenziert“ und „für jede GPU, die im Server oder in der Workstation installiert ist, ist eine Softwarelizenz erforderlich“. Zwei Server mit je acht Karten brauchen deshalb sechzehn Lizenzen, wo immer die Software benötigt wird: für NIM in der Produktion, für Compute-vGPU-Profile und für NVIDIA-Support, wie unser Artikel zur Lizenzierung von NVIDIA AI Enterprise erklärt. Eine Open-Source-Engine auf Bare Metal braucht keine.

Der Leitfaden hält fest: „Jede NVIDIA H200 NVL Tensor Core GPU enthält ein fünfjähriges Abonnement von NVIDIA AI Enterprise. Eine Aktivierung der Software ist erforderlich.“ Die Laufzeit beginnt mit der Auslieferung der Karte an den Serverhersteller „zuzüglich 90 Tagen für die Integration und die endgültige Lieferung an den Standort des Kunden“ und ist damit je Karte festgelegt. Die Aktivierung braucht die Seriennummern der Karten, fragen Sie also mit der Lieferung danach. Für die enthaltenen Abonnements sagt der Leitfaden, die Software „kann auf den NVIDIA-Certified Systems installiert werden, in denen die GPUs eingebaut sind“; prüfen Sie deshalb, dass das angebotene Servermodell mit Ihren Karten auf NVIDIAs Liste zertifizierter Systeme steht.

Für die RTX PRO 6000 Server Edition führt Lenovos Leitfaden ein „Software Kit (NVAIE, Run:ai, vGPU, Support), per GPU, 3Years“ und ein Paket „per GPU, 5 Years“. Abonnements müssen verlängert werden, „um aktiv zu bleiben“, ein dreijähriges Paket in einem Fünfjahresplan bringt also eine Verlängerung im vierten Jahr. Business-Standard-Support ist enthalten, und NVIDIA bietet Business Critical als Upgrade an.

Grafik-vGPU-Editionen werden pro gleichzeitigem Nutzer gezählt, nicht pro Karte. NVIDIAs Leitfaden zu Paketierung und Lizenzierung von vGPU, aktualisiert am 24. März 2026, hält fest: „NVIDIA vApps, NVIDIA vPC und NVIDIA RTX vWS sind in einem Modell pro gleichzeitigem Nutzer (Concurrent User, CCU) erhältlich.“ Vergleichen Sie die Zahl der gleichzeitigen Nutzer in beiden Angeboten.

NVIDIA-AI-Enterprise- und vGPU-Lizenzen liefern wir auf derselben Rechnung wie die Hardware. Nennen Sie uns die Karten, die virtuellen Maschinen und die Nutzer je Karte im Formular unten, und die Lizenzpositionen kommen mit der Konfiguration.

Lieferbedingungen und Rücknahme nach der WEEE-Richtlinie

Die Internationale Handelskammer (ICC) beschreibt die Incoterms®-Regeln als „einen Satz von Standards, die in internationalen und inländischen Verträgen über die Lieferung von Waren verwendet werden“; Incoterms® 2020 sind am 1. Januar 2020 in Kraft getreten. Die im Angebot genannte Regel entscheidet, wer das Transportrisiko trägt und bis zu welchem Punkt. Die Seite der ICC merkt an: „Bei DAP entlädt der Verkäufer die Ware nicht, bei DPU entlädt der Verkäufer die Ware.“ Ein Server mit acht GPUs muss trotzdem entladen, in den Raum getragen und eingebaut werden; prüfen Sie also, welches Angebot diese Schritte enthält, und die Anlieferungsregeln des Rechenzentrums.

Für das Ende der Nutzung bestimmt Artikel 13 Absatz 1 der Richtlinie 2012/19/EU, dass die Finanzierung der Sammlung, Behandlung, Verwertung und umweltgerechten Beseitigung von Elektro- und Elektronik-Altgeräten anderer Nutzer als privater Haushalte bei Produkten, die nach dem 13. August 2005 in Verkehr gebracht wurden, von den Herstellern zu tragen ist. Nach Artikel 13 Absatz 2 können Hersteller und diese Nutzer Vereinbarungen über andere Finanzierungsmodalitäten treffen. Lassen Sie im Angebot oder im Vertrag die Rücknahmebedingungen festhalten und wer die Laufwerke vor der Abholung löscht. Wie die Richtlinie auf einen bestimmten Kauf anzuwenden ist, ist eine rechtliche Bewertung für die Rechtsabteilung des Unternehmens.

Kostenstruktur eines GPU-Servers über fünf Jahre

Eine Angebotssumme deckt den Kauf ab. Über fünf Jahre verteilen sich die Kosten auf Kategorien, die jeweils einen Kostentreiber und eine Quelle für die Zahl haben.

KOSTENKATEGORIEKOSTENTREIBERDATENQUELLE
HardwareServer, Karten, Ersatzteiledie Angebote, Position für Position
Garantie­verlängerungenBasis­laufzeit, Reaktions­zeit, zusätzliche JahreService­optionen des Server­herstellers
Lizenzen und Verlängerungenlizenzierte GPUs, Laufzeit, Jahr der VerlängerungNVIDIA-Lizenzierungs­leitfaden, Angebot
Strom in kWhAufnahme unter Last und im Leerlauf, StundenBMC, messende PDU, DCGM-Energie­zähler
Kühlung und RackplatzWärmelast, Rack­positionenHaustechnik oder Rechenzentrums­vertrag
SupportServicestufe, erste AnlaufstelleSupport­vertrag
Betriebs­aufwandUpdates, Monitoring, Modell­wechselPersonal­stunden oder ein Service­vertrag
Ende der NutzungRücknahme, Löschen der LaufwerkeWEEE-Bedingungen im Vertrag

Kategorien von uns; Lizenzbedingungen aus NVIDIAs Lizenzierungsleitfaden für AI Enterprise (2. September 2026) und Lenovo Press LP2263, Garantieoptionen aus Lenovo Press LP1611, gelesen am 10. Oktober 2026.

Strom ist die Kategorie, die sich vor dem Kauf nach oben begrenzen lässt. Fünf Jahre sind etwa 43.800 Stunden. Acht Karten mit 600 W ziehen höchstens 4,8 kW Kartenleistung, die Karten eines Servers verbrauchen in fünf Jahren also höchstens etwa 210.000 kWh und die von zwei Servern etwa 420.000 kWh, noch vor Prozessoren, Lüftern, Netzteilverlusten und Kühlung. Server ziehen weniger, während sie auf Anfragen warten, und unser Artikel zur GPU-Energie pro Token zeigt, wie Sie die Aufnahme mit DCGM- und vLLM-Zählern messen; multiplizieren Sie die gemessenen kWh mit Ihrem eigenen Tarif.

Die übrigen Kategorien ergeben sich aus den Angebotspositionen oben. Eine dreijährige Garantie und ein dreijähriges Lizenzpaket bringen innerhalb der fünf Jahre jeweils eine Verlängerung, sofern das Angebot nicht die Garantieverlängerung oder das Fünfjahrespaket enthält, während das Abonnement der H200 NVL ab einem je Karte festgelegten Datum läuft. Der Betriebsaufwand hängt davon ab, wer die Server nach der Lieferung betreibt, Ihr eigenes Personal oder ein beauftragter Dienstleister, und gehört in den Vergleich, auch wenn ihn kein Angebot ausweist.

Was wir liefern

Wir bauen KI-Server auf Bestellung rund um den Workload, montiert und im Burn-in getestet, mit Testbericht auf Wunsch, mit Herstellergarantie auf jede Komponente und Lieferung in die ganze EU, unter einem EU-Vertrag und auf einer Rechnung. Zu den Karten gehören die RTX PRO 6000 Server Edition, die H200 NVL mit NVLink-Bridges, die L40S und die L4, aufgeführt auf unserer Seite zu professionellen NVIDIA-GPUs. NVIDIA-AI-Enterprise- und vGPU-Lizenzen kommen auf dieselbe Rechnung wie die Hardware. Betriebssystem, Treiber, CUDA und eine Container-Runtime installieren wir auf Wunsch, und die Inbetriebnahme vor Ort ist auf Anfrage möglich. Wir prüfen Rack, Strom und Luftstrom vor dem Angebot, und Konfiguration und Angebot folgen innerhalb eines Werktages.

FAQ

Wie vergleiche ich Angebote für GPU-Server?
Übertragen Sie beide Angebote in eine gemeinsame Positionsliste, bevor Sie Summen vergleichen: GPU-Edition und Stromkabel, Gehäuse und Netzteile, CPU, Arbeitsspeicher, NVMe, Netzwerkkarten mit Kabeln und Transceivern, Schienen und Netzkabel, Garantielaufzeit und Servicestufe, Burn-in, Inbetriebnahme, Lizenzen, Lieferbedingungen und Rücknahme. Wo ein Angebot eine Position auslässt, ergänzen Sie sie vor dem Vergleich. Bei mehreren Servern zählt jede fehlende Position einmal je Server oder je GPU.
Welche Positionen gehören in ein Angebot für einen KI-Server?
Die genaue GPU-Edition mit ihren Stromkabeln und gegebenenfalls NVLink-Bridges, Prozessoren, Speichermodule und Laufwerke als eigene Positionen, Netzwerkkarten mit Kabeln oder Transceivern, Schienen und Netzkabel sowie die Garantielaufzeit mit ihrer Reaktionsstufe. Hinzu kommen Burn-in und Testbericht, Inbetriebnahme und Softwareinstallation, die Lizenzpositionen für NVIDIA AI Enterprise und vGPU mit ihren Laufzeiten, die Incoterms®-Regel für die Lieferung und die Rücknahmebedingungen am Ende der Nutzung.
Woraus setzen sich die Gesamtkosten (TCO) eines KI-Servers zusammen?
Über fünf Jahre umfassen sie Hardware, Garantieverlängerungen, Lizenzen und ihre Verlängerungen, Strom in kWh, Kühlung und Rackplatz, Support, Betriebsaufwand und das Ende der Nutzung. Der Strom lässt sich vorab nach oben begrenzen: Acht 600-W-Karten verbrauchen in fünf Jahren höchstens etwa 210.000 kWh Kartenenergie, noch vor dem übrigen Server und der Kühlung. Die gemessene Aufnahme ist niedriger, solange der Server auf Anfragen wartet.
Welche Garantieoptionen gibt es für GPU-Server?
Lenovos Produktleitfaden zum ThinkSystem SR675 V3 nennt je nach Modell eine Basisgarantie von drei Jahren oder einem Jahr mit Service 9x5 am nächsten Arbeitstag. Die optionalen Upgrades sind 4 oder 2 Stunden Reaktionszeit, 6 Stunden Reparaturzeit und Verlängerungen um 1 oder 2 Jahre. Vergleichen Sie Reaktionszeit mit Reaktionszeit und Reparaturzeit mit Reparaturzeit, und nehmen Sie die Verlängerung auf, wenn der Plan fünf Jahre läuft.
Ist NVIDIA AI Enterprise in einem KI-Server enthalten?
Bei der H200 NVL ist es enthalten: Jede Karte bringt ein fünfjähriges Abonnement mit, das 90 Tage nach der Auslieferung der Karte an den Serverhersteller beginnt und aktiviert werden muss. Für die RTX PRO 6000 Server Edition, die L40S und die L4 wird es pro GPU gekauft, und Lenovo führt für die Server Edition Softwarepakete pro GPU mit drei und mit fünf Jahren. Ein Server, der eine Open-Source-Engine auf Bare Metal betreibt, braucht keine Lizenz.
Wer zahlt in der EU die Rücknahme eines Servers am Ende der Nutzung?
Nach Artikel 13 der WEEE-Richtlinie 2012/19/EU ist die Finanzierung der Sammlung und Behandlung von Elektro- und Elektronik-Altgeräten anderer Nutzer als privater Haushalte bei Produkten, die nach dem 13. August 2005 in Verkehr gebracht wurden, von den Herstellern zu tragen. Hersteller und diese Nutzer können andere Finanzierungsmodalitäten vereinbaren. Wie das auf einen bestimmten Kauf anzuwenden ist, ist eine rechtliche Bewertung für die Rechtsabteilung des Unternehmens.

Schicken Sie uns den Workload, die Zahl der Server und Karten, die benötigte Garantielaufzeit und Servicestufe, die Lizenzen und den Lieferort. Wir prüfen Rack, Strom und Luftstrom und antworten innerhalb eines Werktages mit einer Konfiguration und einem schriftlichen Angebot, das die Garantiebedingungen nennt.

Mit einem Experten sprechen
Mit einem Experten sprechen

Wir antworten innerhalb eines Werktages

Mit dem Absenden stimmen Sie zu, dass wir Ihre Angaben zur Beantwortung Ihrer Anfrage verarbeiten; siehe unsere Datenschutzerklärung.

request@eurokommerz.at
Jordangasse 7, 1010 Wien