BLOG · GUIDE ·

H200 NVL in der EU kaufen: Karten oder ein Server, die NVLink-Bridge und das enthaltene AI Enterprise

Eurokommerz, Wien, seit 2006: Private AI/ML · IT Managed Services · Enterprise Training · KI-Hardware & Software

IN KÜRZE
  • Die H200 NVL ist eine luftgekühlte PCIe-Karte mit zwei Slots und 141 GB HBM3e für Server, deren Hersteller sie qualifiziert; Unternehmen kaufen sie als Karten für einen solchen Server oder als Server mit 2, 4 oder 8 Karten
  • NVLink-Bridges verbinden zwei oder vier Karten mit 900 GB/s pro GPU laut NVIDIAs H200-Seite, und NVIDIA empfiehlt, dass verbundene Karten in derselben CPU-Domäne sitzen; die Entscheidung über die Bridge bestimmt deshalb den Aufbau des Servers
  • Jede H200 NVL enthält ein fünfjähriges Abonnement für NVIDIA AI Enterprise, aktiviert mit der Seriennummer der Karte; die Laufzeit beginnt 90 Tage nach dem Versanddatum des Boards an den Serverhersteller und lässt sich nicht ändern
  • Die Karte zieht standardmäßig bis zu 600 W, mit einer Compliance-Leistungsgrenze von 350 W und einem Minimum von 200 W laut NVIDIAs Product Brief; der Serverhersteller legt fest, wie viele Karten ein Modell aufnimmt und mit welcher Leistung
  • Das H200 SXM in HGX-H200- und DGX-H200-Systemen ist ein anderes Produkt: bis zu 700 W pro GPU auf Baseboards mit 4 oder 8 GPUs; NVIDIAs H200-Seite führt AI Enterprise dafür als Zukauf, während DGX-Systeme mit Hopper-GPUs es im DGX-Softwarepaket enthalten

Geliefert von Eurokommerz: KI-Server, auf Bestellung gebaut  Konfiguration anfragen →

H200 NVL kaufen: Karten oder ein Server

Wer H200 NVL für ein Unternehmen kaufen will, wählt zwischen zwei Wegen: Karten für einen Server, dessen Hersteller die H200 NVL für genau dieses Modell führt, oder ein auf Bestellung gebauter Server mit 2, 4 oder 8 Karten. Vor beiden steht die Entscheidung, ob Ihre Modelle NVLink-Bridges brauchen und ob eine Bridge zwei oder vier Karten verbindet, denn die Bridge und die Steckplätze, die sie überspannt, gehören zur Bestellung. Zu jeder Karte gehört ein fünfjähriges Abonnement für NVIDIA AI Enterprise, das NVIDIA an die Seriennummer der Karte bindet.

NVIDIAs H200-Seite beschreibt die H200 NVL als PCIe-Karte, „Dual-Slot, luftgekühlt“, mit 141 GB HBM3e mit 4,8 TB/s und einer maximalen TDP von „bis zu 600 W (konfigurierbar)“. Dieselbe Seite nennt sie „ideal für luftgekühlte Enterprise-Rack-Designs mit geringerer Leistung, die flexible Konfigurationen erfordern“. Als Serveroptionen führt NVIDIA für sie „NVIDIA MGX H200 NVL Partner- und NVIDIA-Certified Systems mit bis zu 8 GPUs“, die Karte kommt also in einen Rack-Server, den sein Hersteller für sie qualifiziert hat.

Dieser Leitfaden behandelt die Kaufentscheidungen. Die Einbauprüfungen für einen Server, den Sie bereits besitzen, vom 16-poligen Stromkabel bis zu den BIOS-Einstellungen, stehen in unserer Checkliste für die H200 NVL in einem vorhandenen Server, und dieser Artikel wiederholt sie nicht.

H200 NVL, HGX H200 und DGX H200 im Vergleich

Eine Suche nach H200 liefert die Karte H200 NVL, das Modul H200 SXM und die Systeme, die auf dem Modul aufbauen. Die H200 NVL ist die PCIe-Karte, während das H200 SXM ein Modul ist, das auf einem HGX-H200-Baseboard sitzt, das NVIDIA in „Partner- und NVIDIA-Certified Systems mit 4 oder 8 GPUs“ führt. DGX H200 ist NVIDIAs eigenes 8U-System, und sein User Guide nennt acht H200-GPUs, „die insgesamt 1.128 GB GPU-Speicher bieten“.

MERKMALH200 NVLHGX H200 (SXM)DGX H200
BauformPCIe-Karte, Dual-Slot, luftgekühltSXM-Modul auf einem BaseboardNVIDIA-System, 8U
GPUs pro Systembis zu 8 in Partner­servern4 oder 88
Speicher141 GB pro Karte141 GB pro GPU1.128 GB insgesamt
Leistungbis zu 600 W pro Karte, konfigurierbarbis zu 700 W pro GPU, konfigurierbar6 Netzteile zu 3,3 kW, maximal 10,2 kW
GPU-Verbindung2- oder 4-Wege-Bridge, 900 GB/s pro GPUNVLink, 900 GB/s900 GB/s von GPU zu GPU
AI Enterpriseenthalten, fünf JahreZukaufim DGX-Software­paket

NVIDIA-Produktseite zur H200 (Spezifikationen von NVIDIA als vorläufig gekennzeichnet); NVIDIA DGX H100/H200 User Guide, zuletzt aktualisiert am 26. Januar 2026, dessen Stromzeilen für beide Systeme gelten; NVIDIAs Lizenzierungsleitfaden für AI Enterprise, aktualisiert am 2. September 2026; alle gelesen am 10. Oktober 2026.

Für einen Käufer liegt der wichtigste technische Unterschied in der Reichweite von NVLink. Für einen DGX H200 nennt der User Guide 900 GB/s Bandbreite von GPU zu GPU für seine acht GPUs, während eine Bridge der H200 NVL höchstens vier Karten verbindet. Ein H200-NVL-Server mit acht Karten umfasst deshalb höchstens zwei NVLink-Domänen zu je vier, wie unser Leitfaden zur Zahl der H200 NVL für große Modelle Modell für Modell durchrechnet.

Wir liefern die H200 NVL und damit gebaute Server. HGX- oder DGX-Systeme liefern wir nicht. Ein Modell, das mit Tensor-Parallelismus über acht GPUs auf NVLink laufen muss, braucht ein HGX-H200- oder DGX-H200-System und keinen H200-NVL-Server.

Die Karten oder einen damit gebauten Server kaufen

Die beiden Wege unterscheiden sich darin, wer für die Plattform einsteht. Wenn Sie Karten kaufen, entscheidet die Supportliste des Serverherstellers für Ihr genaues Modell, ob sie überhaupt hineinkommen. Wenn Sie einen auf Bestellung gebauten Server kaufen, wird der Server von Anfang an für die Karten, ihre Bridge und ihre Leistung ausgewählt.

ASPEKTNUR KARTENBAU AUF BESTELLUNG
PlattformIhr Modell, Steckplatz und Riser auf der Liste des Herstellersausgewählt für die Karten und ihre Bridge
Strom und Kühlungdie Grenze je Steckplatz, die der Hersteller setztausgelegt für 2, 4 oder 8 Karten
NVLink-Bridgenur wenn die Karten in überbrückbaren Steckplätzen sitzenBelegung der Steckplätze mit der Bridge geplant
GarantieHersteller­garantie; Bedingungen des Servers prüfenHersteller­garantie auf jede Komponente
TestsIhr Team baut ein und testetmontiert und vor dem Versand im Burn-in getestet
Softwarevon Ihrem Team installiertBetriebs­system, Treiber, CUDA, Container-Runtime auf Wunsch
AI Enterprisefünfjähriges Abonnement je Kartedasselbe, eines je Karte

NVIDIA H200 NVL Product Brief PB-12128-001_v01 (11. April 2025); Lenovo Press LP1944, ThinkSystem NVIDIA H200 141GB GPUs Product Guide (7. November 2025); unsere Seite zu KI-Servern für die Spalte Bau auf Bestellung.

Der Weg über die Karten passt zu einem Unternehmen, das bereits ein für die H200 NVL gelistetes Servermodell betreibt. Lenovo zum Beispiel führt die Karte und beide Bridges unter eigenen Teilenummern: 4X67A97315 für die „ThinkSystem NVIDIA H200 NVL 141GB PCIe GPU Gen5 Passive GPU“, 4X67A97320 für die 2-Wege-Bridge und 4X67A97322 für die 4-Wege-Bridge. Sein Product Guide hält fest, dass die GPU „die Basisgarantie des Servers und alle Garantie-Upgrades übernimmt“. Für Karten, die außerhalb der eigenen Optionen des Serverherstellers gekauft werden, sollte das Angebot nennen, welche Garantie sie abdeckt und wer einen Garantiefall abwickelt.

Wie viele Karten ein gelisteter Server aufnimmt, ist je Modell festgelegt. Lenovo Press führt höchstens zwei H200 NVL mit 600 W in einem ThinkSystem SR650a V4, ein Plan für vier Karten mit 600 W in einem Gehäuse braucht also ein anderes Servermodell.

Der Weg über den Server passt zu einer neuen Plattform für mehrere Abteilungen, zum Beispiel zwei Server mit je vier Karten für einen privaten KI-Dienst, den sich mehrere Abteilungen teilen. Karten, Bridges, Netzteile und Kühlung werden dann gemeinsam ausgewählt und angeboten.

Wir liefern die H200 NVL als Karten mit ihren NVLink-Bridges oder in KI-Servern, auf Bestellung gebaut und im Burn-in getestet. Nennen Sie uns den Server, in den die Karten kommen sollen, oder beschreiben Sie die Rackposition, an der ein neuer Server stehen würde.

NVLink-Bridge für die H200 NVL: 2-Wege, 4-Wege oder keine

NVIDIAs Product Brief führt in seiner Tabelle 4-2 zwei Bridges, in einer Spalte mit der Überschrift „Total NVLink BW“: eine „2-slot (spans two cards)“-Bridge mit „900 GB pro Sekunde“ und eine „4-slot (spans four cards)“-Bridge mit „1800 GB pro Sekunde“. NVIDIAs H200-Seite gibt die Verbindung als „2- oder 4-Wege-NVIDIA-NVLink-Bridge: 900 GB/s pro GPU“ an, und die Übersicht im Product Brief nennt „900 GBps bidirektionale Bandbreite“ für bis zu vier verbundene Karten; eine Dimensionierung rechnet deshalb für beide Bridges mit 900 GB/s pro GPU. Ohne Bridge tauschen die Karten Daten über PCIe Gen5 mit 128 GB/s aus, der Zahl auf der H200-Seite.

Die Bridge wird gebraucht, wenn ein Modell mit Tensor-Parallelismus über mehrere Karten verteilt ist, und für Training, bei dem die Karten Gradienten austauschen. Wenn jede Karte ihre eigene Kopie eines Modells bedient, tauschen die Karten keine Daten aus, und es ist keine Bridge nötig.

Die Entscheidung über die Bridge gehört vor die Bestellung, weil sie die Belegung der Steckplätze festlegt. NVIDIAs Product Brief schreibt, dass „über Bridges verbundene NVIDIA-H200-NVL-Karten innerhalb derselben CPU-Domäne liegen sollten“, und führt „Bridge GPUs under different CPUs“ unter „Allowed but Not Recommended“. Ein Server, dessen Riser je zwei Karten unter jeden Prozessor setzen, eignet sich für 2-Wege-Bridges. Eine 4-Wege-Bridge innerhalb einer CPU-Domäne braucht vier benachbarte Karten unter einem Prozessor. Ein späterer Wechsel von 2-Wege auf 4-Wege kann eine andere Riser-Anordnung oder einen anderen Server bedeuten, nennen Sie den Bridge-Typ deshalb in der Anfrage.

Bei einem Plan mit acht Karten fällt die Wahl zwischen einem Server mit zwei Vierersätzen und zwei Servern mit je einem Satz. NVIDIAs empfohlene Topologie sieht unter jedem CPU-Sockel dieselbe Zahl von GPUs und in jeder CPU-Domäne gleiche Bridge-Spannweiten vor, was in einem Server mit zwei Sockeln und acht Karten einen 4-Wege-Satz pro Prozessor ergibt. Unser Vergleich ein 8-GPU-Server oder zwei 4-GPU-Server behandelt Failover, Wartung und Platz im Rack für diese Wahl.

Das fünfjährige Abonnement für NVIDIA AI Enterprise bei jeder Karte

NVIDIAs Lizenzierungsleitfaden, aktualisiert am 2. September 2026, schreibt: „Jede NVIDIA H200 NVL Tensor Core GPU enthält ein fünfjähriges NVIDIA AI Enterprise-Abonnement.“ Er ergänzt „Softwareaktivierung erforderlich“, und das Abonnement „kann mit der Seriennummer ausgewählter GPUs aktiviert werden“. NVIDIAs H200-Seite führt AI Enterprise für das H200 SXM als Zukauf und für die H200 NVL als enthalten. Für DGX H200 schreibt der Lizenzierungsleitfaden, dass AI Enterprise „im NVIDIA-DGX-Softwarepaket für NVIDIA-DGX-Systeme mit der NVIDIA-Hopper-Architektur enthalten ist“.

Die Laufzeit ist an die jeweilige Karte gebunden, nicht an den Server. NVIDIA zählt den Beginn ab dem Versanddatum „des GPU-Boards an den OEM-Partner“, plus 90 Tage für Integration und Lieferung, und schreibt, dass das Startdatum „nicht geändert werden kann, da es an die jeweilige Karte gebunden ist“. Ein Server mit acht Karten trägt also acht Abonnements, und Karten, die in einem späteren Jahr dazukommen, laufen zu späteren Terminen aus. Nach Ablauf der genannten Laufzeit muss ein Abonnement laut NVIDIAs Leitfaden „verlängert werden, um aktiv zu bleiben“.

Erfassen Sie die Seriennummern beim Eintreffen der Karten, bevor der Server ins Rack kommt. Die Schritte in NVIDIAs Portalen beschreibt unser Leitfaden NVIDIA AI Enterprise aktivieren.

Strom und Kühlung für H200-NVL-Server

NVIDIAs Product Brief nennt als gesamte Board-Leistung für die Kabelbeschaltung mit 600 W „600 W maximal (Standard)“, mit einer „Compliance-Leistungsgrenze von 350 W“ und „200 W minimal“. Die Planung geht von der Voreinstellung aus. Vier Karten mit 600 W ziehen 2.400 W und acht 4.800 W, bevor Prozessoren, Arbeitsspeicher, Laufwerke und Lüfter dazukommen, die Stromzuleitung der Rackposition kann die Kartenzahl also vor dem Platz im Rack begrenzen.

Die Karte ist passiv, und die Lüfter des Servers bewegen die Luft durch sie. Deshalb nennt die Liste des Serverherstellers für jedes Modell die Lüftermodule, Luftkanäle und Steckplätze, und deshalb ist ein Server mit acht Karten ein anderes Gehäuse als einer mit zwei.

Die Einbaudetails für einen vorhandenen Server, die Kabel-Teilenummern, Thermoregeln und Werkzeuge zur Leistungsplanung jedes Herstellers, stehen in der oben verlinkten Checkliste. Für einen neuen Server prüfen wir Rack, Strom und Luftstrom, bevor wir ein Angebot erstellen.

Entscheidungen vor der Bestellung

Diese sechs Entscheidungen, in dieser Reihenfolge getroffen, decken ab, was ein Angebot für H200-NVL-Karten oder -Server braucht.

  1. Modelle und Präzision: Führen Sie die Modelle auf, die die Karten bedienen oder per Fine-Tuning anpassen sollen, und die Präzision ihrer Gewichte, denn diese bestimmen die Zahl der Karten pro Modell.
  2. Karten und Server: Legen Sie die Gesamtzahl der Karten fest und ob sie in einen Server oder in mehrere kommen, zum Beispiel 8 Karten als ein Server oder als zwei Server mit je 4.
  3. NVLink-Bridge: keine, 2-Wege oder 4-Wege für jeden Kartensatz, und die CPU-Domäne, in der jeder Satz sitzt.
  4. Server: ein vorhandener Server, mit voller Modellnummer auf der Liste des Herstellers, oder ein für die Karten auf Bestellung gebauter Server.
  5. Strom und Kühlung: die Zuleitung je Rackposition in Ampere und Phasen, die Steckdosen und die Zulufttemperatur.
  6. Lizenzen und Partitionierung: das fünfjährige AI-Enterprise-Abonnement je Karte, weitere Lizenzen für die anderen GPUs der Plattform und ob die Karten mit MIG in bis zu sieben Instanzen zu 16,5 GB aufgeteilt werden, wie unser Leitfaden zu den MIG-Profilen der H200 NVL erklärt.

Wir prüfen Rack, Strom und Luftstrom, bevor wir ein Angebot erstellen. Schicken Sie uns Ihre Antworten auf diese sechs Punkte über das Formular unten, auch wenn einige noch offen sind.

Was wir liefern

Wir liefern die NVIDIA H200 NVL mit ihren 2-Wege- und 4-Wege-NVLink-Bridges und ihrem fünfjährigen Abonnement für NVIDIA AI Enterprise, als Karten oder in auf Bestellung gebauten KI-Servern mit 2, 4 oder 8 Karten, montiert und im Burn-in getestet, mit Herstellergarantie auf jede Komponente. Für einen Server, den Sie bereits betreiben, prüfen wir zuerst Plattform, Strom und Kühlung und sagen Ihnen vorab, wenn die Karte darin nicht unterstützt wird. Weitere Lizenzen für NVIDIA AI Enterprise und vGPU kommen unter demselben EU-Vertrag und auf dieselbe Rechnung, zusammen mit den Karten L40S, L4 und RTX PRO aus unserem Sortiment professioneller GPUs, wo die Plattform sie kombiniert. Betriebssystem, Treiber, CUDA und eine Container-Runtime installieren wir auf Wunsch, und wenn Sie die Inbetriebnahme abgeben wollen, übernimmt sie unser Engineering-Partner Vixen.UNO unter demselben Vertrag.

FAQ

Wo kann ich eine H200 NVL in Europa kaufen, und bei welchem Händler?
Die H200 NVL wird als PCIe-Karte für Server verkauft, deren Hersteller sie qualifiziert, und in Servern mit 2, 4 oder 8 Karten. Als Händler liefern wir beides EU-weit unter einem europäischen Vertrag und auf einer Rechnung, mit Herstellergarantie und den NVLink-Bridges im selben Angebot.
Brauche ich für die H200 NVL eine NVLink-Bridge?
Nur wenn ein Modell mit Tensor-Parallelismus über mehrere Karten verteilt ist oder für Training, bei dem die Karten Gradienten austauschen; Karten, die jeweils ihre eigene Kopie eines Modells bedienen, brauchen keine. NVIDIA bietet eine 2-Wege-Bridge und eine 4-Wege-Bridge an, und laut Product Brief sollten verbundene Karten in derselben CPU-Domäne liegen.
Ist NVIDIA AI Enterprise bei der H200 NVL enthalten?
Ja, laut NVIDIAs Lizenzierungsleitfaden enthält jede H200 NVL ein fünfjähriges Abonnement für NVIDIA AI Enterprise, das mit der Seriennummer der Karte aktiviert wird. Die Laufzeit beginnt 90 Tage nach dem Versanddatum des Boards an den Serverhersteller und lässt sich nicht ändern.
Was ist der Unterschied zwischen H200 NVL und DGX H200?
Die H200 NVL ist eine PCIe-Karte mit bis zu 600 W, die in Partnerserver mit bis zu acht Karten kommt, verbunden über Bridges für zwei oder vier Karten. DGX H200 ist NVIDIAs 8U-System mit acht H200-SXM-GPUs, 1.128 GB GPU-Speicher und maximal 10,2 kW Leistung.
Wie viele H200 NVL passen in einen Server?
Der Serverhersteller legt die Zahl je Modell fest: NVIDIA führt Partnerserver mit bis zu acht H200 NVL, während Lenovo im ThinkSystem SR650a V4 zwei mit 600 W zulässt. Prüfen Sie vor der Bestellung der Karten die Liste des Herstellers für die genaue Modellnummer.
Wie viel Strom braucht ein H200-NVL-Server?
NVIDIAs Product Brief nennt standardmäßig 600 W pro Karte, mit einer Compliance-Leistungsgrenze von 350 W und einem Minimum von 200 W. Vier Karten mit 600 W ziehen 2.400 W und acht 4.800 W, ohne den Rest des Servers, deshalb wird die Zuleitung des Racks vor dem Angebot geprüft.

Schicken Sie uns die Modelle, die Sie betreiben wollen, die Zahl der H200-NVL-Karten und der Server, ob die Karten NVLink-Bridges brauchen, und das Servermodell oder die Stromzuleitung der Rackposition. Wir antworten innerhalb eines Werktages mit einer Konfiguration und einem schriftlichen Angebot für Karten, Bridges und Server.

Mit einem Experten sprechen
Mit einem Experten sprechen

Wir antworten innerhalb eines Werktages

Mit dem Absenden stimmen Sie zu, dass wir Ihre Angaben zur Beantwortung Ihrer Anfrage verarbeiten; siehe unsere Datenschutzerklärung.

request@eurokommerz.at
Jordangasse 7, 1010 Wien