H200 NVL und H100 NVL, geliefert in Europa
Identisches Rechen-Silizium. Der ganze Unterschied liegt im Speicher – und ob er sein Geld wert ist, hängt allein davon ab, wie speichergebunden Ihre Last ist.
Der Aufpreis kauft Speicher, nicht Rechenleistung. Bei manchen Lasten sind das 3,4×. Bei anderen exakt null. Das sollten Sie vor der Bestellung wissen.
| Karte | Speicher | Bandbreite | Anmerkung |
|---|---|---|---|
| H200 NVL | 141 GB HBM3e | 4,8 TB/s | Sechs HBM-Stapel. Wenn das Modell nicht mehr in 94 GB passt, ist das das ganze Argument. |
| H100 NVL | 94 GB HBM3 | 3,9 TB/s | Immer noch breiter als H100 SXM mit 3,35 TB/s. Oft ausreichend und oft günstiger je nutzbarem Token. |
| NVLink-Bridges | – | – | Der größte Generationsunterschied zwischen NVL-Paaren und Einzelkarten. |
| NVIDIA AI Enterprise | – | – | Die Lizenzlaufzeit wird mit den Karten angeboten, damit es später keine Überraschung gibt. |
Beide Karten und die Bridges sind auf Bestellung verfügbar. Die Lieferzeit wird mit jedem Angebot bestätigt.
Nur Karten sind ein guter Auftrag
Sie brauchen kein Projekt und keinen Engineering-Vertrag, um bei uns zu kaufen. Eine H200 NVL, damit ein vorhandener Server den fehlenden Speicher bekommt, oder gleich vier über Brücken verbunden, in jeder Stückzahl: wir bieten genau das an, was Sie anfragen, zu einem wettbewerbsfähigen Preis, fakturiert in der EU.
Ein Vertragspartner in Wien. Kein grenzüberschreitender Einkauf, kein Import, den Sie selbst abwickeln.
Wenn eine Karte eine Lizenz braucht, um das zu tun, wofür Sie sie gekauft haben, steht sie im Angebot – und fällt nicht erst nach drei Monaten auf.
Unser Partner Vixen.UNO plant, implementiert und betreut. Unter demselben Vertrag – oder gar nicht. Ihre Entscheidung.
Herstellergarantie läuft über uns, Support gemeinsam mit dem Team, das das System betreibt.
Nach den TensorRT-LLM-Optimierungen stellt NVIDIAs eigener MLPerf-Bericht fest, dass Llama 2 70B auf H200 durch die Rechenleistung begrenzt wird, nicht durch die Speicherbandbreite. Hat Ihre Last diese Form, bringen die zusätzlichen 47 GB gar nichts.
Zur vollständigen Analyse →Die lauteste Zahl in H200-Material ist 110× bei HPC. Die Fußnote verrät: vier GPUs gegen zwei Sapphire-Rapids-8480-Prozessoren – ein Vergleich mit CPUs, nicht mit H100. In einem anderen Diagramm lief H100 mit Batch 8 und H200 mit Batch 32.
Zur vollständigen Analyse →Ein 70B in FP16 mit 128K Kontext sind 140 GB Gewichte plus 40 GB Cache – 180 GB für einen einzigen Nutzer. Das Gegenintuitive: ein 7B mit Multi-Head-Attention verbraucht 512 KB pro Token, ein 70B mit Grouped-Query-Attention nur 320.
Zur vollständigen Analyse →H200 oder H100 – was brauche ich?
Warum hat die H200 NVL 141 GB und keine runde Zahl?
Brauche ich die NVLink-Bridges?
Ist die AI-Enterprise-Lizenz enthalten?
Liefern Sie auch den Server?
141 gegen 94 GB – wo der Gewinn 3,4× erreicht und wo er exakt null ist.
Artikel lesen →Die Formeln für Gewichte, KV-Cache und den Overhead, den niemand auf eine Folie schreibt.
Artikel lesen →Was vor der Lieferung zu prüfen ist – die vier Dinge, die eine Lieferung stoppen.
Artikel lesen →Wir antworten innerhalb eines Werktages