BLOG · GUIDE ·

GPUs später nachrüsten: was ein skalierbarer GPU-Server vom ersten Tag an braucht

Eurokommerz, Wien, seit 2006: Private AI/ML · IT Managed Services · Enterprise Training · KI-Hardware & Software

IN KÜRZE
  • Ein GPU-Server wächst von zwei auf vier oder acht Karten nur, wenn Basismodell, Prozessoren, Speicher, Netzteile, Lüfter und Kabelsätze für die endgültige Zahl bestellt wurden; Dells Leitfaden zum XE7745 schreibt „Installieren oder entfernen Sie keine GPUs, ohne vorher Rücksprache mit Dell zu halten“
  • Lenovo verkauft den SR675 V3 als 4-DW- oder als 8-DW-GPU-Modell, und der SR650a V4 mit 2U nimmt zwei RTX PRO 6000 mit 600 W auf oder vier nur in der auf 450 W begrenzten Version
  • NVIDIAs Leitfaden für NVIDIA-Certified Systems skaliert seine Mindestwerte mit den Karten, sechs CPU-Kerne je GPU und das Doppelte des gesamten GPU-Speichers als Systemspeicher, für acht RTX PRO 6000 also 48 Kerne und 1.536 GB
  • Im Dell XE7745 sind acht Karten mit 600 W an Netzteilen mit 2.400 W in der Anordnung mit A/B-Netzredundanz nicht unterstützt, und ein zusätzliches Netzteil wird nur aktiviert, wenn seine Leistung der der bereits installierten Netzteile entspricht
  • NVIDIA AI Enterprise wird pro GPU lizenziert, und das fünfjährige Abonnement jeder H200 NVL beginnt 90 Tage nach Auslieferung dieser Karte an den Serverhersteller, später hinzugefügte Karten laufen also meist zu späteren Terminen aus

Geliefert von Eurokommerz: KI-Server, auf Bestellung gebaut  Konfiguration anfragen →

GPUs später nachrüsten: was am ersten Tag zu planen ist

Sie können GPUs später nachrüsten und einen GPU-Server ohne zweiten Server von zwei auf vier oder acht Karten erweitern, wenn er von Anfang an als größere Konfiguration bestellt wurde. Basismodell, Zahl und Generation der Prozessoren, Systemspeicher, Netzteile, Lüftersatz sowie Riser- und Kabelsätze müssen alle zur endgültigen Kartenzahl passen. Außerdem muss der Serverhersteller diese Zahl für das genaue Modell und die genaue Konfiguration führen.

Die Serverhersteller behandeln eine spätere GPU-Aufrüstung als Änderung der Konfiguration. Dells Technical Guide zum PowerEdge XE7745, Rev. A09 vom September 2026, schreibt: „Installieren oder entfernen Sie keine GPUs, ohne vorher Rücksprache mit Dell zu halten.“ Derselbe Leitfaden hält fest, dass Schäden durch eine Hardwareinstallation, die nicht autorisiert und validiert ist, zum Erlöschen der Systemgarantie führen. Lenovos Leitfaden zum SR650a V4 verlangt ein DIMM-Blindmodul in jedem leeren Speichersteckplatz, wenn eine GPU als Nachrüstung im Feld hinzukommt.

BESTELLENTSCHEIDUNGWIRKUNG SPÄTERQUELLE
Basismodell oder Gehäuselegt die Höchstzahl der Karten fest; ein 4-DW-Modell bleibt bei vierLenovo LP1611
Zahl der Prozessorenzwei Sockel, auf die die GPUs gleichmäßig verteilt sindNVIDIA-Konfigurations­leitfaden
Prozessor­generationdie RTX PRO 6000 im SR675 V3 braucht AMD EPYC der 5. GenerationLenovo LP2263
System­speichermindestens das Doppelte des GPU-Speichers bei der endgültigen KartenzahlNVIDIA-Konfigurations­leitfaden
Leistung der Netzteilezusätzliche Netzteile müssen der installierten Leistung entsprechenLeitfaden zum Dell XE7745
Lüfter und Stromkabel600-W-Karten brauchen den genannten Lüftersatz und die Kabel je SteckplatzLeitfaden zum Dell R770
NVLink-Brücke2-fach- oder 4-fach-Teil, geplant je Satz von H200-NVL-KartenNVIDIA-Seite zur H200; Lenovo LP1944
Software­lizenzenpro GPU, und das Abonnement der H200 NVL läuft je KarteNVIDIA-Lizenzierungs­leitfaden

Gelesen am 10. Oktober 2026: Lenovo Press LP1611 (aktualisiert am 8. Oktober 2026), LP2128 (5. Oktober 2026), LP2263 (28. Juli 2026) und LP1944 (7. November 2025); NVIDIAs Konfigurationsleitfaden für NVIDIA-Certified Systems (30. September 2026) und Lizenzierungsleitfaden für AI Enterprise (2. September 2026); Dell XE7745 Technical Guide Rev. A09 und R770 Technical Guide Rev. A09.

Gehäuse und Basismodell legen die Höchstzahl der Karten fest

Lenovos Produktleitfaden zum ThinkSystem SR675 V3, aktualisiert am 8. Oktober 2026, führt den Server in drei Basiskonfigurationen. Neben einem SXM5-Modell gibt es ein „4-DW GPU model (4x double-wide or single-wide PCIe GPUs with 8x 2.5-inch drive bays)“ und ein „8-DW GPU model (8x double-wide or single-wide PCIe GPUs with EDSFF drive bays)“. Über einen Umbau des einen in das andere sagt der Leitfaden nichts. Ein Unternehmen, das mit acht Karten rechnet, bestellt das 8-DW-Modell, auch wenn zunächst nur zwei Karten eingebaut werden.

Der SR650a V4 mit 2U trägt „bis zu 4 doppelt breite GPUs oder 8 einfach breite GPUs, eingebaut in den vorderen Steckplätzen“. Seine Tabelle der Storage-Konfigurationen führt vier doppelt breite GPUs mit einem oder mit zwei Prozessoren, je nach Laufwerkskonfiguration, und vermerkt: „Konfigurationen, die mit 2xDW-GPUs gelistet sind, gelten für Konfigurationen mit 600-W-GPUs.“ Lenovo führt die RTX PRO 6000 Server Edition für diesen Server als Karte mit 600 W und als Karte „Slot Capped at 450W“, und seine Änderungshistorie vom 28. Juli 2026 ergänzt die begrenzte Version, „um den Einbau von 4 GPUs im SR650a V4 zu ermöglichen“. Ein Server, der vier Karten erreichen soll, wird deshalb mit der begrenzten Version und einer Laufwerkskonfiguration bestellt, die für vier doppelt breite GPUs gelistet ist.

Dells PowerEdge Server GPU Matrix vom August 2026 vermerkt, dass die „maximal zulässige Zahl von GPUs in unterschiedlichen Konfigurationen derselben Plattform abweichen kann“. Unser Artikel dazu, wie viele GPUs in einen Server passen, erklärt die Grenzen bei Lanes, Strom und Luftstrom hinter diesen Zahlen, und die Liste der mit der RTX PRO 6000 Server Edition kompatiblen Server nennt das Maximum je Modell.

Prozessoren und Systemspeicher für die endgültige GPU-Anzahl

NVIDIAs Konfigurationsleitfaden für NVIDIA-Certified Systems, zuletzt aktualisiert am 30. September 2026, nennt „2x / 4x / 8x GPUs pro Server“ eine ausgewogene Konfiguration. Er ergänzt, „GPUs sollten gleichmäßig auf CPU-Sockel und PCIe-Root-Ports verteilt werden“, und verlangt für jede RTX PRO 6000 oder H200 NVL eine PCIe-Gen5-x16-Anbindung sowie mindestens zwei CPU-Sockel. Seine Mindestwerte wachsen mit der Kartenzahl: sechs physische CPU-Kerne je GPU und Systemspeicher von mindestens dem Doppelten des gesamten GPU-Speichers. NVIDIA bezeichnet diese Werte als „einen Ausgangspunkt, um workloadspezifische Anforderungen abzudecken“.

Nach unserer Rechnung haben zwei Karten RTX PRO 6000 zusammen 192 GB GPU-Speicher, woraus sich mindestens 384 GB Systemspeicher und 12 Kerne ergeben. Acht Karten haben 768 GB und ergeben 1.536 GB und 48 Kerne.

Lenovos Leitfaden zum SR650a V4 schreibt „Alle installierten DIMMs müssen identische Teilenummern haben; Mischen wird nicht unterstützt“, später ergänzte Module müssen also den installierten entsprechen. Bestellen Sie den Speicher für die endgültige Kartenzahl oder größere Module mit frei bleibenden Steckplätzen.

Lenovo unterstützt die RTX PRO 6000 im SR675 V3 mit bis zu acht Karten „nur mit AMD-EPYC-Prozessoren der 5. Generation“; ein SR675 V3, der mit einer früheren EPYC-Generation bestellt wurde, liegt also außerhalb dieses Supports.

Netzteile, ausgelegt auf die endgültige GPU-Anzahl

Dells XE7745 teilt seine Netzteile in eine CPU-Zone und eine GPU-Zone, und sechs seiner acht Einschübe liegen in der GPU-Zone. Sein Leitfaden schreibt: „Für volle Redundanz installieren Sie N+N Netzteile in jeder Zone, d. h. 1+1 in der CPU-Zone und 3+3 in der GPU-Zone.“ Mit vier Netzteilen führt Dell Karten mit 600 W nur in der Anordnung ohne Redundanz, und acht davon nur an Netzteilen mit 3.200 W. Mit acht Netzteilen zu 3.200 W sind alle drei Anordnungen für zwei, vier und acht Karten unterstützt, A/B-Netzredundanz eingeschlossen. Mit acht Netzteilen zu 2.400 W sind acht Karten mit 600 W ohne Redundanz und in der 7+1-Anordnung unterstützt, nicht aber in der Anordnung mit A/B-Netzredundanz.

Eine spätere Erhöhung der Leistung bedeutet, Netzteile zu tauschen. Dells Leitfaden hält fest, dass „die Leistung des derzeit verwendeten Netzteils mit der des neu hinzugefügten Netzteils übereinstimmen muss, damit dieses aktiviert wird“. Ein Server, der mit zwei Karten und Netzteilen zu 2.400 W an den Zuleitungen A und B gekauft wurde, kann die A/B-Netzredundanz bei acht Karten deshalb nur halten, wenn alle seine Netzteile getauscht werden. Der SR650a V4 nimmt höchstens zwei Netzteile auf, mit Optionen von 800 bis 3.200 W; die für zwei Karten bestellte Leistung bleibt also die Leistung für vier, sofern nicht beide Netzteile ersetzt werden.

Vier Karten mit 600 W ziehen 2,4 kW und acht 4,8 kW, bevor Prozessoren und Lüfter dazukommen; planen Sie deshalb auch die Stromzuleitung des Racks für die endgültige Kartenzahl.

Wir bauen KI-Server auf Bestellung und prüfen Rack, Strom und Luftstrom vor dem Angebot. Nennen Sie uns, mit wie vielen Karten Sie starten und wie viele Sie nachrüsten wollen, und wir legen CPU, Speicher, Stromversorgung und Kühlung für diese Zahl aus.

Lüfter, Riser, Stromkabel und Blindmodule

Passive GPUs beziehen ihre Luft von den Lüftern des Servers. Dells R770 Technical Guide, Rev. A09 vom Juni 2026, nennt Mindestanforderungen für die H200 NVL und die RTX PRO 6000: „Alle Lüftermodule müssen vom Typ High performance Platinum Fan (HPR Platinum) sein.“ Derselbe Leitfaden hält fest, dass „die Puck-Stromkabel, die für GPU-Installationen erforderlich sind, steckplatzspezifisch sind“.

Für einen Server, der wachsen soll, bestellen Sie den Hochleistungs-Lüftersatz und die GPU-Riser-Käfige für die endgültige Kartenzahl mit der ersten Konfiguration. Notieren Sie die Teilenummer des Stromkabels für jeden leeren GPU-Steckplatz, denn das Kabel wird je Server und Steckplatz bestellt. Unsere Checkliste für eine H200 NVL in einem vorhandenen Server behandelt die Sense-Pins des Kabels, die BIOS-Einstellungen für große Speicherfenster und die Supportlisten der Serverhersteller für diese Karte.

NVLink-Brücken und MIG: die Topologie festlegen, bevor die Karten kommen

NVIDIAs Seite zur H200 nennt für die H200 NVL eine „2- or 4-way NVIDIA NVLink bridge: 900GB/s per GPU“, und Lenovo verkauft die beiden Brücken als getrennte Teile, 4X67A97320 für die 2-fach- und 4X67A97322 für die 4-fach-Brücke. NVIDIAs Entwicklerblog vom 11. Dezember 2024 nennt für vier verbundene Karten „zusammen 564 GB HBM3e-Speicher“. Eine 4-fach-Brücke überspannt vier Karten; wer ein Modell über vier H200 NVL betreiben will, braucht also einen Server, dessen Hersteller die 4-fach-Brücke in den Steckplätzen unterstützt, die Sie nutzen werden. Nach unserem Verständnis bilden zwei zuerst gekaufte Karten an einer 2-fach-Brücke und zwei später hinzugefügte zwei 2-fach-Paare, sofern die Brücke nicht ersetzt wird. Modelle, die auf eine Karte passen und als Kopien laufen, brauchen keine Brücke.

Die RTX PRO 6000 Server Edition hat kein NVLink; zusätzliche Karten ändern also keinen Brückenplan. NVIDIAs Seite zur Karte schreibt, MIG „ermöglicht die Erstellung von bis zu vier vollständig isolierten Instanzen“, und die Seite zur H200 nennt für die H200 NVL „Up to 7 MIGs @16.5GB each“. MIG teilt eine Karte auf, jede zusätzliche Karte bringt also ihren eigenen Satz von Instanzen mit.

Die Leitfäden zum Dell XE7745 und R770, Dells GPU-Matrix und Lenovos Leitfäden zum SR650a V4 und SR675 V3 nennen keine Regel zum Mischen von GPU-Modellen in einem Server; sie führen Höchstzahlen je Kartenmodell. Wir empfehlen, mit dem Modell zu wachsen, mit dem der Server gestartet ist, denn NVLink-Brücken, MIG-Profile sowie die Regeln für Strom, Kühlung und Kabel sind alle je Kartenmodell festgelegt.

Lizenzen für NVIDIA AI Enterprise beim Nachrüsten von Karten

NVIDIAs Lizenzierungsleitfaden, aktualisiert am 2. September 2026, schreibt: „Die Software NVIDIA AI Enterprise wird pro GPU lizenziert.“ Jede zusätzliche Karte bringt also eine zusätzliche Lizenz mit sich, wo immer auf dem Server Software von AI Enterprise läuft, etwa NIM im Produktivbetrieb oder Compute-vGPU-Profile. Unser Artikel dazu, wie NVIDIA AI Enterprise lizenziert wird, erklärt, welche Einsätze die Lizenz brauchen.

Die H200 NVL wird anders lizenziert. NVIDIA schreibt: „Jede NVIDIA H200 NVL Tensor Core GPU enthält ein fünfjähriges Abonnement von NVIDIA AI Enterprise“; sein Startdatum ergebe sich aus dem Datum der Auslieferung der GPU-Karte an den Serverhersteller plus 90 Tage, und es „kann nicht geändert werden, da es an die konkrete Karte gebunden ist“. Bei zwei Karten, die ein Jahr nach den ersten beiden an den Serverhersteller ausgeliefert wurden, enden die Abonnements deshalb etwa ein Jahr später. Für RTX PRO 6000, L40S und L4, die kein Abonnement enthalten, bringt jede zusätzliche Karte eine Lizenz mehr, wo die Software läuft.

Wachstumspfade von zwei auf acht GPUs

Jedes Beispiel startet mit zwei Karten und nennt, was die zitierten Dokumente ab dem ersten Tag verlangen.

WACHSTUMSPFADPLATTFORMBEISPIELAB DEM ERSTEN TAG
2 bis 4 RTX PRO 6000, 2ULenovo SR650a V4auf 450 W begrenzte Version für alle vier; für 4xDW gelistete Laufwerks­konfiguration; Netzteil­leistung für vier Karten
2 bis 8 RTX PRO 6000, 3ULenovo SR675 V38-DW-GPU-Modell; AMD EPYC der 5. Generation; Speicher für acht Karten geplant
2 bis 8 Karten mit 600 W, 4UDell PowerEdge XE7745acht Netzteile mit 3.200 W, wenn bei acht Karten A/B-Netz­redundanz gefordert ist
2 bis 8 H200 NVL mit NVLinkein Server, der 4-fach-Brücken führtSteckplätze für zwei Vierersätze; 4-fach-Brücken im Plan

Lenovo Press LP2128, LP1611 und LP2263; Dell XE7745 Technical Guide Rev. A09, Tabellen 28 und 29; NVIDIA-Seite zur H200 und Lenovo LP1944 für die Brücken, gelesen am 10. Oktober 2026. Der Konfigurator des jeweiligen Serverherstellers entscheidet je Konfiguration.

Wir liefern Karten für Server, die Sie bereits betreiben, und prüfen zuerst Plattform, Strom und Kühlung. Beschreiben Sie Ihren Server und die geplanten zusätzlichen Karten im Formular unten.

Über einen Server hinaus wachsen

Ein zweiter Server ist der nächste Schritt, sobald der erste sein gelistetes Maximum erreicht, acht Karten im XE7745 und im SR675 V3, oder wenn der Dienst weiterlaufen muss, während ein Server nicht verfügbar ist. Er bringt eigene Prozessoren, eigenen Speicher, eigene Netzteile und einen eigenen Platz im Rack mit. Ein Modell, das in einen Server passt, läuft als vollständige Kopie auf jedem, hinter einem Load Balancer, und unser Artikel zur LLM-Hochverfügbarkeit mit zwei GPU-Knoten legt diese Anordnung aus. NVLink-Brücken verbinden Karten innerhalb eines Servers; ein Modell, das über zwei Server verteilt ist, kommuniziert also über das Netzwerk. NVIDIAs Enterprise-Referenzarchitektur für H200-NVL-Cluster nutzt je Server eine Konfiguration „2-8-5“, deren Ziffern für „die Zahl der Sockel (CPUs), die Zahl der GPUs“ und die Netzwerkadapter stehen.

Was wir liefern

Wir bauen KI-Server auf Bestellung mit der RTX PRO 6000 Server Edition, der H200 NVL mit NVLink-Brücken, der L40S oder der L4, montiert und im Burn-in getestet, mit Herstellergarantie auf jede Komponente, unter einem EU-Vertrag und auf einer Rechnung. Wir prüfen Rack, Strom und Luftstrom vor dem Angebot. Für einen Server, den Sie bereits besitzen, prüfen wir Plattform, Stromversorgung und Kühlung, bevor Sie Karten nachrüsten, und sagen Ihnen vorab, wenn etwas nicht funktioniert. Lizenzen für NVIDIA AI Enterprise und vGPU kommen auf dieselbe Rechnung wie die Karten, und zu den professionellen NVIDIA-GPUs, die wir liefern, gehört die RTX-PRO-Reihe von der 2000 bis zur 6000.

FAQ

Kann ich GPUs später in meinen Server nachrüsten?
Ja, wenn der Serverhersteller die endgültige Kartenzahl für Ihr genaues Modell und Ihre Konfiguration führt und der Server bereits die Prozessoren, Netzteile, Lüfter und Kabelsätze hat, die diese Zahl braucht. Dells Leitfaden zum XE7745 fordert Besitzer auf, vor dem Ein- oder Ausbau von GPUs Rücksprache mit Dell zu halten, und Lenovo verlangt DIMM-Blindmodule in jedem leeren Speichersteckplatz, wenn eine GPU im Feld nachgerüstet wird. Klären Sie die Konfiguration mit dem Serverhersteller, bevor Sie die Karten bestellen.
Wie plane ich einen erweiterbaren GPU-Server?
Bestellen Sie Basismodell, Prozessoren, Speicher, Netzteile, Lüftersatz und Riser-Käfige für die endgültige Kartenzahl und bauen Sie nur die Karten ein, die Sie jetzt brauchen. NVIDIAs Leitfaden für NVIDIA-Certified Systems nennt 2, 4 oder 8 GPUs pro Server ausgewogen und skaliert seine Mindestwerte mit den Karten, sechs CPU-Kerne je GPU und das Doppelte des GPU-Speichers als Systemspeicher. Planen Sie auch die Stromzuleitung des Racks für die endgültige Zahl.
Sollte ich jetzt 2 GPUs kaufen und später weitere nachrüsten?
Das funktioniert, wenn der Server als größere Konfiguration bestellt wird, zum Beispiel Lenovos 8-DW-GPU-Modell des SR675 V3 statt des 4-DW-Modells. Im SR650a V4 mit 2U führt Lenovo vier RTX PRO 6000 nur in der auf 450 W begrenzten Version, mit 600 W bestellte Karten beschränken diesen Server also auf zwei. Ohne einen solchen Plan heißt Wachstum, die Plattform zu wechseln oder einen zweiten Server hinzuzufügen.
Brauche ich mehr Netzteile, wenn ich GPUs nachrüste?
Oft ja, und sie müssen der bereits installierten Leistung entsprechen: Dells Leitfaden zum XE7745 aktiviert ein zusätzliches Netzteil nur, wenn seine Leistung der der verwendeten Netzteile entspricht. Mit Netzteilen zu 2.400 W unterstützt Dell acht Karten mit 600 W nicht in der Anordnung mit A/B-Netzredundanz, mit Netzteilen zu 3.200 W dagegen schon. Wählen Sie die Leistung der Netzteile bei der ersten Bestellung für die endgültige Kartenzahl.
Kann ich verschiedene GPU-Modelle in einem Server mischen?
Die Leitfäden von Dell und Lenovo, die wir gelesen haben, führen Höchstzahlen je Kartenmodell und nennen keine Regel zum Mischen von Modellen, weder erlaubend noch verbietend. NVLink-Brücken, MIG-Profile, Stromkabel, Lüftersätze und Leistungsbegrenzungen sind alle je Kartenmodell festgelegt. Wir empfehlen, mit dem Modell zu wachsen, mit dem der Server gestartet ist; jede andere Kombination lassen Sie sich vom Serverhersteller bestätigen.
Brauche ich zusätzliche Lizenzen für NVIDIA AI Enterprise, wenn ich GPUs nachrüste?
Ja, wo immer auf dem Server Software von AI Enterprise läuft, denn NVIDIA lizenziert sie pro GPU. Jede H200 NVL enthält ein fünfjähriges Abonnement, das 90 Tage nach Auslieferung dieser Karte an den Serverhersteller beginnt, später hinzugefügte Karten laufen also meist zu späteren Terminen aus. RTX PRO 6000, L40S und L4 enthalten kein Abonnement, jede zusätzliche Karte braucht also eine eigene Lizenz.

Schicken Sie uns das GPU-Modell, die Zahl der Karten zum Start, die Zahl, die Sie voraussichtlich erreichen, sowie die Stromzuleitung und die Zulufttemperatur am Rack-Platz. Wir antworten innerhalb eines Werktages mit einer Konfiguration und einem Angebot, ausgelegt auf die endgültige Kartenzahl, und prüfen Rack, Strom und Luftstrom vor dem Angebot.

Mit einem Experten sprechen
Mit einem Experten sprechen

Wir antworten innerhalb eines Werktages

Mit dem Absenden stimmen Sie zu, dass wir Ihre Angaben zur Beantwortung Ihrer Anfrage verarbeiten; siehe unsere Datenschutzerklärung.

request@eurokommerz.at
Jordangasse 7, 1010 Wien