GPUs später nachrüsten: was ein skalierbarer GPU-Server vom ersten Tag an braucht
Eurokommerz, Wien, seit 2006: Private AI/ML · IT Managed Services · Enterprise Training · KI-Hardware & Software
- Ein GPU-Server wächst von zwei auf vier oder acht Karten nur, wenn Basismodell, Prozessoren, Speicher, Netzteile, Lüfter und Kabelsätze für die endgültige Zahl bestellt wurden; Dells Leitfaden zum XE7745 schreibt „Installieren oder entfernen Sie keine GPUs, ohne vorher Rücksprache mit Dell zu halten“
- Lenovo verkauft den SR675 V3 als 4-DW- oder als 8-DW-GPU-Modell, und der SR650a V4 mit 2U nimmt zwei RTX PRO 6000 mit 600 W auf oder vier nur in der auf 450 W begrenzten Version
- NVIDIAs Leitfaden für NVIDIA-Certified Systems skaliert seine Mindestwerte mit den Karten, sechs CPU-Kerne je GPU und das Doppelte des gesamten GPU-Speichers als Systemspeicher, für acht RTX PRO 6000 also 48 Kerne und 1.536 GB
- Im Dell XE7745 sind acht Karten mit 600 W an Netzteilen mit 2.400 W in der Anordnung mit A/B-Netzredundanz nicht unterstützt, und ein zusätzliches Netzteil wird nur aktiviert, wenn seine Leistung der der bereits installierten Netzteile entspricht
- NVIDIA AI Enterprise wird pro GPU lizenziert, und das fünfjährige Abonnement jeder H200 NVL beginnt 90 Tage nach Auslieferung dieser Karte an den Serverhersteller, später hinzugefügte Karten laufen also meist zu späteren Terminen aus
Geliefert von Eurokommerz: KI-Server, auf Bestellung gebaut Konfiguration anfragen →
GPUs später nachrüsten: was am ersten Tag zu planen ist
Sie können GPUs später nachrüsten und einen GPU-Server ohne zweiten Server von zwei auf vier oder acht Karten erweitern, wenn er von Anfang an als größere Konfiguration bestellt wurde. Basismodell, Zahl und Generation der Prozessoren, Systemspeicher, Netzteile, Lüftersatz sowie Riser- und Kabelsätze müssen alle zur endgültigen Kartenzahl passen. Außerdem muss der Serverhersteller diese Zahl für das genaue Modell und die genaue Konfiguration führen.
Die Serverhersteller behandeln eine spätere GPU-Aufrüstung als Änderung der Konfiguration. Dells Technical Guide zum PowerEdge XE7745, Rev. A09 vom September 2026, schreibt: „Installieren oder entfernen Sie keine GPUs, ohne vorher Rücksprache mit Dell zu halten.“ Derselbe Leitfaden hält fest, dass Schäden durch eine Hardwareinstallation, die nicht autorisiert und validiert ist, zum Erlöschen der Systemgarantie führen. Lenovos Leitfaden zum SR650a V4 verlangt ein DIMM-Blindmodul in jedem leeren Speichersteckplatz, wenn eine GPU als Nachrüstung im Feld hinzukommt.
| BESTELLENTSCHEIDUNG | WIRKUNG SPÄTER | QUELLE |
|---|---|---|
| Basismodell oder Gehäuse | legt die Höchstzahl der Karten fest; ein 4-DW-Modell bleibt bei vier | Lenovo LP1611 |
| Zahl der Prozessoren | zwei Sockel, auf die die GPUs gleichmäßig verteilt sind | NVIDIA-Konfigurationsleitfaden |
| Prozessorgeneration | die RTX PRO 6000 im SR675 V3 braucht AMD EPYC der 5. Generation | Lenovo LP2263 |
| Systemspeicher | mindestens das Doppelte des GPU-Speichers bei der endgültigen Kartenzahl | NVIDIA-Konfigurationsleitfaden |
| Leistung der Netzteile | zusätzliche Netzteile müssen der installierten Leistung entsprechen | Leitfaden zum Dell XE7745 |
| Lüfter und Stromkabel | 600-W-Karten brauchen den genannten Lüftersatz und die Kabel je Steckplatz | Leitfaden zum Dell R770 |
| NVLink-Brücke | 2-fach- oder 4-fach-Teil, geplant je Satz von H200-NVL-Karten | NVIDIA-Seite zur H200; Lenovo LP1944 |
| Softwarelizenzen | pro GPU, und das Abonnement der H200 NVL läuft je Karte | NVIDIA-Lizenzierungsleitfaden |
Gelesen am 10. Oktober 2026: Lenovo Press LP1611 (aktualisiert am 8. Oktober 2026), LP2128 (5. Oktober 2026), LP2263 (28. Juli 2026) und LP1944 (7. November 2025); NVIDIAs Konfigurationsleitfaden für NVIDIA-Certified Systems (30. September 2026) und Lizenzierungsleitfaden für AI Enterprise (2. September 2026); Dell XE7745 Technical Guide Rev. A09 und R770 Technical Guide Rev. A09.
Gehäuse und Basismodell legen die Höchstzahl der Karten fest
Lenovos Produktleitfaden zum ThinkSystem SR675 V3, aktualisiert am 8. Oktober 2026, führt den Server in drei Basiskonfigurationen. Neben einem SXM5-Modell gibt es ein „4-DW GPU model (4x double-wide or single-wide PCIe GPUs with 8x 2.5-inch drive bays)“ und ein „8-DW GPU model (8x double-wide or single-wide PCIe GPUs with EDSFF drive bays)“. Über einen Umbau des einen in das andere sagt der Leitfaden nichts. Ein Unternehmen, das mit acht Karten rechnet, bestellt das 8-DW-Modell, auch wenn zunächst nur zwei Karten eingebaut werden.
Der SR650a V4 mit 2U trägt „bis zu 4 doppelt breite GPUs oder 8 einfach breite GPUs, eingebaut in den vorderen Steckplätzen“. Seine Tabelle der Storage-Konfigurationen führt vier doppelt breite GPUs mit einem oder mit zwei Prozessoren, je nach Laufwerkskonfiguration, und vermerkt: „Konfigurationen, die mit 2xDW-GPUs gelistet sind, gelten für Konfigurationen mit 600-W-GPUs.“ Lenovo führt die RTX PRO 6000 Server Edition für diesen Server als Karte mit 600 W und als Karte „Slot Capped at 450W“, und seine Änderungshistorie vom 28. Juli 2026 ergänzt die begrenzte Version, „um den Einbau von 4 GPUs im SR650a V4 zu ermöglichen“. Ein Server, der vier Karten erreichen soll, wird deshalb mit der begrenzten Version und einer Laufwerkskonfiguration bestellt, die für vier doppelt breite GPUs gelistet ist.
Dells PowerEdge Server GPU Matrix vom August 2026 vermerkt, dass die „maximal zulässige Zahl von GPUs in unterschiedlichen Konfigurationen derselben Plattform abweichen kann“. Unser Artikel dazu, wie viele GPUs in einen Server passen, erklärt die Grenzen bei Lanes, Strom und Luftstrom hinter diesen Zahlen, und die Liste der mit der RTX PRO 6000 Server Edition kompatiblen Server nennt das Maximum je Modell.
Prozessoren und Systemspeicher für die endgültige GPU-Anzahl
NVIDIAs Konfigurationsleitfaden für NVIDIA-Certified Systems, zuletzt aktualisiert am 30. September 2026, nennt „2x / 4x / 8x GPUs pro Server“ eine ausgewogene Konfiguration. Er ergänzt, „GPUs sollten gleichmäßig auf CPU-Sockel und PCIe-Root-Ports verteilt werden“, und verlangt für jede RTX PRO 6000 oder H200 NVL eine PCIe-Gen5-x16-Anbindung sowie mindestens zwei CPU-Sockel. Seine Mindestwerte wachsen mit der Kartenzahl: sechs physische CPU-Kerne je GPU und Systemspeicher von mindestens dem Doppelten des gesamten GPU-Speichers. NVIDIA bezeichnet diese Werte als „einen Ausgangspunkt, um workloadspezifische Anforderungen abzudecken“.
Nach unserer Rechnung haben zwei Karten RTX PRO 6000 zusammen 192 GB GPU-Speicher, woraus sich mindestens 384 GB Systemspeicher und 12 Kerne ergeben. Acht Karten haben 768 GB und ergeben 1.536 GB und 48 Kerne.
Lenovos Leitfaden zum SR650a V4 schreibt „Alle installierten DIMMs müssen identische Teilenummern haben; Mischen wird nicht unterstützt“, später ergänzte Module müssen also den installierten entsprechen. Bestellen Sie den Speicher für die endgültige Kartenzahl oder größere Module mit frei bleibenden Steckplätzen.
Lenovo unterstützt die RTX PRO 6000 im SR675 V3 mit bis zu acht Karten „nur mit AMD-EPYC-Prozessoren der 5. Generation“; ein SR675 V3, der mit einer früheren EPYC-Generation bestellt wurde, liegt also außerhalb dieses Supports.
Netzteile, ausgelegt auf die endgültige GPU-Anzahl
Dells XE7745 teilt seine Netzteile in eine CPU-Zone und eine GPU-Zone, und sechs seiner acht Einschübe liegen in der GPU-Zone. Sein Leitfaden schreibt: „Für volle Redundanz installieren Sie N+N Netzteile in jeder Zone, d. h. 1+1 in der CPU-Zone und 3+3 in der GPU-Zone.“ Mit vier Netzteilen führt Dell Karten mit 600 W nur in der Anordnung ohne Redundanz, und acht davon nur an Netzteilen mit 3.200 W. Mit acht Netzteilen zu 3.200 W sind alle drei Anordnungen für zwei, vier und acht Karten unterstützt, A/B-Netzredundanz eingeschlossen. Mit acht Netzteilen zu 2.400 W sind acht Karten mit 600 W ohne Redundanz und in der 7+1-Anordnung unterstützt, nicht aber in der Anordnung mit A/B-Netzredundanz.
Eine spätere Erhöhung der Leistung bedeutet, Netzteile zu tauschen. Dells Leitfaden hält fest, dass „die Leistung des derzeit verwendeten Netzteils mit der des neu hinzugefügten Netzteils übereinstimmen muss, damit dieses aktiviert wird“. Ein Server, der mit zwei Karten und Netzteilen zu 2.400 W an den Zuleitungen A und B gekauft wurde, kann die A/B-Netzredundanz bei acht Karten deshalb nur halten, wenn alle seine Netzteile getauscht werden. Der SR650a V4 nimmt höchstens zwei Netzteile auf, mit Optionen von 800 bis 3.200 W; die für zwei Karten bestellte Leistung bleibt also die Leistung für vier, sofern nicht beide Netzteile ersetzt werden.
Vier Karten mit 600 W ziehen 2,4 kW und acht 4,8 kW, bevor Prozessoren und Lüfter dazukommen; planen Sie deshalb auch die Stromzuleitung des Racks für die endgültige Kartenzahl.
Wir bauen KI-Server auf Bestellung und prüfen Rack, Strom und Luftstrom vor dem Angebot. Nennen Sie uns, mit wie vielen Karten Sie starten und wie viele Sie nachrüsten wollen, und wir legen CPU, Speicher, Stromversorgung und Kühlung für diese Zahl aus.
Lüfter, Riser, Stromkabel und Blindmodule
Passive GPUs beziehen ihre Luft von den Lüftern des Servers. Dells R770 Technical Guide, Rev. A09 vom Juni 2026, nennt Mindestanforderungen für die H200 NVL und die RTX PRO 6000: „Alle Lüftermodule müssen vom Typ High performance Platinum Fan (HPR Platinum) sein.“ Derselbe Leitfaden hält fest, dass „die Puck-Stromkabel, die für GPU-Installationen erforderlich sind, steckplatzspezifisch sind“.
Für einen Server, der wachsen soll, bestellen Sie den Hochleistungs-Lüftersatz und die GPU-Riser-Käfige für die endgültige Kartenzahl mit der ersten Konfiguration. Notieren Sie die Teilenummer des Stromkabels für jeden leeren GPU-Steckplatz, denn das Kabel wird je Server und Steckplatz bestellt. Unsere Checkliste für eine H200 NVL in einem vorhandenen Server behandelt die Sense-Pins des Kabels, die BIOS-Einstellungen für große Speicherfenster und die Supportlisten der Serverhersteller für diese Karte.
NVLink-Brücken und MIG: die Topologie festlegen, bevor die Karten kommen
NVIDIAs Seite zur H200 nennt für die H200 NVL eine „2- or 4-way NVIDIA NVLink bridge: 900GB/s per GPU“, und Lenovo verkauft die beiden Brücken als getrennte Teile, 4X67A97320 für die 2-fach- und 4X67A97322 für die 4-fach-Brücke. NVIDIAs Entwicklerblog vom 11. Dezember 2024 nennt für vier verbundene Karten „zusammen 564 GB HBM3e-Speicher“. Eine 4-fach-Brücke überspannt vier Karten; wer ein Modell über vier H200 NVL betreiben will, braucht also einen Server, dessen Hersteller die 4-fach-Brücke in den Steckplätzen unterstützt, die Sie nutzen werden. Nach unserem Verständnis bilden zwei zuerst gekaufte Karten an einer 2-fach-Brücke und zwei später hinzugefügte zwei 2-fach-Paare, sofern die Brücke nicht ersetzt wird. Modelle, die auf eine Karte passen und als Kopien laufen, brauchen keine Brücke.
Die RTX PRO 6000 Server Edition hat kein NVLink; zusätzliche Karten ändern also keinen Brückenplan. NVIDIAs Seite zur Karte schreibt, MIG „ermöglicht die Erstellung von bis zu vier vollständig isolierten Instanzen“, und die Seite zur H200 nennt für die H200 NVL „Up to 7 MIGs @16.5GB each“. MIG teilt eine Karte auf, jede zusätzliche Karte bringt also ihren eigenen Satz von Instanzen mit.
Die Leitfäden zum Dell XE7745 und R770, Dells GPU-Matrix und Lenovos Leitfäden zum SR650a V4 und SR675 V3 nennen keine Regel zum Mischen von GPU-Modellen in einem Server; sie führen Höchstzahlen je Kartenmodell. Wir empfehlen, mit dem Modell zu wachsen, mit dem der Server gestartet ist, denn NVLink-Brücken, MIG-Profile sowie die Regeln für Strom, Kühlung und Kabel sind alle je Kartenmodell festgelegt.
Lizenzen für NVIDIA AI Enterprise beim Nachrüsten von Karten
NVIDIAs Lizenzierungsleitfaden, aktualisiert am 2. September 2026, schreibt: „Die Software NVIDIA AI Enterprise wird pro GPU lizenziert.“ Jede zusätzliche Karte bringt also eine zusätzliche Lizenz mit sich, wo immer auf dem Server Software von AI Enterprise läuft, etwa NIM im Produktivbetrieb oder Compute-vGPU-Profile. Unser Artikel dazu, wie NVIDIA AI Enterprise lizenziert wird, erklärt, welche Einsätze die Lizenz brauchen.
Die H200 NVL wird anders lizenziert. NVIDIA schreibt: „Jede NVIDIA H200 NVL Tensor Core GPU enthält ein fünfjähriges Abonnement von NVIDIA AI Enterprise“; sein Startdatum ergebe sich aus dem Datum der Auslieferung der GPU-Karte an den Serverhersteller plus 90 Tage, und es „kann nicht geändert werden, da es an die konkrete Karte gebunden ist“. Bei zwei Karten, die ein Jahr nach den ersten beiden an den Serverhersteller ausgeliefert wurden, enden die Abonnements deshalb etwa ein Jahr später. Für RTX PRO 6000, L40S und L4, die kein Abonnement enthalten, bringt jede zusätzliche Karte eine Lizenz mehr, wo die Software läuft.
Wachstumspfade von zwei auf acht GPUs
Jedes Beispiel startet mit zwei Karten und nennt, was die zitierten Dokumente ab dem ersten Tag verlangen.
| WACHSTUMSPFAD | PLATTFORMBEISPIEL | AB DEM ERSTEN TAG |
|---|---|---|
| 2 bis 4 RTX PRO 6000, 2U | Lenovo SR650a V4 | auf 450 W begrenzte Version für alle vier; für 4xDW gelistete Laufwerkskonfiguration; Netzteilleistung für vier Karten |
| 2 bis 8 RTX PRO 6000, 3U | Lenovo SR675 V3 | 8-DW-GPU-Modell; AMD EPYC der 5. Generation; Speicher für acht Karten geplant |
| 2 bis 8 Karten mit 600 W, 4U | Dell PowerEdge XE7745 | acht Netzteile mit 3.200 W, wenn bei acht Karten A/ |
| 2 bis 8 H200 NVL mit NVLink | ein Server, der 4-fach-Brücken führt | Steckplätze für zwei Vierersätze; 4-fach-Brücken im Plan |
Lenovo Press LP2128, LP1611 und LP2263; Dell XE7745 Technical Guide Rev. A09, Tabellen 28 und 29; NVIDIA-Seite zur H200 und Lenovo LP1944 für die Brücken, gelesen am 10. Oktober 2026. Der Konfigurator des jeweiligen Serverherstellers entscheidet je Konfiguration.
Wir liefern Karten für Server, die Sie bereits betreiben, und prüfen zuerst Plattform, Strom und Kühlung. Beschreiben Sie Ihren Server und die geplanten zusätzlichen Karten im Formular unten.
Über einen Server hinaus wachsen
Ein zweiter Server ist der nächste Schritt, sobald der erste sein gelistetes Maximum erreicht, acht Karten im XE7745 und im SR675 V3, oder wenn der Dienst weiterlaufen muss, während ein Server nicht verfügbar ist. Er bringt eigene Prozessoren, eigenen Speicher, eigene Netzteile und einen eigenen Platz im Rack mit. Ein Modell, das in einen Server passt, läuft als vollständige Kopie auf jedem, hinter einem Load Balancer, und unser Artikel zur LLM-Hochverfügbarkeit mit zwei GPU-Knoten legt diese Anordnung aus. NVLink-Brücken verbinden Karten innerhalb eines Servers; ein Modell, das über zwei Server verteilt ist, kommuniziert also über das Netzwerk. NVIDIAs Enterprise-Referenzarchitektur für H200-NVL-Cluster nutzt je Server eine Konfiguration „2-8-5“, deren Ziffern für „die Zahl der Sockel (CPUs), die Zahl der GPUs“ und die Netzwerkadapter stehen.
Was wir liefern
Wir bauen KI-Server auf Bestellung mit der RTX PRO 6000 Server Edition, der H200 NVL mit NVLink-Brücken, der L40S oder der L4, montiert und im Burn-in getestet, mit Herstellergarantie auf jede Komponente, unter einem EU-Vertrag und auf einer Rechnung. Wir prüfen Rack, Strom und Luftstrom vor dem Angebot. Für einen Server, den Sie bereits besitzen, prüfen wir Plattform, Stromversorgung und Kühlung, bevor Sie Karten nachrüsten, und sagen Ihnen vorab, wenn etwas nicht funktioniert. Lizenzen für NVIDIA AI Enterprise und vGPU kommen auf dieselbe Rechnung wie die Karten, und zu den professionellen NVIDIA-GPUs, die wir liefern, gehört die RTX-PRO-Reihe von der 2000 bis zur 6000.
FAQ
Kann ich GPUs später in meinen Server nachrüsten?
Wie plane ich einen erweiterbaren GPU-Server?
Sollte ich jetzt 2 GPUs kaufen und später weitere nachrüsten?
Brauche ich mehr Netzteile, wenn ich GPUs nachrüste?
Kann ich verschiedene GPU-Modelle in einem Server mischen?
Brauche ich zusätzliche Lizenzen für NVIDIA AI Enterprise, wenn ich GPUs nachrüste?
Schicken Sie uns das GPU-Modell, die Zahl der Karten zum Start, die Zahl, die Sie voraussichtlich erreichen, sowie die Stromzuleitung und die Zulufttemperatur am Rack-Platz. Wir antworten innerhalb eines Werktages mit einer Konfiguration und einem Angebot, ausgelegt auf die endgültige Kartenzahl, und prüfen Rack, Strom und Luftstrom vor dem Angebot.
Mit einem Experten sprechenWir antworten innerhalb eines Werktages