BLOG · GUIDE · JULI 2026

MIG und vGPU: Wie viele VMs eine Karte wirklich trägt

IN KÜRZE
  • Die RTX PRO 6000 Blackwell teilt sich in 4 × 24-GB-Instanzen, die RTX PRO 5000 in 2, die H100 in 7. Die L40S hat gar keine Hardware-Partitionierung
  • MIG braucht keine Lizenz. vGPU ohne Lizenz läuft 20 Minuten und fällt dann auf 1280×1024 bei 3 fps
  • Obergrenze der RTX PRO 6000 Server Edition: bis zu 48 Grafik-vGPUs, 12 im Compute-Profil DC-8C
  • Von den Blackwell-Karten hat nur die Server Edition vGPU; Workstation und Max-Q können MIG ohne vGPU
  • MIG-gestützte vGPU läuft auf vSphere, RHEL KVM und Ubuntu KVM; unter Windows Server gibt es solche Profile nicht

MIG vs. vGPU: Was geteilt wird

MIG schneidet die Karte in Hardware: Jede Instanz bekommt eigene Rechenblöcke, eigenen Speicher und eigene Speicherbandbreite — ein Nachbar auf derselben Karte kann Sie nicht beeinflussen. vGPU arbeitet anders: Alle VMs sehen dieselbe Karte und wechseln sich ab.

VERGLICHEN WIRDMIGTIME-SLICED vGPU
PrinzipRaum — feste ScheibenZeit — Warteschlange und Umschalten
Speicher- & FehlerisolationHardwarekeine
Codecs und 3Deigene pro Instanzvon allen geteilt
Lizenznicht erforderlichvApps, vPC, vWS oder AI Enterprise
Hypervisornicht erforderlich (Linux mit CUDA)erforderlich, aus der Support-Liste

Es gibt auch einen Hybrid. MIG-gestützte vGPU legt eine virtuelle Karte über eine Hardware-Scheibe, und innerhalb der Scheibe gilt weiter Time-Slicing. Auf dem 48-GB-Profil war dieser Modus laut NVIDIAs Sizing-Guide rund 20% schneller als reines Time-Slicing.

Wie viele Teile jede Karte hergibt

Die Instanzzahl ist von der Architektur fixiert — keine Einstellung ändert sie. Nur Rechenzentrumskarten mit HBM teilen sich siebenfach.

GPUSPEICHERMAX. MIG-INSTANZEN
RTX PRO 6000 Blackwell (alle drei Editionen)96 GB4
RTX PRO 5000 Blackwell48 GB2
RTX PRO 4500 Blackwell32 GB2
H100 PCIe / SXM580 / 94 GB7
L40S, L40, A40, GeForce48 GB und darunterkein MIG

H200 und A100 teilen sich in 7, die A30 in 4

Auf der RTX PRO 6000 heißen die Profile 1g.24gb (vier), 2g.48gb (zwei) und das volle 4g.96gb — jedes mit einer +gfx-Variante, also Grafik innerhalb der Scheibe. Das gab es vor Blackwell nicht. Bei Vierteilung werden aus 96 GB und 188 SM je Scheibe 23,6 GiB und 46 SM; GPT-OSS-20B liefert auf so einer Scheibe rund 80 Token pro Sekunde.

Karte, Szenario, Arbeitsplätze

KARTESZENARIOPROFILPLÄTZE PRO KARTE
RTX PRO 6000 SEBüro-VDIB-Profile, vPCbis 48
RTX PRO 6000 SEschweres CAD / 3DDC-12Q · 16Q · 24Q2–4
RTX PRO 6000 SEInferenz kleiner ModelleDC-8C, time-sliced12
RTX PRO 6000 SEInferenz mit garantierten RessourcenMIG 1g.24gb, DC-4-24C4
RTX PRO 5000zwei isolierte WorkloadsMIG 1g.24gb2
RTX PRO 4500leichte ArbeitsplätzeDC-4Q6–8
L40Svirtuelle WorkstationsL40S-8Q6 (4 bei gemischtem Sizing)

48 und 12 widersprechen sich nicht: Achtundvierzig ist die Grafik-Obergrenze, zwölf die Compute-Grenze. Der Sizing-Guide ergänzt, dass der Best-Effort-Scheduler „oft eine 2–3-fache Überbuchung“ erlaubt, wenn nicht alle Nutzer gleichzeitig aktiv sind — wie weit das trägt, entscheidet die Speicherrechnung pro Session. Die Monitoring-Regel: Stößt der Videospeicher einer VM ständig an die Profilgrenze, wird das Profil vergrößert — nicht die Platzzahl.

Lizenzen: Ohne läuft die Karte 20 Minuten

Es gibt drei Produkte, lizenziert pro gleichzeitig aktivem Nutzer, nicht pro Karte — und nur eine RTX-PRO-6000-Version unterstützt vGPU überhaupt. vApps streamt Anwendungen: ein Display, 1280×1024, A-Profile. vPC sind virtuelle Desktops: vier Displays bis 5120×2880, B-Profile, kein CUDA. vWS ist CAD und Entwicklung: bis 7680×4320, Q-Profile, CUDA, mehrere vGPUs pro VM. In NVIDIAs Preisliste kostet vWS fünfmal so viel wie vPC und fünfundzwanzigmal so viel wie vApps — ein Produktfehler kostet mehr als ein Kartenfehler.

Compute-C-Profile gehören nicht zu diesem Trio: Sie leben nur in NVIDIA AI Enterprise, lizenziert pro GPU im Server, nicht pro Nutzer. Direkt gefragt, ob vWS/vPC/vApps in AI Enterprise enthalten sind, antwortete NVIDIA: nein — nur C-Profile. Eine gemischte Flotte bedeutet zwei Beschaffungen.

Fällt die Lizenz weg, kommt die Degradierung zweistufig: zwanzig Minuten volle Geschwindigkeit, dann 1280×1024, drei Bilder pro Sekunde und CUDA aus. Nach der Wiederverbindung heben sich die Limits — aber Anwendungen müssen neu gestartet werden.

Hypervisoren

PLATTFORMvGPUMIG-BACKED vGPU
vSphere ESXi, RHEL KVM, Ubuntu KVMjaja, seit 19.0
Windows Server Hyper-Vja, seit 18.0nein
Proxmox VEja, seit 18.0MIG nur manuell per CLI
Nutanix AHV, Citrix XenServerjanicht angegeben

Zwei Details kippen Pläne am häufigsten. Auf Proxmox werden MIG-Instanzen von Hand per CLI angelegt, das vGPU-Layout über die Scheiben lässt sich nicht ändern, und AI Enterprise ist dort nicht offiziell unterstützt. Live-Migration verlangt dasselbe GPU-Modell und identische Treiber- und Hypervisor-Versionen auf beiden Hosts — und funktioniert nie zwischen unterschiedlichen MIG-Profilen.

Was in der Praxis bricht

Die längste Saga gehört der RTX PRO 6000 Blackwell. Karten wurden mit vBIOS 98.02.52.00.02 ausgeliefert, während MIG 98.02.55.00.00 verlangt — das es zum Launch nicht gab. Besitzer bekamen „Unable to enable MIG Mode: Not Supported“ und stellten im Forum die naheliegende Frage. Die funktionierende Prozedur: vBIOS über den Lieferanten aktualisieren, die Karte mit dem DisplayModeSelector in den Compute-Modus schalten, dann Profile zuweisen. Fragen Sie vor der Zahlung nach der Firmware-Version.

Der Compute-Modus hat Folgen. In einer Workstation, in der die Karte auch den Monitor treibt, wird der Videoausgang dunkel. BAR1 wächst von 256 MB auf 64 GB zusammenhängenden Adressraum — und das Mainboard muss ihn zuteilen können.

Das wichtigste Editions-Limit: Alle drei RTX-PRO-6000-Editionen können MIG, aber nur die Server Edition unterstützt vGPU. Eine Workstation-Karte kann sich in vier Scheiben für lokale Container teilen — sie kann sie nicht an virtuelle Maschinen übergeben. Limits aller Karten: MIG schaltet NVLink und Peer-to-Peer ab, GPUDirect zwischen MIG-Geräten ist nicht unterstützt, NCCL funktioniert mit MIG nicht. NVIDIA sagt es klar: MIG ist für Workloads, die keine ganze GPU brauchen. Nur Linux mit CUDA.

Macht das Teilen schneller?

Hängt davon ab, ob eine Aufgabe die Karte sättigt. Wenn nicht, erhöht die Partitionierung den Gesamtdurchsatz.

TESTGANZE KARTEPARTITIONIERT
A100 40 GB, flan-t5-base~3.400 Tok/s~9.800 auf 7 × 1g.5gb-Scheiben
H100, zwei Modelle auf vLLM4.940 Tok/s7.110 auf zwei Scheiben
Sprach-Pipeline0,74 Anfr./s1,00 auf MIG (0,76 bei Time-Slicing)
Einzelaufgabe auf einer 1/7-Scheibe0,00533 s0,02640 s — 5× schlechter

Die letzte Zeile ist die wichtige: Eine Einzelaufgabe wird auf einer Scheibe schlechter, denn eine Scheibe ist buchstäblich 1/7 der Karte über alle drei Ressourcen zugleich. Der Gewinn erscheint erst mit vielen beschäftigten Scheiben — und die Skalierung ist sublinear (der MIGPerf-Benchmark zeigte: N Instanzen liefern nicht N-fachen Durchsatz). Der zweite Grund, in Hardware zu schneiden, ist Vorhersagbarkeit: In einem Test mit sieben Mandanten auf der A100 hielt ein geschützter Dienst P95 um 1.319 ms auf MIG gegenüber 2.499 ms auf geteilter Karte.

Was wir liefern

Eurokommerz liefert die RTX PRO 6000 Server Edition (die einzige Edition mit MIG und vGPU zugleich — passiv gekühlt, braucht Server-Airflow), die L40S für Time-Sliced-VDI und die RTX PRO 5000 Blackwell in 48 GB und 72 GB, wenn zwei isolierte 24-GB-Instanzen genügen — EU-weit, mit Herstellergarantie.

FAQ

Ich aktiviere MIG und bekomme „Not Supported“. Treiber-Bug oder Doku-Fehler?
Weder noch. Prüfen Sie das vBIOS (98.02.55.00.00 oder neuer), einen Treiber ab 575.51.03 und den Display-Modus: Standard ist Grafik, MIG aktiviert sich nur im Compute-Modus.
MIG geht auf der RTX PRO 5000 48 GB, aber nicht auf der 72 GB im selben Rechner. Warum?
Ein altes Utility kennt die Geräte-ID nicht und liefert 0x2BB3. Sie brauchen DisplayModeSelector 1.76; Version 1.72 reicht nicht.
Wir haben die L40S wegen TFLOPS pro Euro gewählt. Wie teilen wir sie mit MIG?
Gar nicht — sie hat keine Hardware-Partitionierung; es bleibt lizenziertes vGPU. Prüfen Sie das Partitionierungsmodell vor der Beschaffung: der häufigste Kartenauswahl-Fehler bei Virtualisierung.
Unterstützen die +gfx-Profile Raytracing?
Unbekannt. Forenberichte sagen, manche Vulkan-Erweiterungen (darunter VK_NV_ray_tracing) funktionieren nicht; die Dokumentation spricht von Grafik-API-Support ohne Liste. NVIDIA hat in dem Thread nicht geantwortet.
Wie viele CAD-Arbeitsplätze trägt eine Karte wirklich?
Der Sizing-Guide nennt 2–4 schwere Nutzer auf der RTX PRO 6000 und 6–8 leichte auf der RTX PRO 4500. Ihre eigene Zahl kommt aus einem Pilotprojekt mit Ihren echten Modellen.

Nennen Sie uns Ihren Hypervisor, die Zahl der Personen und deren Workloads — unsere Ingenieure wählen Karte, Profil und Lizenz und markieren, wo die Konfiguration an ein Treiberlimit stößt. Wir antworten innerhalb eines Werktages.

Mit einem Experten sprechen
Mit einem Experten sprechen

Wir antworten innerhalb eines Werktages

Mit dem Absenden stimmen Sie zu, dass wir Ihre Angaben zur Beantwortung Ihrer Anfrage verarbeiten — siehe unsere Datenschutzerklärung.

request@eurokommerz.at  ·  +43 1 585 1405 50  ·  Jordangasse 7, 1010 Wien