L40S vGPU-Profile: alle Q-, B-, A- und C-Typen mit Framebuffer, VMs pro Karte und Lizenz
Eurokommerz, Wien, seit 2006: Private AI/ML · IT Managed Services · Enterprise Training · KI-Hardware & Software
- Die L40S hat kein MIG und wird daher nur per Time-Sliced vGPU geteilt; NVIDIA führt zehn Framebuffer-Größen von 1 GB (L40S-1Q) bis zur ganzen Karte mit 48 GB (L40S-48Q)
- Eine L40S nimmt mit einem 1-GB-Typ im Equal-Size-Modus höchstens 32 vGPUs auf und im Mixed-Size-Modus 16; L40S-12Q gibt in beiden Modi jeder von vier VMs 12 GB
- Q-Typen brauchen eine Lizenz für RTX vWS, B-Typen vPC oder vWS, A-Typen vApps, und die C-Typen von L40S-4C bis L40S-48C brauchen NVIDIA AI Enterprise
- Auf ESXi 8.0 Update 3 und auf VCF 9 können sich A-, B- und Q-Typen unterschiedlicher Größe im Mixed-Size-Modus eine Karte teilen, was das Maximum für einige Größen senkt
- Best Effort ist der Standard-Scheduler; Equal Share und Fixed Share geben jeder vGPU einen festgelegten Anteil an der Karte, und vGPU 20.0 brachte Fixed Share für vGPUs unterschiedlicher Größe auf einer GPU
Geliefert von Eurokommerz: KI-Server, auf Bestellung gebaut Konfiguration anfragen →
L40S vGPU-Profilliste
Die NVIDIA L40S hat kein MIG, daher wird eine Karte zwischen virtuellen Maschinen nur per Time-Sliced vGPU geteilt: Jede VM erhält einen festen Teil des 48-GB-Framebuffers und nutzt die Engines der GPU abwechselnd mit den anderen. NVIDIAs Referenz der vGPU-Typen führt die L40S-vGPU-Profile in zehn Framebuffer-Größen, von 1 GB (L40S-1Q) bis zur ganzen Karte (L40S-48Q), in drei Serien: Q für virtuelle Workstations, B für virtuelle Desktops und A für virtuelle Anwendungen. Die C-Serie für Compute, von 4 bis 48 GB, steht in der Dokumentation zu NVIDIA AI Enterprise. Eine L40S nimmt höchstens 32 vGPUs auf, mit einem 1-GB-Typ im Equal-Size-Modus, und 16, wenn auf der Karte Größen gemischt werden.
| FRAMEBUFFER | MAX. EQUAL-SIZE | MAX. MIXED-SIZE | TYPEN |
|---|---|---|---|
| 48 GB (49.152 MB) | 1 | 1 | L40S-48Q, L40S-48A, L40S-48C |
| 24 GB (24.576 MB) | 2 | 2 | L40S-24Q, L40S-24A, L40S-24C |
| 16 GB (16.384 MB) | 3 | 2 | L40S-16Q, L40S-16A, L40S-16C |
| 12 GB (12.288 MB) | 4 | 4 | L40S-12Q, L40S-12A, L40S-12C |
| 8 GB (8.192 MB) | 6 | 4 | L40S-8Q, L40S-8A, L40S-8C |
| 6 GB (6.144 MB) | 8 | 8 | L40S-6Q, L40S-6A, L40S-6C |
| 4 GB (4.096 MB) | 12 | 8 | L40S-4Q, L40S-4A, L40S-4C |
| 3 GB (3.072 MB) | 16 | 16 | L40S-3Q, L40S-3B, L40S-3A |
| 2 GB (2.048 MB) | 24 | 16 | L40S-2Q, L40S-2B, L40S-2A |
| 1 GB (1.024 MB) | 32 | 16 | L40S-1Q, L40S-1B, L40S-1A |
Maximale Zahl der vGPUs pro GPU. Q-, B- und A-Typen: NVIDIA Virtual GPU Types Reference, vGPU-Benutzerhandbuch, zuletzt aktualisiert am 29. September 2026. C-Typen: NVIDIA AI Enterprise, Ada Lovelace vGPU types, Tabelle 112, zuletzt aktualisiert am 2. September 2026.
In jeder Zeile ist die Zahl im Typnamen der Framebuffer in GB, und das Maximum pro GPU ist für jede Serie dieser Größe gleich. L40S-12Q hat 12.288 MB, und vier davon füllen eine Karte in beiden Modi. Die C-Serie endet bei 4 GB, eine Compute-VM auf der L40S bekommt also nie weniger als das.
Q-, B-, A- und C-Serie: Einsatzzweck, Lizenz und Displays
NVIDIAs Lizenzleitfaden ordnet RTX vWS „NVIDIA-vGPUs der Q-Serie“ und „NVIDIA-vGPUs der B-Serie“ sowie GPU-Passthrough zu, vPC nur vGPUs der B-Serie und vApps vGPUs der A-Serie sowie Passthrough. Die C-Typen der L40S stehen gar nicht in der Referenz der vGPU-Typen; sie sind in der Dokumentation zu NVIDIA AI Enterprise unter „Required license edition: NVIDIA AI Enterprise“ aufgeführt.
| SERIE | NVIDIAS EINSATZZWECK | LIZENZEDITION | DISPLAYS JE VGPU |
|---|---|---|---|
| Q, 1 bis 48 GB | virtuelle Workstations | RTX vWS | bis zu 4; bei 7680×4320: 2 ab 8 GB, 1 bei 2 bis 6 GB |
| B, 1 bis 3 GB | virtuelle Desktops | vPC oder RTX vWS | bis zu 4 bei 2560×1600 oder darunter |
| A, 1 bis 48 GB | virtuelle Anwendungen | vApps | 1 mit bis zu 1280×1024 |
| C, 4 bis 48 GB | Compute | NVIDIA AI Enterprise | 1 mit bis zu 3840×2400 |
NVIDIA Virtual GPU Types Reference (29. September 2026); NVIDIA-vGPU-Lizenzleitfaden, Tabelle 2 (29. September 2026); NVIDIA AI Enterprise, Ada Lovelace vGPU types (2. September 2026). Die Zahl der Displays gilt, wie NVIDIA angibt, wenn alle Displays dieselbe Auflösung haben.
Ob CUDA und OpenCL unterstützt werden, hängt von der Serie ab. NVIDIAs vGPU-Benutzerhandbuch unterstützt sie auf „allen vGPU-Typen der Q-Serie“ einer Liste von GPUs, zu der die L40S gehört, und nennt für die Karte keine B- oder A-Typen. NVIDIA AI Enterprise führt vGPUs mit mehr als 40 GB, auf der L40S also nur L40S-48C, für Trainings-Workloads.
Die Display-Grenzen trennen die kleinen Typen. L40S-12Q steuert zwei Displays mit 7680×4320 oder vier mit 5120×2880 oder darunter an. L40S-2B steuert zwei Displays mit 3840×2160 an, L40S-1B dagegen eines in dieser Auflösung und vier nur bei 2560×1600 oder darunter. Eine VM ohne Lizenz wird laut NVIDIAs Lizenzleitfaden nach 20 Minuten eingeschränkt und nach 24 Stunden weiter, deshalb muss der NVIDIA-Lizenzserver für vGPU, DLS oder CLS erreichbar bleiben.
Equal-Size- und Mixed-Size-Modus auf einer L40S
NVIDIAs Release Notes für vSphere halten fest: „Standardmäßig unterstützt eine GPU oder GPU-Instanz nur vGPUs mit derselben Menge an Framebuffer und befindet sich daher im Equal-Size-Modus.“ Auf ESXi 8.0 Update 3 und späteren 8.0-Updates sowie ab Release 9.0 „kann jede Kombination von vGPUs der A-, B- und Q-Serie mit beliebiger Menge an Framebuffer gleichzeitig auf derselben physischen GPU liegen“, innerhalb der 48 GB der Karte. Dafür „muss die GPU in den Mixed-Size-Modus versetzt werden“.
NVIDIAs Tabellen zeigen, wo der Mixed-Size-Modus das Maximum senkt: bei 1, 2, 4, 8 und 16 GB. Die Typen mit 3, 6, 12, 24 und 48 GB behalten ihre Anzahl aus dem Equal-Size-Modus. Die vSphere-API nennt die beiden Modi sameSize und mixedSize, in einem Enum der Grafikkonfiguration des Hosts seit API-Release 8.0.3.0.
Diese Aussage nennt nur A-, B- und Q-Typen. Für Compute-VMs dokumentiert NVIDIA AI Enterprise heterogene vGPU, die es „einer einzelnen physischen GPU erlaubt, mehrere vGPU-Profile zu hosten“, auf vSphere und auf GPUs ab Turing, und seine L40S-Tabelle gibt den C-Typen dieselben Maxima im Mixed-Size-Modus wie den anderen Serien. Dieselbe Seite hält fest, dass eine heterogene Konfiguration „nur die Scheduler Best Effort und Equal Share unterstützt“. Ein NVIDIA-Dokument, das einen C-Typ und einen Q-, B- oder A-Typ auf eine L40S setzt, haben wir nicht gefunden. Broadcoms Blog zu GPUs in vSphere 8 Update 3 vom 3. Juli 2024 zeigt eine L40, die sich eine VM mit l40-16c und eine mit l40-12q teilen; solange NVIDIA eine solche Mischung für Ihr vGPU-Release nicht dokumentiert, planen Sie Compute-VMs auf eigenen Karten.
Broadcoms KB 447105 hält fest, dass die Host-Richtlinie „Spread VMs across GPUs“ nur für Geräte im Time-Sliced-Same-Size-Modus gilt und im Mixed-Size- und im MIG-Modus umgangen wird; dort zielt die Platzierung darauf, eine Fragmentierung der GPUs zu vermeiden, statt VMs gleichmäßig zu verteilen.
vGPU-Scheduler auf der L40S: Best Effort, Equal Share und Fixed Share
NVIDIAs vGPU-Benutzerhandbuch bietet für jede unterstützte GPU drei Scheduler. Bei Best Effort, dem Standard, „werden die Verarbeitungszyklen der physischen GPU auf eine Weise geteilt, die darauf abzielt, die Leistung zwischen den vGPUs auszugleichen“, und eine vGPU kann Zyklen nutzen, die die anderen ungenutzt lassen. Bei Equal Share „wird die physische GPU gleichmäßig unter den laufenden vGPUs aufgeteilt, die auf ihr liegen“, sodass jede VM mehr bekommt, wenn andere stoppen. Bei Fixed Share „erhält jede vGPU einen festen Anteil an den Verarbeitungszyklen der physischen GPU“, und dieser Anteil bleibt gleich, wenn andere VMs starten oder stoppen.
Bei Fixed Share ist der Anteil einer vGPU im Equal-Size-Modus umgekehrt proportional zur maximalen Zahl ihres Typs pro GPU und im Mixed-Size-Modus proportional zu ihrem Anteil am Framebuffer. Nach beiden Regeln bekommt eine L40S-12Q ein Viertel der Karte. NVIDIAs Tabelle legt die Standard-Zeitscheibe nach der maximalen Zahl der vGPUs pro GPU fest, 2 ms für bis zu acht und 1 ms für mehr. NVIDIA ergänzt: „Wenn Sie den Equal-Share- oder den Fixed-Share-vGPU-Scheduler verwenden, ist der Frame-Rate-Limiter (FRL) deaktiviert.“
nvidia-smi vgpu -ss zeigt den aktuellen Zustand, und der Unterbefehl set-scheduler-state mit -p 1, -p 2 oder -p 3 setzt Best Effort, Equal Share oder Fixed Share sofort, aber nur bis zum nächsten Neuladen des Treibers oder Neustart des Hosts. Um eine Einstellung auf ESXi dauerhaft zu machen, setzen Sie den Registry-Wert RmPVMRL per esxcli am Modul nvidia-gpu (ab Ada Lovelace) und laden danach den Treiber neu oder starten den Host neu. RmPVMRL=0x01 wählt Equal Share und RmPVMRL=0x11 Fixed Share, für alle GPUs oder mit NVreg_RegistryDwordsPerDevice für ausgewählte Karten. Eine Änderung schlägt fehl, solange auf dieser GPU eine vGPU aktiv ist, planen Sie sie daher in einem Wartungsfenster. Wie sich vier VMs mit L40S-12Q unter Last eine Karte teilen, zeigt unser Review der L40S-Benchmarks.
Was sich zwischen den vGPU-Releases für die L40S geändert hat
NVIDIAs Liste der von vGPU unterstützten GPUs, aktualisiert am 2. Oktober 2026, nennt Release 16.1 als erstes Release für die L40S und kennzeichnet sie mit „Full Support“. Release 17.2 brachte die „Unterstützung für eine Mischung verschiedener Typen von Time-Sliced vGPUs auf derselben physischen GPU ab vSphere 8 Update 3“.
Release 20.0 brachte die „Unterstützung für den Fixed-Share-Scheduler für Time-Sliced vGPUs mit unterschiedlicher Menge an Framebuffer auf derselben physischen GPU“ und strich eine Option: „Das Deaktivieren der Strict-Round-Robin-Richtlinie wird nicht mehr unterstützt.“ Das aktuelle Release, 20.2 auf dem Zweig R595, kombiniert den vGPU Manager 595.91.04 mit dem Linux-Gasttreiber 595.91.07. Es unterstützt VCF 9.1, VCF 9.0 und ESXi 8.0 Update 3 P06 oder neuer. In den Release Notes zu 20.x haben wir keinen L40S-Typ gefunden, der hinzugekommen oder entfallen ist. NVIDIAs Tabelle der Display-Modi für vSphere führt die L40S als im Display-Off-Modus ausgeliefert. Regeln zu vMotion, DRS und Passthrough stehen in unserem Leitfaden zu GPUs in VMware vSphere, per Passthrough oder vGPU.
Welches L40S-Profil für CAD, Büro-VDI und KI-Compute-VMs
NVIDIAs vWS-Sizing-Guide, zuletzt aktualisiert am 19. August 2026, gibt seine Empfehlungen je Nutzertyp für Karten der RTX PRO Blackwell statt für die L40S. Er empfiehlt Q-Profile mit 4 GB für leichte Nutzer, 4 bis 8 GB für mittlere und 12 bis 24 GB für schwere Nutzer, und wir übertragen dieselben Framebuffer-Stufen in der Tabelle unten auf die L40S-Typen.
| NUTZERTYP | L40S-PROFIL | LIZENZ | PRO KARTE |
|---|---|---|---|
| Desktop, zwei 4K-Monitore | L40S-2B | vPC | 24 |
| Desktop, vier QHD-Monitore | L40S-1B | vPC | 32 |
| Leichtes CAD, 2D-Zeichnen | L40S-4Q | RTX vWS | 12 |
| Mittleres 3D-CAD | L40S-8Q | RTX vWS | 6 |
| Schweres CAD, Visualisierung | L40S-12Q bis L40S-24Q | RTX vWS | 4 bis 2 |
| Inferenz-VM, kleines Modell | L40S-12C oder L40S-24C | NVIDIA AI Enterprise | 4 oder 2 |
| Trainings-/ | L40S-48C | NVIDIA AI Enterprise | 1 |
Unsere Einordnung. Framebuffer-Stufen aus NVIDIAs RTX-vWS-Sizing-Guide (19. August 2026); Display-Grenzen, Maxima pro Karte im Equal-Size-Modus und Lizenzeditionen aus NVIDIAs Referenz der vGPU-Typen und dem Lizenzleitfaden; Training für vGPUs über 40 GB aus NVIDIA AI Enterprise.
NVIDIAs vPC-Sizing-Guide veröffentlicht die gemessene Framebuffer-Nutzung für 1B- und 2B-Profile, mit Tabellen für die L40 und die L40S, und ein Pilot mit Ihren eigenen Anwendungen entscheidet über die Größe je Platz. Wie viele Plätze und Hosts eine Umgebung mit mehreren hundert Desktops braucht, behandelt unser Leitfaden zu GPU-Servern für virtuelle Desktops, und der Vergleich mit Karten, die auch MIG bieten, steht in MIG und vGPU: wie viele VMs eine Karte trägt.
Wir bauen GPU-Knoten für virtuelle Workstations mit L40S-Karten und NVIDIA-vGPU-Lizenzierung, ausgelegt nach Plätzen pro Karte. Nennen Sie uns Ihre Nutzertypen, Plätze und Bildschirme im Formular unten, und wir antworten mit den Profilen und der Zahl der Karten.
Rechenbeispiel: acht L40S in zwei vSphere-Hosts
Dieses Beispiel dient der Veranschaulichung. Ein Unternehmen plant 16 Konstrukteure mit schwerem CAD, 48 Büronutzer, die GPU-beschleunigte Desktops mit zwei 4K-Bildschirmen brauchen, und vier VMs für kleine Inferenzdienste, auf zwei ESXi-Hosts mit je vier L40S.
Jeder Host betreibt zwei Karten mit je vier L40S-12Q (acht CAD-Plätze), eine Karte mit 24 L40S-2B (24 Desktops) und eine Karte mit zwei L40S-24C (zwei Compute-VMs). Alle Karten bleiben im Equal-Size-Modus, sodass jede Karte die Maxima der ersten Tabelle erreicht und die Richtlinie „Spread VMs across GPUs“ weiter greift. Die CAD-Karten laufen mit Fixed Share, je Gerät gesetzt mit RmPVMRL=0x11, damit sich der Anteil eines Konstrukteurs an der Karte nicht ändert, wenn ein Kollege ein Rendering startet; die Desktop-Karte behält Best Effort, sodass ausgelastete Desktops Zyklen nutzen können, die untätige freilassen.
Braucht ein Konstrukteur je Host 24 GB, könnte der Mixed-Size-Modus eine L40S-24Q neben zwei L40S-12Q auf eine Karte setzen, eine Mischung von Q-Typen, die NVIDIAs Hinweise für vSphere erlauben. Der Kompromiss liegt bei der Platzierung, denn die Verteilungsrichtlinie gilt für diese Karte nicht mehr. Eine vGPU-VM lässt sich nur live auf einen Host mit demselben GPU-Typ und einem freien Platz für ihr Profil migrieren; sind alle Plätze belegt, gehen die VMs eines Hosts in Wartung offline. Die Lizenzen folgen der Serie, mit RTX vWS für die CAD-Plätze, vPC für die Desktops und NVIDIA AI Enterprise für die GPUs, auf denen C-Typen laufen.
Wir prüfen Rack, Stromversorgung und Luftstrom, bevor wir ein Angebot für L40S-Hosts erstellen. Schicken Sie uns Ihre Plätze je Nutzertyp über das Formular unten, und wir senden Ihnen innerhalb eines Werktages die Profilaufteilung und eine Konfiguration.
Was wir liefern
Wir liefern die NVIDIA L40S mit Herstellergarantie unter einem EU-Vertrag und auf einer Rechnung, als Karten oder in nach Auftrag gebauten KI-Servern, darunter GPU-Knoten für virtuelle Workstations, ausgelegt nach Plätzen pro Karte. NVIDIA AI Enterprise und vGPU-Lizenzen stehen auf derselben Rechnung wie die Hardware, wie unsere Seite zu NVIDIA-AI-Enterprise- und vGPU-Lizenzen beschreibt. Wächst ein Workload über 48 GB je VM hinaus oder braucht er Hardware-Partitionierung, umfasst unser Sortiment professioneller GPUs die RTX PRO 6000 Server Edition und die H200 NVL. Für Updates von vSphere und VCF auf vGPU-Hosts erbringt unser Engineering-Partner Vixen.UNO die VMware-Optimierung, mit Änderungen in vereinbarten Wartungsfenstern und mit Rollback-Plan.
FAQ
Welche vGPU-Profile unterstützt die NVIDIA L40S?
Was ist das Profil L40S-12Q?
Wie viele VMs pro GPU laufen auf einer L40S mit vGPU?
Welche Lizenz braucht eine vGPU vom Typ L40S-24C?
Kann man verschiedene vGPU-Profile auf einer L40S mischen?
Welche Lizenz brauchen die vWS-Profile der L40S?
Schicken Sie uns die Nutzertypen und Platzzahlen, die Bildschirme je Nutzer, die geplanten Compute-VMs und Ihre Version von vSphere oder VCF. Wir antworten innerhalb eines Werktages mit den passenden L40S-Profilen und der Zahl der Karten, den dafür nötigen Lizenzen für vGPU und NVIDIA AI Enterprise sowie einer Konfiguration und einem Angebot für die Hosts.
Mit einem Experten sprechenWir antworten innerhalb eines Werktages