BLOG · GUIDE ·

NVIDIA-Lizenzserver: DLS oder CLS, wie Sie ihn einrichten und was passiert, wenn er nicht erreichbar ist

Eurokommerz, Wien, seit 2006: Private AI/ML · IT Managed Services · Enterprise Training · KI-Hardware & Software

IN KÜRZE
  • Das NVIDIA License System gibt vGPU- und NVIDIA-AI-Enterprise-Lizenzen aus einer Instanz des Cloud License Service (CLS) auf dem NVIDIA Licensing Portal oder aus einer Instanz des Delegated License Service (DLS) aus, die Sie im eigenen Haus betreiben; Compute auf Bare Metal oder in Containern braucht keinen Lizenzserver
  • Ein DLS wird in dieser Reihenfolge eingerichtet: Appliance, Administratorkonto, Lizenzserver im Portal, Upload des DLS-Instanztokens, Bindung, Installation der Lizenzdatei, Client-Konfigurationstoken, dann das Token auf jeder VM oder jedem Client
  • Hochverfügbarkeit braucht mindestens zwei DLS-Instanzen, eine primäre und eine sekundäre, seit vGPU 16.1 bis zu neun je Cluster; bei zwei Instanzen ist die nach einem Ausfall verbleibende ein Single Point of Failure
  • Eine Compute-VM, die ohne Lizenz startet, läuft 20 Minuten mit voller Leistungsfähigkeit, dann mit Rechenleistung auf Leerlaufniveau; eine lizenzierte Compute-VM arbeitet nach dem Verlust des Dienstes bei CLS standardmäßig 7 Tage weiter (auf dem DLS konfigurierbar), Grafik-Clients bis zu 1 Tag
  • Eine DLS-Instanz mit 4 vCPU und 8 GB bediente in NVIDIAs Messungen bis zu 32.000 Clients; für 200 bis 1.000 VMs richtet sich die Zahl der HA-Cluster daher nach Standorten und Netzwerkzonen, nicht nach der Zahl der Clients

Geliefert von Eurokommerz: KI-Server, auf Bestellung gebaut  Konfiguration anfragen →

NVIDIA-Lizenzserver: DLS oder CLS

Lizenzen für NVIDIA vGPU und NVIDIA AI Enterprise erhalten virtuelle Maschinen von einem NVIDIA-Lizenzserver, einer Service-Instanz des NVIDIA License System, die es in zwei Arten gibt. Eine Instanz des Cloud License Service (CLS) wird auf dem NVIDIA Licensing Portal gehostet. Eine Instanz des Delegated License Service (DLS) ist eine virtuelle Appliance oder ein Container, den Sie im eigenen Haus betreiben, innerhalb Ihres eigenen Netzes. Wählen Sie CLS, wenn die VMs ausgehende HTTPS-Verbindungen zu NVIDIA aufbauen dürfen, und DLS, wenn sie das nicht dürfen, wenn der Standort air-gapped ist oder wenn der Lizenzdienst mit einem eigenen Hochverfügbarkeitscluster unter Ihrer Kontrolle bleiben muss.

Der Lizenzserver bedient VMs mit Compute- oder Grafik-vGPU sowie GPUs im Passthrough oder auf Bare Metal, auf denen RTX-vWS-Grafik läuft. NVIDIAs Lizenzierungsleitfaden für AI Enterprise, aktualisiert am 2. September 2026, hält fest, dass das License System „nur dann installiert und konfiguriert werden muss, wenn NVIDIA-vGPU-for-Compute-Treiber verwendet werden“. Der Leitfaden zur vGPU-Client-Lizenzierung wendet die Lizenzdurchsetzung auf vGPUs der A-, B- und Q-Serie an sowie auf GPUs im Passthrough und auf Bare Metal, die für professionelle 3D-Grafik genutzt werden. Ein Server, der Modelle auf Bare Metal oder in Containern mit dem Rechenzentrumstreiber betreibt, braucht keinen Lizenzserver. Wie Lizenzen gezählt werden, steht in unserem Leitfaden zur Lizenzierung von NVIDIA AI Enterprise. Die Quellen der folgenden Abschnitte sind die Leitfäden zum NVIDIA License System, Version 3.6.1 vom 29. Juni 2026, und der Leitfaden zur vGPU-Client-Lizenzierung vom 29. September 2026.

CLS vs. DLS im Vergleich

ASPEKTCLS-INSTANZDLS-INSTANZ
Wo sie läuftNVIDIA Licensing PortalVM oder Container in Ihrem Netz
Client-VerbindungPort 443 ausgehend zu NVIDIAPort 443 zum DLS
Lizenzen auf der Instanzim Portal zugewiesenheruntergeladen, dann von Hand hochgeladen
Air-Gapped-Standortenicht nutzbarnutzbar; Knoten­gebundene Datei für Offline-Clients
Hoch­verfügbarkeitkein Cluster auf Ihrer SeiteIhr Cluster aus 2 bis 9 Instanzen
Ressourcen vor Ortkeinemindestens 4 vCPU, 8 GB RAM, 15 GB Festplatte
UpgradesNVIDIA und sein Cloud-AnbieterSie migrieren die Appliance

Benutzerhandbuch und Schnellstartanleitung zum NVIDIA License System v3.6.1 (29. Juni 2026), Abschnitte 1.2, 1.4, 2.1 und 2.3.

CLS passt zu VMs, die das Internet bereits über einen kontrollierten ausgehenden Weg erreichen; für einen nicht transparenten Proxy dokumentiert der Leitfaden zur Client-Lizenzierung die Einstellung ProxyServerAddress. DLS passt zu VMs ohne Route ins Internet oder zu Umgebungen, in denen die Lizenzierung weiterlaufen muss, während der Uplink ausgefallen ist. Weil „eine DLS-Instanz vollständig vom NVIDIA Licensing Portal getrennt ist“, wie es im Benutzerhandbuch heißt, müssen Sie „Lizenzen aus dem NVIDIA Licensing Portal herunterladen und manuell auf die Instanz hochladen“. Für einen Client ganz ohne Netzwerk beschreibt dasselbe Handbuch die knotengebundene Lizenzierung aus einer lokal installierten Datei, verfügbar seit vGPU-Software 15.0; der Rest einer Offline-Installation steht in unserem Artikel zur Offline-Installation eines Air-Gapped LLM-Servers.

So richten Sie eine NVIDIA-DLS-Instanz ein

NVIDIAs Schnellstartanleitung und Benutzerhandbuch nennen die Schritte in dieser Reihenfolge.

  1. Stellen Sie das DLS-Image als VM auf einem unterstützten Hypervisor bereit (das Handbuch nennt unter anderem VMware vSphere, Red Hat Enterprise Linux KVM und Ubuntu) oder als Container auf Docker, Kubernetes, Podman oder OpenShift, mit mindestens 4 vCPU, 8 GB RAM und 15 GB Festplatte, einer festen IP-Adresse und einem Reverse-DNS-Eintrag.
  2. Öffnen Sie die Appliance im Browser, wählen Sie NEW INSTALLATION, registrieren Sie das DLS-Administratorkonto und bewahren Sie das angezeigte lokale Reset-Secret auf; ein HA-Cluster lässt sich jetzt oder jederzeit später anlegen.
  3. Legen Sie im NVIDIA Licensing Portal einen Lizenzserver an und weisen Sie ihm Lizenzen aus Ihren Berechtigungen (Entitlements) zu.
  4. Laden Sie auf der Appliance das DLS-Instanztoken herunter und laden Sie es dann im Portal unter Register DLS Instance hoch.
  5. Binden Sie im Portal den Lizenzserver an die registrierte DLS-Instanz, sodass seine Lizenzen nur über diese Instanz verfügbar sind.
  6. Laden Sie die Lizenzdatei (license_*.bin) aus dem Portal herunter.
  7. Wählen Sie auf der Appliance die Lizenzdatei aus und installieren Sie sie, erzeugen Sie dann ein Client-Konfigurationstoken mit mindestens einer Scope-Referenz und laden Sie es herunter.
  8. Kopieren Sie das Token auf jeden Client und starten Sie den Lizenzierungsdienst des Clients neu.

NVIDIA erklärt, dass die Appliance beim Erstellen des Tokens „den Reverse-Pointer-Eintrag benötigt, um den Domänennamen zu bestimmen“. Die Berechtigung selbst, die vor Schritt 3 eintrifft, behandelt unser Artikel zur Aktivierung von NVIDIA-AI-Enterprise-Lizenzen.

Das Client-Konfigurationstoken auf jeder VM

Pfad und neu zu startender Dienst hängen vom Gastbetriebssystem ab. Unter Linux kommt das Token nach /etc/nvidia/ClientConfigToken, mit Dateirechten, die dem Eigentümer Lesen, Schreiben und Ausführen und allen anderen das Lesen erlauben (744). Ein vGPU-Client bekommt zusätzlich den Parameter FeatureType in /etc/nvidia/gridd.conf; der Leitfaden nennt für vGPU den Wert 1, der Lizenztyp wird dann automatisch gewählt, und der Dienst nvidia-gridd wird neu gestartet. Auf Windows-Gästen kommt das Token in den Ordner ClientConfigToken unter dem Verzeichnis vGPU Licensing der NVIDIA-Installation, und der Dienst NvDisplayContainer wird neu gestartet. Danach gilt laut Leitfaden: „Der NVIDIA-Dienst auf dem Client sollte nun automatisch eine Lizenz beziehen“.

Standardmäßig wird die Lizenz laut Leitfaden „beim Booten der VM ausgecheckt und beim Herunterfahren der VM freigegeben“, das Token gehört also in das Golden Image eines Desktop-Pools oder in die Vorlage der Compute-VMs, und eine neue VM lizenziert sich beim ersten Start selbst. Die Unterschiede zwischen vGPU und Passthrough auf ESXi behandelt unser Leitfaden zu GPUs in VMware vSphere, per Passthrough oder vGPU.

DLS-Hochverfügbarkeit und die Ports zwischen den Knoten

Das Benutzerhandbuch hält fest, dass „Hochverfügbarkeit mindestens zwei DLS-Instanzen in einer Failover-Konfiguration erfordert“, mit einer primären Instanz, die Lizenzen ausgibt, und einer oder mehreren sekundären als deren Backup. Ein Cluster umfasst höchstens neun Instanzen, und Cluster mit mehr als zwei Instanzen werden seit vGPU-Software 16.1 unterstützt. Mit nur zwei Instanzen „wird die verbleibende Instanz zum Single Point of Failure“, sobald eine ausfällt; reparieren oder ersetzen Sie den ausgefallenen Knoten also zügig.

Damit Clients einem Failover ohne neues Token folgen, bietet das Handbuch Virtual IP Management, das „bei Failover-Ereignissen automatisch eine Floating-IP-Adresse zwischen den Clusterknoten migriert“. Platzieren Sie die Instanzen auf verschiedenen Hosts. Zwischen den Knoten muss die Firewall die Ports 4369 (Peer Discovery), 5671 (AMQP über TLS) und 8080 bis 8085 (HTTPS) durchlassen, zwischen virtuellen Appliances außerdem 443; die Container-Version nutzt 443 zwischen den Knoten nicht. Clients brauchen nur 443 zum Cluster sowie Port 80, den NVIDIA für die Lizenzfreigabe durch Windows-VMs aufführt. Eine Failover-Zeit haben wir im Handbuch nicht gefunden; testen Sie nach der Einrichtung also einmal ein Failover und notieren Sie, wie lange die Clients brauchen, um ihre Lizenz beim neuen Primärknoten zu erneuern.

Was passiert, wenn der Lizenzserver nicht erreichbar ist

Das dokumentierte Verhalten hängt davon ab, ob die VM je eine Lizenz hatte, und von ihrem Typ: Compute-VMs mit Profilen der C-Serie folgen den Regeln von NVIDIA AI Enterprise, Grafik-VMs denen des Leitfadens zur vGPU-Client-Lizenzierung.

SITUATIONLAUT DOKUMENTATION
Start ohne Lizenzvolle Leistungs­fähigkeit für 20 Minuten
Compute-VM nach 20 Minuten„Rechen­leistung auf Leerlauf­niveau reduziert“, bis lizenziert
Grafik-VM nach 20 Minutengedrosselt, nach 24 Stunden „weiter gedrosselt“
Compute-VM verliert Dienst„7 Tage (CLS-Standard; für DLS konfigurierbar)“, dann gedrosselt
Grafik-VM verliert Dienst„bis zu 1 Tag“, dann „vor dem Ablauf der Lizenz gewarnt“
Lizenz wieder bezogen„Volle Leistungs­fähigkeit wird sofort Wieder­hergestellt“ (Compute)
Primärer DLS fällt aus (HA)eine sekundäre Instanz wird primär und gibt Lizenzen aus
DLS vor 3.4, vGPU 18Lizenzierungs­fehler; zuerst den DLS aktualisieren
Compute auf Bare Metalkein Lizenzserver beteiligt

NVIDIA-AI-Enterprise-Lizenzierungsseite (Infrastructure Release 8, aktualisiert am 2. September 2026); Leitfaden zur vGPU-Client-Lizenzierung, Einführung und fortgeschrittene Themen (aktualisiert am 29. September 2026); Benutzerhandbuch zum NVIDIA License System v3.6.1, Abschnitte 1.1.1 und 1.4.

Der aktuelle Grafik-Leitfaden führt nicht auf, welche Funktionen eingeschränkt werden. Er schreibt, dass ein Client ohne Lizenz „seine Lizenzanfrage an den Lizenzserver regelmäßig wiederholt“, und seine Einführung nennt die zwei Stufen der Drosselung, nach 20 Minuten und nach 24 Stunden. Eine Firewalländerung zwischen den VM-Netzen und dem DLS kann unbemerkt bleiben, solange die Lizenzen reichen, bei Desktops bis zu einem Tag und bei Compute-VMs für den auf dem DLS konfigurierten Zeitraum (sieben Tage sind der CLS-Standard), und trifft dann alle VMs gleichzeitig. Überwachen Sie den Lizenzstatus einer Stichprobe von Clients und das Ereignisprotokoll des DLS, und nehmen Sie die Client-Ports in die Change-Checkliste des Firewall-Teams auf.

Wir liefern NVIDIA-AI-Enterprise- und vGPU-Lizenzen im selben Angebot wie die GPUs, und unser Engineering-Partner Vixen.UNO kann den Lizenzdienst bereitstellen und betreuen. Nennen Sie uns die Zahl der vGPU-VMs je Standort und ob diese das Internet erreichen.

Dimensionierung für 200 bis 1.000 VMs: ein DLS-Cluster oder mehrere

Die Zahl der Clients entscheidet selten über die Zahl der DLS-Instanzen. NVIDIA hat eine Instanz mit 4 vCPU und 8 GB bei 2,6 GHz gemessen, mit Lizenzen, die für 12 Stunden ausgeliehen und nach 15 Prozent dieser Zeit erneuert wurden, und sie bediente bis zu 32.000 Clients; mit 8 vCPU und 16 GB stieg der Wert auf 84.000. Das Handbuch ergänzt: „Die maximale Zahl der Clients ist direkt proportional zur Dauer, für die Lizenzen ausgeliehen werden.“ In NVIDIAs Lastspitzentest bediente dieselbe Instanz mit 4 vCPU 1.000 Clients, die innerhalb von 20 Sekunden eintrafen, in 50 Sekunden, Ergebnisse, die NVIDIA als „nur zur Veranschaulichung“ bezeichnet.

Für eine Umgebung mit 200 bis 1.000 vGPU-VMs trägt die minimale Appliance die Last also mit großem Spielraum, einschließlich des Boot-Sturms eines ganzen Desktop-Pools. Die Zahl der Cluster ergibt sich aus Standorten, Netzwerkzonen und Fehlerdomänen. Nehmen Sie ein Unternehmen mit 600 virtuellen Desktops auf Hosts mit L40S und L4 am Hauptstandort, 150 Desktops an einem zweiten Standort und 24 Compute-VMs auf H200 NVL für einen internen Assistenten. Ein HA-Cluster aus zwei Instanzen am Hauptstandort hinter einer virtuellen IP bedient alle 774 VMs. Der zweite Standort hängt dann für seine Lizenzen an der WAN-Verbindung, und seine Desktops laufen bis zu einem Tag weiter, wenn die Verbindung ausfällt.

Wo der zweite Standort seine VMs selbstständig lizenzieren muss, etwa als Ausweichstandort eines Notfallplans, geben Sie ihm einen eigenen Cluster. Lizenzen werden im Portal einem Lizenzserver zugewiesen, und jeder Lizenzserver ist an eine Service-Instanz gebunden, jeder Standort hält also seinen eigenen Anteil. Ein Notfallplan, der Desktops an den zweiten Standort verlagert, braucht dort genügend zugewiesene Lizenzen oder eine geänderte Zuweisung, gefolgt von einer neuen Lizenzdatei auf diesem DLS. Die Dimensionierung der Desktops und GPUs selbst behandelt unser Leitfaden zur VDI-GPU-Dimensionierung.

Wir bieten die Lizenzen für jeden Standort zusammen mit den GPUs an, auf denen sie laufen. Beschreiben Sie Ihre Standorte, Desktop-Pools und Compute-VMs im Formular unten, einschließlich jedes Standorts, der seine VMs bei einem Failover selbstständig lizenzieren muss.

Verlängerungen, Upgrades und die dreijährige Lizenzdatei

Ab NLS-Release 3.4 „haben die an eine DLS-SI gebundenen Lizenzserverdateien eine Gültigkeit von drei Jahren“, gerechnet ab dem Download; das Portal zeigt die Gültigkeit in den Details des Lizenzservers. Führen Sie dieses Datum im selben Kalender wie die Verlängerungen der Abonnements. Ein verlängertes Abonnement ändert die Berechtigung im Portal, und ein DLS erfährt davon erst, wenn Sie die Lizenzdatei erneut herunterladen und installieren.

NVIDIAs Voraussetzungen für vGPU 18 und neuer verlangen, den Lizenzserver „auf mindestens Version DLS 3.4“ zu aktualisieren, bevor vGPU auf 18.0 oder neuer aktualisiert wird, und danach eine neue Lizenzserverdatei herunterzuladen und auf der aktualisierten Appliance zu installieren. Eine DLS-Appliance wird durch Migration auf eine neue aktualisiert: Die Lizenzserver, die Benutzerregistrierung, die IP-Adresse und die Service-Instanz werden übernommen, die Ereignisdatensätze auf der alten Appliance dagegen nicht migriert. Wenn Sie die Ereignisdatensätze für Berichte zur Lizenznutzung verwenden, sichern Sie das Benötigte vor der Migration. Planen Sie das DLS-Upgrade als eigene Änderung in einem vereinbarten Wartungsfenster mit Rollback-Plan, vor dem Upgrade der Host- und Gasttreiber.

Was wir liefern

Wir liefern NVIDIA-AI-Enterprise-Lizenzen für Compute-vGPU sowie die Lizenzen RTX vWS, vPC und vApps für Grafik, unter einem EU-Vertrag und auf einer Rechnung mit den GPUs, auf denen sie laufen, und wir dimensionieren sie zusammen mit der Hardware, sodass die Lizenzpositionen im Angebot stehen. Wir liefern die L4, L40S und H200 NVL aus dem Beispiel oben und die RTX PRO 6000 Server Edition mit Herstellergarantie, als Karten oder in auf Bestellung gebauten KI-Servern. Unsere Seite zu NVIDIA-AI-Enterprise- und vGPU-Lizenzen erklärt, wie jede Lizenz gezählt wird, und das gesamte Kartensortiment steht auf unserer Seite zu professionellen NVIDIA-GPUs. Wenn Sie es wünschen, plant, implementiert und betreut unser Engineering-Partner Vixen.UNO den Aufbau unter demselben Vertrag.

FAQ

Was ist der NVIDIA-Lizenzserver?
Er ist eine Service-Instanz des NVIDIA License System, die vGPU- und NVIDIA-AI-Enterprise-Lizenzen an virtuelle Maschinen ausgibt. Er läuft entweder als Instanz des Cloud License Service (CLS) auf dem NVIDIA Licensing Portal oder als Instanz des Delegated License Service (DLS), einer virtuellen Appliance oder einem Container in Ihrem eigenen Netz. Laut NVIDIA braucht AI Enterprise ihn nur für Treiber von vGPU for Compute, Server mit Modellen auf Bare Metal oder in Containern nutzen ihn also nicht, während RTX-vWS-Grafik auf GPUs im Passthrough oder auf Bare Metal über ihn lizenziert wird.
NVIDIA DLS vs CLS: was ist der Unterschied?
Eine CLS-Instanz wird von NVIDIA auf seinem Licensing Portal gehostet, und die Clients erreichen sie über ausgehenden Port 443. Eine DLS-Instanz läuft im eigenen Haus, braucht mindestens 4 vCPU, 8 GB RAM und 15 GB Festplatte und erhält ihre Lizenzen als Datei, die Sie aus dem Portal herunterladen und von Hand hochladen. DLS funktioniert an Air-Gapped-Standorten und unterstützt Hochverfügbarkeitscluster aus zwei bis neun Instanzen.
Wie richte ich einen NVIDIA DLS als vGPU-Lizenzserver ein?
Stellen Sie die Appliance bereit, registrieren Sie das DLS-Administratorkonto, legen Sie im NVIDIA Licensing Portal einen Lizenzserver an und registrieren Sie dort die DLS-Instanz mit ihrem Instanztoken. Binden Sie dann den Lizenzserver an die Instanz, installieren Sie die Lizenzdatei auf der Appliance und erzeugen Sie ein Client-Konfigurationstoken. Kopieren Sie das Token auf jeden Client und starten Sie dessen Lizenzierungsdienst neu.
Wohin kommt das NVIDIA-Client-Konfigurationstoken?
Der Ort hängt vom Gastbetriebssystem ab: Unter Linux kommt es nach /etc/nvidia/ClientConfigToken, mit dem Parameter FeatureType in /etc/nvidia/gridd.conf und einem Neustart des Dienstes nvidia-gridd. Auf Windows-Gästen kommt es in den Ordner ClientConfigToken des Verzeichnisses NVIDIA vGPU Licensing, gefolgt von einem Neustart des Dienstes NvDisplayContainer. Steht es im Golden Image oder in der VM-Vorlage, lizenzieren sich neue VMs beim ersten Start selbst.
Was passiert mit einer vGPU-VM ohne Lizenz (unlizenziert)?
Eine VM, die ohne Lizenz startet, läuft 20 Minuten mit voller Leistungsfähigkeit. Bei einer Compute-VM mit einem Profil der C-Serie fällt die Rechenleistung dann auf Leerlaufniveau, bis sie eine Lizenz bezieht, während eine Grafik-VM gedrosselt und nach 24 Stunden weiter gedrosselt wird. Eine lizenzierte Compute-VM, die den Lizenzserver verliert, arbeitet bei CLS standardmäßig 7 Tage weiter, ein Zeitraum, der auf einem DLS konfigurierbar ist, und laut NVIDIA kehrt die volle Leistungsfähigkeit sofort zurück, sobald eine Lizenz bezogen wird.
Wie viele VMs kann eine NVIDIA-DLS-Instanz bedienen?
In NVIDIAs Messungen bediente eine DLS-Instanz mit 4 vCPU und 8 GB RAM bei einer Ausleihdauer von 12 Stunden bis zu 32.000 Clients, mit 8 vCPU und 16 GB bis zu 84.000. Eine Umgebung mit 200 bis 1.000 vGPU-VMs passt daher auf die minimale Appliance. Planen Sie die Zahl der DLS-Cluster nach Standort und Fehlerdomäne, mit mindestens zwei Instanzen in jedem für Hochverfügbarkeit.

Schicken Sie uns die Zahl der vGPU-VMs und virtuellen Desktops je Standort, die GPUs und den Hypervisor und ob die VMs das Internet erreichen dürfen. Wir antworten innerhalb eines Werktages mit den Lizenzen, die Ihr Aufbau braucht, und einem schriftlichen Angebot dafür zusammen mit den GPUs.

Mit einem Experten sprechen
Mit einem Experten sprechen

Wir antworten innerhalb eines Werktages

Mit dem Absenden stimmen Sie zu, dass wir Ihre Angaben zur Beantwortung Ihrer Anfrage verarbeiten; siehe unsere Datenschutzerklärung.

request@eurokommerz.at
Jordangasse 7, 1010 Wien