NVIDIA DGX SPARK · LIEFERUNG IN DER EU

NVIDIA DGX Spark,
geliefert in Europa

Eine 1,2 kg schwere Desktop-Maschine mit 128 GB Speicher, den sich CPU und GPU teilen. Sie lädt Modelle, die auf eine Workstation-Karte nicht passen, und sie ist ehrlich beim Tempo. Ein Gerät oder mehrere, unter einem europäischen Vertrag, fakturiert aus Wien.

AUF BESTELLUNG
Was wirklich in der Box steckt

Jede Zahl unten stammt von NVIDIAs eigener Produktseite, dem User Guide oder dem Quick Start Guide. Preise stehen hier nicht, weil Konfiguration und Lizenzen die Zahl bestimmen – Sie bekommen stattdessen ein schriftliches Angebot.

MerkmalDGX SparkWas das in der Praxis heißt
SuperchipGB10 Grace Blackwell: 20 Arm-Kerne (10 × Cortex-X925, 10 × Cortex-A725) und eine Blackwell-GPU mit Tensor-Kernen der 5. GenerationEin Chip, nicht CPU plus Karte. Kein PCIe-Steckplatz zu füllen, nichts zu konfigurieren
Speicher128 GB LPDDR5X, kohärent und vereinheitlicht, 256 Bit, 273 GB/sCPU und GPU teilen sich einen Pool. Es gibt keine separate VRAM-Zahl, die man mit einer Grafikkarte vergleichen könnte
RechenleistungBis zu 1 PFLOP bei FP4NVIDIAs eigene Fußnote sagt: mit Sparsity. Eine dichte Zahl veröffentlicht NVIDIA nicht
Speichermedium1 TB oder 4 TB selbstverschlüsselnde NVMe M.2Modellgewichte sind groß. Die 4-TB-Variante ist die, bei der die meisten landen
NetzwerkConnectX-7 mit zwei QSFP-Ports zu je 200 Gb/s, dazu 10 GbE RJ-45 und Wi-Fi 7Über die QSFP-Ports werden zwei oder mehr Geräte gekoppelt – das ist kein Nebenschauplatz
Strom240 W Netzteil; NVIDIAs eigene Erklärung misst 233,2 W maximal und 38,0 W im Leerlauf an der SteckdoseSie steckt in einer Schreibtischsteckdose. Kein Rack, kein Drehstrom, keine Raumplanung
Maße und Gewicht150 × 150 × 50,5 mm, 1,2 kgKleiner als die meisten Mini-PCs. Betriebsbereich 5 bis 30 °C
SoftwareNVIDIA DGX OS, CUDA, die DGX-Spark-PlaybooksDasselbe CUDA, das Sie ohnehin schreiben. Arm – also jede reine Binärabhängigkeit prüfen

Auf Bestellung, ein Gerät oder mehrere. Die Lieferzeit wird mit jedem Angebot bestätigt.

NUR DIE HARDWARE?

Ein Spark ist ein guter Auftrag

Sie brauchen kein Projekt, kein Lizenzpaket und keinen Engineering-Vertrag, um bei uns zu kaufen. Ein Gerät für einen Entwickler oder gleich vier für ein Team, in jeder Stückzahl: wir bieten genau das an, was Sie anfragen, zu einem wettbewerbsfähigen Preis, fakturiert in der EU. Die Lösungen gibt es, wenn Sie sie wollen – sie sind keine Kaufbedingung.

WAS DAZUGEHÖRT
Nicht nur ein Karton auf der Palette
EU-Vertrag und Rechnung

Ein Vertragspartner in Wien. Kein grenzüberschreitender Einkauf, kein Import, den Sie selbst abwickeln.

Lizenzen gemeinsam mit der Hardware

Wenn eine Karte eine Lizenz braucht, um das zu tun, wofür Sie sie gekauft haben, steht sie im Angebot – und fällt nicht erst nach drei Monaten auf.

Engineering, wenn Sie es wollen

Unser Partner Vixen.UNO plant, implementiert und betreut. Unter demselben Vertrag – oder gar nicht. Ihre Entscheidung.

Garantie und Support

Herstellergarantie läuft über uns, Support gemeinsam mit dem Team, das das System betreibt.

DIE RICHTIGE WAHL
Welche passt zu Ihnen
Was tatsächlich in 128 GB passt

NVIDIA nennt Inferenz für Modelle bis 200 Milliarden Parameter. Rechnen Sie nach, bevor Sie damit planen: 200 Milliarden Parameter zu je einem halben Byte sind 100 GB – die Aussage ist also eine 4-Bit-Aussage. In BF16 fasst dieselbe Box rund 55 Milliarden. Beides stimmt, es ist nur nicht derselbe Satz.

Zur vollständigen Analyse →
Kapazität ist echt, Durchsatz hat eine Grenze

Jedes Token muss die Gewichte durch 273 GB/s lesen. Ein dichtes 70B in FP8 wurde mit 2,7 Token pro Sekunde bei einem Nutzer gemessen. Für einen Entwickler, der an Prompts feilt, reicht das. Für zwanzig Leute an einem Chat-Assistenten nicht.

Zur vollständigen Analyse →
Mehr als zwei Geräte sind vorgesehen

Verbreitet ist die Annahme, bei zwei sei Schluss. NVIDIAs eigener User Guide nennt bis zu drei direkt per Kabel und bis zu vier über einen Switch. Gemessen liegt ein direkter 200-GbE-Link bei rund 190 Gb/s über beide Ports.

Zur vollständigen Analyse →
FAQ
DGX Spark, kurz gefasst
Wie viel der 128 GB kann ein Modell wirklich nutzen?
NVIDIA veröffentlicht keine Zahl dafür, und auf dieser Plattform kann nvidia-smi den GPU-Speicher gar nicht melden. Die ehrliche Antwort steht in NVIDIAs eigenen Playbooks: Standard ist 0,8 des Pools für vLLM und 0,8 bis 0,9 für TensorRT-LLM. Rechnen Sie mit rund 100 bis 115 GB für Gewichte und KV-Cache zusammen, der Rest gehört dem Betriebssystem.
Läuft darauf wirklich ein Modell mit 200 Milliarden Parametern?
Ja, in 4 Bit. NVIDIA nennt Inferenz bis 200 Milliarden Parameter, und die eigene Liste geprüfter Modelle enthält GPT-OSS-120B und Llama-3.3-70B in 4-Bit-Formaten. Ein 235B-Mixture-of-Experts ist in derselben Tabelle als Multi-Node markiert – das zeigt, wo die Grenze für ein einzelnes Gerät liegt.
Was lässt sich auf einem Gerät feinabstimmen?
NVIDIA nennt bis zu 70 Milliarden Parameter, und das Playbook zeigt, welche Methode dorthin führt: volles Fine-Tuning bei 3B, LoRA bei 8B, QLoRA bei 70B. Die Skripte heißen genau so – das ist also keine Auslegung von uns.
Lassen sich mehr als zwei koppeln?
Bis zu drei direkt über QSFP-Kabel und bis zu vier über einen Switch, laut NVIDIAs Clustering-Guide. Die Kabel sind mit Teilenummern angegeben, das ist also eine unterstützte Konfiguration und kein Bastelweg.
Ist NVIDIA AI Enterprise enthalten?
Nicht automatisch. Ein Anspruch besteht nur, wenn Sie es gekauft, eine Evaluierung angefordert oder ein Entitlement-Zertifikat erhalten haben. Wenn Sie es brauchen, steht es bei uns zusammen mit der Hardware im Angebot – und fällt nicht erst nach drei Monaten auf.
Wer stellt die Rechnung, und wie läuft die Garantie?
Eurokommerz in Wien. Ein EU-Vertragspartner, kein Import für Sie, Herstellergarantie über uns.
Preis und Verfügbarkeit anfragen

Wir antworten innerhalb eines Werktages

Mit dem Absenden stimmen Sie zu, dass wir Ihre Angaben zur Beantwortung Ihrer Anfrage verarbeiten – siehe unsere Datenschutzerklärung.

request@eurokommerz.at  ·  +43 1 585 1405 50  ·  Jordangasse 7, 1010 Wien