NVIDIA DGX Spark,
geliefert in Europa
Eine 1,2 kg schwere Desktop-Maschine mit 128 GB Speicher, den sich CPU und GPU teilen. Sie lädt Modelle, die auf eine Workstation-Karte nicht passen, und sie ist ehrlich beim Tempo. Ein Gerät oder mehrere, unter einem europäischen Vertrag, fakturiert aus Wien.
Jede Zahl unten stammt von NVIDIAs eigener Produktseite, dem User Guide oder dem Quick Start Guide. Preise stehen hier nicht, weil Konfiguration und Lizenzen die Zahl bestimmen – Sie bekommen stattdessen ein schriftliches Angebot.
| Merkmal | DGX Spark | Was das in der Praxis heißt |
|---|---|---|
| Superchip | GB10 Grace Blackwell: 20 Arm-Kerne (10 × Cortex-X925, 10 × Cortex-A725) und eine Blackwell-GPU mit Tensor-Kernen der 5. Generation | Ein Chip, nicht CPU plus Karte. Kein PCIe-Steckplatz zu füllen, nichts zu konfigurieren |
| Speicher | 128 GB LPDDR5X, kohärent und vereinheitlicht, 256 Bit, 273 GB/s | CPU und GPU teilen sich einen Pool. Es gibt keine separate VRAM-Zahl, die man mit einer Grafikkarte vergleichen könnte |
| Rechenleistung | Bis zu 1 PFLOP bei FP4 | NVIDIAs eigene Fußnote sagt: mit Sparsity. Eine dichte Zahl veröffentlicht NVIDIA nicht |
| Speichermedium | 1 TB oder 4 TB selbstverschlüsselnde NVMe M.2 | Modellgewichte sind groß. Die 4-TB-Variante ist die, bei der die meisten landen |
| Netzwerk | ConnectX-7 mit zwei QSFP-Ports zu je 200 Gb/s, dazu 10 GbE RJ-45 und Wi-Fi 7 | Über die QSFP-Ports werden zwei oder mehr Geräte gekoppelt – das ist kein Nebenschauplatz |
| Strom | 240 W Netzteil; NVIDIAs eigene Erklärung misst 233,2 W maximal und 38,0 W im Leerlauf an der Steckdose | Sie steckt in einer Schreibtischsteckdose. Kein Rack, kein Drehstrom, keine Raumplanung |
| Maße und Gewicht | 150 × 150 × 50,5 mm, 1,2 kg | Kleiner als die meisten Mini-PCs. Betriebsbereich 5 bis 30 °C |
| Software | NVIDIA DGX OS, CUDA, die DGX-Spark-Playbooks | Dasselbe CUDA, das Sie ohnehin schreiben. Arm – also jede reine Binärabhängigkeit prüfen |
Auf Bestellung, ein Gerät oder mehrere. Die Lieferzeit wird mit jedem Angebot bestätigt.
Ein Spark ist ein guter Auftrag
Sie brauchen kein Projekt, kein Lizenzpaket und keinen Engineering-Vertrag, um bei uns zu kaufen. Ein Gerät für einen Entwickler oder gleich vier für ein Team, in jeder Stückzahl: wir bieten genau das an, was Sie anfragen, zu einem wettbewerbsfähigen Preis, fakturiert in der EU. Die Lösungen gibt es, wenn Sie sie wollen – sie sind keine Kaufbedingung.
Ein Vertragspartner in Wien. Kein grenzüberschreitender Einkauf, kein Import, den Sie selbst abwickeln.
Wenn eine Karte eine Lizenz braucht, um das zu tun, wofür Sie sie gekauft haben, steht sie im Angebot – und fällt nicht erst nach drei Monaten auf.
Unser Partner Vixen.UNO plant, implementiert und betreut. Unter demselben Vertrag – oder gar nicht. Ihre Entscheidung.
Herstellergarantie läuft über uns, Support gemeinsam mit dem Team, das das System betreibt.
NVIDIA nennt Inferenz für Modelle bis 200 Milliarden Parameter. Rechnen Sie nach, bevor Sie damit planen: 200 Milliarden Parameter zu je einem halben Byte sind 100 GB – die Aussage ist also eine 4-Bit-Aussage. In BF16 fasst dieselbe Box rund 55 Milliarden. Beides stimmt, es ist nur nicht derselbe Satz.
Zur vollständigen Analyse →Jedes Token muss die Gewichte durch 273 GB/s lesen. Ein dichtes 70B in FP8 wurde mit 2,7 Token pro Sekunde bei einem Nutzer gemessen. Für einen Entwickler, der an Prompts feilt, reicht das. Für zwanzig Leute an einem Chat-Assistenten nicht.
Zur vollständigen Analyse →Verbreitet ist die Annahme, bei zwei sei Schluss. NVIDIAs eigener User Guide nennt bis zu drei direkt per Kabel und bis zu vier über einen Switch. Gemessen liegt ein direkter 200-GbE-Link bei rund 190 Gb/s über beide Ports.
Zur vollständigen Analyse →Wie viel der 128 GB kann ein Modell wirklich nutzen?
Läuft darauf wirklich ein Modell mit 200 Milliarden Parametern?
Was lässt sich auf einem Gerät feinabstimmen?
Lassen sich mehr als zwei koppeln?
Ist NVIDIA AI Enterprise enthalten?
Wer stellt die Rechnung, und wie läuft die Garantie?
Die Rechnung hinter der 200B-Aussage, was jede Genauigkeit kostet und was sich auf einem Gerät feinabstimmen lässt.
Artikel lesen →Gemessene Token-Raten, die 273-GB/s-Grenze und der Abstand zwischen Folie und Realität.
Artikel lesen →Drei Wege zu starten und die vier Fragen, die entscheiden, welcher Ihrer ist.
Artikel lesen →Wir antworten innerhalb eines Werktages