BLOG

Guides zu KI-Infrastruktur
& Enterprise-IT

Praxisguides unseres Engineering-Teams – Benchmarks, Sizing-Formeln und ehrliche Vergleiche.

COMPARISON · SEPTEMBER 2026
DGX Spark, RTX PRO 6000 oder H200 NVL zum Start

Vier Fragen entscheiden: Modellgröße, gleichzeitige Nutzer, Standort der Maschine und was nach dem Pilot kommt. 273 GB/s gegen 1.597 und 4.800.

Artikel lesen →
GUIDE · SEPTEMBER 2026
Was in 128 GB auf einem DGX Spark passt

Keine VRAM-Zahl, ein gemeinsamer Pool: was der Speicher bei BF16, FP8 und FP4 wirklich fasst und was ein Gerät feinabstimmen kann.

Artikel lesen →
GUIDE · SEPTEMBER 2026
Wie viele Nutzer eine RTX PRO 6000 bedient

Der Hersteller nennt keine Token pro Sekunde für diese Karte. Die KV-Cache-Rechnung, die 1.597 GB/s der Server Edition und wie Sie selbst messen.

Artikel lesen →
GUIDE · SEPTEMBER 2026
H200 NVL in einen vorhandenen Server einbauen

Steckplatz, Sense-Pin, Kühlung, Supportliste, NVLink und Lizenz: die Prüfungen vor der Bestellung.

Artikel lesen →
GUIDE · SEPTEMBER 2026
Backup ist kein Disaster Recovery

Ein gelaufener Backup-Job belegt den RPO, nicht den RTO. Was beim Restore fehlt und was bewiesene Wiederherstellung zeigen muss.

Artikel lesen →
GUIDE · SEPTEMBER 2026
Fine-Tuning oder RAG: was wofür, und was es kostet

RAG ändert die Eingabe, Fine-Tuning die Gewichte. Was jedes löst und was volles Tuning, LoRA und QLoRA an VRAM kosten.

Artikel lesen →
GUIDE · SEPTEMBER 2026
Immutable Backup: wovor es wirklich schützt

Wie Hardened Repository und Object Lock arbeiten, welche Angriffe Immutability stoppt und welche nicht, und wie lang die Frist sein sollte.

Artikel lesen →
GUIDE · SEPTEMBER 2026
VMware-Verlängerung 2026: Standard, VVF oder VCF

Standard und Enterprise Plus enden bei vSphere 8 U3: was jede Stufe freischaltet, die Regeln pro Kern, die vSAN-Kontingente und die Fallen.

Artikel lesen →
COMPARISON · SEPTEMBER 2026
DGX B300 oder ein Server mit acht RTX PRO 6000

2,1 TB HBM3e mit NVLink oder 768 GB GDDR7 über PCIe: Speicherrechnung, MLPerf v6.0 und wofür jede Maschine wirklich gebaut ist.

Artikel lesen →
COMPARISON · SEPTEMBER 2026
RTX PRO 6000, 5000 oder 4500 Blackwell: welche Karte

96, 72, 48, 32 oder 24 GB: Speicher, Bandbreite, MIG und vGPU je Karte, welches Modell wohin passt und warum CAD die große nicht braucht.

Artikel lesen →
GUIDE · SEPTEMBER 2026
NVIDIA AI Enterprise: was die Lizenz enthält

Pro GPU statt pro VM: wie gezählt wird, was bei H100 NVL und H200 NVL dabei ist, wann vGPU sie braucht und was ohne sie läuft.

Artikel lesen →
GUIDE · SEPTEMBER 2026
GPU-Server für ein 70B-Modell: ein Rechenbeispiel

Llama 3.3 70B, dreißig Nutzer, 8k Kontext: die Speicherrechnung, warum eine 96-GB-Karte nur in FP4 gerade so reicht, und der Server um die Karte herum.

Artikel lesen →
GUIDE · SEPTEMBER 2026
Flüssigkühlung für GPU-Racks mit 50 bis 120 kW

Wo Luft endet, was Rear-Door-Wärmetauscher, Kaltplatten und Immersion jeweils tragen, ASHRAE-Wasserklassen, Durchfluss und was ein Umbau wirklich bedeutet.

Artikel lesen →
GUIDE · SEPTEMBER 2026
Wie viele GPUs in einen Server passen: Lanes, Strom, Luft

Warum ein 2U vier 350-W-Karten nimmt, aber nur zwei mit 600 W, wo PCIe-Switches ins Spiel kommen, und die eine Zahl, die die meisten Bestellungen stoppt.

Artikel lesen →
HARDWARE-REVIEW · SEPTEMBER 2026
DGX Spark: zwei Knoten zusammen, und mehr als LLMs

Wie zwei Geräte verbunden werden, gemessene Token-Raten im Verbund, Bild- und Videogenerierung, Fine-Tuning und die ehrliche Antwort zum Gaming.

Artikel lesen →
VERGLEICH · SEPTEMBER 2026
RTX PRO 6000 vs. H200 NVL für LLM-Inferenz

96 GB GDDR7 mit FP4 oder 141 GB HBM3e mit NVLink: Modellgrößen, die Bandbreitenrechnung hinter Token pro Sekunde und die MLPerf-Zahlen.

Artikel lesen →
VERGLEICH · SEPTEMBER 2026
L40S vs. RTX PRO 6000 Server Edition: wo Ada noch gewinnt

48 GB bei 350 W gegen 96 GB bei bis zu 600 W: Speicher, MIG, vGPU-Plätze, Server-Passung und die Fälle, in denen die ältere Karte die richtige Bestellung ist.

Artikel lesen →
GUIDE · SEPTEMBER 2026
RAG auf Unternehmensdaten: was es braucht, wo es scheitert

Fast jeder Fehler ist ein Such-Fehler. Berechtigungen beim Abruf, sinnerhaltende Zerlegung und der Testsatz, den niemand baut.

Artikel lesen →
GUIDE · SEPTEMBER 2026
Privates LLM oder Cloud-API: was ist günstiger?

Der Break-even ist eine Mengenfrage. Die vier Kostenpositionen, die niemand rechnet – und wann die Datenlage vorher entscheidet.

Artikel lesen →
GUIDE · SEPTEMBER 2026
RPO und RTO: die Zahlen wählen statt abschreiben

Warum die Kosten nahe null steil steigen, wie man Systeme in Stufen einteilt – und die Abhängigkeitsreihenfolge, die Pläne ruiniert.

Artikel lesen →
GUIDE · SEPTEMBER 2026
Wo in einer vSphere-Umgebung die Verschwendung sitzt

Überdimensionierte VMs, vergessene Maschinen, alte Snapshots – und warum mehr vCPU eine VM oft langsamer macht.

Artikel lesen →
GUIDE · SEPTEMBER 2026
VMware-Lizenzierung nach der Broadcom-Umstellung

Wie Kerne gezählt werden, was die 16-Kern-Regel mit kleinen Clustern macht, was hinter der 72-Kern-Meldung steckte.

Artikel lesen →
GUIDE · AUGUST 2026
Strom und Kühlung für ein GPU-Rack

Dichtewerte pro Rack, die Luftmengen-Rechnung, wo Luftkühlung endet – und die vier Prüfungen vor der Lieferung.

Artikel lesen →
HARDWARE-REVIEW · AUGUST 2026
NVIDIA DGX Spark: echte Benchmarks und Grenzen

Gemessene Token-Raten, das 273-GB/s-Limit, Batch-Serving-Ergebnisse und Zwei-Knoten-Betrieb.

Artikel lesen →
GUIDE · AUGUST 2026
Nutanix und GPUs: ein KI-Cluster richtig geplant

Welche NX-Knoten GPUs aufnehmen, wie MIG und vGPU teilen, was auf AHV funktioniert.

Artikel lesen →
VERGLEICH · JULI 2026
RTX PRO 6000: Workstation, Max-Q und Server Edition

Ein Chip, drei Karten: die komplette Vergleichstabelle, die NVIDIA nie an einem Ort veröffentlicht hat.

Artikel lesen →
GUIDE · JULI 2026
MIG und vGPU: wie viele VMs eine Karte wirklich trägt

Hardware-Slices vs. Time-Slicing, Sitzplätze pro Karte für RTX PRO und L40S, Lizenzen.

Artikel lesen →
VERGLEICH · JULI 2026
RTX PRO 6000 Blackwell vs. RTX 6000 Ada

96 vs. 48 GB, FP4 und MIG, die Ada nie hatte – und wann die Vorgängergeneration reicht.

Artikel lesen →
VERGLEICH · JUNI 2026
H200 NVL vs. H100 NVL: wann sich der Aufpreis lohnt

Identische Rechenleistung, der ganze Unterschied im Speicher: wo der Gewinn 3,4× erreicht – und wo null.

Artikel lesen →
GUIDE · JUNI 2026
Wie viel VRAM ein LLM braucht: Formeln und Tabellen

Gewichte, KV-Cache, Overhead und parallele Nutzer – die Formeln für die GPU-Wahl.

Artikel lesen →
Fragen Sie unsere Ingenieure

Sizing, Konfiguration, Angebot – wir antworten innerhalb eines Werktages

Mit dem Absenden stimmen Sie zu, dass wir Ihre Angaben zur Beantwortung Ihrer Anfrage verarbeiten – siehe unsere Datenschutzerklärung.

request@eurokommerz.at  ·  +43 1 585 1405 50  ·  Jordangasse 7, 1010 Wien