NVIDIA DGX Spark: 64-GB-Modell startet am 23. Oktober für 4.999 Dollar
Veröffentlicht am: 05.10.2026 um 08:42 Uhr | Redaktion boerse-global.de
NVIDIA hat ein neues Einstiegsmodell seines KI-Desktopcomputers DGX Spark vorgestellt, das mit 64 GB Arbeitsspeicher ausgestattet ist und ab dem 23. Oktober zu einem Einstiegspreis von 4.999 US-Dollar über Partner wie Acer, ASUS, Dell, Gigabyte, HP und MSI erhältlich sein soll. Zugleich hat das Unternehmen Testergebnisse veröffentlicht, die zeigen, wie sich zwei gekoppelte Geräte bei bestimmten Modellen schlagen.
Gleiche Technik, kleinerer Speicher
Das 64-GB-Modell basiert auf demselben GB10-Grace-Blackwell-Chip, derselben 20-Kern-Arm-CPU sowie dem gleichen DGX-Betriebssystem und KI-Softwarestack wie die bereits etablierte 128-GB-Variante.
Die Speicherbandbreite liegt bei 273 GB/s, die Rechenleistung bei bis zu 1 PetaFLOP FP4. Für die Vernetzung sorgt ein ConnectX-7-Netzwerkadapter mit 200 Gbit/s pro Gerät.
Während die Hardware-Leistung für lokale KI-Anwendungen steigt, wachsen auch die regulatorischen Anforderungen an Unternehmen. Dieser kostenlose Umsetzungsleitfaden bietet einen kompakten Überblick über alle Pflichten und Fristen, die der EU AI Act für den Einsatz von KI-Systemen vorschreibt. EU AI Act in 5 Schritten verstehen
Laut NVIDIA lässt sich auf einem einzelnen Gerät ein Modell mit bis zu rund 100 Milliarden Parametern betreiben. Für lokale Inferenz nennt The Register hingegen einen praxisnäheren Bereich von 26 bis 35 Milliarden Parametern.
Werden zwei Geräte über QSFP und ConnectX-7 verbunden, ergeben sich 128 GB gemeinsamer Speicher, womit Modelle bis 200 Milliarden Parameter möglich werden. Bis zu vier GB10-Geräte lassen sich laut Berichten insgesamt koppeln.
Cluster-Test mit Qwen 3.8 27B
Im Zentrum der aktuellen Ankündigung steht ein von NVIDIA selbst durchgeführter Leistungstest mit dem Modell Qwen 3.8 27B: Zwei gekoppelte DGX-Spark-Geräte erreichten dabei bis zu das 1,7-Fache der Leistung eines einzelnen Geräts. NVIDIA weist allerdings darauf hin, dass dieser Wert kein allgemeingültiger Leistungsfaktor ist, sondern sich auf dieses spezifische Modell und Testszenario bezieht.
Für die Einrichtung solcher Mehrgeräte-Konfigurationen bietet NVIDIA einen Sync Cluster Assistant an. Ein zugehöriger Sync Model Launcher, der speziell für Qwen3.8 27B und OpenCode ausgelegt ist, wurde für Ende Oktober angekündigt. Zum Softwareangebot rund um den DGX Spark zählen zudem das Agent Toolkit, CUDA-X, Nemotron sowie die Frameworks Ollama, vLLM und PyTorch.
Der Einsatz leistungsstarker KI-Systeme erfordert nicht nur technische Ressourcen, sondern auch eine rechtssichere Dokumentation der Risikoklassen. Erfahren Sie in diesem praxisnahen Report, welche konkreten Schritte Unternehmen jetzt unternehmen müssen, um die neuen EU-Regeln einzuhalten. Kostenlosen Umsetzungsleitfaden zum EU AI Act herunterladen
Preisentwicklung beim 128-GB-Modell
Während das neue 64-GB-Modell zum Marktstart bei 4.999 US-Dollar liegt, hat sich der Preis des bereits etablierten 128-GB-Modells deutlich verändert: Es kostet inzwischen 6.950 US-Dollar, nachdem es vor rund einem Jahr zur CES 2025 noch für etwa 3.999 US-Dollar eingeführt worden war – ein Anstieg von rund 75 Prozent.
Als Grund nennt NVIDIA eine begrenzte Speicherverfügbarkeit. Bereits im März 2026 hatte das Unternehmen laut heise.de eine Preiserhöhung mit Speicherengpässen begründet. Im US-Shop von NVIDIA wird das 128-GB-Modell für 6.950 US-Dollar gelistet, ist jedoch laut Bericht derzeit ausverkauft. Eine 128-GB-Variante von ASUS mit 1 TB Speicher kostet 5.999 US-Dollar.
Wer stattdessen zwei 64-GB-Geräte zu einem 128-GB-Cluster verbindet, zahlt zusammen 9.998 US-Dollar beziehungsweise, je nach Quelle, zwischen rund 8.000 und 10.000 US-Dollar – und damit 3.048 US-Dollar mehr als für ein einzelnes 128-GB-Gerät.
Speicheroptionen zwischen 1 TB und 4 TB NVMe können zudem die Partnerpreise beeinflussen; unabhängige Tests und konkrete Partnerpreise lagen zum Zeitpunkt der Berichte noch nicht vor.
Die Entwicklung reiht sich in eine Serie von Preissteigerungen bei speicherintensiver KI-Hardware ein, die unter anderem mit allgemeinen Engpässen bei Speicherbauteilen in Verbindung gebracht werden.
