NVIDIA DGX Spark
Gunakan ini untuk membezakan konfigurasi berbeza dalam troli anda — berguna jika anda memesan produk sama dengan pilihan berbeza.
Spesifikasi Penuh
Pengiraan & Memori
Cip
NVIDIA GB10 Grace Blackwell Superchip
CPU
20-teras Arm (10 × Cortex-X925 + 10 × Cortex-A725)
Memori Bersepadu
128 GB LPDDR5x (273 GB/s lebar jalur)
Prestasi AI
1 PetaFLOP (FP4)
Storan & Fizikal
Storan
4 TB NVMe SSD, penyulitan sendiri (PCIe Gen4)
Dimensi
150 x 150 x 50.5 mm
Berat
1.2 kg
Output Paparan
Sehingga 3 paparan serentak (HDMI + USB4 DisplayPort alt-mode)
Kuasa & Rangkaian
Bekalan Kuasa
Penyesuai 240 W USB-C PD
Rangkaian
NVIDIA ConnectX-7 Smart NIC, dual 200 Gbps QSFP + 10 GbE RJ-45
Wayarles
Wi-Fi 7, Bluetooth 5.4
Perisian & Keselamatan
Sistem Pengendalian
NVIDIA DGX OS (Ubuntu 24.04 LTS), timbunan AI CUDA penuh dipasang prapasang
AI Agen
Rangka kerja agen berpetak NemoClaw disertakan
Keselamatan
TPM 2.0, Secure Boot, SSD penyulitan sendiri
NVIDIA DGX Spark ialah sistem desktop rujukan untuk NVIDIA GB10 Grace Blackwell Superchip, pertama kali dipamerkan secara umum pada Januari 2025 di bawah nama kerja Project DIGITS sebelum dihantar dengan nama akhirnya. Sebagai platform yang direka, divalidasi dan terus dikemaskini secara langsung oleh NVIDIA sendiri, ia membungkus 1 petaFLOP prestasi AI FP4 dan 128 GB memori bersepadu koheren dalam selungkup 1.2 kg yang cukup kecil untuk diletakkan di atas meja sebelah papan kekunci.
Oleh kerana DGX Spark ialah reka bentuk rujukan NVIDIA sendiri, ia juga platform di mana keupayaan ekosistem GB10 baharu divalidasi terlebih dahulu. Berikutan persidangan GTC 2026 NVIDIA pada akhir Mac 2026, sokongan rasmi untuk pengeklusteran RoCE 4-nod — meningkatkan satu penyebaran kepada 512 GB memori bersepadu kongsi — disahkan pada DGX Spark sebelum diadaptasi oleh perkakasan rakan kongsi, bersama-sama keupayaan pautan langsung 2-unit yang sudah menjadi standard dalam barisan GB10.
Spesifikasi Perkakasan
Di terasnya ialah NVIDIA GB10 Grace Blackwell Superchip, menggabungkan pemproses Arm 20-teras (10 × teras prestasi Cortex-X925 + 10 × teras kecekapan Cortex-A725) dengan GPU generasi Blackwell yang mempunyai Tensor Core generasi kelima dan sokongan kekerapan FP4 asli. Kedua-duanya dihubungkan oleh memori bersepadu 128 GB LPDDR5x yang menyampaikan lebar jalur koheren 273 GB/s dikongsi antara CPU dan GPU, menghapuskan overhead salinan yang biasanya diperkenalkan oleh kolam memori CPU/GPU berasingan. Storannya ialah SSD PCIe Gen4 NVMe menyulitkan sendiri 4 TB, bersaiz untuk menyimpan titik semak model besar dan set data secara tempatan.
Perisian: Timbalan AI NVIDIA Penuh, Diprapasang
DGX Spark dihantar dengan NVIDIA DGX OS (Ubuntu 24.04 LTS) dan timbalan perisian AI NVIDIA lengkap diprapasang dan divalidasi untuk perkakasan — CUDA, cuDNN, TensorRT dan NVIDIA Container Runtime sedia pada but pertama. Mikroperkhidmatan NVIDIA NIM membolehkan model disokong disebarkan sebagai kontena inferens dioptimumkan tanpa penyetelan manual, dan kontena sama diteruskan tanpa perubahan apabila beban kerja kemudiannya dipindahkan ke NVIDIA DGX Cloud atau sistem DGX pusat data. Satu set buku panduan rasmi yang dikekalkan secara berterusan meliputi aliran kerja biasa — dari penyajian vLLM dan TensorRT-LLM hingga penyetelan halus dengan NeMo dan Unsloth — mengurangkan masa penyediaan untuk pengguna kali pertama dan maju.
Untuk beban kerja AI agen, DGX Spark termasuk NemoClaw, lapangan pelaksanaan agen berpetak NVIDIA. Ia menguatkuasakan kawalan akses berasaskan polisi di sekitar agen autonomi, log tindakan mereka untuk tujuan audit, dan telah dioptimumkan untuk menyampaikan inferens agen tempatan lebih pantas secara boleh diukur dalam kemas kini DGX OS terkini.
Sambungan & Rangkaian
Rangkaian dibina di sekitar NVIDIA ConnectX-7 Smart NIC dengan dwi-port QSFP 200 Gbps, digunakan untuk pautan terus unit-ke-unit atau, dalam penyebaran lebih besar, sambungan ke fabrik suis RoCE terurus. Sambungan onboard tambahan merangkumi Ethernet 10 GbE (RJ-45), Wi-Fi 7 dan Bluetooth 5.4. Empat port USB4 Type-C menyokong output DisplayPort untuk penggunaan multi-monitor tempatan — sehingga tiga paparan serentak — bersama HDMI, membolehkan unit sama berfungsi sebagai kedua-dua stesen kerja pembangunan dan pelayan inferens sentiasa hidup.
Pengurusan Perusahaan & Keselamatan
DGX Spark menyokong penyebaran terpencil udara untuk persekitaran tanpa sambungan internet, termasuk penciptaan ISO tersuai melalui Cloud-init dan kemas kini OS serta pemacu berasaskan USB — membolehkan armada dibekalkan dan dikekalkan tanpa pergantungan rangkaian luaran. Storannya menyulitkan sendiri secara lalai, dan platform ini termasuk TPM 2.0 dan Secure Boot, memberikan asas keselamatan sesuai untuk penyebaran teratur sensitif data di mana pemprosesan mesti kekal sepenuhnya di premis.
Penskalaan: Konfigurasi Tunggal, 2-Unit dan 4-Unit
Satu unit DGX Spark menyajikan model sehingga kira-kira 200 bilion parameter secara tempatan dengan selesa. Untuk model lebih besar, dua unit dipautkan terus melalui port QSFP ConnectX-7 menjadi kumpulan memori bersepadu gabungan 256 GB, dan sehingga empat unit boleh disambungkan melalui fabrik suis RoCE 200 GbE terurus untuk kumpulan koheren 512 GB — laluan pengeklusteran sama yang divalidasi NVIDIA di GTC 2026.
| Konfigurasi | Jumlah Memori Bersepadu | Pautan | Parameter Model Maks |
|---|---|---|---|
| Unit tunggal | 128 GB | T/A | ~200B |
| Kluster 2-Unit | 256 GB | DAC QSFP Langsung, 200 Gbps | ~400B |
| Kluster 4-Unit | 512 GB | Fabrik suis RoCE 200 GbE terurus | 700B+ |
Ekosistem & Laluan Penskalaan Jangka Panjang
Oleh kerana DGX Spark menjalankan DGX OS dan timbalan perisian AI NVIDIA sama yang digunakan di seluruh NVIDIA DGX Cloud dan sistem DGX pusat data, beban kerja dibangunkan secara tempatan — kontena, penyebaran NIM, saluran penyetelan halus — diteruskan tanpa pengubahsuaian apabila tiba masanya untuk berpindah dari prototaip desktop ke penyebaran pengeluaran lebih besar.









