Supermicro Super AI Station GB300
Gunakan ini untuk membezakan konfigurasi berbeza dalam troli anda — berguna jika anda memesan produk sama dengan pilihan berbeza.
Spesifikasi Penuh
Pengiraan & Memori
Supercip
NVIDIA GB300 Grace Blackwell Ultra Desktop Supercip
CPU
1× NVIDIA Grace CPU Supercip, 72 teras Arm Neoverse V2
GPU
1× NVIDIA Blackwell Ultra GPU
Memori Koheren
748 GB bersepadu: 496 GB LPDDR5X + 252 GB HBM3e
Prestasi AI
20 PetaFLOPS (FP4)
Storan & Fizikal
Storan (Slot)
4× M.2 2280 PCIe 5.0 x4 NVMe
Faktor Bentuk
Menara sisi meja boleh tukar atau pemasangan rak 5U, reka bentuk casis kongsi
Dimensi
21.5 x 48 x 49 cm
Rangkaian & Penskalauan Kluster
Rangkaian Berkelajuan Tinggi
2× port 400G QSFP112 melalui NVIDIA ConnectX-8 SuperNIC
Penskalaan Kluster
Sehingga 8 unit dalam satu kluster koheren melalui 400GbE, boleh dikembangkan lagi menjadi infrastruktur HGX B300 (8 GPU) atau GB300 NVL72 (72 GPU)
Pengembangan PCIe
PCIe 5.0, 1× slot lebar berganda x16 + slot x8 tambahan
Kuasa & Terma
Bekalan Kuasa
Bekalan kuasa 1600 W, kecekapan Titanium, soket pejabat standard
Penyejukan
Penyejukan cecair gelung tertutup, boleh diservis, operasi berterusan hampir senyap
Pengurusan & Perisian
Pengurusan Jauh
IPMI 2.0 dan API Redfish, pemantauan dan kawalan gaya pusat data
Tindanan Perisian
Persekitaran Linux pra dimuatkan dengan peralatan NVIDIA AI Enterprise, sedia untuk penyebaran ejen NVIDIA NemoClaw
Supermicro memperkenalkan Super AI Station GB300 pada 28 Oktober 2025 sebagai sistem meja sisi berasaskan platform NVIDIA GB300 Grace Blackwell Superchip — sistem yang dibina untuk menjalankan model berparameter trilion secara tempatan, sambil menawarkan laluan terdokumen untuk berkembang secara kos efektif dan beransur-ansur ke kapasiti AI berskala pusat data.
Spesifikasi Perkakasan
Super AI Station dibina di sekitar satu NVIDIA Grace CPU Superchip — 72 teras Arm Neoverse V2 dan memori LPDDR5X 496 GB — dipasangkan dengan NVIDIA Blackwell Ultra GPU dengan memori GPU HBM3e 252 GB, disatukan melalui NVLink-C2C menjadi kolam memori koheren 748 GB. Sehingga 7 partisi MIG terpencil membolehkan satu stesen melayani beberapa pasukan atau beban kerja sekaligus tanpa pertindihan. Sistem ini menyediakan storan NVMe 4× M.2 2280 PCIe 5.0 x4 dan NVIDIA ConnectX-8 SuperNIC dwi-port 400G — fabrik rangkaian sama yang digunakan untuk menyambung stesen tambahan apabila penyebaran berkembang.
Pelayan AI Tempatan untuk Kegunaan Perniagaan
Super AI Station direka untuk berfungsi sebagai sumber AI tempatan yang dikongsi. Berbilang pekerja boleh menghantar tugas pemprosesan dokumen — semakan kontrak, pengekstrakan invois, penyediaan draf laporan, triaj e-mel — sepanjang hari bekerja, dengan tugasan dikendalikan secara pusat di tapak berbanding dihalakan melalui perkhidmatan awan luaran.
Melalui NVIDIA NemoClaw, agen autonomi boleh berjalan secara berterusan pada sistem, mengendalikan tugas berulang seperti pemantauan peti masuk atau penjanaan laporan berjadual tanpa memerlukan seseorang memulakan setiap permintaan. Ini membolehkan Super AI Station beroperasi sebagai infrastruktur AI berterusan untuk perniagaan, menyokong beban kerja dokumen yang stabil.
Dibina untuk Berskala: Dari Satu Stesen ke Kilang AI
Satu Super AI Station tunggal ialah sistem lengkap yang berdiri sendiri, tetapi ia juga unit asas penyebaran lebih besar. Sehingga 7 stesen tambahan boleh ditambah dari masa ke masa — sehingga 8 unit — berkomunikasi melalui fabrik dwi-port 400G yang sama, tanpa menyusun semula infrastruktur atau aliran kerja sedia ada. Setiap unit tambahan menyumbang 748 GB memori koheren dan pengiraannya sendiri ke kolam, memberi organisasi yang berkembang cara langsung dan beransur-ansur untuk mengembangkan kapasiti apabila penerimaan meningkat.
Apabila permintaan akhirnya melebihi kluster 8-unit, asas rangkaian 400G yang sama meluas ke platform NVIDIA HGX B300 dan NVIDIA GB300 NVL72 Supermicro. Stesen yang dibeli lebih awal terus berjalan dalam pengeluaran berbanding dibersarakan atau diganti — pelaburan awal kekal sebagai sebahagian penyebaran pada setiap peringkat pertumbuhan.
Setiap stesen yang ditambah sepanjang laluan ini terus berfungsi — tiada yang dibeli lebih awal diganti.
| Peringkat | Memori Koheren | Kos Indikatif | Maksudnya |
|---|---|---|---|
| Stesen Tunggal | 748 GB | RM405K | Titik permulaan; berjalan sepenuhnya secara berdiri sendiri. |
| Kluster 2-Unit | 1.5 TB | RM770K | Menambah 1 stesen melalui fabrik 400GbE yang sama. |
| Kluster 4-Unit | 3 TB | RM1500K | Menambah 3 stesen; tiada perubahan pada persediaan sedia ada diperlukan. |
| Kluster 8-Unit | 6 TB | RM2850K | Kapasiti kluster tunggal maksimum pada perkakasan Super AI Station. |
| HGX B300 Pengembangan | 9+ TB digabungkan | ~RM1700K (tambahan) | Stesen sedia ada terus berjalan; kapasiti latihan multi-nod padat ditambah bersama mereka. |
| GB300 NVL72 Pengembangan | 20+ TB digabungkan | ~RM3700K (tambahan) | Tier skala rak bersepadu untuk inferens eksaskala; stesen sebelumnya kekal dalam pengeluaran. |
Angka HGX B300 dan GB300 NVL72 adalah harga permulaan indikatif untuk infrastruktur tambahan yang disambungkan ke penyebaran Super AI Station sedia ada, bukan penggantinya.
Perbandingan Kos: On-Premises Skalabel vs. API AI Awan
Untuk SME yang memproses volum dokumen tinggi setiap hari, perbezaan antara kluster on-premises tetap dan pengebilan AI awan berasaskan penggunaan meningkat dengan ketara dari masa ke masa.
| Kategori Kos | API AI Awan | Supermicro (On-Premises) |
|---|---|---|
| Pelaburan perkakasan awal | Tiada | RM405K (sekali) |
| Kos operasi Tahun 1 | ~RM400K - ~RM1020K | ~RM20K (kuasa & penyelenggaraan) |
| Kos operasi Tahun 2 | ~RM400K - ~RM1020K | ~RM20K (kuasa & penyelenggaraan) |
| Kos operasi Tahun 3 | ~RM400K - ~RM1020K | ~RM20K (kuasa & penyelenggaraan) |
| Kos kumulatif 3 tahun | ~RM1200K - ~RM3050K | ~RM470K |
Oleh kerana pemprosesan berlaku sepenuhnya di tapak, dokumen dan data perniagaan tidak dihantar ke pelayan pihak ketiga. Ini merupakan pertimbangan relevan untuk organisasi dalam sektor undang-undang, kewangan, atau sektor sensitif data lain.
Ringkasan
Super AI Station GB300 menawarkan akses kepada AI tempatan berkeupayaan parameter trilion pada kos terhad, mampu berkembang stesen demi stesen, dan akhirnya ke infrastruktur HGX B300 atau GB300 NVL72. Untuk SME dengan beban kerja AI yang semakin meningkat, ia boleh menyediakan alternatif kos lebih rendah kepada perbelanjaan AI awan.










