NVIDIA DGX Spark 4'lü Switch'li Cluster — 4x DGX Spark + 400G anahtar + kablolar, kurulu teslim. 512 GB birleşik bellek, 16 TB NVMe. Tensör paralelliğinin çalıştığı ilk ölçek: 671B sınıfı tek model ya da 4 modeli eşzamanlı servis. GTM Teknoloji NVIDIA NPN güvencesiyle.

, ,

NVIDIA DGX Spark 4’lü Switch’li Cluster Paketi | 4 DGX Spark + 400G Switch | Kurulum Dahil

NVIDIA DGX Spark 4’lü Switch’li Cluster — 4x DGX Spark + 400G anahtar + kablolar, kurulu teslim. 512 GB birleşik bellek, 16 TB NVMe. Tensör paralelliğinin çalıştığı ilk ölçek: 671B sınıfı tek model ya da 4 modeli eşzamanlı servis. GTM Teknoloji NVIDIA NPN güvencesiyle.

Stok kodu: DGX-SPARK-CLUSTER-4X Kategoriler: , , Marka:
Form Faktör Compact & IoT
CPU NVIDIA Grace (Arm Neo…
GPU NVIDIA GB10 Grace Bla…
Stok Sorunuz Hızlı teslimat seçenekleri mevcut
Yerinde Destek
Opsiyonel 24/7 Destek
Yerel Stok
Major Ürünlerde Hızlı Teslimat
Kurulum
opsiyonel
◆ 4'LÜ SWITCH'Lİ KÜME — 4x DGX SPARK + 400G SWITCH + KURULUM

Tensör paralelliğinin başladığı yer

4 düğüm, DGX Spark ailesinde ölçeklemenin karakter değiştirdiği noktadır. Tensör paralelliği pratikte 2'nin katlarını istediği için 3 düğümde kullanılamaz; 4 düğümde kullanılabilir. Sonuç: 512 GB birleşik bellek yalnızca daha büyük model değil, daha hızlı çalışan model anlamına da gelir.

4 PFLOPSTOPLAM AI PERFORMANSI (FP4)
512 GBTOPLAM BİRLEŞİK BELLEK
16 TBTOPLAM NVMe
4x 200GSWITCH ÜZERİNDEN RDMA

4 PFLOPS, dört ünitenin toplam teorik FP4 kapasitesidir. Ayrıca sahadaki ölçümler, ConnectX-7 portu içindeki PCIe Gen5 x4 tavanı nedeniyle bağlantı başına pratik hızın 200 Gbps yerine ~100 Gbps civarında kaldığını gösteriyor. Gerçek throughput; modele, kuantizasyona ve paralellik moduna göre değişir.

Paket İçeriği

4xNVIDIA DGX Spark

GB10 Grace Blackwell Superchip — her ünitede 128 GB birleşik bellek, 4 TB NVMe, çift ConnectX-7 portu

1x400G Anahtar (Switch)

MikroTik CRS804-4DDQ-HRM — 4x 400G QSFP56-DD + 2x 10GbE yönetim portu, 1U yarım raf genişliğinde

4xQSFP-DD → QSFP56 Kablo

Düğüm başına bir adet 200 Gbps bağlantı; 4 düğümde port sırası önemli değildir

GTM Kurulum Hizmeti

Küme kurulumu, port hızı ayarı, RDMA doğrulaması ve dağıtık çıkarım testleri yapılmış — çalışır durumda teslim

4 düğüm neden 3'ten farklı?

Tensör paralelliği (TP) pratikte 2'nin katlarında çalışır: 2, 4, 8. Bu yüzden 3 düğümlü ring, kapasiteyi büyütür ama modeli katmanlara bölen pipeline paralelliğine mahkûmdur — ve pipeline'ın düğümler arası ek yükü, toplam hızı 2 düğümün altına bile düşürebilir.

4 düğümde bu kısıt kalkar. Model dört ünite arasında tensör düzeyinde bölünebilir; kapasite artışı doğrudan performansa dönüşebilir. Bunun bedeli, ring topolojisinin gerektirmediği bir ağ anahtarıdır.

Tek ünite, 2'li, 3'lü, 4'lü — hangisi?

Tek Ünite2'li3'lü Ring4'lü Switch'li
AI performansı (FP4)1 PFLOPS2 PFLOPS3 PFLOPS4 PFLOPS
Birleşik bellek128 GB256 GB384 GB512 GB
Toplam NVMe4 TB8 TB12 TB16 TB
Tensör paralelliğivaryok (2'nin katı değil)var
Paralellik modutensörpipeline / datatensör · pipeline · data
Ağ anahtarıgerekmezgerekmezgerekmezgerekir (pakete dâhil)
Toplam güç240W480W720W~1.083W (switch dâhil)
Genişleme2'liye3'lüyetavan — 4+ switch isterbreakout kabloyla 8 düğüme

4 düğümü iki şekilde kullanabilirsiniz

Dört ünite ya tek bir dev modeli taşır, ya da aynı anda birden çok modeli servis eder. Hangisinin doğru olduğu, kullanıcı sayınıza ve model büyüklüğünüze bağlıdır.

Mod 1

Tek dev model

Dört ünitenin belleği birleşerek yüz milyarlarca parametreli tek bir modeli taşır.

  • DeepSeek-R1 671B sınıfı modeller (4-bit kuantize)
  • Yaklaşık 700–800B parametre bandı
  • Tensör paralelliğiyle bölünmüş tek servis
  • Tek kullanıcı/uygulama için en yüksek model kalitesi
Mod 2

Çok modelli eşzamanlı servis

Her düğüm bağımsız bir servis çalıştırır; ekip veya ajan mimarisi aynı anda farklı modellere erişir.

  • Düğüm başına bir servis — 4x Llama 3 70B sınıfı
  • Karma kurulum: 2x 70B + 2x 32B (sohbet + kod + RAG)
  • 30B–70B sınıfında düşük gecikmeli çoklu kullanıcı
  • Ajan tabanlı mimariler için ayrı model havuzları

Güç, yer ve genişleme

~1.083WTepe çekiş: 4x 240W ünite + 123W switch. Standart 1.800W'lık devrenin altında kalır — özel elektrik tesisatı gerekmez.
1UAnahtar yarım raf genişliğinde; rafa monte edilebilir ya da masaüstünde çalışabilir. Sessiz çalışma için 150W altı TDP.
8 düğümBreakout kablo seçeneğiyle bir 400G port iki adet 200G bacağa bölünür; iki port boş kalır ve küme sonradan 8 düğüme çıkarılabilir.
Kurulumda gözden kaçan ayrıntı — biz hallediyoruz

Anahtar portları otomatik anlaşmaya bırakıldığında sıklıkla 50 Gbps'e düşer; her portun elle 200 Gbps'e sabitlenmesi gerekir. Ayrıca dağıtık iş yükleri düğümler arası iletişim için MPI, GPU toplu işlemleri için NCCL ister.

Kümeyi bu ayarlar yapılmış, bağlantılar doğrulanmış ve dağıtık çıkarım testinden geçmiş halde teslim ediyoruz — kutudan çıkıp deneme yanılmayla uğraşmıyorsunuz.

Switch istemiyor musunuz?

3'lü ring, ek ağ anahtarı olmadan kurulabilen en büyük DGX Spark kümesidir — 384 GB kapasite verir, ama tensör paralelliği yapamaz.

3'lü Ring Cluster →
Daha küçük başlangıç

2'li paket 256 GB ve tensör paralelliği sunar; tek ünite masaüstünde 200B parametreye kadar yerel çıkarım sağlar.

2'li Cluster Paketi →
Kurulumun teknik ayrıntısını merak ediyorsanız

Anahtar seçimi, kablolama seçenekleri, güç bütçesi ve kurulumda gözden kaçan ayrıntıları ayrı bir yazıda topladık — 2, 3 ve 4 düğüm arasındaki farkı da orada karşılaştırıyoruz.

Kurulum rehberini okuyun →

GTM Teknoloji farkı: NVIDIA NPN yetkili iş ortağı olarak dört üniteyi, anahtarı ve kabloları tek paket halinde, kurulu ve test edilmiş şekilde teslim ediyoruz. Anahtar markası ve kablo seçeneği (1:1 ya da breakout) projenize göre belirlenir. Toplu alım, eğitim kurumu ve kamu projeleri için teklif isteyin.

Satın alın ya da GTM Cloud’dan kiralayın

Bu sistemi satın alıp kendi lokasyonunuzda çalıştırabilir, ya da donanım yatırımı yapmadan GTM Cloud üzerinden dönemsel olarak kiralayabilirsiniz. Kalıcı ve öngörülebilir iş yüklerinde satın alma uzun vadede daha ekonomiktir; süresi belli projelerde ve kapasitesi baştan netleşmemiş çalışmalarda kiralama daha doğru sonuç verir.

Yol 1

Satın alın

Donanım sizin mülkiyetinizde olur; kurulum, kablolama ve testler tarafımızdan yapılır.

  • Sermaye harcaması (CAPEX) — amortisman sonrası maliyet düşer
  • Kendi lokasyonunuzda çalıştırın ya da co-location ile GTM Cloud’da barındırın
  • Kurulum, yapılandırma ve devreye alma dâhil
  • TL fatura, yerel garanti ve Türkçe teknik destek
Satın alma teklifi isteyin
Yol 2

GTM Cloud’dan kiralayın

4x DGX Spark + 400G anahtar — 512 GB birleşik bellek — kurulu ve yapılandırılmış olarak, dönemsel kiralama modeliyle.

  • Donanım yatırımı yok — işletme gideri (OPEX) olarak ödeyin
  • Kısa ve uzun dönem kiralama modelleri
  • Türkiye’deki Tier-3 veri merkezinde barındırma — veri yurt dışına çıkmaz
  • 7/24 altyapı izleme ve Türkçe teknik destek
  • İhtiyaç büyürse daha büyük kite geçiş

Kiralanan sistemler GTM Cloud altyapısında, Türkiye sınırları içindeki Tier-3 veri merkezlerinde çalışır. Kiralama bedeli kit büyüklüğüne ve süreye göre belirlenir; talebinizi ilettikten sonra 1 iş günü içinde dönüş yapıyoruz.

Tüm Özellikler

CPU Desteği NVIDIA Grace (Arm Neoverse V2)
Form Faktör Compact & IoT
Desteklenen GPU NVIDIA GB10 Grace Blackwell Superchip
İşlemci Markası NVIDIA
GPU Markası NVIDIA
Scroll to Top
Dört NVIDIA DGX Spark ünitesi istiflenmiş, 200G QSFP56 DAC kablolarıyla bağlı

NVIDIA DGX Spark 4'lü Switch'li Cluster Paketi | 4 DGX Spark + 400G Switch | Kurulum Dahil

SKU: DGX-SPARK-CLUSTER-4X
Teklif İste