NVIDIA DGX Spark 4'lü Switch'li Cluster — 4x DGX Spark + 400G anahtar + kablolar, kurulu teslim. 512 GB birleşik bellek, 16 TB NVMe. Tensör paralelliğinin çalıştığı ilk ölçek: 671B sınıfı tek model ya da 4 modeli eşzamanlı servis. GTM Teknoloji NVIDIA NPN güvencesiyle.
NVIDIA DGX Spark 4’lü Switch’li Cluster Paketi | 4 DGX Spark + 400G Switch | Kurulum Dahil
NVIDIA DGX Spark 4’lü Switch’li Cluster — 4x DGX Spark + 400G anahtar + kablolar, kurulu teslim. 512 GB birleşik bellek, 16 TB NVMe. Tensör paralelliğinin çalıştığı ilk ölçek: 671B sınıfı tek model ya da 4 modeli eşzamanlı servis. GTM Teknoloji NVIDIA NPN güvencesiyle.
Tensör paralelliğinin başladığı yer
4 düğüm, DGX Spark ailesinde ölçeklemenin karakter değiştirdiği noktadır. Tensör paralelliği pratikte 2'nin katlarını istediği için 3 düğümde kullanılamaz; 4 düğümde kullanılabilir. Sonuç: 512 GB birleşik bellek yalnızca daha büyük model değil, daha hızlı çalışan model anlamına da gelir.
4 PFLOPS, dört ünitenin toplam teorik FP4 kapasitesidir. Ayrıca sahadaki ölçümler, ConnectX-7 portu içindeki PCIe Gen5 x4 tavanı nedeniyle bağlantı başına pratik hızın 200 Gbps yerine ~100 Gbps civarında kaldığını gösteriyor. Gerçek throughput; modele, kuantizasyona ve paralellik moduna göre değişir.
Paket İçeriği
GB10 Grace Blackwell Superchip — her ünitede 128 GB birleşik bellek, 4 TB NVMe, çift ConnectX-7 portu
MikroTik CRS804-4DDQ-HRM — 4x 400G QSFP56-DD + 2x 10GbE yönetim portu, 1U yarım raf genişliğinde
Düğüm başına bir adet 200 Gbps bağlantı; 4 düğümde port sırası önemli değildir
Küme kurulumu, port hızı ayarı, RDMA doğrulaması ve dağıtık çıkarım testleri yapılmış — çalışır durumda teslim
Tensör paralelliği (TP) pratikte 2'nin katlarında çalışır: 2, 4, 8. Bu yüzden 3 düğümlü ring, kapasiteyi büyütür ama modeli katmanlara bölen pipeline paralelliğine mahkûmdur — ve pipeline'ın düğümler arası ek yükü, toplam hızı 2 düğümün altına bile düşürebilir.
4 düğümde bu kısıt kalkar. Model dört ünite arasında tensör düzeyinde bölünebilir; kapasite artışı doğrudan performansa dönüşebilir. Bunun bedeli, ring topolojisinin gerektirmediği bir ağ anahtarıdır.
Tek ünite, 2'li, 3'lü, 4'lü — hangisi?
| Tek Ünite | 2'li | 3'lü Ring | 4'lü Switch'li | |
|---|---|---|---|---|
| AI performansı (FP4) | 1 PFLOPS | 2 PFLOPS | 3 PFLOPS | 4 PFLOPS |
| Birleşik bellek | 128 GB | 256 GB | 384 GB | 512 GB |
| Toplam NVMe | 4 TB | 8 TB | 12 TB | 16 TB |
| Tensör paralelliği | — | var | yok (2'nin katı değil) | var |
| Paralellik modu | — | tensör | pipeline / data | tensör · pipeline · data |
| Ağ anahtarı | gerekmez | gerekmez | gerekmez | gerekir (pakete dâhil) |
| Toplam güç | 240W | 480W | 720W | ~1.083W (switch dâhil) |
| Genişleme | 2'liye | 3'lüye | tavan — 4+ switch ister | breakout kabloyla 8 düğüme |
4 düğümü iki şekilde kullanabilirsiniz
Dört ünite ya tek bir dev modeli taşır, ya da aynı anda birden çok modeli servis eder. Hangisinin doğru olduğu, kullanıcı sayınıza ve model büyüklüğünüze bağlıdır.
Tek dev model
Dört ünitenin belleği birleşerek yüz milyarlarca parametreli tek bir modeli taşır.
- DeepSeek-R1 671B sınıfı modeller (4-bit kuantize)
- Yaklaşık 700–800B parametre bandı
- Tensör paralelliğiyle bölünmüş tek servis
- Tek kullanıcı/uygulama için en yüksek model kalitesi
Çok modelli eşzamanlı servis
Her düğüm bağımsız bir servis çalıştırır; ekip veya ajan mimarisi aynı anda farklı modellere erişir.
- Düğüm başına bir servis — 4x Llama 3 70B sınıfı
- Karma kurulum: 2x 70B + 2x 32B (sohbet + kod + RAG)
- 30B–70B sınıfında düşük gecikmeli çoklu kullanıcı
- Ajan tabanlı mimariler için ayrı model havuzları
Güç, yer ve genişleme
Anahtar portları otomatik anlaşmaya bırakıldığında sıklıkla 50 Gbps'e düşer; her portun elle 200 Gbps'e sabitlenmesi gerekir. Ayrıca dağıtık iş yükleri düğümler arası iletişim için MPI, GPU toplu işlemleri için NCCL ister.
Kümeyi bu ayarlar yapılmış, bağlantılar doğrulanmış ve dağıtık çıkarım testinden geçmiş halde teslim ediyoruz — kutudan çıkıp deneme yanılmayla uğraşmıyorsunuz.
3'lü ring, ek ağ anahtarı olmadan kurulabilen en büyük DGX Spark kümesidir — 384 GB kapasite verir, ama tensör paralelliği yapamaz.
2'li paket 256 GB ve tensör paralelliği sunar; tek ünite masaüstünde 200B parametreye kadar yerel çıkarım sağlar.
Anahtar seçimi, kablolama seçenekleri, güç bütçesi ve kurulumda gözden kaçan ayrıntıları ayrı bir yazıda topladık — 2, 3 ve 4 düğüm arasındaki farkı da orada karşılaştırıyoruz.
GTM Teknoloji farkı: NVIDIA NPN yetkili iş ortağı olarak dört üniteyi, anahtarı ve kabloları tek paket halinde, kurulu ve test edilmiş şekilde teslim ediyoruz. Anahtar markası ve kablo seçeneği (1:1 ya da breakout) projenize göre belirlenir. Toplu alım, eğitim kurumu ve kamu projeleri için teklif isteyin.
Satın alın ya da GTM Cloud’dan kiralayın
Bu sistemi satın alıp kendi lokasyonunuzda çalıştırabilir, ya da donanım yatırımı yapmadan GTM Cloud üzerinden dönemsel olarak kiralayabilirsiniz. Kalıcı ve öngörülebilir iş yüklerinde satın alma uzun vadede daha ekonomiktir; süresi belli projelerde ve kapasitesi baştan netleşmemiş çalışmalarda kiralama daha doğru sonuç verir.
Satın alın
Donanım sizin mülkiyetinizde olur; kurulum, kablolama ve testler tarafımızdan yapılır.
- Sermaye harcaması (CAPEX) — amortisman sonrası maliyet düşer
- Kendi lokasyonunuzda çalıştırın ya da co-location ile GTM Cloud’da barındırın
- Kurulum, yapılandırma ve devreye alma dâhil
- TL fatura, yerel garanti ve Türkçe teknik destek
GTM Cloud’dan kiralayın
4x DGX Spark + 400G anahtar — 512 GB birleşik bellek — kurulu ve yapılandırılmış olarak, dönemsel kiralama modeliyle.
- Donanım yatırımı yok — işletme gideri (OPEX) olarak ödeyin
- Kısa ve uzun dönem kiralama modelleri
- Türkiye’deki Tier-3 veri merkezinde barındırma — veri yurt dışına çıkmaz
- 7/24 altyapı izleme ve Türkçe teknik destek
- İhtiyaç büyürse daha büyük kite geçiş
Kiralanan sistemler GTM Cloud altyapısında, Türkiye sınırları içindeki Tier-3 veri merkezlerinde çalışır. Kiralama bedeli kit büyüklüğüne ve süreye göre belirlenir; talebinizi ilettikten sonra 1 iş günü içinde dönüş yapıyoruz.
Tüm Özellikler
| CPU Desteği | NVIDIA Grace (Arm Neoverse V2) |
|---|---|
| Form Faktör | Compact & IoT |
| Desteklenen GPU | NVIDIA GB10 Grace Blackwell Superchip |
| İşlemci Markası | NVIDIA |
| GPU Markası | NVIDIA |

