İş yükünü tanımlayın
LLM çıkarımı, eğitim, fine-tuning veya HPC için model boyutu, precision, context, batch, eş zamanlılık ve hedef süreyi yazılı hale getirin.
NVIDIA H200 teknik özelliklerini yalnız tepe performans tablosu olarak değil; GPU belleği, bağlantı topolojisi, güç, soğutma ve tam sunucu uyumluluğuyla birlikte okuyun. H200 SXM ve H200 NVL değerlerini resmî üretici verileriyle karşılaştırın.
LLM çıkarımı, eğitim, fine-tuning veya HPC için model boyutu, precision, context, batch, eş zamanlılık ve hedef süreyi yazılı hale getirin.
Model ağırlıkları yanında KV cache, optimizer, aktivasyon, framework ve güvenlik payını da hesaba katın; 141 GB değerini tek başına yeterlilik kabul etmeyin.
Yoğun çoklu GPU iletişimi için HGX/SXM; PCIe tabanlı, hava soğutmalı ve daha esnek kurumsal yerleşimler için H200 NVL yaklaşımını değerlendirin.
CPU, sistem RAM’i, NVMe, PCIe hatları, NIC, GPU yakınlığı ve yazılım sürümlerini seçilen tam platformun QVL listesiyle birlikte doğrulayın.
GPU TDP’si dışında sunucunun toplam ve tepe güç tüketimini; PDU, giriş gerilimi, rack ölçüsü, hava akışı ve ısı uzaklaştırma kapasitesiyle eşleştirin.
Uygulama benchmarkı veya güvenilir üretici verisiyle ölçek varsayımını test edin; GPU, sunucu, ağ, yazılım, garanti ve hizmetleri tek BOM’da karşılaştırın.
NVIDIA H200’ün ayırt edici yönü Hopper hesaplama çekirdeğini daha büyük ve hızlı bellekle birleştirmesidir. GPU başına 141 GB HBM3e kapasite ve 4,8 TB/sn bant genişliği; büyük model ağırlıkları, uzun context, KV cache ve bellek yoğun HPC veri setleri için daha geniş çalışma alanı sağlar.
H200; FP64, FP32, TF32, BFLOAT16, FP16, FP8 ve INT8 hesaplama türlerini destekler. Üretici tablosundaki bazı Tensor Core tepe değerleri seyrekliğe göredir. Bu rakamlar doğrudan uygulama hızı veya token/saniye sonucu değildir.
H200 SXM’de dördüncü nesil NVLink GPU başına 900 GB/sn’ye kadar GPU-GPU bağlantısı sunar; PCIe Gen5 ise cihazın ana sistemle veri yoludur. H200 NVL, desteklenen sunucularda iki veya dört GPU’yu NVLink köprüsüyle bağlayabilir. Sunucular arası küme ağı ayrıca tasarlanır.
Hopper mimarisi Multi-Instance GPU ve confidential computing yetenekleri sunar. MIG, desteklenen profillerle tek GPU’yu izole örneklere ayırarak farklı ekip veya servislerin kaynak paylaşmasına yardım eder; ancak her iş yükü için doğru yaklaşım değildir.
H200 SXM için 700 W’a, H200 NVL için 600 W’a kadar yapılandırılabilir GPU TDP değerleri yayımlanır. Bunlar yalnız GPU sınırıdır; iki işlemci, yüksek kapasiteli RAM, NVMe, NIC, fanlar ve güç kaynağı kayıpları sunucunun toplamını yükseltir.
H200 teknik özellikleri kısa liste oluşturur; çalışan çözümü ise tam sunucu modeli belirler. GPU form faktörü, desteklenen adet, CPU, RAM, depolama, NIC, firmware, işletim sistemi ve yazılım yığını platform üreticisinin güncel destek listesiyle doğrulanmalıdır.
Aşağıdaki değerler NVIDIA’nın H200 ürün sayfasındaki yayımlanmış özelliklerdir. Bazı değerler ön bilgi niteliğindedir; siparişte tam GPU ve sunucu SKU’su esas alınır.
| Özellik | H200 SXM | H200 NVL |
|---|---|---|
| GPU mimarisi | NVIDIA Hopper | NVIDIA Hopper |
| GPU belleği | 141 GB HBM3e | 141 GB HBM3e |
| Bellek bant genişliği | 4,8 TB/sn | 4,8 TB/sn |
| FP64 | 34 TFLOPS | 30 TFLOPS |
| FP64 Tensor Core | 67 TFLOPS | 60 TFLOPS |
| FP32 | 67 TFLOPS | 60 TFLOPS |
| TF32 Tensor Core* | 989 TFLOPS | 835 TFLOPS |
| BFLOAT16 / FP16 Tensor Core* | 1.979 TFLOPS | 1.671 TFLOPS |
| FP8 Tensor Core* | 3.958 TFLOPS | 3.341 TFLOPS |
| Azami TDP | 700 W’a kadar, yapılandırılabilir | 600 W’a kadar, yapılandırılabilir |
| Form faktörü | SXM | PCIe, çift slot, hava soğutmalı |
| Bağlantı | NVLink 900 GB/sn; PCIe Gen5 128 GB/sn | 2/4 yönlü NVLink; GPU başına 900 GB/sn; PCIe Gen5 128 GB/sn |
| MIG | En çok 7 × 18 GB | En çok 7 × 16,5 GB |
| Sunucu yaklaşımı | HGX H200, 4 veya 8 GPU | MGX ve sertifikalı sistemler, 8 GPU’ya kadar |
NVIDIA H200 SXM ve H200 NVL, GPU başına 141 GB HBM3e belleğe sahiptir. Uygulamanın kullanabileceği alan; sürücü, runtime, model biçimi ve sistem rezervlerine göre fiziksel kapasiteden düşük olabilir.
NVIDIA’nın ürün tablosuna göre H200 SXM ve H200 NVL için GPU bellek bant genişliği 4,8 TB/sn’dir. Bu değer GPU belleği içindir; ağ veya NVLink bant genişliğiyle karıştırılmamalıdır.
H200, NVIDIA Hopper mimarisini kullanır. Transformer Engine, dördüncü nesil NVLink, MIG ve confidential computing gibi Hopper yeteneklerini desteklenen platform ve yazılım yığınıyla sunar.
NVIDIA, H200 SXM için 700 W’a kadar yapılandırılabilir azami TDP listeler. Bu yalnız GPU değeridir; sunucunun toplam güç ihtiyacı CPU, RAM, NVMe, NIC, fanlar ve güç kaynaklarıyla daha yüksektir.
Evet. H200 NVL, çift slotlu ve hava soğutmalı PCIe form faktöründedir. Masaüstü kartı gibi değerlendirilmez; yalnız desteklenen kurumsal sunucu, güç, riser, hava akışı ve yazılım matrisi içinde kullanılmalıdır.
NVIDIA, H200 SXM için en çok yedi adet 18 GB; H200 NVL için en çok yedi adet 16,5 GB MIG profili listeler. Kullanılabilir profil ve sürüm uyumu güncel MIG User Guide ile doğrulanmalıdır.
H200 tedarik modeli varyanta göre değişir. SXM, uyumlu HGX/baseboard platformunun parçasıdır. H200 NVL PCIe formunda olsa da desteklenen sunucu ve tam BOM olmadan bağımsız bir masaüstü kartı gibi ele alınmamalıdır.
Hayır. Tepe hesaplama ve bant genişliği değerleri kapasiteyi gösterir; gerçek performans model, precision, batch, context, framework, kernel, CPU, depolama, ağ ve paralelleştirme verimine bağlıdır.
Modelinizi, GPU adedi hedefinizi, rack, güç, ağ ve teslimat koşullarını paylaşın; H200 SXM veya H200 NVL için doğrulanabilir tam sistem BOM’u ve proje teklifi hazırlayalım.
Birincil ve resmî kaynaklar