استدلال 7B/8B
موصى به
NVIDIA · Hopper
مناسب لاستدلال 70B المكمم وضبط LoRA وخدمة عالية الإنتاجية.
الإيجار الشهري
~ USD 2.55/ساعة بناءً على شهر من 730 ساعة
التوافر: Available
مقارنة وحدات GPU| المورّد | NVIDIA |
|---|---|
| الطراز | NVIDIA H100 SXM 80GB |
| SKU | H100 SXM |
| Architecture | Hopper |
| فئة العتاد | datacenter gpu |
| VRAM | 80 GB |
|---|---|
| نوع الذاكرة | HBM3 |
| عرض نطاق الذاكرة | 3350 GB/s |
| الدقة | كثيف | مع التناثر |
|---|---|---|
| FP64 | 34 TFLOPS | — |
| FP64 Tensor | 67 TFLOPS | — |
| FP32 | 67 TFLOPS | — |
| TF32 Tensor | 494.5 TFLOPS | 989 TFLOPS |
| BF16 Tensor | 989.5 TFLOPS | 1979 TFLOPS |
| FP16 Tensor | 989.5 TFLOPS | 1979 TFLOPS |
| FP8 Tensor | 1979 TFLOPS | 3958 TFLOPS |
| INT8 Tensor | 1979 TOPS | 3958 TOPS |
| الشكل / الواجهة | SXM module |
|---|---|
| الواجهة | PCIe Gen5 x16 host interface |
| TDP | 700 W |
| NVLink | 900 GB/s NVLink |
| NVSwitch | مدعوم |
| MIG | حتى 7 MIG بسعة 10 GB |
| أقصى عدد GPU لكل عقدة | 8 |
| CUDA | مدعوم |
|---|---|
| التحقق | OFFICIAL_VENDOR |
| المصدر | www.nvidia.com |
موصى به
موصى به مع التكميم أو مراجعة هامش FP16/BF16
موصى به مع التكميم للحفاظ على هامش إنتاجي
موصى به للاستدلال المكمم؛ راجع السياق والتزامن
مناسب لـ LoRA/QLoRA؛ الضبط الكامل يعتمد على حجم النموذج والطوبولوجيا
استخدم عقدًا متعددة GPU بطوبولوجيا عالية النطاق
80 GB HBM2e · Limited capacity
USD 1,579/شهر
80 GB HBM2e · Available
USD 915/شهر
48 GB GDDR6 ECC · Available
USD 506/شهر
تعتمد الملاءمة على حجم النموذج والدقة وطول السياق والتزامن. استخدم أداة التوصية للحساب بهامش مناسب.
السعر الشهري العام هو نسخة السعر المعتمدة. يعرض المقابل بالساعة مشتقًا من السعر الشهري على أساس 730 ساعة.
تتوفر التهيئات متعددة GPU عندما يسمح المخزون وطوبولوجيا العقدة بذلك.