استدلال 7B/8B
موصى به
NVIDIA · Hopper
مناسب للنماذج الكبيرة والسياق الطويل والضبط الثقيل وأحمال الذكاء الاصطناعي كثيفة الذاكرة.
الإيجار الشهري
~ USD 3.21/ساعة بناءً على شهر من 730 ساعة
التوافر: Limited capacity
مقارنة وحدات GPU| المورّد | NVIDIA |
|---|---|
| الطراز | NVIDIA H200 SXM 141GB |
| SKU | H200 SXM |
| Architecture | Hopper |
| فئة العتاد | datacenter gpu |
| VRAM | 141 GB |
|---|---|
| نوع الذاكرة | HBM3e |
| عرض نطاق الذاكرة | 4800 GB/s |
| الدقة | كثيف | مع التناثر |
|---|---|---|
| FP64 | 34 TFLOPS | — |
| FP64 Tensor | 67 TFLOPS | — |
| FP32 | 67 TFLOPS | — |
| TF32 Tensor | 494.5 TFLOPS | 989 TFLOPS |
| BF16 Tensor | 989.5 TFLOPS | 1979 TFLOPS |
| FP16 Tensor | 989.5 TFLOPS | 1979 TFLOPS |
| FP8 Tensor | 1979 TFLOPS | 3958 TFLOPS |
| INT8 Tensor | 1979 TOPS | 3958 TOPS |
| الشكل / الواجهة | SXM module |
|---|---|
| الواجهة | PCIe Gen5 x16 host interface |
| TDP | 700 W |
| NVLink | 900 GB/s NVLink |
| NVSwitch | مدعوم |
| MIG | حتى 7 MIG بسعة 18 GB |
| أقصى عدد GPU لكل عقدة | 8 |
| CUDA | مدعوم |
|---|---|
| التحقق | OFFICIAL_VENDOR |
| المصدر | www.nvidia.com |
موصى به
موصى به مع التكميم أو مراجعة هامش FP16/BF16
موصى به مع التكميم للحفاظ على هامش إنتاجي
موصى به للاستدلال المكمم؛ راجع السياق والتزامن
مناسب لـ LoRA/QLoRA؛ الضبط الكامل يعتمد على حجم النموذج والطوبولوجيا
استخدم عقدًا متعددة GPU بطوبولوجيا عالية النطاق
80 GB HBM3 · Available
USD 1,860/شهر
80 GB HBM2e · Limited capacity
USD 1,579/شهر
80 GB HBM2e · Available
USD 915/شهر
تعتمد الملاءمة على حجم النموذج والدقة وطول السياق والتزامن. استخدم أداة التوصية للحساب بهامش مناسب.
السعر الشهري العام هو نسخة السعر المعتمدة. يعرض المقابل بالساعة مشتقًا من السعر الشهري على أساس 730 ساعة.
تتوفر التهيئات متعددة GPU عندما يسمح المخزون وطوبولوجيا العقدة بذلك.