استدلال 7B/8B
موصى به
NVIDIA · Ampere
مناسب لاستدلال 70B المكمم وضبط LoRA وخدمة عالية الإنتاجية.
الإيجار الشهري
~ USD 1.25/ساعة بناءً على شهر من 730 ساعة
التوافر: Available
مقارنة وحدات GPU| المورّد | NVIDIA |
|---|---|
| الطراز | NVIDIA A100 SXM 80GB |
| SKU | A100 SXM 80GB |
| Architecture | Ampere |
| فئة العتاد | datacenter gpu |
| VRAM | 80 GB |
|---|---|
| نوع الذاكرة | HBM2e |
| عرض نطاق الذاكرة | 2039 GB/s |
| الدقة | كثيف | مع التناثر |
|---|---|---|
| FP64 | 9.7 TFLOPS | — |
| FP64 Tensor | 19.5 TFLOPS | — |
| FP32 | 19.5 TFLOPS | — |
| TF32 Tensor | 156 TFLOPS | 312 TFLOPS |
| BF16 Tensor | 312 TFLOPS | 624 TFLOPS |
| FP16 Tensor | 312 TFLOPS | 624 TFLOPS |
| INT8 Tensor | 624 TOPS | 1248 TOPS |
| الشكل / الواجهة | SXM module |
|---|---|
| الواجهة | PCIe Gen4 x16 host interface |
| TDP | 400 W |
| NVLink | 600 GB/s NVLink |
| NVSwitch | مدعوم |
| MIG | حتى 7 MIG بسعة 10 GB |
| أقصى عدد GPU لكل عقدة | 8 |
| CUDA | مدعوم |
|---|---|
| التحقق | OFFICIAL_VENDOR |
| المصدر | www.nvidia.com |
موصى به
موصى به مع التكميم أو مراجعة هامش FP16/BF16
موصى به مع التكميم للحفاظ على هامش إنتاجي
موصى به للاستدلال المكمم؛ راجع السياق والتزامن
مناسب لـ LoRA/QLoRA؛ الضبط الكامل يعتمد على حجم النموذج والطوبولوجيا
استخدم عقدًا متعددة GPU بطوبولوجيا عالية النطاق
80 GB HBM3 · Available
USD 1,860/شهر
80 GB HBM2e · Limited capacity
USD 1,579/شهر
48 GB GDDR6 ECC · Available
USD 506/شهر
تعتمد الملاءمة على حجم النموذج والدقة وطول السياق والتزامن. استخدم أداة التوصية للحساب بهامش مناسب.
السعر الشهري العام هو نسخة السعر المعتمدة. يعرض المقابل بالساعة مشتقًا من السعر الشهري على أساس 730 ساعة.
تتوفر التهيئات متعددة GPU عندما يسمح المخزون وطوبولوجيا العقدة بذلك.