استدلال 7B/8B
موصى به
NVIDIA · Ada Lovelace
متوازن للنماذج المتوسطة وتوليد الصور والرؤية الحاسوبية واستدلال الإنتاج منخفض التكلفة.
الإيجار الشهري
~ USD 0.69/ساعة بناءً على شهر من 730 ساعة
التوافر: Available
مقارنة وحدات GPU| المورّد | NVIDIA |
|---|---|
| الطراز | NVIDIA L40S 48GB |
| SKU | L40S |
| Architecture | Ada Lovelace |
| فئة العتاد | datacenter gpu |
| VRAM | 48 GB |
|---|---|
| نوع الذاكرة | GDDR6 ECC |
| عرض نطاق الذاكرة | 864 GB/s |
| الدقة | كثيف | مع التناثر |
|---|---|---|
| FP32 | 91.6 TFLOPS | — |
| TF32 Tensor | 183 TFLOPS | 366 TFLOPS |
| BF16 Tensor | 362.05 TFLOPS | 733 TFLOPS |
| FP16 Tensor | 362.05 TFLOPS | 733 TFLOPS |
| FP8 Tensor | 733 TFLOPS | 1466 TFLOPS |
| INT8 Tensor | 733 TOPS | 1466 TOPS |
| الشكل / الواجهة | PCIe dual-slot accelerator card |
|---|---|
| الواجهة | PCIe Gen4 x16 |
| TDP | 350 W |
| NVLink | غير مدعوم |
| NVSwitch | غير مدعوم |
| MIG | غير مدعوم |
| أقصى عدد GPU لكل عقدة | 8 |
| CUDA | مدعوم |
|---|---|
| التحقق | OFFICIAL_VENDOR |
| المصدر | www.nvidia.com |
موصى به
موصى به مع التكميم أو مراجعة هامش FP16/BF16
موصى به مع التكميم للحفاظ على هامش إنتاجي
غالبًا يحتاج إلى عدة وحدات GPU أو تكميم أقوى
مناسب لـ LoRA/QLoRA؛ الضبط الكامل يعتمد على حجم النموذج والطوبولوجيا
ليس الخيار الأساسي للتدريب الموزع الكبير
24 GB GDDR6 · Available
USD 250/شهر
80 GB HBM3 · Available
USD 1,860/شهر
80 GB HBM2e · Limited capacity
USD 1,579/شهر
تعتمد الملاءمة على حجم النموذج والدقة وطول السياق والتزامن. استخدم أداة التوصية للحساب بهامش مناسب.
السعر الشهري العام هو نسخة السعر المعتمدة. يعرض المقابل بالساعة مشتقًا من السعر الشهري على أساس 730 ساعة.
تتوفر التهيئات متعددة GPU عندما يسمح المخزون وطوبولوجيا العقدة بذلك.