استدلال 7B/8B
موصى به
NVIDIA · Ada Lovelace
فعال لاستدلال النماذج الصغيرة وembeddings وreranking والتطوير وخدمات الذكاء الاصطناعي الحساسة للتكلفة.
الإيجار الشهري
~ USD 0.34/ساعة بناءً على شهر من 730 ساعة
التوافر: Available
مقارنة وحدات GPU| المورّد | NVIDIA |
|---|---|
| الطراز | NVIDIA L4 24GB |
| SKU | L4 |
| Architecture | Ada Lovelace |
| فئة العتاد | datacenter gpu |
| VRAM | 24 GB |
|---|---|
| نوع الذاكرة | GDDR6 |
| عرض نطاق الذاكرة | 300 GB/s |
| الدقة | كثيف | مع التناثر |
|---|---|---|
| FP32 | 30.3 TFLOPS | — |
| TF32 Tensor | 60 TFLOPS | 120 TFLOPS |
| BF16 Tensor | 121 TFLOPS | 242 TFLOPS |
| FP16 Tensor | 121 TFLOPS | 242 TFLOPS |
| FP8 Tensor | 242.5 TFLOPS | 485 TFLOPS |
| INT8 Tensor | 242.5 TOPS | 485 TOPS |
| الشكل / الواجهة | PCIe low-profile accelerator card |
|---|---|
| الواجهة | PCIe Gen4 x16 |
| TDP | 72 W |
| NVLink | غير مدعوم |
| NVSwitch | غير مدعوم |
| MIG | غير مدعوم |
| أقصى عدد GPU لكل عقدة | 8 |
| CUDA | مدعوم |
|---|---|
| التحقق | OFFICIAL_VENDOR |
| المصدر | www.nvidia.com |
موصى به
موصى به مع التكميم أو مراجعة هامش FP16/BF16
محدود
غالبًا يحتاج إلى عدة وحدات GPU أو تكميم أقوى
محدود للأحمال الصغيرة أو المعدلة
ليس الخيار الأساسي للتدريب الموزع الكبير
48 GB GDDR6 ECC · Available
USD 506/شهر
80 GB HBM3 · Available
USD 1,860/شهر
80 GB HBM2e · Limited capacity
USD 1,579/شهر
تعتمد الملاءمة على حجم النموذج والدقة وطول السياق والتزامن. استخدم أداة التوصية للحساب بهامش مناسب.
السعر الشهري العام هو نسخة السعر المعتمدة. يعرض المقابل بالساعة مشتقًا من السعر الشهري على أساس 730 ساعة.
تتوفر التهيئات متعددة GPU عندما يسمح المخزون وطوبولوجيا العقدة بذلك.