7B/8B inference
अनुशंसित
NVIDIA · Ada Lovelace
मध्यम LLMs, image generation, computer vision और cost-aware production inference के लिए संतुलित।
मासिक किराया
~ USD 0.69/घंटा 730 घंटे के महीने पर आधारित
उपलब्धता: Available
GPU तुलना करें| विक्रेता | NVIDIA |
|---|---|
| मॉडल | NVIDIA L40S 48GB |
| SKU | L40S |
| Architecture | Ada Lovelace |
| हार्डवेयर श्रेणी | datacenter gpu |
| VRAM | 48 GB |
|---|---|
| मेमोरी प्रकार | GDDR6 ECC |
| मेमोरी बैंडविड्थ | 864 GB/s |
| प्रिसिजन | घना | स्पार्सिटी सहित |
|---|---|---|
| FP32 | 91.6 TFLOPS | — |
| TF32 Tensor | 183 TFLOPS | 366 TFLOPS |
| BF16 Tensor | 362.05 TFLOPS | 733 TFLOPS |
| FP16 Tensor | 362.05 TFLOPS | 733 TFLOPS |
| FP8 Tensor | 733 TFLOPS | 1466 TFLOPS |
| INT8 Tensor | 733 TOPS | 1466 TOPS |
| फॉर्म फैक्टर / इंटरफ़ेस | PCIe dual-slot accelerator card |
|---|---|
| Interface | PCIe Gen4 x16 |
| TDP | 350 W |
| NVLink | समर्थित नहीं |
| NVSwitch | समर्थित नहीं |
| MIG | समर्थित नहीं |
| प्रति नोड अधिकतम GPU | 8 |
| CUDA | समर्थित |
|---|---|
| सत्यापन | OFFICIAL_VENDOR |
| स्रोत | www.nvidia.com |
अनुशंसित
quantisation या FP16/BF16 headroom समीक्षा के साथ अनुशंसित
production headroom के लिए quantisation के साथ अनुशंसित
आम तौर पर कई GPU या अधिक मजबूत quantisation चाहिए
LoRA/QLoRA के लिए उपयुक्त; full fine-tuning model size और topology पर निर्भर है
बड़े distributed training के लिए प्राथमिक विकल्प नहीं
24 GB GDDR6 · Available
USD 250/माह
80 GB HBM3 · Available
USD 1,860/माह
80 GB HBM2e · Limited capacity
USD 1,579/माह
उपयुक्तता मॉडल, प्रिसीजन, कॉन्टेक्स्ट और समवर्ती उपयोग पर निर्भर है. मार्जिन के साथ सुझाव इंजन उपयोग करें.
सार्वजनिक मासिक मूल्य स्वीकृत मूल्य संस्करण है. घंटे का समतुल्य 730 घंटे के आधार पर निकाला जाता है.
जब इन्वेंटरी और नोड टोपोलॉजी अनुमति दें, multi-GPU कॉन्फ़िगरेशन उपलब्ध हैं.