NVIDIA L40S 48GB GPU accelerator

NVIDIA · Ada Lovelace

NVIDIA L40S 48GB

मध्यम LLMs, image generation, computer vision और cost-aware production inference के लिए संतुलित।

मासिक किराया

USD 506/माह

~ USD 0.69/घंटा 730 घंटे के महीने पर आधारित

उपलब्धता: Available

GPU तुलना करें

तकनीकी विनिर्देश

पहचान

विक्रेता NVIDIA
मॉडल NVIDIA L40S 48GB
SKU L40S
Architecture Ada Lovelace
हार्डवेयर श्रेणी datacenter gpu

मेमोरी

VRAM 48 GB
मेमोरी प्रकार GDDR6 ECC
मेमोरी बैंडविड्थ 864 GB/s

कम्प्यूट

प्रिसिजन घना स्पार्सिटी सहित
FP32 91.6 TFLOPS
TF32 Tensor 183 TFLOPS 366 TFLOPS
BF16 Tensor 362.05 TFLOPS 733 TFLOPS
FP16 Tensor 362.05 TFLOPS 733 TFLOPS
FP8 Tensor 733 TFLOPS 1466 TFLOPS
INT8 Tensor 733 TOPS 1466 TOPS

प्लेटफ़ॉर्म

फॉर्म फैक्टर / इंटरफ़ेस PCIe dual-slot accelerator card
Interface PCIe Gen4 x16
TDP 350 W
NVLink समर्थित नहीं
NVSwitch समर्थित नहीं
MIG समर्थित नहीं
प्रति नोड अधिकतम GPU 8

सॉफ्टवेयर

CUDA समर्थित
सत्यापन OFFICIAL_VENDOR
स्रोत www.nvidia.com

वर्कलोड उपयुक्तता

  • LLM inferenceबहुत अच्छा
  • LLM fine-tuningउपयुक्त
  • पूर्ण मॉडल trainingउपयुक्त
  • image / video generationबहुत अच्छा
  • embeddings / rerankingउत्कृष्ट

फ्रेमवर्क

  • PyTorch
  • TensorFlow
  • JAX
  • Hugging Face
  • vLLM
  • TensorRT
  • ONNX Runtime
  • CUDA

मॉडल संगतता मार्गदर्शन

7B/8B inference

अनुशंसित

13B/14B inference

quantisation या FP16/BF16 headroom समीक्षा के साथ अनुशंसित

30B/32B inference

production headroom के लिए quantisation के साथ अनुशंसित

65B/70B inference

आम तौर पर कई GPU या अधिक मजबूत quantisation चाहिए

fine-tuning

LoRA/QLoRA के लिए उपयुक्त; full fine-tuning model size और topology पर निर्भर है

large training

बड़े distributed training के लिए प्राथमिक विकल्प नहीं

संबंधित GPU

AI GPU hosting FAQ

क्या यह GPU LLM इन्फ़रेंस के लिए उपयुक्त है?

उपयुक्तता मॉडल, प्रिसीजन, कॉन्टेक्स्ट और समवर्ती उपयोग पर निर्भर है. मार्जिन के साथ सुझाव इंजन उपयोग करें.

मासिक मूल्य कैसे निकाला जाता है?

सार्वजनिक मासिक मूल्य स्वीकृत मूल्य संस्करण है. घंटे का समतुल्य 730 घंटे के आधार पर निकाला जाता है.

क्या कई GPU किराये पर ले सकते हैं?

जब इन्वेंटरी और नोड टोपोलॉजी अनुमति दें, multi-GPU कॉन्फ़िगरेशन उपलब्ध हैं.