NVIDIA L40S 48GB GPU accelerator

NVIDIA · Ada Lovelace

NVIDIA L40S 48GB

Équilibré pour LLM moyens, génération d’images, vision par ordinateur et inférence de production optimisée.

Location mensuelle

USD 506/mois

~ USD 0.69/heure sur la base de 730 heures par mois

Disponibilité: Available

Comparer les GPU

Spécifications techniques

Identité

Fournisseur NVIDIA
Modèle NVIDIA L40S 48GB
SKU L40S
Architecture Ada Lovelace
Classe matérielle datacenter gpu

Mémoire

VRAM 48 GB
Type de mémoire GDDR6 ECC
Bande passante mémoire 864 GB/s

Calcul

Précision Mode dense Avec sparsité
FP32 91.6 TFLOPS
TF32 Tensor 183 TFLOPS 366 TFLOPS
BF16 Tensor 362.05 TFLOPS 733 TFLOPS
FP16 Tensor 362.05 TFLOPS 733 TFLOPS
FP8 Tensor 733 TFLOPS 1466 TFLOPS
INT8 Tensor 733 TOPS 1466 TOPS

Plateforme

Format / interface PCIe dual-slot accelerator card
Interface PCIe Gen4 x16
TDP 350 W
NVLink Non pris en charge
NVSwitch Non pris en charge
MIG Non pris en charge
GPU max par nœud 8

Logiciel

CUDA Pris en charge
Vérification OFFICIAL_VENDOR
Source www.nvidia.com

Adéquation aux charges

  • Inférence LLMTrès bon
  • Fine-tuning LLMAdapté
  • Entraînement completAdapté
  • Génération image / vidéoTrès bon
  • Embeddings / rerankingExcellent

Frameworks

  • PyTorch
  • TensorFlow
  • JAX
  • Hugging Face
  • vLLM
  • TensorRT
  • ONNX Runtime
  • CUDA

Guide de compatibilité modèle

Inférence 7B/8B

Recommandé

Inférence 13B/14B

Recommandé avec quantification ou analyse de marge FP16/BF16

Inférence 30B/32B

Recommandé avec quantification pour garder une marge de production

Inférence 65B/70B

Nécessite souvent plusieurs GPU ou une quantification plus forte

Fine-tuning

Adapté à LoRA/QLoRA ; le fine-tuning complet dépend du modèle et de la topologie

Grand entraînement

Pas le choix principal pour entraînement distribué large

GPU associés

FAQ hébergement GPU IA

Ce GPU convient-il à l’inférence LLM ?

L’adéquation dépend du modèle, de la précision, du contexte et de la concurrence. Utilisez le recommandateur pour dimensionner avec marge.

Comment le prix mensuel est-il calculé ?

Le prix mensuel public est la version de prix autorisée. L’équivalent horaire est dérivé du prix mensuel sur une base de 730 heures.

Puis-je louer plusieurs GPU ?

Les configurations multi-GPU sont possibles lorsque l’inventaire et la topologie du nœud le permettent.