NVIDIA L4 24GB GPU accelerator

NVIDIA · Ada Lovelace

NVIDIA L4 24GB

Efficace pour petits modèles, embeddings, reranking, développement et services IA sensibles au coût.

Location mensuelle

USD 250/mois

~ USD 0.34/heure sur la base de 730 heures par mois

Disponibilité: Available

Comparer les GPU

Spécifications techniques

Identité

Fournisseur NVIDIA
Modèle NVIDIA L4 24GB
SKU L4
Architecture Ada Lovelace
Classe matérielle datacenter gpu

Mémoire

VRAM 24 GB
Type de mémoire GDDR6
Bande passante mémoire 300 GB/s

Calcul

Précision Mode dense Avec sparsité
FP32 30.3 TFLOPS
TF32 Tensor 60 TFLOPS 120 TFLOPS
BF16 Tensor 121 TFLOPS 242 TFLOPS
FP16 Tensor 121 TFLOPS 242 TFLOPS
FP8 Tensor 242.5 TFLOPS 485 TFLOPS
INT8 Tensor 242.5 TOPS 485 TOPS

Plateforme

Format / interface PCIe low-profile accelerator card
Interface PCIe Gen4 x16
TDP 72 W
NVLink Non pris en charge
NVSwitch Non pris en charge
MIG Non pris en charge
GPU max par nœud 8

Logiciel

CUDA Pris en charge
Vérification OFFICIAL_VENDOR
Source www.nvidia.com

Adéquation aux charges

  • Inférence LLMAdapté
  • Fine-tuning LLMLimité
  • Entraînement completLimité
  • Génération image / vidéoAdapté
  • Embeddings / rerankingExcellent

Frameworks

  • PyTorch
  • TensorFlow
  • JAX
  • Hugging Face
  • vLLM
  • TensorRT
  • ONNX Runtime
  • CUDA

Guide de compatibilité modèle

Inférence 7B/8B

Recommandé

Inférence 13B/14B

Recommandé avec quantification ou analyse de marge FP16/BF16

Inférence 30B/32B

Limité

Inférence 65B/70B

Nécessite souvent plusieurs GPU ou une quantification plus forte

Fine-tuning

Limité aux petites charges ou charges adaptées

Grand entraînement

Pas le choix principal pour entraînement distribué large

GPU associés

FAQ hébergement GPU IA

Ce GPU convient-il à l’inférence LLM ?

L’adéquation dépend du modèle, de la précision, du contexte et de la concurrence. Utilisez le recommandateur pour dimensionner avec marge.

Comment le prix mensuel est-il calculé ?

Le prix mensuel public est la version de prix autorisée. L’équivalent horaire est dérivé du prix mensuel sur une base de 730 heures.

Puis-je louer plusieurs GPU ?

Les configurations multi-GPU sont possibles lorsque l’inventaire et la topologie du nœud le permettent.