NVIDIA · Centre de données · Carte accélératrice
NVIDIA A40 48GB
Cette page présente les caractéristiques de référence du A40 et des conseils de déploiement de l’IA, distincts de l’inventaire commercial de FusionPointAI.
Caractéristiques techniques vérifiées
| Fabricant | NVIDIA |
|---|---|
| SKU exact | A40 |
| Famille produit | NVIDIA A40 |
| Architecture du modèle | Ampere |
| Génération | Ampere pour centre de données |
| Type d’entité | Carte accélératrice |
| Cycle de vie | Génération précédente |
| Date de lancement | Information non publiée par le fabricant. |
| VRAM | 48 GB |
| Technologie mémoire | GDDR6 ECC |
| Bande passante mémoire | 696 GB/s |
| Puissance | 300 W |
| Interface | PCIe Gen4 x16 |
| Format | Double emplacement · PCIe · Accélérateur |
| Interconnexion | NVLink |
| MIG / partitionnement | Non pris en charge |
| Formats numériques pris en charge | FP64, FP32, TF32, BF16, FP16, INT8, INT4 |
| Pile logicielle | cuda, vllm, sglang, tensorrt-llm |
Adéquation aux charges IA
Inférence LLM
Convient aux petits checkpoints, modèles compressés ou configurations distribuées dimensionnées par le moteur.
Ajustement fin et entraînement
Conçu pour des charges de calcul accélérées et soutenues ; l’aptitude à l’entraînement dépend de l’interconnexion, de la précision numérique et de la topologie du cluster.
Image, vidéo et représentations vectorielles
L’accélération FP16 prend en charge les charges génératives et vectorielles dans la VRAM indiquée.
Alimentation et refroidissement
La puissance publiée de 300 W exige un châssis, un flux d’air et une alimentation adaptés.
Usage multi-GPU
NVLink est l’interconnexion enregistrée ; la topologie doit encore être validée.
Écosystème logiciel
cuda, vllm, sglang, tensorrt-llm
Chronologie du produit
Source officielle du fabricant
https://www.nvidia.com/en-us/data-center/a40/
Dernière vérification: 2026-08-24