7B/8B 推理
推荐
NVIDIA · Ada Lovelace
适合中型 LLM、图像生成、计算机视觉和成本可控的生产推理。
| 供应商 | NVIDIA |
|---|---|
| 型号 | NVIDIA L40S 48GB |
| SKU | L40S |
| Architecture | Ada Lovelace |
| 硬件类别 | datacenter gpu |
| VRAM | 48 GB |
|---|---|
| 内存类型 | GDDR6 ECC |
| 内存带宽 | 864 GB/s |
| 精度 | 密集 | 启用稀疏 |
|---|---|---|
| FP32 | 91.6 TFLOPS | — |
| TF32 Tensor | 183 TFLOPS | 366 TFLOPS |
| BF16 Tensor | 362.05 TFLOPS | 733 TFLOPS |
| FP16 Tensor | 362.05 TFLOPS | 733 TFLOPS |
| FP8 Tensor | 733 TFLOPS | 1466 TFLOPS |
| INT8 Tensor | 733 TOPS | 1466 TOPS |
| 外形 / 接口 | PCIe dual-slot accelerator card |
|---|---|
| Interface | PCIe Gen4 x16 |
| TDP | 350 W |
| NVLink | 不支持 |
| NVSwitch | 不支持 |
| MIG | 不支持 |
| 每节点最大 GPU 数 | 8 |
| CUDA | 支持 |
|---|---|
| 验证 | OFFICIAL_VENDOR |
| 来源 | www.nvidia.com |
推荐
建议使用量化,或检查 FP16/BF16 余量
建议使用量化以保留生产余量
通常需要多块 GPU 或更强量化
适合 LoRA/QLoRA;完整微调取决于模型大小和拓扑
不是大规模分布式训练的首选
24 GB GDDR6 · Available
USD 250/月
80 GB HBM3 · Available
USD 1,860/月
80 GB HBM2e · Limited capacity
USD 1,579/月
适配度取决于模型、精度、上下文和并发。请使用推荐器按余量计算。
公开月租是已授权价格版本。小时等价从月价按 730 小时换算。
当库存和节点拓扑允许时,可以提供多 GPU 配置。