NVIDIA L4 24GB GPU accelerator

NVIDIA · Ada Lovelace

NVIDIA L4 24GB

适合小模型推理、embedding、reranking、开发和成本敏感 AI 服务。

月租

USD 250/月

~ USD 0.34/小时 按每月 730 小时计算

可用性: Available

比较 GPU

技术规格

身份

供应商 NVIDIA
型号 NVIDIA L4 24GB
SKU L4
Architecture Ada Lovelace
硬件类别 datacenter gpu

内存

VRAM 24 GB
内存类型 GDDR6
内存带宽 300 GB/s

计算

精度 密集 启用稀疏
FP32 30.3 TFLOPS
TF32 Tensor 60 TFLOPS 120 TFLOPS
BF16 Tensor 121 TFLOPS 242 TFLOPS
FP16 Tensor 121 TFLOPS 242 TFLOPS
FP8 Tensor 242.5 TFLOPS 485 TFLOPS
INT8 Tensor 242.5 TOPS 485 TOPS

平台

外形 / 接口 PCIe low-profile accelerator card
Interface PCIe Gen4 x16
TDP 72 W
NVLink 不支持
NVSwitch 不支持
MIG 不支持
每节点最大 GPU 数 8

软件

CUDA 支持
验证 OFFICIAL_VENDOR
来源 www.nvidia.com

工作负载适配

  • LLM 推理适合
  • LLM 微调有限
  • 完整模型训练有限
  • 图像 / 视频生成适合
  • embedding / reranking优秀

框架

  • PyTorch
  • TensorFlow
  • JAX
  • Hugging Face
  • vLLM
  • TensorRT
  • ONNX Runtime
  • CUDA

模型兼容指南

7B/8B 推理

推荐

13B/14B 推理

建议使用量化,或检查 FP16/BF16 余量

30B/32B 推理

有限

65B/70B 推理

通常需要多块 GPU 或更强量化

微调

仅适合小型或适配后的工作负载

大规模训练

不是大规模分布式训练的首选

相关 GPU

AI GPU hosting 常见问题

这块 GPU 适合 LLM 推理吗?

适配度取决于模型、精度、上下文和并发。请使用推荐器按余量计算。

月租价格如何计算?

公开月租是已授权价格版本。小时等价从月价按 730 小时换算。

可以租多块 GPU 吗?

当库存和节点拓扑允许时,可以提供多 GPU 配置。