已验证技术规格
| 制造商 | NVIDIA |
|---|---|
| 精确 SKU | A30 |
| 产品家族 | NVIDIA A30 |
| 架构 | Ampere |
| 代际 | Ampere 数据中心 |
| 实体类型 | 加速卡 |
| 生命周期 | 上一代 |
| 发布日期 | 制造商尚未公布此信息。 |
| VRAM | 24 GB |
| 内存技术 | HBM2 |
| 内存带宽 | 933 GB/s |
| 功耗 | 165 W |
| 接口 | PCIe Gen4 x16 |
| 形态 | 双槽 · PCIe · 加速器 |
| 互连 | NVLink |
| MIG / 分区 | 支持 |
| AI 数值格式支持 | FP64, FP32, TF32, BF16, FP16, INT8, INT4 |
| 软件栈 | cuda, vllm, sglang, tensorrt-llm |
AI 工作负载适配性
LLM 推理
适合较小检查点、压缩模型或由推荐引擎估算的分布式配置。
微调与训练
适用于需要持续运行加速器的工作负载;是否适合训练取决于互连方式、数值精度和集群拓扑。
图像、视频与嵌入
FP16 加速可在所列 VRAM 范围内支持常见生成与向量工作负载。
供电与散热
公布功耗 165 W,需要适配该形态的机箱、气流和供电。
多 GPU 使用
NVLink 是记录的互连路径;仍需在节点级验证拓扑。
软件生态
cuda, vllm, sglang, tensorrt-llm