NVIDIA · 数据中心 · 加速卡
NVIDIA H200 NVL 141GB
H200 NVL 的精确参考规格与 AI 部署建议,与 FusionPointAI 商业库存分离。
当前
仅供参考
已验证技术规格
| 制造商 | NVIDIA |
|---|---|
| 精确 SKU | H200 NVL |
| 产品家族 | NVIDIA H200 |
| 架构 | Hopper |
| 代际 | Hopper |
| 实体类型 | 加速卡 |
| 生命周期 | 当前 |
| 发布日期 | 制造商尚未公布此信息。 |
| VRAM | 141 GB |
| 内存技术 | HBM3e |
| 内存带宽 | 4,800 GB/s |
| 功耗 | 600 W |
| 接口 | PCIe Gen5 x16 |
| 形态 | 双槽 · PCIe · 加速器 |
| 互连 | NVLink |
| MIG / 分区 | 支持 |
| AI 数值格式支持 | FP64, FP32, TF32, BF16, FP16, FP8, INT8 |
| 软件栈 | cuda |
AI 工作负载适配性
LLM 推理
高内存容量在运行时与拓扑认证后可支持大型检查点和多 GPU 推理。
微调与训练
适用于需要持续运行加速器的工作负载;是否适合训练取决于互连方式、数值精度和集群拓扑。
图像、视频与嵌入
FP16 加速可在所列 VRAM 范围内支持常见生成与向量工作负载。
供电与散热
公布功耗 600 W,需要适配该形态的机箱、气流和供电。
多 GPU 使用
NVLink 是记录的互连路径;仍需在节点级验证拓扑。
软件生态
cuda