NVIDIA H200 SXM 141GB GPU accelerator

NVIDIA · Hopper

NVIDIA H200 SXM 141GB

适合大模型、长上下文、重型微调和高显存 AI 工作负载。

月租

USD 2,345/月

~ USD 3.21/小时 按每月 730 小时计算

可用性: Limited capacity

比较 GPU

技术规格

身份

供应商 NVIDIA
型号 NVIDIA H200 SXM 141GB
SKU H200 SXM
Architecture Hopper
硬件类别 datacenter gpu

内存

VRAM 141 GB
内存类型 HBM3e
内存带宽 4800 GB/s

计算

精度 密集 启用稀疏
FP64 34 TFLOPS
FP64 Tensor 67 TFLOPS
FP32 67 TFLOPS
TF32 Tensor 494.5 TFLOPS 989 TFLOPS
BF16 Tensor 989.5 TFLOPS 1979 TFLOPS
FP16 Tensor 989.5 TFLOPS 1979 TFLOPS
FP8 Tensor 1979 TFLOPS 3958 TFLOPS
INT8 Tensor 1979 TOPS 3958 TOPS

平台

外形 / 接口 SXM module
Interface PCIe Gen5 x16 host interface
TDP 700 W
NVLink 900 GB/s NVLink
NVSwitch 支持
MIG 最多 7 个 MIG,每个 18 GB
每节点最大 GPU 数 8

软件

CUDA 支持
验证 OFFICIAL_VENDOR
来源 www.nvidia.com

工作负载适配

  • LLM 推理优秀
  • LLM 微调优秀
  • 完整模型训练优秀
  • 图像 / 视频生成优秀
  • embedding / reranking优秀

框架

  • PyTorch
  • TensorFlow
  • JAX
  • Hugging Face
  • vLLM
  • TensorRT
  • ONNX Runtime
  • CUDA

模型兼容指南

7B/8B 推理

推荐

13B/14B 推理

建议使用量化,或检查 FP16/BF16 余量

30B/32B 推理

建议使用量化以保留生产余量

65B/70B 推理

推荐用于量化推理;需要检查上下文和并发

微调

适合 LoRA/QLoRA;完整微调取决于模型大小和拓扑

大规模训练

使用高带宽拓扑的多 GPU 节点

相关 GPU

AI GPU hosting 常见问题

这块 GPU 适合 LLM 推理吗?

适配度取决于模型、精度、上下文和并发。请使用推荐器按余量计算。

月租价格如何计算?

公开月租是已授权价格版本。小时等价从月价按 730 小时换算。

可以租多块 GPU 吗?

当库存和节点拓扑允许时,可以提供多 GPU 配置。