NVIDIA H100 PCIe 80GB GPU accelerator

NVIDIA · Hopper

NVIDIA H100 PCIe 80GB

适合量化 70B 推理、LoRA 微调和高吞吐服务。

月租

USD 1,579/月

~ USD 2.16/小时 按每月 730 小时计算

可用性: Limited capacity

比较 GPU

技术规格

身份

供应商 NVIDIA
型号 NVIDIA H100 PCIe 80GB
SKU H100 PCIe
Architecture Hopper
硬件类别 datacenter gpu

内存

VRAM 80 GB
内存类型 HBM2e
内存带宽 2000 GB/s

计算

精度 密集 启用稀疏
FP64 26 TFLOPS
FP64 Tensor 51 TFLOPS
FP32 51 TFLOPS
TF32 Tensor 378 TFLOPS 756 TFLOPS
BF16 Tensor 756.5 TFLOPS 1513 TFLOPS
FP16 Tensor 756.5 TFLOPS 1513 TFLOPS
FP8 Tensor 1513 TFLOPS 3026 TFLOPS
INT8 Tensor 1513 TOPS 3026 TOPS

平台

外形 / 接口 PCIe dual-slot accelerator card
Interface PCIe Gen5 x16
TDP 350 W
NVLink 600 GB/s NVLink Bridge
NVSwitch 不支持
MIG 最多 7 个 MIG,每个 10 GB
每节点最大 GPU 数 8

软件

CUDA 支持
验证 OFFICIAL_VENDOR
来源 www.nvidia.com

工作负载适配

  • LLM 推理很好
  • LLM 微调很好
  • 完整模型训练很好
  • 图像 / 视频生成很好
  • embedding / reranking优秀

框架

  • PyTorch
  • TensorFlow
  • JAX
  • Hugging Face
  • vLLM
  • TensorRT
  • ONNX Runtime
  • CUDA

模型兼容指南

7B/8B 推理

推荐

13B/14B 推理

建议使用量化,或检查 FP16/BF16 余量

30B/32B 推理

建议使用量化以保留生产余量

65B/70B 推理

推荐用于量化推理;需要检查上下文和并发

微调

适合 LoRA/QLoRA;完整微调取决于模型大小和拓扑

大规模训练

使用高带宽拓扑的多 GPU 节点

相关 GPU

AI GPU hosting 常见问题

这块 GPU 适合 LLM 推理吗?

适配度取决于模型、精度、上下文和并发。请使用推荐器按余量计算。

月租价格如何计算?

公开月租是已授权价格版本。小时等价从月价按 730 小时换算。

可以租多块 GPU 吗?

当库存和节点拓扑允许时,可以提供多 GPU 配置。