7B/8B 推理
推荐
NVIDIA · Hopper
适合量化 70B 推理、LoRA 微调和高吞吐服务。
| 供应商 | NVIDIA |
|---|---|
| 型号 | NVIDIA H100 SXM 80GB |
| SKU | H100 SXM |
| Architecture | Hopper |
| 硬件类别 | datacenter gpu |
| VRAM | 80 GB |
|---|---|
| 内存类型 | HBM3 |
| 内存带宽 | 3350 GB/s |
| 精度 | 密集 | 启用稀疏 |
|---|---|---|
| FP64 | 34 TFLOPS | — |
| FP64 Tensor | 67 TFLOPS | — |
| FP32 | 67 TFLOPS | — |
| TF32 Tensor | 494.5 TFLOPS | 989 TFLOPS |
| BF16 Tensor | 989.5 TFLOPS | 1979 TFLOPS |
| FP16 Tensor | 989.5 TFLOPS | 1979 TFLOPS |
| FP8 Tensor | 1979 TFLOPS | 3958 TFLOPS |
| INT8 Tensor | 1979 TOPS | 3958 TOPS |
| 外形 / 接口 | SXM module |
|---|---|
| Interface | PCIe Gen5 x16 host interface |
| TDP | 700 W |
| NVLink | 900 GB/s NVLink |
| NVSwitch | 支持 |
| MIG | 最多 7 个 MIG,每个 10 GB |
| 每节点最大 GPU 数 | 8 |
| CUDA | 支持 |
|---|---|
| 验证 | OFFICIAL_VENDOR |
| 来源 | www.nvidia.com |
推荐
建议使用量化,或检查 FP16/BF16 余量
建议使用量化以保留生产余量
推荐用于量化推理;需要检查上下文和并发
适合 LoRA/QLoRA;完整微调取决于模型大小和拓扑
使用高带宽拓扑的多 GPU 节点
80 GB HBM2e · Limited capacity
USD 1,579/月
80 GB HBM2e · Available
USD 915/月
48 GB GDDR6 ECC · Available
USD 506/月
适配度取决于模型、精度、上下文和并发。请使用推荐器按余量计算。
公开月租是已授权价格版本。小时等价从月价按 730 小时换算。
当库存和节点拓扑允许时,可以提供多 GPU 配置。