7B/8B 推理
推荐
NVIDIA · Hopper
适合量化 70B 推理、LoRA 微调和高吞吐服务。
| 供应商 | NVIDIA |
|---|---|
| 型号 | NVIDIA H100 PCIe 80GB |
| SKU | H100 PCIe |
| Architecture | Hopper |
| 硬件类别 | datacenter gpu |
| VRAM | 80 GB |
|---|---|
| 内存类型 | HBM2e |
| 内存带宽 | 2000 GB/s |
| 精度 | 密集 | 启用稀疏 |
|---|---|---|
| FP64 | 26 TFLOPS | — |
| FP64 Tensor | 51 TFLOPS | — |
| FP32 | 51 TFLOPS | — |
| TF32 Tensor | 378 TFLOPS | 756 TFLOPS |
| BF16 Tensor | 756.5 TFLOPS | 1513 TFLOPS |
| FP16 Tensor | 756.5 TFLOPS | 1513 TFLOPS |
| FP8 Tensor | 1513 TFLOPS | 3026 TFLOPS |
| INT8 Tensor | 1513 TOPS | 3026 TOPS |
| 外形 / 接口 | PCIe dual-slot accelerator card |
|---|---|
| Interface | PCIe Gen5 x16 |
| TDP | 350 W |
| NVLink | 600 GB/s NVLink Bridge |
| NVSwitch | 不支持 |
| MIG | 最多 7 个 MIG,每个 10 GB |
| 每节点最大 GPU 数 | 8 |
| CUDA | 支持 |
|---|---|
| 验证 | OFFICIAL_VENDOR |
| 来源 | www.nvidia.com |
推荐
建议使用量化,或检查 FP16/BF16 余量
建议使用量化以保留生产余量
推荐用于量化推理;需要检查上下文和并发
适合 LoRA/QLoRA;完整微调取决于模型大小和拓扑
使用高带宽拓扑的多 GPU 节点
80 GB HBM3 · Available
USD 1,860/月
80 GB HBM2e · Available
USD 915/月
48 GB GDDR6 ECC · Available
USD 506/月
适配度取决于模型、精度、上下文和并发。请使用推荐器按余量计算。
公开月租是已授权价格版本。小时等价从月价按 730 小时换算。
当库存和节点拓扑允许时,可以提供多 GPU 配置。