Инференс 7B/8B
Рекомендуется
NVIDIA · Hopper
Хорошо подходит для квантованного 70B-инференса, LoRA fine-tuning и высокопроизводительного serving.
Месячная аренда
~ USD 2.55/час из расчета 730 часов в месяц
Доступность: Available
Сравнить GPU| Поставщик | NVIDIA |
|---|---|
| Модель | NVIDIA H100 SXM 80GB |
| SKU | H100 SXM |
| Architecture | Hopper |
| Класс оборудования | datacenter gpu |
| VRAM | 80 GB |
|---|---|
| Тип памяти | HBM3 |
| Пропускная способность памяти | 3350 GB/s |
| Точность | Плотный режим | С разреженностью |
|---|---|---|
| FP64 | 34 TFLOPS | — |
| FP64 Tensor | 67 TFLOPS | — |
| FP32 | 67 TFLOPS | — |
| TF32 Tensor | 494.5 TFLOPS | 989 TFLOPS |
| BF16 Tensor | 989.5 TFLOPS | 1979 TFLOPS |
| FP16 Tensor | 989.5 TFLOPS | 1979 TFLOPS |
| FP8 Tensor | 1979 TFLOPS | 3958 TFLOPS |
| INT8 Tensor | 1979 TOPS | 3958 TOPS |
| Форм-фактор / интерфейс | SXM module |
|---|---|
| Интерфейс | PCIe Gen5 x16 host interface |
| TDP | 700 W |
| NVLink | 900 GB/s NVLink |
| NVSwitch | Поддерживается |
| MIG | До 7 MIG по 10 ГБ |
| Макс. GPU на узел | 8 |
| CUDA | Поддерживается |
|---|---|
| Проверка | OFFICIAL_VENDOR |
| Источник | www.nvidia.com |
Рекомендуется
Рекомендуется с квантованием или проверкой запаса FP16/BF16
Рекомендуется с квантованием для производственного запаса
Рекомендуется для квантованного инференса; проверьте контекст и параллельность
Подходит для LoRA/QLoRA; полный fine-tuning зависит от модели и топологии
Используйте multi-GPU узлы с высокоскоростной топологией
80 GB HBM2e · Limited capacity
USD 1,579/месяц
80 GB HBM2e · Available
USD 915/месяц
48 GB GDDR6 ECC · Available
USD 506/месяц
Подходит зависит от модели, точности, длины контекста и параллельности. Используйте рекомендатель для расчета с запасом.
Публичная месячная цена является одобренной версией цены. Почасовой эквивалент выводится из 730 часов в месяц.
Multi-GPU конфигурации доступны, если позволяют инвентарь и топология узла.