Инференс 7B/8B
Рекомендуется
NVIDIA · Hopper
Хорошо подходит для квантованного 70B-инференса, LoRA fine-tuning и высокопроизводительного serving.
Месячная аренда
~ USD 2.16/час из расчета 730 часов в месяц
Доступность: Limited capacity
Сравнить GPU| Поставщик | NVIDIA |
|---|---|
| Модель | NVIDIA H100 PCIe 80GB |
| SKU | H100 PCIe |
| Architecture | Hopper |
| Класс оборудования | datacenter gpu |
| VRAM | 80 GB |
|---|---|
| Тип памяти | HBM2e |
| Пропускная способность памяти | 2000 GB/s |
| Точность | Плотный режим | С разреженностью |
|---|---|---|
| FP64 | 26 TFLOPS | — |
| FP64 Tensor | 51 TFLOPS | — |
| FP32 | 51 TFLOPS | — |
| TF32 Tensor | 378 TFLOPS | 756 TFLOPS |
| BF16 Tensor | 756.5 TFLOPS | 1513 TFLOPS |
| FP16 Tensor | 756.5 TFLOPS | 1513 TFLOPS |
| FP8 Tensor | 1513 TFLOPS | 3026 TFLOPS |
| INT8 Tensor | 1513 TOPS | 3026 TOPS |
| Форм-фактор / интерфейс | PCIe dual-slot accelerator card |
|---|---|
| Интерфейс | PCIe Gen5 x16 |
| TDP | 350 W |
| NVLink | 600 GB/s NVLink Bridge |
| NVSwitch | Не поддерживается |
| MIG | До 7 MIG по 10 ГБ |
| Макс. GPU на узел | 8 |
| CUDA | Поддерживается |
|---|---|
| Проверка | OFFICIAL_VENDOR |
| Источник | www.nvidia.com |
Рекомендуется
Рекомендуется с квантованием или проверкой запаса FP16/BF16
Рекомендуется с квантованием для производственного запаса
Рекомендуется для квантованного инференса; проверьте контекст и параллельность
Подходит для LoRA/QLoRA; полный fine-tuning зависит от модели и топологии
Используйте multi-GPU узлы с высокоскоростной топологией
80 GB HBM3 · Available
USD 1,860/месяц
80 GB HBM2e · Available
USD 915/месяц
48 GB GDDR6 ECC · Available
USD 506/месяц
Подходит зависит от модели, точности, длины контекста и параллельности. Используйте рекомендатель для расчета с запасом.
Публичная месячная цена является одобренной версией цены. Почасовой эквивалент выводится из 730 часов в месяц.
Multi-GPU конфигурации доступны, если позволяют инвентарь и топология узла.