Инференс 7B/8B
Рекомендуется
NVIDIA · Ampere
Хорошо подходит для квантованного 70B-инференса, LoRA fine-tuning и высокопроизводительного serving.
Месячная аренда
~ USD 1.25/час из расчета 730 часов в месяц
Доступность: Available
Сравнить GPU| Поставщик | NVIDIA |
|---|---|
| Модель | NVIDIA A100 SXM 80GB |
| SKU | A100 SXM 80GB |
| Architecture | Ampere |
| Класс оборудования | datacenter gpu |
| VRAM | 80 GB |
|---|---|
| Тип памяти | HBM2e |
| Пропускная способность памяти | 2039 GB/s |
| Точность | Плотный режим | С разреженностью |
|---|---|---|
| FP64 | 9.7 TFLOPS | — |
| FP64 Tensor | 19.5 TFLOPS | — |
| FP32 | 19.5 TFLOPS | — |
| TF32 Tensor | 156 TFLOPS | 312 TFLOPS |
| BF16 Tensor | 312 TFLOPS | 624 TFLOPS |
| FP16 Tensor | 312 TFLOPS | 624 TFLOPS |
| INT8 Tensor | 624 TOPS | 1248 TOPS |
| Форм-фактор / интерфейс | SXM module |
|---|---|
| Интерфейс | PCIe Gen4 x16 host interface |
| TDP | 400 W |
| NVLink | 600 GB/s NVLink |
| NVSwitch | Поддерживается |
| MIG | До 7 MIG по 10 ГБ |
| Макс. GPU на узел | 8 |
| CUDA | Поддерживается |
|---|---|
| Проверка | OFFICIAL_VENDOR |
| Источник | www.nvidia.com |
Рекомендуется
Рекомендуется с квантованием или проверкой запаса FP16/BF16
Рекомендуется с квантованием для производственного запаса
Рекомендуется для квантованного инференса; проверьте контекст и параллельность
Подходит для LoRA/QLoRA; полный fine-tuning зависит от модели и топологии
Используйте multi-GPU узлы с высокоскоростной топологией
80 GB HBM3 · Available
USD 1,860/месяц
80 GB HBM2e · Limited capacity
USD 1,579/месяц
48 GB GDDR6 ECC · Available
USD 506/месяц
Подходит зависит от модели, точности, длины контекста и параллельности. Используйте рекомендатель для расчета с запасом.
Публичная месячная цена является одобренной версией цены. Почасовой эквивалент выводится из 730 часов в месяц.
Multi-GPU конфигурации доступны, если позволяют инвентарь и топология узла.