Инференс 7B/8B
Рекомендуется
NVIDIA · Ada Lovelace
Сбалансировано для средних LLM, генерации изображений, computer vision и экономичной production-инференс.
Месячная аренда
~ USD 0.69/час из расчета 730 часов в месяц
Доступность: Available
Сравнить GPU| Поставщик | NVIDIA |
|---|---|
| Модель | NVIDIA L40S 48GB |
| SKU | L40S |
| Architecture | Ada Lovelace |
| Класс оборудования | datacenter gpu |
| VRAM | 48 GB |
|---|---|
| Тип памяти | GDDR6 ECC |
| Пропускная способность памяти | 864 GB/s |
| Точность | Плотный режим | С разреженностью |
|---|---|---|
| FP32 | 91.6 TFLOPS | — |
| TF32 Tensor | 183 TFLOPS | 366 TFLOPS |
| BF16 Tensor | 362.05 TFLOPS | 733 TFLOPS |
| FP16 Tensor | 362.05 TFLOPS | 733 TFLOPS |
| FP8 Tensor | 733 TFLOPS | 1466 TFLOPS |
| INT8 Tensor | 733 TOPS | 1466 TOPS |
| Форм-фактор / интерфейс | PCIe dual-slot accelerator card |
|---|---|
| Интерфейс | PCIe Gen4 x16 |
| TDP | 350 W |
| NVLink | Не поддерживается |
| NVSwitch | Не поддерживается |
| MIG | Не поддерживается |
| Макс. GPU на узел | 8 |
| CUDA | Поддерживается |
|---|---|
| Проверка | OFFICIAL_VENDOR |
| Источник | www.nvidia.com |
Рекомендуется
Рекомендуется с квантованием или проверкой запаса FP16/BF16
Рекомендуется с квантованием для производственного запаса
Обычно требует несколько GPU или более сильное квантование
Подходит для LoRA/QLoRA; полный fine-tuning зависит от модели и топологии
Не основной вариант для крупного распределенного обучения
24 GB GDDR6 · Available
USD 250/месяц
80 GB HBM3 · Available
USD 1,860/месяц
80 GB HBM2e · Limited capacity
USD 1,579/месяц
Подходит зависит от модели, точности, длины контекста и параллельности. Используйте рекомендатель для расчета с запасом.
Публичная месячная цена является одобренной версией цены. Почасовой эквивалент выводится из 730 часов в месяц.
Multi-GPU конфигурации доступны, если позволяют инвентарь и топология узла.