NVIDIA L40S 48GB GPU accelerator

NVIDIA · Ada Lovelace

NVIDIA L40S 48GB

Сбалансировано для средних LLM, генерации изображений, computer vision и экономичной production-инференс.

Месячная аренда

USD 506/месяц

~ USD 0.69/час из расчета 730 часов в месяц

Доступность: Available

Сравнить GPU

Технические характеристики

Идентификация

Поставщик NVIDIA
Модель NVIDIA L40S 48GB
SKU L40S
Architecture Ada Lovelace
Класс оборудования datacenter gpu

Память

VRAM 48 GB
Тип памяти GDDR6 ECC
Пропускная способность памяти 864 GB/s

Вычисления

Точность Плотный режим С разреженностью
FP32 91.6 TFLOPS
TF32 Tensor 183 TFLOPS 366 TFLOPS
BF16 Tensor 362.05 TFLOPS 733 TFLOPS
FP16 Tensor 362.05 TFLOPS 733 TFLOPS
FP8 Tensor 733 TFLOPS 1466 TFLOPS
INT8 Tensor 733 TOPS 1466 TOPS

Платформа

Форм-фактор / интерфейс PCIe dual-slot accelerator card
Интерфейс PCIe Gen4 x16
TDP 350 W
NVLink Не поддерживается
NVSwitch Не поддерживается
MIG Не поддерживается
Макс. GPU на узел 8

ПО

CUDA Поддерживается
Проверка OFFICIAL_VENDOR
Источник www.nvidia.com

Подходит для нагрузок

  • LLM-инференсОчень хорошо
  • LLM fine-tuningПодходит
  • Полное обучениеПодходит
  • Генерация изображений / видеоОчень хорошо
  • Embeddings / rerankingОтлично

Фреймворки

  • PyTorch
  • TensorFlow
  • JAX
  • Hugging Face
  • vLLM
  • TensorRT
  • ONNX Runtime
  • CUDA

Совместимость моделей

Инференс 7B/8B

Рекомендуется

Инференс 13B/14B

Рекомендуется с квантованием или проверкой запаса FP16/BF16

Инференс 30B/32B

Рекомендуется с квантованием для производственного запаса

Инференс 65B/70B

Обычно требует несколько GPU или более сильное квантование

Fine-tuning

Подходит для LoRA/QLoRA; полный fine-tuning зависит от модели и топологии

Крупное обучение

Не основной вариант для крупного распределенного обучения

Похожие GPU

FAQ по AI GPU hosting

Подходит ли эта GPU для LLM-инференса?

Подходит зависит от модели, точности, длины контекста и параллельности. Используйте рекомендатель для расчета с запасом.

Как рассчитывается месячная цена?

Публичная месячная цена является одобренной версией цены. Почасовой эквивалент выводится из 730 часов в месяц.

Можно арендовать несколько GPU?

Multi-GPU конфигурации доступны, если позволяют инвентарь и топология узла.