NVIDIA L4 24GB GPU accelerator

NVIDIA · Ada Lovelace

NVIDIA L4 24GB

Эффективно для малых моделей, embeddings, reranking, разработки и сервисов с ограниченным бюджетом.

Месячная аренда

USD 250/месяц

~ USD 0.34/час из расчета 730 часов в месяц

Доступность: Available

Сравнить GPU

Технические характеристики

Идентификация

Поставщик NVIDIA
Модель NVIDIA L4 24GB
SKU L4
Architecture Ada Lovelace
Класс оборудования datacenter gpu

Память

VRAM 24 GB
Тип памяти GDDR6
Пропускная способность памяти 300 GB/s

Вычисления

Точность Плотный режим С разреженностью
FP32 30.3 TFLOPS
TF32 Tensor 60 TFLOPS 120 TFLOPS
BF16 Tensor 121 TFLOPS 242 TFLOPS
FP16 Tensor 121 TFLOPS 242 TFLOPS
FP8 Tensor 242.5 TFLOPS 485 TFLOPS
INT8 Tensor 242.5 TOPS 485 TOPS

Платформа

Форм-фактор / интерфейс PCIe low-profile accelerator card
Интерфейс PCIe Gen4 x16
TDP 72 W
NVLink Не поддерживается
NVSwitch Не поддерживается
MIG Не поддерживается
Макс. GPU на узел 8

ПО

CUDA Поддерживается
Проверка OFFICIAL_VENDOR
Источник www.nvidia.com

Подходит для нагрузок

  • LLM-инференсПодходит
  • LLM fine-tuningОграничено
  • Полное обучениеОграничено
  • Генерация изображений / видеоПодходит
  • Embeddings / rerankingОтлично

Фреймворки

  • PyTorch
  • TensorFlow
  • JAX
  • Hugging Face
  • vLLM
  • TensorRT
  • ONNX Runtime
  • CUDA

Совместимость моделей

Инференс 7B/8B

Рекомендуется

Инференс 13B/14B

Рекомендуется с квантованием или проверкой запаса FP16/BF16

Инференс 30B/32B

Ограничено

Инференс 65B/70B

Обычно требует несколько GPU или более сильное квантование

Fine-tuning

Ограничено малыми или адаптированными нагрузками

Крупное обучение

Не основной вариант для крупного распределенного обучения

Похожие GPU

FAQ по AI GPU hosting

Подходит ли эта GPU для LLM-инференса?

Подходит зависит от модели, точности, длины контекста и параллельности. Используйте рекомендатель для расчета с запасом.

Как рассчитывается месячная цена?

Публичная месячная цена является одобренной версией цены. Почасовой эквивалент выводится из 730 часов в месяц.

Можно арендовать несколько GPU?

Multi-GPU конфигурации доступны, если позволяют инвентарь и топология узла.