NVIDIA A100 SXM 80GB GPU accelerator

NVIDIA · Ampere

NVIDIA A100 SXM 80GB

Хорошо подходит для квантованного 70B-инференса, LoRA fine-tuning и высокопроизводительного serving.

Месячная аренда

USD 915/месяц

~ USD 1.25/час из расчета 730 часов в месяц

Доступность: Available

Сравнить GPU

Технические характеристики

Идентификация

Поставщик NVIDIA
Модель NVIDIA A100 SXM 80GB
SKU A100 SXM 80GB
Architecture Ampere
Класс оборудования datacenter gpu

Память

VRAM 80 GB
Тип памяти HBM2e
Пропускная способность памяти 2039 GB/s

Вычисления

Точность Плотный режим С разреженностью
FP64 9.7 TFLOPS
FP64 Tensor 19.5 TFLOPS
FP32 19.5 TFLOPS
TF32 Tensor 156 TFLOPS 312 TFLOPS
BF16 Tensor 312 TFLOPS 624 TFLOPS
FP16 Tensor 312 TFLOPS 624 TFLOPS
INT8 Tensor 624 TOPS 1248 TOPS

Платформа

Форм-фактор / интерфейс SXM module
Интерфейс PCIe Gen4 x16 host interface
TDP 400 W
NVLink 600 GB/s NVLink
NVSwitch Поддерживается
MIG До 7 MIG по 10 ГБ
Макс. GPU на узел 8

ПО

CUDA Поддерживается
Проверка OFFICIAL_VENDOR
Источник www.nvidia.com

Подходит для нагрузок

  • LLM-инференсОчень хорошо
  • LLM fine-tuningОчень хорошо
  • Полное обучениеОчень хорошо
  • Генерация изображений / видеоОчень хорошо
  • Embeddings / rerankingОтлично

Фреймворки

  • PyTorch
  • TensorFlow
  • JAX
  • Hugging Face
  • vLLM
  • TensorRT
  • ONNX Runtime
  • CUDA

Совместимость моделей

Инференс 7B/8B

Рекомендуется

Инференс 13B/14B

Рекомендуется с квантованием или проверкой запаса FP16/BF16

Инференс 30B/32B

Рекомендуется с квантованием для производственного запаса

Инференс 65B/70B

Рекомендуется для квантованного инференса; проверьте контекст и параллельность

Fine-tuning

Подходит для LoRA/QLoRA; полный fine-tuning зависит от модели и топологии

Крупное обучение

Используйте multi-GPU узлы с высокоскоростной топологией

Похожие GPU

FAQ по AI GPU hosting

Подходит ли эта GPU для LLM-инференса?

Подходит зависит от модели, точности, длины контекста и параллельности. Используйте рекомендатель для расчета с запасом.

Как рассчитывается месячная цена?

Публичная месячная цена является одобренной версией цены. Почасовой эквивалент выводится из 730 часов в месяц.

Можно арендовать несколько GPU?

Multi-GPU конфигурации доступны, если позволяют инвентарь и топология узла.