NVIDIA H100 SXM 80GB GPU accelerator

NVIDIA · Hopper

NVIDIA H100 SXM 80GB

Хорошо подходит для квантованного 70B-инференса, LoRA fine-tuning и высокопроизводительного serving.

Месячная аренда

USD 1,860/месяц

~ USD 2.55/час из расчета 730 часов в месяц

Доступность: Available

Сравнить GPU

Технические характеристики

Идентификация

Поставщик NVIDIA
Модель NVIDIA H100 SXM 80GB
SKU H100 SXM
Architecture Hopper
Класс оборудования datacenter gpu

Память

VRAM 80 GB
Тип памяти HBM3
Пропускная способность памяти 3350 GB/s

Вычисления

Точность Плотный режим С разреженностью
FP64 34 TFLOPS
FP64 Tensor 67 TFLOPS
FP32 67 TFLOPS
TF32 Tensor 494.5 TFLOPS 989 TFLOPS
BF16 Tensor 989.5 TFLOPS 1979 TFLOPS
FP16 Tensor 989.5 TFLOPS 1979 TFLOPS
FP8 Tensor 1979 TFLOPS 3958 TFLOPS
INT8 Tensor 1979 TOPS 3958 TOPS

Платформа

Форм-фактор / интерфейс SXM module
Интерфейс PCIe Gen5 x16 host interface
TDP 700 W
NVLink 900 GB/s NVLink
NVSwitch Поддерживается
MIG До 7 MIG по 10 ГБ
Макс. GPU на узел 8

ПО

CUDA Поддерживается
Проверка OFFICIAL_VENDOR
Источник www.nvidia.com

Подходит для нагрузок

  • LLM-инференсОчень хорошо
  • LLM fine-tuningОчень хорошо
  • Полное обучениеОчень хорошо
  • Генерация изображений / видеоОчень хорошо
  • Embeddings / rerankingОтлично

Фреймворки

  • PyTorch
  • TensorFlow
  • JAX
  • Hugging Face
  • vLLM
  • TensorRT
  • ONNX Runtime
  • CUDA

Совместимость моделей

Инференс 7B/8B

Рекомендуется

Инференс 13B/14B

Рекомендуется с квантованием или проверкой запаса FP16/BF16

Инференс 30B/32B

Рекомендуется с квантованием для производственного запаса

Инференс 65B/70B

Рекомендуется для квантованного инференса; проверьте контекст и параллельность

Fine-tuning

Подходит для LoRA/QLoRA; полный fine-tuning зависит от модели и топологии

Крупное обучение

Используйте multi-GPU узлы с высокоскоростной топологией

Похожие GPU

FAQ по AI GPU hosting

Подходит ли эта GPU для LLM-инференса?

Подходит зависит от модели, точности, длины контекста и параллельности. Используйте рекомендатель для расчета с запасом.

Как рассчитывается месячная цена?

Публичная месячная цена является одобренной версией цены. Почасовой эквивалент выводится из 730 часов в месяц.

Можно арендовать несколько GPU?

Multi-GPU конфигурации доступны, если позволяют инвентарь и топология узла.