NVIDIA H200 SXM 141GB GPU accelerator

NVIDIA · Hopper

NVIDIA H200 SXM 141GB

Лучше для крупных моделей, длинного контекста, тяжелого fine-tuning и ресурсоемких AI-нагрузок.

Месячная аренда

USD 2,345/месяц

~ USD 3.21/час из расчета 730 часов в месяц

Доступность: Limited capacity

Сравнить GPU

Технические характеристики

Идентификация

Поставщик NVIDIA
Модель NVIDIA H200 SXM 141GB
SKU H200 SXM
Architecture Hopper
Класс оборудования datacenter gpu

Память

VRAM 141 GB
Тип памяти HBM3e
Пропускная способность памяти 4800 GB/s

Вычисления

Точность Плотный режим С разреженностью
FP64 34 TFLOPS
FP64 Tensor 67 TFLOPS
FP32 67 TFLOPS
TF32 Tensor 494.5 TFLOPS 989 TFLOPS
BF16 Tensor 989.5 TFLOPS 1979 TFLOPS
FP16 Tensor 989.5 TFLOPS 1979 TFLOPS
FP8 Tensor 1979 TFLOPS 3958 TFLOPS
INT8 Tensor 1979 TOPS 3958 TOPS

Платформа

Форм-фактор / интерфейс SXM module
Интерфейс PCIe Gen5 x16 host interface
TDP 700 W
NVLink 900 GB/s NVLink
NVSwitch Поддерживается
MIG До 7 MIG по 18 ГБ
Макс. GPU на узел 8

ПО

CUDA Поддерживается
Проверка OFFICIAL_VENDOR
Источник www.nvidia.com

Подходит для нагрузок

  • LLM-инференсОтлично
  • LLM fine-tuningОтлично
  • Полное обучениеОтлично
  • Генерация изображений / видеоОтлично
  • Embeddings / rerankingОтлично

Фреймворки

  • PyTorch
  • TensorFlow
  • JAX
  • Hugging Face
  • vLLM
  • TensorRT
  • ONNX Runtime
  • CUDA

Совместимость моделей

Инференс 7B/8B

Рекомендуется

Инференс 13B/14B

Рекомендуется с квантованием или проверкой запаса FP16/BF16

Инференс 30B/32B

Рекомендуется с квантованием для производственного запаса

Инференс 65B/70B

Рекомендуется для квантованного инференса; проверьте контекст и параллельность

Fine-tuning

Подходит для LoRA/QLoRA; полный fine-tuning зависит от модели и топологии

Крупное обучение

Используйте multi-GPU узлы с высокоскоростной топологией

Похожие GPU

FAQ по AI GPU hosting

Подходит ли эта GPU для LLM-инференса?

Подходит зависит от модели, точности, длины контекста и параллельности. Используйте рекомендатель для расчета с запасом.

Как рассчитывается месячная цена?

Публичная месячная цена является одобренной версией цены. Почасовой эквивалент выводится из 730 часов в месяц.

Можно арендовать несколько GPU?

Multi-GPU конфигурации доступны, если позволяют инвентарь и топология узла.