NVIDIA H100 SXM 80GB GPU accelerator

NVIDIA · Hopper

NVIDIA H100 SXM 80GB

Adecuado para inferencia 70B cuantizada, fine-tuning LoRA y servicio de alto rendimiento.

Alquiler mensual

USD 1,860/mes

~ USD 2.55/hora basado en un mes de 730 horas

Disponibilidad: Available

Comparar GPUs

Especificaciones técnicas

Identidad

Proveedor NVIDIA
Modelo NVIDIA H100 SXM 80GB
SKU H100 SXM
Architecture Hopper
Clase de hardware datacenter gpu

Memoria

VRAM 80 GB
Tipo de memoria HBM3
Ancho de banda de memoria 3350 GB/s

Cómputo

Precisión Denso Con dispersión
FP64 34 TFLOPS
FP64 Tensor 67 TFLOPS
FP32 67 TFLOPS
TF32 Tensor 494.5 TFLOPS 989 TFLOPS
BF16 Tensor 989.5 TFLOPS 1979 TFLOPS
FP16 Tensor 989.5 TFLOPS 1979 TFLOPS
FP8 Tensor 1979 TFLOPS 3958 TFLOPS
INT8 Tensor 1979 TOPS 3958 TOPS

Plataforma

Formato / interfaz SXM module
Interface PCIe Gen5 x16 host interface
TDP 700 W
NVLink 900 GB/s NVLink
NVSwitch Compatible
MIG Hasta 7 MIG de 10 GB
GPU máx. por nodo 8

Software

CUDA Compatible
Verificación OFFICIAL_VENDOR
Fuente www.nvidia.com

Adecuación de carga

  • Inferencia LLMMuy bueno
  • Fine-tuning LLMMuy bueno
  • Entrenamiento completoMuy bueno
  • Generación de imagen / vídeoMuy bueno
  • Embeddings / rerankingExcelente

Frameworks

  • PyTorch
  • TensorFlow
  • JAX
  • Hugging Face
  • vLLM
  • TensorRT
  • ONNX Runtime
  • CUDA

Guía de compatibilidad del modelo

Inferencia 7B/8B

Recomendado

Inferencia 13B/14B

Recomendado con cuantización o revisión de margen FP16/BF16

Inferencia 30B/32B

Recomendado con cuantización para mantener margen de producción

Inferencia 65B/70B

Recomendado para inferencia cuantizada; revise contexto y concurrencia

Fine-tuning

Adecuado para LoRA/QLoRA; el fine-tuning completo depende del modelo y la topología

Entrenamiento grande

Use nodos multi-GPU con topología de alto ancho de banda

GPUs relacionados

Preguntas sobre hosting GPU IA

¿Esta GPU sirve para inferencia LLM?

La idoneidad depende del modelo, precisión, contexto y concurrencia. Use el recomendador para dimensionar con margen.

¿Cómo se calcula el precio mensual?

El precio mensual público es la versión autorizada. El equivalente por hora deriva del precio mensual con una base de 730 horas.

¿Puedo alquilar varias GPU?

Las configuraciones multi-GPU son posibles cuando el inventario y la topología del nodo lo permiten.