Dimensionamiento por modelo Ofertas con inventario Cotizaciones versionadas

Cloud GPU de alto rendimiento para IA

Alquile GPUs con precios desde base de datos para inferencia LLM, fine-tuning, cargas multimodales, visión computacional e investigación.

6
opciones GPU públicas
6
GPUs con precio de alquiler
730
base horas/mes

Catálogo GPU y capacidad disponible

Browse hardware the calculator understands before running a workload-specific recommendation. Catalogue entries are separate from live capacity and approved pricing.

NVIDIA H200 SXM 141GB GPU accelerator
NVIDIA · Hopper

NVIDIA H200 SXM 141GB

Ideal para modelos grandes, contexto largo, fine-tuning pesado y cargas IA intensivas en memoria.

VRAM
141 GB
Memoria
HBM3e
Ancho de banda
4,800 GB/s
Limited capacity Ideal para revisión de carga
USD 2,345/mes ~ USD 3.21/hora
NVIDIA H100 SXM 80GB GPU accelerator
NVIDIA · Hopper

NVIDIA H100 SXM 80GB

Adecuado para inferencia 70B cuantizada, fine-tuning LoRA y servicio de alto rendimiento.

VRAM
80 GB
Memoria
HBM3
Ancho de banda
3,350 GB/s
Available Ideal para revisión de carga
USD 1,860/mes ~ USD 2.55/hora
NVIDIA H100 PCIe 80GB GPU accelerator
NVIDIA · Hopper

NVIDIA H100 PCIe 80GB

Adecuado para inferencia 70B cuantizada, fine-tuning LoRA y servicio de alto rendimiento.

VRAM
80 GB
Memoria
HBM2e
Ancho de banda
2,000 GB/s
Limited capacity Ideal para revisión de carga
USD 1,579/mes ~ USD 2.16/hora
NVIDIA A100 SXM 80GB GPU accelerator
NVIDIA · Ampere

NVIDIA A100 SXM 80GB

Adecuado para inferencia 70B cuantizada, fine-tuning LoRA y servicio de alto rendimiento.

VRAM
80 GB
Memoria
HBM2e
Ancho de banda
2,039 GB/s
Available Ideal para revisión de carga
USD 915/mes ~ USD 1.25/hora
NVIDIA L40S 48GB GPU accelerator
NVIDIA · Ada Lovelace

NVIDIA L40S 48GB

Equilibrado para LLM medianos, generación de imágenes, visión computacional e inferencia de producción.

VRAM
48 GB
Memoria
GDDR6 ECC
Ancho de banda
864 GB/s
Available Ideal para revisión de carga
USD 506/mes ~ USD 0.69/hora
NVIDIA L4 24GB GPU accelerator
NVIDIA · Ada Lovelace

NVIDIA L4 24GB

Eficiente para modelos pequeños, embeddings, reranking, desarrollo y servicios sensibles al coste.

VRAM
24 GB
Memoria
GDDR6
Ancho de banda
300 GB/s
Available Ideal para revisión de carga
USD 250/mes ~ USD 0.34/hora

¿Qué desea ejecutar?

Modo simple
Modo avanzado

Elija inventario GPU verificado

Use el catálogo para elegir hardware y el recomendador cuando importen el tamaño del modelo, contexto o presupuesto.

NVIDIA H200 SXM 141GB GPU accelerator

NVIDIA H200 SXM 141GB

Ideal para modelos grandes, contexto largo, fine-tuning pesado y cargas IA intensivas en memoria.

VRAM
141 GB
Arquitectura
Hopper
Precio
USD 2,345
Ver GPU

Cómo funciona el dimensionamiento GPU

La calculadora estima pesos del modelo, caché KV, espacio de ejecución, sobrecarga de carga y margen de producción antes de filtrar inventario.

Inferencia y entrenamiento

Inferencia y entrenamiento se dimensionan por separado. El entrenamiento incluye estado del optimizador, gradientes o adaptadores, activaciones, espacio de ejecución y topología.

Precisión y cuantización

Una precisión menor puede reducir memoria, pero los metadatos de cuantización, el espacio de ejecución y los límites técnicos siguen aplicando.

Lógica de cotización versionada

Las cotizaciones quedan vinculadas al snapshot del modelo, versión de calculadora, configuración y versión de precio.

Preguntas sobre hosting GPU IA

¿Cómo se estima la VRAM?

Combina pesos del modelo, caché KV, espacio de ejecución, lotes, sobrecarga y margen de seguridad.

¿El entrenamiento se dimensiona distinto?

Sí. Fine-tuning y entrenamiento incluyen gradientes, estado del optimizador, activaciones y restricciones de topología.

¿Puedo usar un modelo personalizado?

Sí. Puede introducir parámetros y arquitectura; las estimaciones de menor confianza se etiquetan.

Are recommendations benchmarks?

No. Estimated results and measured benchmark data are labelled separately.

Can unavailable GPUs be purchased?

No. Unavailable hardware can remain in the catalogue, but it is not offered as immediately purchasable inventory.

How does pricing work?

Approved prices are shown where cost and market inputs have been reviewed. Otherwise the offer remains request-quote.