Dimensionamento por modelo Ofertas com inventário Orçamentos versionados

Cloud GPU de alto desempenho para IA

Alugue GPUs com preços de base de dados para inferência LLM, afinação, cargas multimodais, visão computacional e investigação com especificações claras.

6
opções públicas de GPU
6
GPUs com preço de aluguer
730
base horas/mês

Catálogo GPU e capacidade disponível

Consulte o hardware que a calculadora compreende antes de executar uma recomendação específica da carga de trabalho.

NVIDIA H200 SXM 141GB GPU accelerator
NVIDIA · Hopper

NVIDIA H200 SXM 141GB

Ideal para modelos grandes, contexto longo, fine-tuning pesado e cargas de IA intensivas em memória.

VRAM
141 GB
Memória
HBM3e
Largura de banda
4,800 GB/s
Capacidade limitada Ideal para análise de carga
USD 2,345/mês ~ USD 3.21/hora
NVIDIA H100 SXM 80GB GPU accelerator
NVIDIA · Hopper

NVIDIA H100 SXM 80GB

Forte para inferência 70B quantizada, fine-tuning LoRA e serving de alto débito.

VRAM
80 GB
Memória
HBM3
Largura de banda
3,350 GB/s
Disponível Ideal para análise de carga
USD 1,860/mês ~ USD 2.55/hora
NVIDIA H100 PCIe 80GB GPU accelerator
NVIDIA · Hopper

NVIDIA H100 PCIe 80GB

Forte para inferência 70B quantizada, fine-tuning LoRA e serving de alto débito.

VRAM
80 GB
Memória
HBM2e
Largura de banda
2,000 GB/s
Capacidade limitada Ideal para análise de carga
USD 1,579/mês ~ USD 2.16/hora
NVIDIA A100 SXM 80GB GPU accelerator
NVIDIA · Ampere

NVIDIA A100 SXM 80GB

Forte para inferência 70B quantizada, fine-tuning LoRA e serving de alto débito.

VRAM
80 GB
Memória
HBM2e
Largura de banda
2,039 GB/s
Disponível Ideal para análise de carga
USD 915/mês ~ USD 1.25/hora
NVIDIA L40S 48GB GPU accelerator
NVIDIA · Ada Lovelace

NVIDIA L40S 48GB

Equilibrado para LLMs médios, geração de imagem, visão computacional e inferência de produção.

VRAM
48 GB
Memória
GDDR6 ECC
Largura de banda
864 GB/s
Disponível Ideal para análise de carga
USD 506/mês ~ USD 0.69/hora
NVIDIA L4 24GB GPU accelerator
NVIDIA · Ada Lovelace

NVIDIA L4 24GB

Eficiente para modelos pequenos, embeddings, reranking, desenvolvimento e serviços sensíveis ao custo.

VRAM
24 GB
Memória
GDDR6
Largura de banda
300 GB/s
Disponível Ideal para análise de carga
USD 250/mês ~ USD 0.34/hora

O que pretende executar?

Modo simples
Modo avançado

Escolher inventário GPU verificado

Use o catálogo para selecionar hardware e o recomendador quando o tamanho do modelo, contexto ou orçamento forem decisivos.

NVIDIA H200 SXM 141GB GPU accelerator

NVIDIA H200 SXM 141GB

Ideal para modelos grandes, contexto longo, fine-tuning pesado e cargas de IA intensivas em memória.

VRAM
141 GB
Arquitetura
Hopper
Preço
USD 2,345
Ver GPU

Como funciona o dimensionamento GPU

A calculadora estima pesos do modelo, cache KV quando aplicável, espaço de execução, sobrecarga da carga de trabalho e margem de segurança de produção antes de filtrar o inventário.

Inferência vs treino

Inferência e treino são dimensionados separadamente. O treino inclui estado do optimizador, gradientes ou adaptadores, activações, espaço de execução e restrições de topologia.

Precisão e quantização

Precisões mais baixas podem reduzir a memória dos pesos, mas metadados de quantização, espaço de execução e limites técnicos continuam a aplicar-se.

Lógica de orçamento versionada

Os orçamentos ficam ligados ao snapshot do modelo, à versão da calculadora, à configuração seleccionada e à versão de preço.

Perguntas sobre alojamento GPU para IA

How is VRAM estimated?

The estimator combines model weights, KV cache, runtime workspace, batching, workload overhead and safety headroom.

Is training sized differently from inference?

Yes. Fine-tuning and training include gradients, optimiser state, activations and topology constraints.

Can I use a custom model?

Yes. You can enter parameter count and architecture details; lower-confidence estimates are labelled.

Are recommendations benchmarks?

No. Estimated results and measured benchmark data are labelled separately.

Can unavailable GPUs be purchased?

No. Unavailable hardware can remain in the catalogue, but it is not offered as immediately purchasable inventory.

How does pricing work?

Approved prices are shown where cost and market inputs have been reviewed. Otherwise the offer remains request-quote.