NVIDIA H200 SXM 141GB
Ideal para modelos grandes, contexto longo, fine-tuning pesado e cargas de IA intensivas em memória.
- VRAM
- 141 GB
- Memória
- HBM3e
- Largura de banda
- 4,800 GB/s
Alugue GPUs com preços de base de dados para inferência LLM, afinação, cargas multimodais, visão computacional e investigação com especificações claras.
Consulte o hardware que a calculadora compreende antes de executar uma recomendação específica da carga de trabalho.
Ideal para modelos grandes, contexto longo, fine-tuning pesado e cargas de IA intensivas em memória.
Forte para inferência 70B quantizada, fine-tuning LoRA e serving de alto débito.
Forte para inferência 70B quantizada, fine-tuning LoRA e serving de alto débito.
Forte para inferência 70B quantizada, fine-tuning LoRA e serving de alto débito.
Equilibrado para LLMs médios, geração de imagem, visão computacional e inferência de produção.
Eficiente para modelos pequenos, embeddings, reranking, desenvolvimento e serviços sensíveis ao custo.
Use o catálogo para selecionar hardware e o recomendador quando o tamanho do modelo, contexto ou orçamento forem decisivos.
Ideal para modelos grandes, contexto longo, fine-tuning pesado e cargas de IA intensivas em memória.
A calculadora estima pesos do modelo, cache KV quando aplicável, espaço de execução, sobrecarga da carga de trabalho e margem de segurança de produção antes de filtrar o inventário.
Inferência e treino são dimensionados separadamente. O treino inclui estado do optimizador, gradientes ou adaptadores, activações, espaço de execução e restrições de topologia.
Precisões mais baixas podem reduzir a memória dos pesos, mas metadados de quantização, espaço de execução e limites técnicos continuam a aplicar-se.
Os orçamentos ficam ligados ao snapshot do modelo, à versão da calculadora, à configuração seleccionada e à versão de preço.
The estimator combines model weights, KV cache, runtime workspace, batching, workload overhead and safety headroom.
Yes. Fine-tuning and training include gradients, optimiser state, activations and topology constraints.
Yes. You can enter parameter count and architecture details; lower-confidence estimates are labelled.
No. Estimated results and measured benchmark data are labelled separately.
No. Unavailable hardware can remain in the catalogue, but it is not offered as immediately purchasable inventory.
Approved prices are shown where cost and market inputs have been reviewed. Otherwise the offer remains request-quote.