Dimensionnement par modèle Offres avec inventaire Devis versionnés

Cloud GPU haute performance pour l’IA

Louez des GPU tarifés en base de données pour l’inférence LLM, le fine-tuning, les charges multimodales, la vision par ordinateur et la recherche.

6
options GPU publiques
6
GPU de location tarifés
730
base heures/mois

Catalogue GPU et capacité disponible

Browse hardware the calculator understands before running a workload-specific recommendation. Catalogue entries are separate from live capacity and approved pricing.

NVIDIA H200 SXM 141GB GPU accelerator
NVIDIA · Hopper

NVIDIA H200 SXM 141GB

Idéal pour grands modèles, longs contextes, fine-tuning lourd et charges IA très consommatrices de mémoire.

VRAM
141 GB
Mémoire
HBM3e
Bande passante
4,800 GB/s
Limited capacity Idéal pour Inférence LLM · Fine-tuning LLM
USD 2,345/mois ~ USD 3.21/heure
NVIDIA H100 SXM 80GB GPU accelerator
NVIDIA · Hopper

NVIDIA H100 SXM 80GB

Adapté à l’inférence 70B quantifiée, au fine-tuning LoRA et au service à haut débit.

VRAM
80 GB
Mémoire
HBM3
Bande passante
3,350 GB/s
Available Idéal pour Embeddings / reranking
USD 1,860/mois ~ USD 2.55/heure
NVIDIA H100 PCIe 80GB GPU accelerator
NVIDIA · Hopper

NVIDIA H100 PCIe 80GB

Adapté à l’inférence 70B quantifiée, au fine-tuning LoRA et au service à haut débit.

VRAM
80 GB
Mémoire
HBM2e
Bande passante
2,000 GB/s
Limited capacity Idéal pour Embeddings / reranking
USD 1,579/mois ~ USD 2.16/heure
NVIDIA A100 SXM 80GB GPU accelerator
NVIDIA · Ampere

NVIDIA A100 SXM 80GB

Adapté à l’inférence 70B quantifiée, au fine-tuning LoRA et au service à haut débit.

VRAM
80 GB
Mémoire
HBM2e
Bande passante
2,039 GB/s
Available Idéal pour Embeddings / reranking
USD 915/mois ~ USD 1.25/heure
NVIDIA L40S 48GB GPU accelerator
NVIDIA · Ada Lovelace

NVIDIA L40S 48GB

Équilibré pour LLM moyens, génération d’images, vision par ordinateur et inférence de production optimisée.

VRAM
48 GB
Mémoire
GDDR6 ECC
Bande passante
864 GB/s
Available Idéal pour Embeddings / reranking
USD 506/mois ~ USD 0.69/heure
NVIDIA L4 24GB GPU accelerator
NVIDIA · Ada Lovelace

NVIDIA L4 24GB

Efficace pour petits modèles, embeddings, reranking, développement et services IA sensibles au coût.

VRAM
24 GB
Mémoire
GDDR6
Bande passante
300 GB/s
Available Idéal pour Embeddings / reranking
USD 250/mois ~ USD 0.34/heure

Que voulez-vous exécuter ?

Mode simple
Mode avancé

Choisir dans un inventaire GPU vérifié

Utilisez le catalogue pour choisir le matériel, puis le recommandateur lorsque la taille du modèle, le contexte ou le budget comptent.

NVIDIA H200 SXM 141GB GPU accelerator

NVIDIA H200 SXM 141GB

Idéal pour grands modèles, longs contextes, fine-tuning lourd et charges IA très consommatrices de mémoire.

VRAM
141 GB
Architecture
Hopper
Prix
USD 2,345
Voir le GPU

Fonctionnement du dimensionnement GPU

Le calculateur estime les poids du modèle, le cache KV, l’espace d’exécution, la surcharge de charge et la marge de production avant de filtrer l’inventaire.

Inférence et entraînement

L’inférence et l’entraînement sont dimensionnés séparément. L’entraînement inclut l’état optimiseur, les gradients ou adaptateurs, les activations, l’espace d’exécution et la topologie.

Précision et quantification

Une précision plus basse peut réduire la mémoire des poids, mais les métadonnées de quantification, l’espace d’exécution et les limites techniques restent applicables.

Logique de devis versionnée

Les demandes de devis sont liées au snapshot de modèle, à la version du calculateur, à la configuration sélectionnée et à la version de prix.

FAQ hébergement GPU IA

Comment la VRAM est-elle estimée ?

L’estimation combine poids du modèle, cache KV, espace d’exécution, lots, surcharge de charge et marge de sécurité.

L’entraînement est-il dimensionné différemment ?

Oui. Fine-tuning et entraînement incluent gradients, état optimiseur, activations et contraintes de topologie.

Puis-je utiliser un modèle personnalisé ?

Oui. Indiquez le nombre de paramètres et l’architecture ; les estimations moins certaines sont signalées.

Are recommendations benchmarks?

No. Estimated results and measured benchmark data are labelled separately.

Can unavailable GPUs be purchased?

No. Unavailable hardware can remain in the catalogue, but it is not offered as immediately purchasable inventory.

How does pricing work?

Approved prices are shown where cost and market inputs have been reviewed. Otherwise the offer remains request-quote.