Modellbasierte Dimensionierung Inventarbasierte Angebote Versionierte Angebote

Hochleistungs-GPU-Cloud für KI

Mieten Sie datenbankbepreiste GPUs für LLM-Inferenz, Fine-Tuning, multimodale Workloads, Computer Vision und Forschung.

6
öffentliche GPU-Optionen
6
GPU-Mieten mit Preis
730
Stunden/Monat-Basis

GPU-Katalog und verfügbare Kapazität

Browse hardware the calculator understands before running a workload-specific recommendation. Catalogue entries are separate from live capacity and approved pricing.

NVIDIA H200 SXM 141GB GPU accelerator
NVIDIA · Hopper

NVIDIA H200 SXM 141GB

Geeignet für große Modelle, langen Kontext, schweres Fine-Tuning und speicherintensive KI-Workloads.

VRAM
141 GB
Speicher
HBM3e
Bandbreite
4,800 GB/s
Limited capacity Geeignet für Workload-Prüfung
USD 2,345/Monat ~ USD 3.21/Stunde
NVIDIA H100 SXM 80GB GPU accelerator
NVIDIA · Hopper

NVIDIA H100 SXM 80GB

Stark für quantisierte 70B-Inferenz, LoRA-Fine-Tuning und Serving mit hohem Durchsatz.

VRAM
80 GB
Speicher
HBM3
Bandbreite
3,350 GB/s
Available Geeignet für Workload-Prüfung
USD 1,860/Monat ~ USD 2.55/Stunde
NVIDIA H100 PCIe 80GB GPU accelerator
NVIDIA · Hopper

NVIDIA H100 PCIe 80GB

Stark für quantisierte 70B-Inferenz, LoRA-Fine-Tuning und Serving mit hohem Durchsatz.

VRAM
80 GB
Speicher
HBM2e
Bandbreite
2,000 GB/s
Limited capacity Geeignet für Workload-Prüfung
USD 1,579/Monat ~ USD 2.16/Stunde
NVIDIA A100 SXM 80GB GPU accelerator
NVIDIA · Ampere

NVIDIA A100 SXM 80GB

Stark für quantisierte 70B-Inferenz, LoRA-Fine-Tuning und Serving mit hohem Durchsatz.

VRAM
80 GB
Speicher
HBM2e
Bandbreite
2,039 GB/s
Available Geeignet für Workload-Prüfung
USD 915/Monat ~ USD 1.25/Stunde
NVIDIA L40S 48GB GPU accelerator
NVIDIA · Ada Lovelace

NVIDIA L40S 48GB

Ausgewogen für mittlere LLMs, Bildgenerierung, Computer Vision und kostenbewusste Produktionsinferenz.

VRAM
48 GB
Speicher
GDDR6 ECC
Bandbreite
864 GB/s
Available Geeignet für Workload-Prüfung
USD 506/Monat ~ USD 0.69/Stunde
NVIDIA L4 24GB GPU accelerator
NVIDIA · Ada Lovelace

NVIDIA L4 24GB

Effizient für kleine Modelle, Embeddings, Reranking, Entwicklung und kostensensitive KI-Dienste.

VRAM
24 GB
Speicher
GDDR6
Bandbreite
300 GB/s
Available Geeignet für Workload-Prüfung
USD 250/Monat ~ USD 0.34/Stunde

Was möchten Sie ausführen?

Einfacher Modus
Erweiterter Modus

Aus geprüftem GPU-Inventar wählen

Nutzen Sie den Katalog für die Hardwareauswahl und den Empfehlungsrechner, wenn Modellgröße, Kontext oder Budget wichtig sind.

NVIDIA H200 SXM 141GB GPU accelerator

NVIDIA H200 SXM 141GB

Geeignet für große Modelle, langen Kontext, schweres Fine-Tuning und speicherintensive KI-Workloads.

VRAM
141 GB
Architektur
Hopper
Preis
USD 2,345
GPU ansehen

So funktioniert GPU-Dimensionierung

Der Rechner schätzt Modellgewichte, KV-Cache, Laufzeitbereich, Workload-Overhead und Produktionsreserve, bevor Inventar gefiltert wird.

Inferenz und Training

Inferenz und Training werden getrennt dimensioniert. Training enthält Optimiererzustand, Gradienten oder Adapter, Aktivierungen, Laufzeitbereich und Topologie.

Präzision und Quantisierung

Niedrigere Präzision kann Speicher reduzieren, aber Quantisierungsmetadaten, Laufzeitbereich und technische Grenzen bleiben relevant.

Versionierte Angebotslogik

Anfragen werden an Modell-Snapshot, Rechner-Version, Konfiguration und Preisversion gebunden.

FAQ zum KI-GPU-Hosting

Wie wird VRAM geschätzt?

Die Schätzung kombiniert Modellgewichte, KV-Cache, Laufzeitbereich, Batching, Overhead und Sicherheitsreserve.

Wird Training anders dimensioniert?

Ja. Fine-Tuning und Training enthalten Gradienten, Optimiererzustand, Aktivierungen und Topologiegrenzen.

Kann ich ein eigenes Modell verwenden?

Ja. Parameterzahl und Architektur können eingegeben werden; unsichere Schätzungen werden markiert.

Are recommendations benchmarks?

No. Estimated results and measured benchmark data are labelled separately.

Can unavailable GPUs be purchased?

No. Unavailable hardware can remain in the catalogue, but it is not offered as immediately purchasable inventory.

How does pricing work?

Approved prices are shown where cost and market inputs have been reviewed. Otherwise the offer remains request-quote.