7B/8B-Inferenz
Empfohlen
NVIDIA · Hopper
Stark für quantisierte 70B-Inferenz, LoRA-Fine-Tuning und Serving mit hohem Durchsatz.
Monatliche Miete
~ USD 2.55/Stunde basierend auf einem 730-Stunden-Monat
Verfügbarkeit: Available
GPUs vergleichen| Anbieter | NVIDIA |
|---|---|
| Modell | NVIDIA H100 SXM 80GB |
| SKU | H100 SXM |
| Architecture | Hopper |
| Hardwareklasse | datacenter gpu |
| VRAM | 80 GB |
|---|---|
| Speichertyp | HBM3 |
| Speicherbandbreite | 3350 GB/s |
| Präzision | Dicht | Mit spärlicher Ausführung |
|---|---|---|
| FP64 | 34 TFLOPS | — |
| FP64 Tensor | 67 TFLOPS | — |
| FP32 | 67 TFLOPS | — |
| TF32 Tensor | 494.5 TFLOPS | 989 TFLOPS |
| BF16 Tensor | 989.5 TFLOPS | 1979 TFLOPS |
| FP16 Tensor | 989.5 TFLOPS | 1979 TFLOPS |
| FP8 Tensor | 1979 TFLOPS | 3958 TFLOPS |
| INT8 Tensor | 1979 TOPS | 3958 TOPS |
| Formfaktor / Schnittstelle | SXM module |
|---|---|
| Interface | PCIe Gen5 x16 host interface |
| TDP | 700 W |
| NVLink | 900 GB/s NVLink |
| NVSwitch | Unterstützt |
| MIG | Bis zu 7 MIGs @ 10 GB |
| Max. GPUs pro Knoten | 8 |
| CUDA | Unterstützt |
|---|---|
| Verifizierung | OFFICIAL_VENDOR |
| Quelle | www.nvidia.com |
Empfohlen
Empfohlen mit Quantisierung oder FP16/BF16-Headroom-Prüfung
Empfohlen mit Quantisierung für Produktions-Headroom
Empfohlen für quantisierte Inferenz; Kontext und Parallelität prüfen
Geeignet für LoRA/QLoRA; vollständiges Fine-Tuning hängt von Modellgröße und Topologie ab
Multi-GPU-Knoten mit hoher Bandbreite verwenden
80 GB HBM2e · Limited capacity
USD 1,579/Monat
80 GB HBM2e · Available
USD 915/Monat
48 GB GDDR6 ECC · Available
USD 506/Monat
Die Eignung hängt von Modellgröße, Präzision, Kontextlänge und Parallelität ab. Nutzen Sie den Empfehlungsrechner mit Reserve.
Der öffentliche Monatspreis ist die genehmigte Preisversion. Der Stundenwert wird aus 730 Monatsstunden abgeleitet.
Multi-GPU-Konfigurationen sind möglich, wenn Inventar und Knotentopologie es erlauben.