NVIDIA H100 PCIe 80GB GPU accelerator

NVIDIA · Hopper

NVIDIA H100 PCIe 80GB

Stark für quantisierte 70B-Inferenz, LoRA-Fine-Tuning und Serving mit hohem Durchsatz.

Monatliche Miete

USD 1,579/Monat

~ USD 2.16/Stunde basierend auf einem 730-Stunden-Monat

Verfügbarkeit: Limited capacity

GPUs vergleichen

Technische Daten

Identität

Anbieter NVIDIA
Modell NVIDIA H100 PCIe 80GB
SKU H100 PCIe
Architecture Hopper
Hardwareklasse datacenter gpu

Speicher

VRAM 80 GB
Speichertyp HBM2e
Speicherbandbreite 2000 GB/s

Rechenleistung

Präzision Dicht Mit spärlicher Ausführung
FP64 26 TFLOPS
FP64 Tensor 51 TFLOPS
FP32 51 TFLOPS
TF32 Tensor 378 TFLOPS 756 TFLOPS
BF16 Tensor 756.5 TFLOPS 1513 TFLOPS
FP16 Tensor 756.5 TFLOPS 1513 TFLOPS
FP8 Tensor 1513 TFLOPS 3026 TFLOPS
INT8 Tensor 1513 TOPS 3026 TOPS

Plattform

Formfaktor / Schnittstelle PCIe dual-slot accelerator card
Interface PCIe Gen5 x16
TDP 350 W
NVLink 600 GB/s NVLink Bridge
NVSwitch Nicht unterstützt
MIG Bis zu 7 MIGs @ 10 GB
Max. GPUs pro Knoten 8

Software

CUDA Unterstützt
Verifizierung OFFICIAL_VENDOR
Quelle www.nvidia.com

Workload-Eignung

  • LLM-InferenzSehr gut
  • LLM-Fine-TuningSehr gut
  • Vollständiges TrainingSehr gut
  • Bild- / VideogenerierungSehr gut
  • Embeddings / RerankingAusgezeichnet

Frameworks

  • PyTorch
  • TensorFlow
  • JAX
  • Hugging Face
  • vLLM
  • TensorRT
  • ONNX Runtime
  • CUDA

Modellkompatibilität

7B/8B-Inferenz

Empfohlen

13B/14B-Inferenz

Empfohlen mit Quantisierung oder FP16/BF16-Headroom-Prüfung

30B/32B-Inferenz

Empfohlen mit Quantisierung für Produktions-Headroom

65B/70B-Inferenz

Empfohlen für quantisierte Inferenz; Kontext und Parallelität prüfen

Fine-Tuning

Geeignet für LoRA/QLoRA; vollständiges Fine-Tuning hängt von Modellgröße und Topologie ab

Großes Training

Multi-GPU-Knoten mit hoher Bandbreite verwenden

Ähnliche GPUs

FAQ zum KI-GPU-Hosting

Eignet sich diese GPU für LLM-Inferenz?

Die Eignung hängt von Modellgröße, Präzision, Kontextlänge und Parallelität ab. Nutzen Sie den Empfehlungsrechner mit Reserve.

Wie wird der Monatspreis berechnet?

Der öffentliche Monatspreis ist die genehmigte Preisversion. Der Stundenwert wird aus 730 Monatsstunden abgeleitet.

Kann ich mehrere GPUs mieten?

Multi-GPU-Konfigurationen sind möglich, wenn Inventar und Knotentopologie es erlauben.