NVIDIA A100 SXM 80GB GPU accelerator

NVIDIA · Ampere

NVIDIA A100 SXM 80GB

Stark für quantisierte 70B-Inferenz, LoRA-Fine-Tuning und Serving mit hohem Durchsatz.

Monatliche Miete

USD 915/Monat

~ USD 1.25/Stunde basierend auf einem 730-Stunden-Monat

Verfügbarkeit: Available

GPUs vergleichen

Technische Daten

Identität

Anbieter NVIDIA
Modell NVIDIA A100 SXM 80GB
SKU A100 SXM 80GB
Architecture Ampere
Hardwareklasse datacenter gpu

Speicher

VRAM 80 GB
Speichertyp HBM2e
Speicherbandbreite 2039 GB/s

Rechenleistung

Präzision Dicht Mit spärlicher Ausführung
FP64 9.7 TFLOPS
FP64 Tensor 19.5 TFLOPS
FP32 19.5 TFLOPS
TF32 Tensor 156 TFLOPS 312 TFLOPS
BF16 Tensor 312 TFLOPS 624 TFLOPS
FP16 Tensor 312 TFLOPS 624 TFLOPS
INT8 Tensor 624 TOPS 1248 TOPS

Plattform

Formfaktor / Schnittstelle SXM module
Interface PCIe Gen4 x16 host interface
TDP 400 W
NVLink 600 GB/s NVLink
NVSwitch Unterstützt
MIG Bis zu 7 MIGs @ 10 GB
Max. GPUs pro Knoten 8

Software

CUDA Unterstützt
Verifizierung OFFICIAL_VENDOR
Quelle www.nvidia.com

Workload-Eignung

  • LLM-InferenzSehr gut
  • LLM-Fine-TuningSehr gut
  • Vollständiges TrainingSehr gut
  • Bild- / VideogenerierungSehr gut
  • Embeddings / RerankingAusgezeichnet

Frameworks

  • PyTorch
  • TensorFlow
  • JAX
  • Hugging Face
  • vLLM
  • TensorRT
  • ONNX Runtime
  • CUDA

Modellkompatibilität

7B/8B-Inferenz

Empfohlen

13B/14B-Inferenz

Empfohlen mit Quantisierung oder FP16/BF16-Headroom-Prüfung

30B/32B-Inferenz

Empfohlen mit Quantisierung für Produktions-Headroom

65B/70B-Inferenz

Empfohlen für quantisierte Inferenz; Kontext und Parallelität prüfen

Fine-Tuning

Geeignet für LoRA/QLoRA; vollständiges Fine-Tuning hängt von Modellgröße und Topologie ab

Großes Training

Multi-GPU-Knoten mit hoher Bandbreite verwenden

Ähnliche GPUs

FAQ zum KI-GPU-Hosting

Eignet sich diese GPU für LLM-Inferenz?

Die Eignung hängt von Modellgröße, Präzision, Kontextlänge und Parallelität ab. Nutzen Sie den Empfehlungsrechner mit Reserve.

Wie wird der Monatspreis berechnet?

Der öffentliche Monatspreis ist die genehmigte Preisversion. Der Stundenwert wird aus 730 Monatsstunden abgeleitet.

Kann ich mehrere GPUs mieten?

Multi-GPU-Konfigurationen sind möglich, wenn Inventar und Knotentopologie es erlauben.