7B/8B-Inferenz
Empfohlen
NVIDIA · Ada Lovelace
Effizient für kleine Modelle, Embeddings, Reranking, Entwicklung und kostensensitive KI-Dienste.
Monatliche Miete
~ USD 0.34/Stunde basierend auf einem 730-Stunden-Monat
Verfügbarkeit: Available
GPUs vergleichen| Anbieter | NVIDIA |
|---|---|
| Modell | NVIDIA L4 24GB |
| SKU | L4 |
| Architecture | Ada Lovelace |
| Hardwareklasse | datacenter gpu |
| VRAM | 24 GB |
|---|---|
| Speichertyp | GDDR6 |
| Speicherbandbreite | 300 GB/s |
| Präzision | Dicht | Mit spärlicher Ausführung |
|---|---|---|
| FP32 | 30.3 TFLOPS | — |
| TF32 Tensor | 60 TFLOPS | 120 TFLOPS |
| BF16 Tensor | 121 TFLOPS | 242 TFLOPS |
| FP16 Tensor | 121 TFLOPS | 242 TFLOPS |
| FP8 Tensor | 242.5 TFLOPS | 485 TFLOPS |
| INT8 Tensor | 242.5 TOPS | 485 TOPS |
| Formfaktor / Schnittstelle | PCIe low-profile accelerator card |
|---|---|
| Interface | PCIe Gen4 x16 |
| TDP | 72 W |
| NVLink | Nicht unterstützt |
| NVSwitch | Nicht unterstützt |
| MIG | Nicht unterstützt |
| Max. GPUs pro Knoten | 8 |
| CUDA | Unterstützt |
|---|---|
| Verifizierung | OFFICIAL_VENDOR |
| Quelle | www.nvidia.com |
Empfohlen
Empfohlen mit Quantisierung oder FP16/BF16-Headroom-Prüfung
Begrenzt
Benötigt meist mehrere GPUs oder stärkere Quantisierung
Begrenzt auf kleine oder angepasste Workloads
Nicht die primäre Wahl für großes verteiltes Training
48 GB GDDR6 ECC · Available
USD 506/Monat
80 GB HBM3 · Available
USD 1,860/Monat
80 GB HBM2e · Limited capacity
USD 1,579/Monat
Die Eignung hängt von Modellgröße, Präzision, Kontextlänge und Parallelität ab. Nutzen Sie den Empfehlungsrechner mit Reserve.
Der öffentliche Monatspreis ist die genehmigte Preisversion. Der Stundenwert wird aus 730 Monatsstunden abgeleitet.
Multi-GPU-Konfigurationen sind möglich, wenn Inventar und Knotentopologie es erlauben.