Inferencia 7B/8B
Recomendado
NVIDIA · Ada Lovelace
Equilibrado para LLM medianos, generación de imágenes, visión computacional e inferencia de producción.
Alquiler mensual
~ USD 0.69/hora basado en un mes de 730 horas
Disponibilidad: Available
Comparar GPUs| Proveedor | NVIDIA |
|---|---|
| Modelo | NVIDIA L40S 48GB |
| SKU | L40S |
| Architecture | Ada Lovelace |
| Clase de hardware | datacenter gpu |
| VRAM | 48 GB |
|---|---|
| Tipo de memoria | GDDR6 ECC |
| Ancho de banda de memoria | 864 GB/s |
| Precisión | Denso | Con dispersión |
|---|---|---|
| FP32 | 91.6 TFLOPS | — |
| TF32 Tensor | 183 TFLOPS | 366 TFLOPS |
| BF16 Tensor | 362.05 TFLOPS | 733 TFLOPS |
| FP16 Tensor | 362.05 TFLOPS | 733 TFLOPS |
| FP8 Tensor | 733 TFLOPS | 1466 TFLOPS |
| INT8 Tensor | 733 TOPS | 1466 TOPS |
| Formato / interfaz | PCIe dual-slot accelerator card |
|---|---|
| Interface | PCIe Gen4 x16 |
| TDP | 350 W |
| NVLink | No compatible |
| NVSwitch | No compatible |
| MIG | No compatible |
| GPU máx. por nodo | 8 |
| CUDA | Compatible |
|---|---|
| Verificación | OFFICIAL_VENDOR |
| Fuente | www.nvidia.com |
Recomendado
Recomendado con cuantización o revisión de margen FP16/BF16
Recomendado con cuantización para mantener margen de producción
Normalmente requiere varias GPU o cuantización más fuerte
Adecuado para LoRA/QLoRA; el fine-tuning completo depende del modelo y la topología
No es la opción principal para entrenamiento distribuido grande
24 GB GDDR6 · Available
USD 250/mes
80 GB HBM3 · Available
USD 1,860/mes
80 GB HBM2e · Limited capacity
USD 1,579/mes
La idoneidad depende del modelo, precisión, contexto y concurrencia. Use el recomendador para dimensionar con margen.
El precio mensual público es la versión autorizada. El equivalente por hora deriva del precio mensual con una base de 730 horas.
Las configuraciones multi-GPU son posibles cuando el inventario y la topología del nodo lo permiten.