Listo para ingenieria
GLM-5.3-Flash FP8 Paquete de produccion
GLM / GLM-5.3-Flash · FP8 · Engineering status: Listo para ingenieria
Linaje de transformacion
Version baseGLM-5.3-Flash
Ingenieria de modelosquantization fp8, runtime optimization
Delivery optionsDescargar paquete / Alojar con FusionPointAI / Descargar + alojar
Precios transparentes
- Ingenieria del modelo baseUSD 95,700.00
- FP8 CuantizacionUSD 5,900.00
- Empaquetado de runtimeUSD 2,800.00
- Evaluacion y benchmarkingUSD 3,600.00
- Descargar paqueteUSD 1,500.00
- Configuracion de despliegue gestionadoUSD 3,200.00
- Ingenieria unicaUSD 112,700.00
Hosting mensual
- 6 x nvidia-a100-sxm-80gbUSD 5,490.00
- Hosting mensualUSD 5,490.00
Cuantizacion
FuenteFuente
TransformationEstimated until measured during engineering
GPU topology
6 × nvidia-a100-sxm-80gb
transformers
Download or managed hosting
Artefacto, configuracion, tokenizador y sumas de comprobacion
Asignacion GPU, runtime, endpoint y monitorizacion