Technisch bereit
GLM-5.3-Flash FP8 Produktionspaket
GLM / GLM-5.3-Flash · FP8 · Engineering-Status: Technisch bereit
Transformations-Lineage
BasisversionGLM-5.3-Flash
Modell-EngineeringFP8 Quantisierung, Runtime-Paketierung, Evaluierung und Benchmarking
BereitstellungsoptionenPaket herunterladen / Mit FusionPointAI hosten / Herunterladen + hosten
Transparente Preise
- Basismodell-EngineeringUSD 95,700.00
- FP8 QuantisierungUSD 5,900.00
- Runtime-PaketierungUSD 2,800.00
- Evaluierung und BenchmarkingUSD 3,600.00
- Paket herunterladenUSD 1,500.00
- Managed-Deployment-EinrichtungUSD 3,200.00
- Einmalige EntwicklungUSD 112,700.00
Monatliches Hosting
- 6 x nvidia-h100-pcie-80gbUSD 9,474.00
- Monatliches HostingUSD 9,474.00
Quantisierung
QuelleQuelle
TransformationGeschatzt bis zur Messung im Engineering
GPU-Topologie
6 × nvidia-h100-pcie-80gb
transformers
Download oder Managed Hosting
Artefakt, Konfiguration, Tokenizer und Pruefsummen
GPU-Zuweisung, Runtime, Endpoint und Monitoring