Technisch bereit
GLM-4.6V FP8 Produktionspaket
GLM / GLM-4.6V · FP8 · Engineering-Status: Technisch bereit
Transformations-Lineage
BasisversionGLM-4.6V
Modell-EngineeringFP8 Quantisierung, Runtime-Paketierung, Evaluierung und Benchmarking
BereitstellungsoptionenPaket herunterladen / Mit FusionPointAI hosten / Herunterladen + hosten
Transparente Preise
- Basismodell-EngineeringUSD 59,160.00
- FP8 QuantisierungUSD 5,900.00
- Runtime-PaketierungUSD 2,800.00
- Evaluierung und BenchmarkingUSD 3,600.00
- Paket herunterladenUSD 1,500.00
- Managed-Deployment-EinrichtungUSD 3,200.00
- Einmalige EntwicklungUSD 76,160.00
Monatliches Hosting
- 2 x nvidia-h100-sxm-80gbUSD 3,720.00
- Monatliches HostingUSD 3,720.00
Quantisierung
QuelleQuelle
TransformationGeschatzt bis zur Messung im Engineering
GPU-Topologie
2 × nvidia-h100-sxm-80gb
transformers
Download oder Managed Hosting
Artefakt, Konfiguration, Tokenizer und Pruefsummen
GPU-Zuweisung, Runtime, Endpoint und Monitoring