Technisch bereit
Qwen3-VL 32B Thinking FP8 Produktionspaket
Qwen / Qwen3-VL 32B Thinking · FP8 · Engineering-Status: Technisch bereit
Transformations-Lineage
BasisversionQwen3-VL 32B Thinking
Modell-EngineeringFP8 Quantisierung, Runtime-Paketierung, Evaluierung und Benchmarking
BereitstellungsoptionenPaket herunterladen / Mit FusionPointAI hosten / Herunterladen + hosten
Transparente Preise
- Basismodell-EngineeringUSD 17,400.00
- FP8 QuantisierungUSD 5,900.00
- Runtime-PaketierungUSD 2,800.00
- Evaluierung und BenchmarkingUSD 3,600.00
- Paket herunterladenUSD 1,500.00
- Managed-Deployment-EinrichtungUSD 3,200.00
- Einmalige EntwicklungUSD 34,400.00
Monatliches Hosting
- 1 x nvidia-h200-sxm-141gbUSD 2,345.00
- Monatliches HostingUSD 2,345.00
Quantisierung
QuelleQuelle
TransformationGeschatzt bis zur Messung im Engineering
GPU-Topologie
1 × nvidia-h200-sxm-141gb
transformers
Download oder Managed Hosting
Artefakt, Konfiguration, Tokenizer und Pruefsummen
GPU-Zuweisung, Runtime, Endpoint und Monitoring