Technisch bereit
Qwen3-VL 32B Thinking FP8 Produktionspaket
Qwen / Qwen3-VL 32B Thinking · FP8 · Engineering status: Technisch bereit
Transformations-Lineage
BasisversionQwen3-VL 32B Thinking
Modell-Engineeringquantization fp8, runtime optimization, Evaluation and benchmarking
Delivery optionsPaket herunterladen / Mit FusionPointAI hosten / Herunterladen + hosten
Transparente Preise
- Basismodell-EngineeringUSD 17,400.00
- FP8 QuantisierungUSD 5,900.00
- Runtime-PaketierungUSD 2,800.00
- Evaluierung und BenchmarkingUSD 3,600.00
- Paket herunterladenUSD 1,500.00
- Managed-Deployment-EinrichtungUSD 3,200.00
- Einmalige EntwicklungUSD 34,400.00
Monatliches Hosting
- 1 x nvidia-l40sUSD 506.00
- Monatliches HostingUSD 506.00
Quantisierung
QuelleQuelle
TransformationEstimated until measured during engineering
GPU topology
1 × nvidia-l40s
transformers
Download or managed hosting
Artefakt, Konfiguration, Tokenizer und Pruefsummen
GPU-Zuweisung, Runtime, Endpoint und Monitoring