Pret pour l ingenierie
Qwen3-VL 32B Thinking FP8 Package de production
Qwen / Qwen3-VL 32B Thinking · FP8 · Engineering status: Pret pour l ingenierie
Lineage de transformation
Version de baseQwen3-VL 32B Thinking
Ingenierie de modelesquantization fp8, runtime optimization
Delivery optionsTelecharger le package / Heberger avec FusionPointAI / Telecharger + heberger
Tarification transparente
- Ingenierie du modele de baseUSD 17,400.00
- FP8 QuantificationUSD 5,900.00
- Packaging runtimeUSD 2,800.00
- Evaluation et benchmarkingUSD 3,600.00
- Telecharger le packageUSD 1,500.00
- Configuration du deploiement gereUSD 3,200.00
- Ingenierie ponctuelleUSD 34,400.00
Hebergement mensuel
- 1 x nvidia-a100-sxm-80gbUSD 915.00
- Hebergement mensuelUSD 915.00
Quantification
SourceSource
TransformationEstimated until measured during engineering
GPU topology
1 × nvidia-a100-sxm-80gb
transformers
Download or managed hosting
Artefact, configuration, tokenizer, sommes de controle
Allocation GPU, runtime, endpoint et supervision