Pret pour l ingenierie
Qwen3-VL 32B Instruct FP8 Package de production
Qwen / Qwen3-VL 32B Instruct · FP8 · Statut d ingenierie: Pret pour l ingenierie
Lineage de transformation
Version de baseQwen3-VL 32B Instruct
Ingenierie de modelesFP8 Quantification, Packaging runtime, Evaluation et benchmarking
Options de livraisonTelecharger le package / Heberger avec FusionPointAI / Telecharger + heberger
Tarification transparente
- Ingenierie du modele de baseUSD 17,400.00
- FP8 QuantificationUSD 5,900.00
- Packaging runtimeUSD 2,800.00
- Evaluation et benchmarkingUSD 3,600.00
- Telecharger le packageUSD 1,500.00
- Configuration du deploiement gereUSD 3,200.00
- Ingenierie ponctuelleUSD 34,400.00
Hebergement mensuel
- 1 x nvidia-a100-sxm-80gbUSD 915.00
- Hebergement mensuelUSD 915.00
Quantification
SourceSource
TransformationEstime jusqu aux mesures d ingenierie
Topologie GPU
1 × nvidia-a100-sxm-80gb
transformers
Telechargement ou hebergement gere
Artefact, configuration, tokenizer, sommes de controle
Allocation GPU, runtime, endpoint et supervision