Qwen / Qwen3-VL 32B Thinking

Transformation options for Qwen3-VL 32B Thinking

根据注册表证据、定价组件和运行时兼容性对每个版本进行验证。

技术转换状态

支持转换

Verified public open-weight release with authoritative checkpoint evidence.

架构

Qwen3VLForConditionalGeneration

32.00B parameters · 262144 context

支持的转换

quantization

按版本验证

runtime packaging

按版本验证

managed hosting

按版本验证

蒸馏

按版本验证

gpu targeting

按版本验证

评估和基准测试

按版本验证

download

按版本验证

已发布的软件包

工程就绪

Qwen3-VL 32B Thinking FP8 生产包

Qwen · Qwen3-VL 32B Thinking

转换操作: FP8 量化, 评估和基准测试

目标 GPU: 在构建器中选择硬件

交付选项: 下载模型包 / 使用 FusionPointAI 托管 / 下载 + 托管

FP8transformers 下载模型包使用 FusionPointAI 托管下载 + 托管

USD 28,400.00
一次性工程服务

工程就绪

Qwen3-VL 32B Thinking FP8 生产包 - 1 × nvidia-h200-sxm-141gb

Qwen · Qwen3-VL 32B Thinking

转换操作: FP8 量化, 运行时打包, 评估和基准测试

目标 GPU: 1 × nvidia-h200-sxm-141gb

交付选项: 下载模型包 / 使用 FusionPointAI 托管 / 下载 + 托管

FP81 × nvidia-h200-sxm-141gbtransformers 下载模型包使用 FusionPointAI 托管下载 + 托管

USD 34,400.00
一次性工程服务

工程就绪

Qwen3-VL 32B Thinking FP8 生产包 - 1 × nvidia-h100-sxm-80gb

Qwen · Qwen3-VL 32B Thinking

转换操作: FP8 量化, 运行时打包, 评估和基准测试

目标 GPU: 1 × nvidia-h100-sxm-80gb

交付选项: 下载模型包 / 使用 FusionPointAI 托管 / 下载 + 托管

FP81 × nvidia-h100-sxm-80gbtransformers 下载模型包使用 FusionPointAI 托管下载 + 托管

USD 34,400.00
一次性工程服务

工程就绪

Qwen3-VL 32B Thinking FP8 生产包 - 1 × nvidia-h100-pcie-80gb

Qwen · Qwen3-VL 32B Thinking

转换操作: FP8 量化, 运行时打包, 评估和基准测试

目标 GPU: 1 × nvidia-h100-pcie-80gb

交付选项: 下载模型包 / 使用 FusionPointAI 托管 / 下载 + 托管

FP81 × nvidia-h100-pcie-80gbtransformers 下载模型包使用 FusionPointAI 托管下载 + 托管

USD 34,400.00
一次性工程服务

工程就绪

Qwen3-VL 32B Thinking FP8 生产包 - 1 × nvidia-a100-sxm-80gb

Qwen · Qwen3-VL 32B Thinking

转换操作: FP8 量化, 运行时打包, 评估和基准测试

目标 GPU: 1 × nvidia-a100-sxm-80gb

交付选项: 下载模型包 / 使用 FusionPointAI 托管 / 下载 + 托管

FP81 × nvidia-a100-sxm-80gbtransformers 下载模型包使用 FusionPointAI 托管下载 + 托管

USD 34,400.00
一次性工程服务

工程就绪

Qwen3-VL 32B Thinking FP8 生产包 - 1 × nvidia-l40s

Qwen · Qwen3-VL 32B Thinking

转换操作: FP8 量化, 运行时打包, 评估和基准测试

目标 GPU: 1 × nvidia-l40s

交付选项: 下载模型包 / 使用 FusionPointAI 托管 / 下载 + 托管

FP81 × nvidia-l40stransformers 下载模型包使用 FusionPointAI 托管下载 + 托管

USD 34,400.00
一次性工程服务

工程就绪

Qwen3-VL 32B Thinking FP8 生产包 - 2 × nvidia-l4

Qwen · Qwen3-VL 32B Thinking

转换操作: FP8 量化, 运行时打包, 评估和基准测试

目标 GPU: 2 × nvidia-l4

交付选项: 下载模型包 / 使用 FusionPointAI 托管 / 下载 + 托管

FP82 × nvidia-l4transformers 下载模型包使用 FusionPointAI 托管下载 + 托管

USD 34,400.00
一次性工程服务

设计已验证

Qwen3-VL 32B Thinking DISTILLATION 生产包 - 质量保留

Qwen · Qwen3-VL 32B Thinking

转换操作: 蒸馏, 评估和基准测试

目标 GPU: 在构建器中选择硬件

交付选项: 下载模型包 / 使用 FusionPointAI 托管 / 下载 + 托管

DISTILLATION质量保留transformers 下载模型包使用 FusionPointAI 托管下载 + 托管

USD 47,875.00
一次性工程服务

设计已验证

Qwen3-VL 32B Thinking DISTILLATION 生产包 - 吞吐量优化

Qwen · Qwen3-VL 32B Thinking

转换操作: 蒸馏, 评估和基准测试

目标 GPU: 在构建器中选择硬件

交付选项: 下载模型包 / 使用 FusionPointAI 托管 / 下载 + 托管

DISTILLATION吞吐量优化transformers 下载模型包使用 FusionPointAI 托管下载 + 托管

USD 47,875.00
一次性工程服务