Qwen / Qwen3-VL 32B Instruct

Transformation options for Qwen3-VL 32B Instruct

レジストリ証拠、価格コンポーネント、ランタイム互換性に基づきリリースごとに検証されています。

技術変換ステータス

変換に対応

Verified public open-weight release with authoritative checkpoint evidence.

アーキテクチャ

Qwen3VLForConditionalGeneration

32.00B parameters · 262144 context

対応する変換

quantization

リリースごとに検証済み

runtime packaging

リリースごとに検証済み

managed hosting

リリースごとに検証済み

蒸留

リリースごとに検証済み

gpu targeting

リリースごとに検証済み

評価とベンチマーク

リリースごとに検証済み

download

リリースごとに検証済み

公開済みパッケージ

エンジニアリング準備完了

Qwen3-VL 32B Instruct FP8 本番パッケージ

Qwen · Qwen3-VL 32B Instruct

変換操作: FP8 量子化, 評価とベンチマーク

対象 GPU: ハードウェアはビルダーで選択

提供オプション: モデルパッケージをダウンロード / FusionPointAI でホスト / ダウンロード + ホスト

FP8transformers モデルパッケージをダウンロードFusionPointAI でホストダウンロード + ホスト

USD 28,400.00
一回限りのエンジニアリング

エンジニアリング準備完了

Qwen3-VL 32B Instruct FP8 本番パッケージ - 1 × nvidia-h200-sxm-141gb

Qwen · Qwen3-VL 32B Instruct

変換操作: FP8 量子化, ランタイムパッケージ, 評価とベンチマーク

対象 GPU: 1 × nvidia-h200-sxm-141gb

提供オプション: モデルパッケージをダウンロード / FusionPointAI でホスト / ダウンロード + ホスト

FP81 × nvidia-h200-sxm-141gbtransformers モデルパッケージをダウンロードFusionPointAI でホストダウンロード + ホスト

USD 34,400.00
一回限りのエンジニアリング

エンジニアリング準備完了

Qwen3-VL 32B Instruct FP8 本番パッケージ - 1 × nvidia-h100-sxm-80gb

Qwen · Qwen3-VL 32B Instruct

変換操作: FP8 量子化, ランタイムパッケージ, 評価とベンチマーク

対象 GPU: 1 × nvidia-h100-sxm-80gb

提供オプション: モデルパッケージをダウンロード / FusionPointAI でホスト / ダウンロード + ホスト

FP81 × nvidia-h100-sxm-80gbtransformers モデルパッケージをダウンロードFusionPointAI でホストダウンロード + ホスト

USD 34,400.00
一回限りのエンジニアリング

エンジニアリング準備完了

Qwen3-VL 32B Instruct FP8 本番パッケージ - 1 × nvidia-h100-pcie-80gb

Qwen · Qwen3-VL 32B Instruct

変換操作: FP8 量子化, ランタイムパッケージ, 評価とベンチマーク

対象 GPU: 1 × nvidia-h100-pcie-80gb

提供オプション: モデルパッケージをダウンロード / FusionPointAI でホスト / ダウンロード + ホスト

FP81 × nvidia-h100-pcie-80gbtransformers モデルパッケージをダウンロードFusionPointAI でホストダウンロード + ホスト

USD 34,400.00
一回限りのエンジニアリング

エンジニアリング準備完了

Qwen3-VL 32B Instruct FP8 本番パッケージ - 1 × nvidia-a100-sxm-80gb

Qwen · Qwen3-VL 32B Instruct

変換操作: FP8 量子化, ランタイムパッケージ, 評価とベンチマーク

対象 GPU: 1 × nvidia-a100-sxm-80gb

提供オプション: モデルパッケージをダウンロード / FusionPointAI でホスト / ダウンロード + ホスト

FP81 × nvidia-a100-sxm-80gbtransformers モデルパッケージをダウンロードFusionPointAI でホストダウンロード + ホスト

USD 34,400.00
一回限りのエンジニアリング

エンジニアリング準備完了

Qwen3-VL 32B Instruct FP8 本番パッケージ - 1 × nvidia-l40s

Qwen · Qwen3-VL 32B Instruct

変換操作: FP8 量子化, ランタイムパッケージ, 評価とベンチマーク

対象 GPU: 1 × nvidia-l40s

提供オプション: モデルパッケージをダウンロード / FusionPointAI でホスト / ダウンロード + ホスト

FP81 × nvidia-l40stransformers モデルパッケージをダウンロードFusionPointAI でホストダウンロード + ホスト

USD 34,400.00
一回限りのエンジニアリング

エンジニアリング準備完了

Qwen3-VL 32B Instruct FP8 本番パッケージ - 2 × nvidia-l4

Qwen · Qwen3-VL 32B Instruct

変換操作: FP8 量子化, ランタイムパッケージ, 評価とベンチマーク

対象 GPU: 2 × nvidia-l4

提供オプション: モデルパッケージをダウンロード / FusionPointAI でホスト / ダウンロード + ホスト

FP82 × nvidia-l4transformers モデルパッケージをダウンロードFusionPointAI でホストダウンロード + ホスト

USD 34,400.00
一回限りのエンジニアリング

設計検証済み

Qwen3-VL 32B Instruct DISTILLATION 本番パッケージ - 品質保持

Qwen · Qwen3-VL 32B Instruct

変換操作: 蒸留, 評価とベンチマーク

対象 GPU: ハードウェアはビルダーで選択

提供オプション: モデルパッケージをダウンロード / FusionPointAI でホスト / ダウンロード + ホスト

DISTILLATION品質保持transformers モデルパッケージをダウンロードFusionPointAI でホストダウンロード + ホスト

USD 47,875.00
一回限りのエンジニアリング

設計検証済み

Qwen3-VL 32B Instruct DISTILLATION 本番パッケージ - スループット最適化

Qwen · Qwen3-VL 32B Instruct

変換操作: 蒸留, 評価とベンチマーク

対象 GPU: ハードウェアはビルダーで選択

提供オプション: モデルパッケージをダウンロード / FusionPointAI でホスト / ダウンロード + ホスト

DISTILLATIONスループット最適化transformers モデルパッケージをダウンロードFusionPointAI でホストダウンロード + ホスト

USD 47,875.00
一回限りのエンジニアリング