エンジニアリング準備完了
Qwen3-VL 32B Thinking FP8 本番パッケージ
Qwen / Qwen3-VL 32B Thinking · FP8 · エンジニアリング状態: エンジニアリング準備完了
変換リネージ
基盤リリースQwen3-VL 32B Thinking
モデルエンジニアリングFP8 量子化, ランタイムパッケージ, 評価とベンチマーク
提供オプションモデルパッケージをダウンロード / FusionPointAI でホスト / ダウンロード + ホスト
透明な価格設定
- ベースモデルエンジニアリングUSD 17,400.00
- FP8 量子化USD 5,900.00
- ランタイムパッケージUSD 2,800.00
- 評価とベンチマークUSD 3,600.00
- モデルパッケージをダウンロードUSD 1,500.00
- マネージドデプロイ設定USD 3,200.00
- 一回限りのエンジニアリングUSD 34,400.00
月額ホスティング
- 2 x nvidia-l4USD 500.00
- 月額ホスティングUSD 500.00
量子化
ソースソース
Transformationエンジニアリング計測までの推定値
GPU トポロジ
2 × nvidia-l4
transformers
ダウンロードまたはマネージドホスティング
アーティファクト、構成、トークナイザー、チェックサム
GPU割り当て、ランタイム、エンドポイント、監視