Qwen3-VL-30B-A3B-Thinking
Qwen/Qwen3-VL-30B-A3B-Thinking
公式 · BF16 · safetensors
検証済み実行環境: Transformers
| 精度 / 量子化 | 形式 | ビット | 公開元の信頼区分 | デプロイ状態 |
|---|---|---|---|---|
| BF16 | safetensors | 16 | 公式 | 検証済み実行環境 |
Qwen · 視覚 · Qwen3-VL
Qwen3-VL 30B-A3B Thinking は Qwen の視覚系列に属する現行バージョンで、公式リビジョンから検証されています。
Qwen3-VL 30B-A3B Thinking は Qwen の公式セルフホスト版で、Qwen 視覚系列、Qwen3VLMoeForConditionalGeneration、30.5B / 3.3B MoE、検証済み 262,144 トークンコンテキストを備えます。
Qwen3-VL 30B-A3B Thinking は Qwen3VLMoeForConditionalGeneration と 30.5B / 3.3B MoE を使用します。公開されている場合は 48 層、隠れ幅 2048、注意ヘッド 32 を記録します。
このバージョンに紐づく、情報源で検証済みの正確なバリアントだけを表示します。
Qwen/Qwen3-VL-30B-A3B-Thinking
公式 · BF16 · safetensors
検証済み実行環境: Transformers
| 精度 / 量子化 | 形式 | ビット | 公開元の信頼区分 | デプロイ状態 |
|---|---|---|---|---|
| BF16 | safetensors | 16 | 公式 | 検証済み実行環境 |
正確なチェックポイント精度に対応する検証済みランタイム構成だけを使用します。重み、KV キャッシュ、負荷、GPU アーキテクチャ、トポロジを確認します。
推奨コストパフォーマンス
160 GB 合計 VRAM · nvlink
67.43 GB 余裕 · 利用可能
USD 1,830 / 月最安の適合構成
96 GB 合計 VRAM · pcie
3.43 GB 余裕 · 利用可能
USD 1,000 / 月最高性能
160 GB 合計 VRAM · nvlink
67.43 GB 余裕 · 利用可能
USD 1,830 / 月30.5 B の常駐重み全体が選択 GPU に収まる必要があります。コンテキストと同時実行で KV キャッシュが増えます。
Qwen3-VL 30B-A3B Thinking は Apache 2.0 ライセンス で公開され、公式 URL と検証日を保持します。
商用利用可. 公式ライセンスは商用利用を許可していますが、すべての義務は引き続き適用されます。
Qwen3-VL 8B Instruct, Qwen3-VL 235B-A22B Instruct, Qwen3-VL 235B-A22B Thinking, Qwen3-VL 32B Instruct, Qwen3-VL 32B Thinking, Qwen3-VL 30B-A3B Instruct, Qwen3-VL 8B Thinking
精度、コンテキスト、同時実行数に依存し、認証済みデータで計算します。
transformers の公式証拠が認証されています。
保存区分は商用利用可です。公式 Apache 2.0 ライセンス 条件を確認してください。
最終検証日: 2026-08-26