Qwen3-VL-30B-A3B-Thinking
Qwen/Qwen3-VL-30B-A3B-Thinking
आधिकारिक · BF16 · safetensors
सत्यापित निष्पादन परिवेश: Transformers
| प्रिसीजन / क्वांटाइज़ेशन | प्रारूप | बिट | प्रकाशक भरोसा | परिनियोजन स्थिति |
|---|---|---|---|---|
| BF16 | safetensors | 16 | आधिकारिक | सत्यापित निष्पादन परिवेश |
Qwen · दृश्य · Qwen3-VL
Qwen3-VL 30B-A3B Thinking, Qwen परिवार की दृश्य शाखा में वर्तमान संस्करण है और आधिकारिक revision से प्रमाणित है।
Qwen3-VL 30B-A3B Thinking, Qwen का आधिकारिक स्व-होस्ट योग्य संस्करण है। यह Qwen दृश्य शाखा में Qwen3VLMoeForConditionalGeneration, 30.5B / 3.3B MoE और 262,144 टोकन सत्यापित संदर्भ उपयोग करता है।
Qwen3-VL 30B-A3B Thinking Qwen3VLMoeForConditionalGeneration और 30.5B / 3.3B MoE उपयोग करता है। प्रकाशित होने पर 48 परतें, hidden width 2048 और 32 attention heads दर्ज हैं।
केवल इस संस्करण से जुड़े सटीक और स्रोत-प्रमाणित वैरिएंट दिखाए जाते हैं।
Qwen/Qwen3-VL-30B-A3B-Thinking
आधिकारिक · BF16 · safetensors
सत्यापित निष्पादन परिवेश: Transformers
| प्रिसीजन / क्वांटाइज़ेशन | प्रारूप | बिट | प्रकाशक भरोसा | परिनियोजन स्थिति |
|---|---|---|---|---|
| BF16 | safetensors | 16 | आधिकारिक | सत्यापित निष्पादन परिवेश |
सटीक चेकपॉइंट प्रिसीजन के साथ केवल प्रमाणित रनटाइम कॉन्फ़िगरेशन उपयोग करें। रैंकिंग वेट, केवी कैश, ओवरहेड, GPU आर्किटेक्चर और टोपोलॉजी जाँचती है।
अनुशंसित सर्वोत्तम मूल्य
160 GB कुल VRAM · nvlink
67.43 GB मार्जिन · उपलब्ध
USD १,८३० / माहसबसे कम लागत वाला उपयुक्त विकल्प
96 GB कुल VRAM · pcie
3.43 GB मार्जिन · उपलब्ध
USD १,००० / माहसर्वोच्च प्रदर्शन
160 GB कुल VRAM · nvlink
67.43 GB मार्जिन · उपलब्ध
USD १,८३० / माहपूरे 30.5 B निवासी वेट चयनित GPUs पर समाने चाहिए। संदर्भ और concurrency केवी कैश बढ़ाते हैं।
Qwen3-VL 30B-A3B Thinking Apache 2.0 लाइसेंस के अंतर्गत जारी है। आधिकारिक URL और सत्यापन तारीख सुरक्षित हैं।
व्यावसायिक उपयोग अनुमत. आधिकारिक लाइसेंस व्यावसायिक उपयोग की अनुमति देता है; उसकी सभी शर्तें लागू रहती हैं।
Qwen3-VL 8B Instruct, Qwen3-VL 235B-A22B Instruct, Qwen3-VL 235B-A22B Thinking, Qwen3-VL 32B Instruct, Qwen3-VL 32B Thinking, Qwen3-VL 30B-A3B Instruct, Qwen3-VL 8B Thinking
अनुमान चेकपॉइंट प्रिसीजन, संदर्भ और concurrency पर निर्भर है और प्रमाणित डेटा उपयोग करता है।
transformers के लिए आधिकारिक प्रमाण सत्यापित हैं।
संग्रहीत वर्गीकरण व्यावसायिक उपयोग अनुमत है। आधिकारिक Apache 2.0 लाइसेंस शर्तें देखें।
अंतिम सत्यापन: 2026-08-26