मुख्य सामग्री पर जाएं

Qwen · दृश्य · Qwen3-VL

Qwen3-VL 30B-A3B Thinking: विनिर्देश, GPU आवश्यकताएँ, होस्टिंग और परिनियोजन

Qwen3-VL 30B-A3B Thinking, Qwen परिवार की दृश्य शाखा में वर्तमान संस्करण है और आधिकारिक revision से प्रमाणित है।

Qwen3-VL 30B-A3B Thinking के लिए तकनीकी परिनियोजन चित्र
संदर्भ प्रवाह; सटीक तथ्य अलग सूचीबद्ध हैं।
कुल पैरामीटर३०.५B
सक्रिय पैरामीटर३.३B
संदर्भ सीमा२,६२,१४४ tokens
संस्करण स्थितिवर्तमान · वर्तमान
वास्तुकलाQwen3VLMoeForConditionalGeneration
मोडैलिटीपाठ, चित्र, वीडियो
लाइसेंसApache 2.0 लाइसेंस
परिनियोजन स्थितिप्रमाणित कॉन्फ़िगरेशन के साथ परिनियोज्य
वाणिज्यिक स्थितिव्यावसायिक उपयोग अनुमत
जारी होने की तारीख2025-09-30

आर्किटेक्चर, खूबियाँ और उपयोग

Qwen3-VL 30B-A3B Thinking, Qwen का आधिकारिक स्व-होस्ट योग्य संस्करण है। यह Qwen दृश्य शाखा में Qwen3VLMoeForConditionalGeneration, 30.5B / 3.3B MoE और 262,144 टोकन सत्यापित संदर्भ उपयोग करता है।

Qwen3-VL 30B-A3B Thinking Qwen3VLMoeForConditionalGeneration और 30.5B / 3.3B MoE उपयोग करता है। प्रकाशित होने पर 48 परतें, hidden width 2048 और 32 attention heads दर्ज हैं।

सत्यापित Qwen3VLMoeForConditionalGeneration आर्किटेक्चर
262,144 टोकन प्रमाणित संदर्भ
आधिकारिक चेकपॉइंट स्रोत
निजी LLM इन्फ़रेंस
एजेंट वर्कफ़्लो
लंबे दस्तावेज़ संसाधन

प्रमाणित चेकपॉइंट और क्वांटाइज़ेशन

केवल इस संस्करण से जुड़े सटीक और स्रोत-प्रमाणित वैरिएंट दिखाए जाते हैं।

Qwen3-VL-30B-A3B-Thinking

Qwen/Qwen3-VL-30B-A3B-Thinking

आधिकारिक · BF16 · safetensors

सत्यापित निष्पादन परिवेश: Transformers

प्रिसीजन / क्वांटाइज़ेशनप्रारूपबिटप्रकाशक भरोसापरिनियोजन स्थिति
BF16safetensors16आधिकारिकसत्यापित निष्पादन परिवेश

अनुशंसित हार्डवेयर

सटीक चेकपॉइंट प्रिसीजन के साथ केवल प्रमाणित रनटाइम कॉन्फ़िगरेशन उपयोग करें। रैंकिंग वेट, केवी कैश, ओवरहेड, GPU आर्किटेक्चर और टोपोलॉजी जाँचती है।

अनुमानित वेट मेमोरी58.51 GB
केवी कैश0.75 GB
रनटाइम ओवरहेड15.39 GB
सुरक्षा मार्जिन सहित कुल92.57 GB

अनुशंसित सर्वोत्तम मूल्य

2× NVIDIA A100 SXM 80GB

160 GB कुल VRAM · nvlink

67.43 GB मार्जिन · उपलब्ध

USD १,८३० / माह

सबसे कम लागत वाला उपयुक्त विकल्प

4× NVIDIA L4 24GB

96 GB कुल VRAM · pcie

3.43 GB मार्जिन · उपलब्ध

USD १,००० / माह

सर्वोच्च प्रदर्शन

2× NVIDIA A100 SXM 80GB

160 GB कुल VRAM · nvlink

67.43 GB मार्जिन · उपलब्ध

USD १,८३० / माह

लाइसेंस और स्व-होस्टिंग विचार

पूरे 30.5 B निवासी वेट चयनित GPUs पर समाने चाहिए। संदर्भ और concurrency केवी कैश बढ़ाते हैं।

Qwen3-VL 30B-A3B Thinking Apache 2.0 लाइसेंस के अंतर्गत जारी है। आधिकारिक URL और सत्यापन तारीख सुरक्षित हैं।

व्यावसायिक उपयोग अनुमत. आधिकारिक लाइसेंस व्यावसायिक उपयोग की अनुमति देता है; उसकी सभी शर्तें लागू रहती हैं।

विकल्प और समान-पीढ़ी वैरिएंट

Qwen3-VL 8B Instruct, Qwen3-VL 235B-A22B Instruct, Qwen3-VL 235B-A22B Thinking, Qwen3-VL 32B Instruct, Qwen3-VL 32B Thinking, Qwen3-VL 30B-A3B Instruct, Qwen3-VL 8B Thinking

रिलीज़ क्रम

सामान्य प्रश्न

Qwen3-VL 30B-A3B Thinking को कितनी VRAM चाहिए?

अनुमान चेकपॉइंट प्रिसीजन, संदर्भ और concurrency पर निर्भर है और प्रमाणित डेटा उपयोग करता है।

कौन से रनटाइम Qwen3-VL 30B-A3B Thinking को समर्थन देते हैं?

transformers के लिए आधिकारिक प्रमाण सत्यापित हैं।

क्या Qwen3-VL 30B-A3B Thinking का वाणिज्यिक उपयोग हो सकता है?

संग्रहीत वर्गीकरण व्यावसायिक उपयोग अनुमत है। आधिकारिक Apache 2.0 लाइसेंस शर्तें देखें।

आधिकारिक स्रोत

अंतिम सत्यापन: 2026-08-26