Qwen3-30B-A3B-Instruct-2507
Qwen/Qwen3-30B-A3B-Instruct-2507
رسمي · BF16 · safetensors
بيئة التشغيل الموثقة: Transformers
| الدقة / التكميم | التنسيق | البتات | ثقة الناشر | حالة النشر |
|---|---|---|---|---|
| BF16 | safetensors | 16 | رسمي | بيئة التشغيل الموثقة |
Qwen · عام · Qwen3
Qwen3 30B-A3B Instruct 2507 إصدار حديث ضمن مسار عام في عائلة Qwen، موثق من المراجعة الرسمية.
Qwen3 30B-A3B Instruct 2507 إصدار رسمي من Qwen قابل للاستضافة الذاتية ضمن مسار Qwen عام. يستخدم Qwen3MoeForCausalLM مع 30.5B / 3.3B MoE وسياق موثق قدره 262,144 الرمز.
يستخدم Qwen3 30B-A3B Instruct 2507 بنية Qwen3MoeForCausalLM مع 30.5B / 3.3B MoE. يسجل الملف 48 طبقة وعرضا مخفيا 2048 و32 رأس انتباه حيث تنشر هذه القيم.
تظهر فقط المتغيرات الدقيقة المرتبطة بهذا الإصدار والموثقة من المصدر.
Qwen/Qwen3-30B-A3B-Instruct-2507
رسمي · BF16 · safetensors
بيئة التشغيل الموثقة: Transformers
| الدقة / التكميم | التنسيق | البتات | ثقة الناشر | حالة النشر |
|---|---|---|---|---|
| BF16 | safetensors | 16 | رسمي | بيئة التشغيل الموثقة |
استخدم فقط تركيبات بيئة التشغيل الموثقة مع دقة نقطة التحقق المحددة. يفحص الترتيب الأوزان وKV cache والتكاليف وبنية GPU والطوبولوجيا.
أفضل قيمة موصى بها
160 GB إجمالي VRAM · nvlink
67.43 GB هامش · متاح
USD ١٬٨٣٠ / شهرأقل خيار قابل للتشغيل تكلفة
96 GB إجمالي VRAM · pcie
3.43 GB هامش · متاح
USD ١٬٠٠٠ / شهرأعلى أداء
160 GB إجمالي VRAM · nvlink
67.43 GB هامش · متاح
USD ١٬٨٣٠ / شهريجب أن تلائم مجموعة الأوزان المقيمة الكاملة البالغة 30.5 B وحدات GPU المختارة. يزيد السياق والتزامن ذاكرة ذاكرة KV المؤقتة.
ينشر Qwen3 30B-A3B Instruct 2507 بموجب رخصة Apache 2.0، ويحتفظ برابط الرخصة الرسمي وتاريخ التحقق.
الاستخدام التجاري مسموح. تسمح الرخصة الرسمية بالاستخدام التجاري مع بقاء جميع التزاماتها سارية.
Qwen3 235B-A22B, Qwen3 8B, Qwen3.8 2.4T-A95B, Qwen3.8 27B
يعتمد التقدير على دقة نقطة التحقق والسياق والتزامن ويستخدم بيانات موثقة.
توجد أدلة رسمية موثقة لبيئات transformers.
التصنيف المخزن هو الاستخدام التجاري مسموح. راجع شروط رخصة Apache 2.0 الرسمية.
آخر تحقق: 2026-08-26