GLM-5.3-Flash
رسمي · FP8 · safetensors
بيئة التشغيل الموثقة: Transformers vLLM SGLang Tokenspeed KTransformers
| الدقة / التكميم | التنسيق | البتات | ثقة الناشر | حالة النشر |
|---|---|---|---|---|
| FP8 | safetensors | 8 | رسمي | بيئة التشغيل الموثقة |
GLM · سريع · GLM-5.3
GLM-5.3-Flash إصدار حالي ضمن مسار سريع في عائلة GLM، موثق من المراجعة الرسمية.
GLM-5.3-Flash إصدار رسمي من Z.ai قابل للاستضافة الذاتية ضمن مسار GLM سريع. يستخدم Glm5NextForConditionalGeneration مع 320B / 18B MoE وسياق موثق قدره 1,048,576 الرمز.
يستخدم GLM-5.3-Flash بنية Glm5NextForConditionalGeneration مع 320B / 18B MoE. يسجل الملف 45 طبقة وعرضا مخفيا 4096 و64 رأس انتباه حيث تنشر هذه القيم.
تظهر فقط المتغيرات الدقيقة المرتبطة بهذا الإصدار والموثقة من المصدر.
رسمي · FP8 · safetensors
بيئة التشغيل الموثقة: Transformers vLLM SGLang Tokenspeed KTransformers
| الدقة / التكميم | التنسيق | البتات | ثقة الناشر | حالة النشر |
|---|---|---|---|---|
| FP8 | safetensors | 8 | رسمي | بيئة التشغيل الموثقة |
رسمي · غير معروف · unknown
| الدقة / التكميم | التنسيق | البتات | ثقة الناشر | حالة النشر |
|---|
استخدم فقط تركيبات بيئة التشغيل الموثقة مع دقة نقطة التحقق المحددة. يفحص الترتيب الأوزان وKV cache والتكاليف وبنية GPU والطوبولوجيا.
لا ينجح أي مخزون حالي لدى FusionPointAI في جميع اختبارات بيئة التشغيل والبنية والطوبولوجيا والذاكرة لهذا نقطة التحقق. استخدم أداة التقدير للعتاد المتوافق عالميا.
يجب أن تلائم مجموعة الأوزان المقيمة الكاملة البالغة 320 B وحدات GPU المختارة. يزيد السياق والتزامن ذاكرة ذاكرة KV المؤقتة.
ينشر GLM-5.3-Flash بموجب رخصة MIT، ويحتفظ برابط الرخصة الرسمي وتاريخ التحقق.
الاستخدام التجاري مسموح. تسمح الرخصة الرسمية بالاستخدام التجاري مع بقاء جميع التزاماتها سارية.
GLM-4.7 Flash, GLM-5.3-Flash
يعتمد التقدير على دقة نقطة التحقق والسياق والتزامن ويستخدم بيانات موثقة.
توجد أدلة رسمية موثقة لبيئات transformers, vllm, sglang, tokenspeed, ktransformers.
التصنيف المخزن هو الاستخدام التجاري مسموح. راجع شروط رخصة MIT الرسمية.
آخر تحقق: 2026-08-26