GLM-4.5
आधिकारिक · BF16 · safetensors
सत्यापित निष्पादन परिवेश: SGLang Transformers
| प्रिसीजन / क्वांटाइज़ेशन | प्रारूप | बिट | प्रकाशक भरोसा | परिनियोजन स्थिति |
|---|---|---|---|---|
| BF16 | safetensors | 16 | आधिकारिक | सत्यापित निष्पादन परिवेश |
GLM · सामान्य · GLM-4.5
GLM-4.5, GLM परिवार की सामान्य शाखा में पुराना संस्करण है और आधिकारिक revision से प्रमाणित है।
GLM-4.5, Z.ai का आधिकारिक स्व-होस्ट योग्य संस्करण है। यह GLM सामान्य शाखा में Glm4MoeForCausalLM, 355B / 32B MoE और 131,072 टोकन सत्यापित संदर्भ उपयोग करता है।
GLM-4.5 Glm4MoeForCausalLM और 355B / 32B MoE उपयोग करता है। प्रकाशित होने पर 92 परतें, hidden width 5120 और 96 attention heads दर्ज हैं।
केवल इस संस्करण से जुड़े सटीक और स्रोत-प्रमाणित वैरिएंट दिखाए जाते हैं।
आधिकारिक · BF16 · safetensors
सत्यापित निष्पादन परिवेश: SGLang Transformers
| प्रिसीजन / क्वांटाइज़ेशन | प्रारूप | बिट | प्रकाशक भरोसा | परिनियोजन स्थिति |
|---|---|---|---|---|
| BF16 | safetensors | 16 | आधिकारिक | सत्यापित निष्पादन परिवेश |
सटीक चेकपॉइंट प्रिसीजन के साथ केवल प्रमाणित रनटाइम कॉन्फ़िगरेशन उपयोग करें। रैंकिंग वेट, केवी कैश, ओवरहेड, GPU आर्किटेक्चर और टोपोलॉजी जाँचती है।
इस चेकपॉइंट के लिए वर्तमान FusionPointAI इन्वेंटरी रनटाइम, आर्किटेक्चर, टोपोलॉजी और मेमोरी के सभी नियम पार नहीं करती। वैश्विक संगत हार्डवेयर के लिए अनुमानक का उपयोग करें।
पूरे 355 B निवासी वेट चयनित GPUs पर समाने चाहिए। संदर्भ और concurrency केवी कैश बढ़ाते हैं।
GLM-4.5 mit के अंतर्गत जारी है। आधिकारिक URL और सत्यापन तारीख सुरक्षित हैं।
व्यावसायिक उपयोग अनुमत. आधिकारिक लाइसेंस व्यावसायिक उपयोग की अनुमति देता है; उसकी सभी शर्तें लागू रहती हैं।
GLM-5.3, GLM-5.2, GLM-5.1
अनुमान चेकपॉइंट प्रिसीजन, संदर्भ और concurrency पर निर्भर है और प्रमाणित डेटा उपयोग करता है।
sglang, transformers के लिए आधिकारिक प्रमाण सत्यापित हैं।
संग्रहीत वर्गीकरण व्यावसायिक उपयोग अनुमत है। आधिकारिक mit शर्तें देखें।
अंतिम सत्यापन: 2026-09-03