gpt-oss-120b
आधिकारिक · MXFP4 · safetensors
सत्यापित निष्पादन परिवेश: Transformers
| प्रिसीजन / क्वांटाइज़ेशन | प्रारूप | बिट | प्रकाशक भरोसा | परिनियोजन स्थिति |
|---|---|---|---|---|
| MXFP4 | safetensors | 4 | आधिकारिक | सत्यापित निष्पादन परिवेश |
GPT-OSS · सामान्य · GPT-OSS
GPT-OSS 120B, GPT-OSS परिवार की सामान्य शाखा में वर्तमान संस्करण है और आधिकारिक revision से प्रमाणित है।
GPT-OSS 120B, OpenAI का आधिकारिक स्व-होस्ट योग्य संस्करण है। यह GPT-OSS सामान्य शाखा में GptOssForCausalLM, 117B / 5.1B MoE और 131,072 टोकन सत्यापित संदर्भ उपयोग करता है।
GPT-OSS 120B GptOssForCausalLM और 117B / 5.1B MoE उपयोग करता है। प्रकाशित होने पर 36 परतें, hidden width 2880 और 64 attention heads दर्ज हैं।
केवल इस संस्करण से जुड़े सटीक और स्रोत-प्रमाणित वैरिएंट दिखाए जाते हैं।
आधिकारिक · MXFP4 · safetensors
सत्यापित निष्पादन परिवेश: Transformers
| प्रिसीजन / क्वांटाइज़ेशन | प्रारूप | बिट | प्रकाशक भरोसा | परिनियोजन स्थिति |
|---|---|---|---|---|
| MXFP4 | safetensors | 4 | आधिकारिक | सत्यापित निष्पादन परिवेश |
सटीक चेकपॉइंट प्रिसीजन के साथ केवल प्रमाणित रनटाइम कॉन्फ़िगरेशन उपयोग करें। रैंकिंग वेट, केवी कैश, ओवरहेड, GPU आर्किटेक्चर और टोपोलॉजी जाँचती है।
इस चेकपॉइंट के लिए वर्तमान FusionPointAI इन्वेंटरी रनटाइम, आर्किटेक्चर, टोपोलॉजी और मेमोरी के सभी नियम पार नहीं करती। वैश्विक संगत हार्डवेयर के लिए अनुमानक का उपयोग करें।
पूरे 117 B निवासी वेट चयनित GPUs पर समाने चाहिए। संदर्भ और concurrency केवी कैश बढ़ाते हैं।
GPT-OSS 120B apache-2.0 के अंतर्गत जारी है। आधिकारिक URL और सत्यापन तारीख सुरक्षित हैं।
व्यावसायिक उपयोग अनुमत. आधिकारिक लाइसेंस व्यावसायिक उपयोग की अनुमति देता है; उसकी सभी शर्तें लागू रहती हैं।
GPT-OSS 20B, gpt-oss-120b-Eagle3-v3, granitelib-rag-gpt-oss-r1.0
अनुमान चेकपॉइंट प्रिसीजन, संदर्भ और concurrency पर निर्भर है और प्रमाणित डेटा उपयोग करता है।
transformers के लिए आधिकारिक प्रमाण सत्यापित हैं।
संग्रहीत वर्गीकरण व्यावसायिक उपयोग अनुमत है। आधिकारिक apache-2.0 शर्तें देखें।
अंतिम सत्यापन: 2026-09-03