跳到主要内容

GPT-OSS · 通用 · GPT-OSS

GPT-OSS 120B:规格、GPU 需求、托管与部署

GPT-OSS 120B 是 GPT-OSS 家族通用分支中的当前版本,并由官方修订认证。

GPT-OSS 120B 技术部署示意图
参考部署流程;精确架构事实另行列出。
总参数117.0B
激活参数5.1B
上下文窗口131,072 tokens
版本状态当前 · 当前
架构GptOssForCausalLM
模态文本
许可证apache-2.0
部署状态具备认证配置,可部署
商业状态允许商业使用
发布日期2025-08-04

架构、优势与用途

GPT-OSS 120B 是 OpenAI 在 GPT-OSS 通用分支中的官方可自托管版本,采用 GptOssForCausalLM、117B / 5.1B MoE,认证上下文为 131,072 词元。

GPT-OSS 120B 使用 GptOssForCausalLM 和 117B / 5.1B MoE。官方资料发布时记录 36 层、隐藏维度 2880 和 64 个注意力头。

已验证的 GptOssForCausalLM 架构
131,072 词元认证上下文
官方检查点来源
私有 LLM 推理
智能体工作流
长文档处理

已认证检查点与量化

仅显示与此版本关联并经来源认证的精确变体。

gpt-oss-120b

openai/gpt-oss-120b

官方 · MXFP4 · safetensors

已验证运行环境: Transformers

精度 / 量化格式位数发布者可信度部署状态
MXFP4safetensors4官方已验证运行环境

推荐硬件

仅使用与精确检查点精度匹配的认证运行时组合。硬件排序会检查权重、KV 缓存、开销、GPU 架构与拓扑。

估算权重内存56.12 GB
KV 缓存0.14 GB
运行时开销26.69 GB
含安全余量总计102.86 GB
技术兼容参考配置

当前 FusionPointAI 库存没有同时通过此检查点的运行时、架构、拓扑和内存检查。请使用估算器查看全球兼容硬件。

许可证与自托管注意事项

全部 117 B 常驻权重必须装入所选 GPU;上下文与并发会增加 KV 缓存。

GPT-OSS 120B 采用 apache-2.0 发布,并保留版本级官方 URL 与验证日期。

允许商业使用. 官方许可允许商业使用,但仍须遵守其全部义务。

替代方案与同代变体

GPT-OSS 20B, gpt-oss-120b-Eagle3-v3, granitelib-rag-gpt-oss-r1.0

发布历程

openai/gpt-oss/gpt-oss-120b @ 776a162c0c69e2eae8df64b37ac803df6f2dfe928aad74f49583f0532c30e946

官方来源

常见问题

GPT-OSS 120B 需要多少 VRAM?

估算取决于精度、上下文和并发,并使用认证数据。

哪些运行时支持 GPT-OSS 120B?

transformers 已有认证的上游证据。

GPT-OSS 120B 可用于商业用途吗?

存储分类为允许商业使用;请查阅官方 apache-2.0 条款。

官方来源

最近验证: 2026-09-03