gpt-oss-120b-Eagle3-throughput
nvidia/gpt-oss-120b-Eagle3-throughput
官方 · 未知 · safetensors
| 精度 / 量化 | 格式 | 位数 | 发布者可信度 | 部署状态 |
|---|
GPT-OSS · 通用 · gpt-oss-120b-eagle3-throughput
gpt-oss-120b-Eagle3-throughput 是 GPT-OSS 家族通用分支中的近期版本,并由官方修订认证。
gpt-oss-120b-Eagle3-throughput 是 OpenAI 在 GPT-OSS 通用分支中的官方可自托管版本,采用制造商未发布、制造商未发布,认证上下文为 0 词元。
gpt-oss-120b-Eagle3-throughput 使用制造商未发布和制造商未发布。官方资料发布时记录 N/A 层、隐藏维度 N/A 和 N/A 个注意力头。
仅显示与此版本关联并经来源认证的精确变体。
nvidia/gpt-oss-120b-Eagle3-throughput
官方 · 未知 · safetensors
| 精度 / 量化 | 格式 | 位数 | 发布者可信度 | 部署状态 |
|---|
仅使用与精确检查点精度匹配的认证运行时组合。硬件排序会检查权重、KV 缓存、开销、GPU 架构与拓扑。
商业权利尚未核实,因此不建议用于商业部署。
全部 0 B 常驻权重必须装入所选 GPU;上下文与并发会增加 KV 缓存。
gpt-oss-120b-Eagle3-throughput 采用 other 发布,并保留版本级官方 URL 与验证日期。
未知 / 不建议部署. 商业权利尚未核实,因此不建议用于商业部署。
gpt-oss-120b-Eagle3-v3, granitelib-rag-gpt-oss-r1.0, gpt-oss-120b-Eagle3-short-context, gpt-oss-120b-Eagle3-long-context, gpt-oss-safeguard-20b, gpt-oss-safeguard-120b, GPT-OSS 120B, GPT-OSS 20B
估算取决于精度、上下文和并发,并使用认证数据。
制造商未发布已有认证的上游证据。
存储分类为未知 / 不建议部署;请查阅官方 other 条款。
最近验证: 2026-09-03