Saltar al contenido principal

GPT-OSS · General · GPT-OSS

GPT-OSS 120B: especificaciones, GPU, hosting y despliegue

GPT-OSS 120B es una versión Actual de la línea General de GPT-OSS, certificada desde su revisión oficial.

Ilustración técnica de despliegue para GPT-OSS 120B
Flujo de referencia; los datos exactos se muestran aparte.
Parámetros totales117,0B
Parámetros activos5,1B
Ventana de contexto131.072 tokens
Estado de versiónActual · Actual
ArquitecturaGptOssForCausalLM
ModalidadesTexto
Licenciaapache-2.0
Estado de despliegueDesplegable con una configuración certificada
Estado comercialUso comercial permitido
Fecha de lanzamiento2025-08-04

Arquitectura, fortalezas y usos

GPT-OSS 120B es una versión oficial autoalojable de OpenAI en la línea GPT-OSS General. Usa GptOssForCausalLM con 117B / 5.1B MoE y un contexto verificado de 131,072 tokens.

GPT-OSS 120B usa GptOssForCausalLM con 117B / 5.1B MoE. El perfil registra 36 capas, ancho oculto 2880 y 64 cabezas de atención cuando se publican.

Arquitectura GptOssForCausalLM verificada
Contexto certificado de 131,072 tokens
Proveniencia oficial del checkpoint
Inferencia LLM privada
Flujos con agentes
Documentos de contexto largo

Checkpoints y cuantizaciones certificados

Solo se muestran variantes exactas, vinculadas a esta versión y certificadas por su fuente.

gpt-oss-120b

openai/gpt-oss-120b

Oficial · MXFP4 · safetensors

Entorno de ejecución certificado: Transformers

Precisión / cuantizaciónFormatoBitsConfianza del editorEstado de despliegue
MXFP4safetensors4OficialEntorno de ejecución certificado

Hardware recomendado

Use solo configuraciones de entorno de ejecución certificadas con la precisión exacta. El ranking comprueba pesos, caché KV, sobrecarga, arquitectura GPU y topología.

Memoria estimada de pesos56.12 GB
KV cache0.14 GB
Sobrecarga del entorno de ejecución26.69 GB
Total con margen de seguridad102.86 GB
Dimensionamiento de referencia técnicamente compatible

Ningún inventario actual de FusionPointAI cumple todos los requisitos de entorno de ejecución, arquitectura, topología y memoria para este checkpoint. Use el estimador para hardware compatible global.

Licencia y autoalojamiento

Los 117 B de pesos residentes deben caber en las GPU. Contexto y concurrencia añaden caché KV.

GPT-OSS 120B se publica bajo apache-2.0. Se conservan la URL oficial y la fecha de verificación.

Uso comercial permitido. La licencia oficial permite el uso comercial; todas sus obligaciones siguen vigentes.

Alternativas y variantes hermanas

GPT-OSS 20B, gpt-oss-120b-Eagle3-v3, granitelib-rag-gpt-oss-r1.0

Cronología de la versión

openai/gpt-oss/gpt-oss-120b @ 776a162c0c69e2eae8df64b37ac803df6f2dfe928aad74f49583f0532c30e946

Fuente oficial

Preguntas frecuentes

¿Cuánta VRAM requiere GPT-OSS 120B?

La estimación depende de precisión, contexto y concurrencia y usa datos certificados.

¿Qué entornos de ejecución admiten GPT-OSS 120B?

Hay pruebas oficiales certificadas para transformers.

¿Puede usarse GPT-OSS 120B comercialmente?

La clasificación es Uso comercial permitido. Consulte los términos oficiales de apache-2.0.

Referencias oficiales

Última verificación: 2026-09-03