Saltar para o conteúdo principal

GPT-OSS · Geral · GPT-OSS

GPT-OSS 120B: especificações, requisitos GPU, alojamento e implementação

GPT-OSS 120B é uma versão Atual da linha Geral de GPT-OSS, certificada pela revisão oficial.

Ilustração técnica de implementação para GPT-OSS 120B
Fluxo de referência; os dados exatos são apresentados separadamente.
Parâmetros totais117,0B
Parâmetros ativos5,1B
Janela de contexto131 072 tokens
Estado da versãoAtual · Atual
ArquiteturaGptOssForCausalLM
ModalidadesTexto
Licençaapache-2.0
Estado de implementaçãoImplementável com configuração certificada
Estado comercialUso comercial permitido
Data de lançamento2025-08-04

Arquitetura, vantagens e usos

GPT-OSS 120B é uma versão oficial autoalojável da OpenAI na linha GPT-OSS Geral. Usa GptOssForCausalLM com 117B / 5.1B MoE e contexto verificado de 131,072 tokens.

GPT-OSS 120B usa GptOssForCausalLM com 117B / 5.1B MoE. O perfil regista 36 camadas, largura 2880 e 64 cabeças de atenção quando publicados.

Arquitetura GptOssForCausalLM verificada
Contexto certificado de 131,072 tokens
Proveniência oficial do checkpoint
Inferência LLM privada
Fluxos de agentes
Documentos de contexto longo

Checkpoints e quantizações certificados

São mostradas apenas variantes exatas desta versão, certificadas pela fonte.

gpt-oss-120b

openai/gpt-oss-120b

Oficial · MXFP4 · safetensors

Ambiente de execução certificado: Transformers

Precisão / quantizaçãoFormatoBitsConfiança no editorEstado de implementação
MXFP4safetensors4OficialAmbiente de execução certificado

Hardware recomendado

Use apenas configurações de ambiente de execução certificadas com a precisão exata. A classificação verifica pesos, cache KV, sobrecarga, arquitetura GPU e topologia.

Memória estimada dos pesos56.12 GB
KV cache0.14 GB
Sobrecarga do ambiente de execução26.69 GB
Total com margem de segurança102.86 GB
Dimensionamento de referência tecnicamente compatível

Nenhum inventário atual da FusionPointAI cumpre todos os requisitos de ambiente de execução, arquitetura, topologia e memória para este checkpoint. Use o estimador para hardware global compatível.

Licença e alojamento próprio

Os 117 B de pesos residentes têm de caber nas GPUs. Contexto e concorrência adicionam cache KV.

GPT-OSS 120B é publicado sob apache-2.0. O URL oficial e a data de verificação são guardados.

Uso comercial permitido. A licença oficial permite o uso comercial; todas as suas obrigações continuam aplicáveis.

Alternativas e variantes irmãs

GPT-OSS 20B, gpt-oss-120b-Eagle3-v3, granitelib-rag-gpt-oss-r1.0

Cronologia da versão

openai/gpt-oss/gpt-oss-120b @ 776a162c0c69e2eae8df64b37ac803df6f2dfe928aad74f49583f0532c30e946

Fonte oficial

Perguntas frequentes

Quanta VRAM requer GPT-OSS 120B?

A estimativa depende da precisão, contexto e concorrência e usa dados certificados.

Que ambientes de execução suportam GPT-OSS 120B?

Existem provas oficiais certificadas para transformers.

GPT-OSS 120B pode ser usado comercialmente?

A classificação guardada é Uso comercial permitido. Consulte os termos oficiais de apache-2.0.

Referências oficiais

Última verificação: 2026-09-03