GPT-OSS / GPT-OSS 120B
GPT-OSS 120B MXFP4 quantization
Estimado até à medição durante a engenharia
Antes → Depois
Lançamento baseCheckpoint verificado
117.000B
117.000B
quantizationMXFP4
Objetivo de retenção de qualidade
Objetivo de retenção de qualidade
Artefacto de produçãoArtefacto
Relatorio de linhagem e benchmark
Relatorio de linhagem e benchmark
Destino de GPU
Pesos e cache KVEstimado até à medição durante a engenharia
VRAM estimadaOs resultados medidos e certificados são entregues com o projeto.
Empacotamento de runtimetransformers
Preço transparente
Não disponível para encomenda