Passer au contenu principal

GPT-OSS · Général · GPT-OSS

GPT-OSS 20B : caractéristiques, besoins GPU, hébergement et déploiement

GPT-OSS 20B est une version Actuel de la branche Général de GPT-OSS, certifiée depuis sa révision officielle.

Illustration technique de déploiement pour GPT-OSS 20B
Flux de déploiement de référence ; les faits d’architecture exacts sont indiqués séparément.
Paramètres totaux21,0B
Paramètres actifs3,6B
Fenêtre de contexte131 072 tokens
Statut de la versionActuel · Actuel
Architecture du modèleGptOssForCausalLM
ModalitésTexte
Licenceapache-2.0
État de déploiementDéployable avec une configuration certifiée
État commercialUsage commercial autorisé
Date de sortie2025-08-04

Architecture, points forts et usages

GPT-OSS 20B est une version officielle auto-hébergeable de OpenAI dans la branche GPT-OSS Général. Elle utilise GptOssForCausalLM avec 21B / 3.6B MoE et un contexte vérifié de 131,072 tokens.

GPT-OSS 20B utilise GptOssForCausalLM avec 21B / 3.6B MoE. Le profil vérifié indique 24 couches, une largeur cachée de 2880 et 64 têtes d’attention lorsque ces valeurs sont publiées.

Architecture GptOssForCausalLM vérifiée
Contexte certifié de 131,072 tokens
Provenance officielle du checkpoint
Inférence LLM privée
Flux agentiques
Traitement de documents longs

Checkpoints et quantifications certifiés

Seules les variantes exactes, rattachées à cette version et certifiées par leur source sont affichées.

gpt-oss-20b

openai/gpt-oss-20b

Officiel · MXFP4 · safetensors

Environnement d’exécution certifié: Transformers

Précision / quantificationFormatBitsConfiance éditeurÉtat de déploiement
MXFP4safetensors4OfficielEnvironnement d’exécution certifié

Matériel recommandé

Utilisez uniquement les configurations d’exécution certifiées avec la précision exacte du checkpoint. Le classement matériel vérifie poids, cache KV, surcharge, architecture GPU et topologie.

Mémoire estimée des poids10.07 GB
Cache KV0.09 GB
Surcharge de l’environnement d’exécution6.55 GB
Total avec marge de sécurité20.73 GB

Meilleur rapport qualité-prix

1× NVIDIA H100 SXM 80GB

80 GB VRAM totale · nvswitch

59.27 GB de marge · Disponible

USD 1 860 / mois

Option viable la moins chère

1× NVIDIA H100 PCIe 80GB

80 GB VRAM totale · pcie

59.27 GB de marge · Capacité limitée

USD 1 579 / mois

Performances maximales

1× NVIDIA H200 SXM 141GB

141 GB VRAM totale · nvswitch

120.27 GB de marge · Capacité limitée

USD 2 345 / mois

Licence et considérations d’auto-hébergement

Les 21 B de poids résidents doivent tenir sur les GPU choisis. Le contexte et la concurrence ajoutent la mémoire du cache KV.

GPT-OSS 20B est publié sous apache-2.0. Le lien officiel de licence et la date de vérification sont conservés.

Usage commercial autorisé. La licence officielle autorise l’usage commercial ; toutes ses obligations restent applicables.

Alternatives et variantes associées

GPT-OSS 120B, gpt-oss-120b-Eagle3-v3, granitelib-rag-gpt-oss-r1.0

Chronologie des versions

openai/gpt-oss/gpt-oss-20b @ 0092e0d9951eb4f12c2a37d27e03f6c2688cb749e08312cd3145232e3b737168

Source officielle

Questions fréquentes

Quelle VRAM faut-il pour GPT-OSS 20B ?

L’estimation dépend de la précision, du contexte et de la concurrence et utilise les données certifiées.

Quels environnements d’exécution prennent en charge GPT-OSS 20B ?

Des preuves officielles sur les environnements d’exécution sont certifiées pour transformers.

GPT-OSS 20B peut-il être utilisé commercialement ?

La classification enregistrée est Usage commercial autorisé. Consultez les conditions officielles de apache-2.0.

Références officielles

Dernière vérification: 2026-09-03