Zum Hauptinhalt springen

GPT-OSS · Allgemein · GPT-OSS

GPT-OSS 20B: Daten, GPU-Bedarf, Hosting und Bereitstellung

GPT-OSS 20B ist eine Aktuell-Version im Allgemein-Zweig der GPT-OSS-Familie und anhand der offiziellen Revision zertifiziert.

Technische Bereitstellungsillustration für GPT-OSS 20B
Referenzablauf; exakte Architekturdaten stehen separat.
Gesamtparameter21,0B
Aktive Parameter3,6B
Kontextfenster131.072 tokens
VersionsstatusAktuell · Aktuell
ArchitekturGptOssForCausalLM
ModalitätenText
Lizenzapache-2.0
BereitstellungsstatusMit zertifizierter Konfiguration bereitstellbar
Kommerzieller StatusKommerzielle Nutzung erlaubt
Veröffentlichungsdatum2025-08-04

Architektur, Stärken und Einsatzbereiche

GPT-OSS 20B ist eine offizielle selbst hostbare OpenAI-Version im Zweig GPT-OSS Allgemein. Sie nutzt GptOssForCausalLM mit 21B / 3.6B MoE und 131,072 geprüften Kontext-Token.

GPT-OSS 20B nutzt GptOssForCausalLM mit 21B / 3.6B MoE. Das Quellenprofil enthält 24 Schichten, Breite 2880 und 64 Attention-Köpfe, soweit veröffentlicht.

Geprüfte GptOssForCausalLM-Architektur
131,072 zertifizierte Kontext-Token
Offizielle Checkpoint-Herkunft
Private LLM-Inferenz
Agentische Abläufe
Verarbeitung langer Dokumente

Zertifizierte Checkpoints und Quantisierungen

Angezeigt werden nur exakte, quellengeprüfte Varianten dieser Version.

gpt-oss-20b

openai/gpt-oss-20b

Offiziell · MXFP4 · safetensors

Laufzeitumgebung verifiziert: Transformers

Präzision / QuantisierungFormatBitVertrauen in HerausgeberBereitstellungsstatus
MXFP4safetensors4OffiziellLaufzeitumgebung verifiziert

Empfohlene Hardware

Nutzen Sie nur zertifizierte Laufzeitkonfigurationen mit exakter Checkpoint-Präzision. Die Rangfolge prüft Gewichte, KV-Cache, Laufzeitaufwand, GPU-Architektur und Topologie.

Geschätzter Gewichtsspeicher10.07 GB
KV cache0.09 GB
Laufzeitaufwand6.55 GB
Gesamt mit Sicherheitsreserve20.73 GB

Empfohlenes Preis-Leistungs-Verhältnis

1× NVIDIA H100 SXM 80GB

80 GB VRAM gesamt · nvswitch

59.27 GB Reserve · Verfügbar

$1.860,00 / Monat

Günstigste geeignete Option

1× NVIDIA H100 PCIe 80GB

80 GB VRAM gesamt · pcie

59.27 GB Reserve · Begrenzte Kapazität

$1.579,00 / Monat

Höchste Leistung

1× NVIDIA H200 SXM 141GB

141 GB VRAM gesamt · nvswitch

120.27 GB Reserve · Begrenzte Kapazität

$2.345,00 / Monat

Lizenz und Selbsthosting

Der vollständige Residenzsatz von 21 B muss auf die GPUs passen. Kontext und Parallelität erhöhen den KV-Cache.

GPT-OSS 20B wird unter apache-2.0 veröffentlicht. Offizielle URL und Prüfdatum werden gespeichert.

Kommerzielle Nutzung erlaubt. Die offizielle Lizenz erlaubt die kommerzielle Nutzung; sämtliche Auflagen gelten weiterhin.

Alternativen und gleichrangige Varianten

GPT-OSS 120B, gpt-oss-120b-Eagle3-v3, granitelib-rag-gpt-oss-r1.0

Versionsverlauf

openai/gpt-oss/gpt-oss-20b @ 0092e0d9951eb4f12c2a37d27e03f6c2688cb749e08312cd3145232e3b737168

Offizielle Quelle

Häufige Fragen

Wie viel VRAM benötigt GPT-OSS 20B?

Die Schätzung hängt von Präzision, Kontext und Parallelität ab und nutzt zertifizierte Daten.

Welche Laufzeitumgebungen unterstützen GPT-OSS 20B?

Geprüfte Upstream-Belege liegen für transformers vor.

Darf GPT-OSS 20B kommerziell genutzt werden?

Die gespeicherte Einstufung ist Kommerzielle Nutzung erlaubt. Maßgeblich sind die offiziellen apache-2.0-Bedingungen.

Offizielle Quellen

Zuletzt geprüft: 2026-09-03