Zum Hauptinhalt springen

GPT-OSS · Allgemein · GPT-OSS

GPT-OSS 120B: Daten, GPU-Bedarf, Hosting und Bereitstellung

GPT-OSS 120B ist eine Aktuell-Version im Allgemein-Zweig der GPT-OSS-Familie und anhand der offiziellen Revision zertifiziert.

Technische Bereitstellungsillustration für GPT-OSS 120B
Referenzablauf; exakte Architekturdaten stehen separat.
Gesamtparameter117,0B
Aktive Parameter5,1B
Kontextfenster131.072 tokens
VersionsstatusAktuell · Aktuell
ArchitekturGptOssForCausalLM
ModalitätenText
Lizenzapache-2.0
BereitstellungsstatusMit zertifizierter Konfiguration bereitstellbar
Kommerzieller StatusKommerzielle Nutzung erlaubt
Veröffentlichungsdatum2025-08-04

Architektur, Stärken und Einsatzbereiche

GPT-OSS 120B ist eine offizielle selbst hostbare OpenAI-Version im Zweig GPT-OSS Allgemein. Sie nutzt GptOssForCausalLM mit 117B / 5.1B MoE und 131,072 geprüften Kontext-Token.

GPT-OSS 120B nutzt GptOssForCausalLM mit 117B / 5.1B MoE. Das Quellenprofil enthält 36 Schichten, Breite 2880 und 64 Attention-Köpfe, soweit veröffentlicht.

Geprüfte GptOssForCausalLM-Architektur
131,072 zertifizierte Kontext-Token
Offizielle Checkpoint-Herkunft
Private LLM-Inferenz
Agentische Abläufe
Verarbeitung langer Dokumente

Zertifizierte Checkpoints und Quantisierungen

Angezeigt werden nur exakte, quellengeprüfte Varianten dieser Version.

gpt-oss-120b

openai/gpt-oss-120b

Offiziell · MXFP4 · safetensors

Laufzeitumgebung verifiziert: Transformers

Präzision / QuantisierungFormatBitVertrauen in HerausgeberBereitstellungsstatus
MXFP4safetensors4OffiziellLaufzeitumgebung verifiziert

Empfohlene Hardware

Nutzen Sie nur zertifizierte Laufzeitkonfigurationen mit exakter Checkpoint-Präzision. Die Rangfolge prüft Gewichte, KV-Cache, Laufzeitaufwand, GPU-Architektur und Topologie.

Geschätzter Gewichtsspeicher56.12 GB
KV cache0.14 GB
Laufzeitaufwand26.69 GB
Gesamt mit Sicherheitsreserve102.86 GB
Technisch kompatible Referenzdimensionierung

Kein aktueller FusionPointAI-Bestand erfüllt für diesen Checkpoint alle Laufzeit-, Architektur-, Topologie- und Speicherkriterien. Nutzen Sie den Rechner für global kompatible Hardware.

Lizenz und Selbsthosting

Der vollständige Residenzsatz von 117 B muss auf die GPUs passen. Kontext und Parallelität erhöhen den KV-Cache.

GPT-OSS 120B wird unter apache-2.0 veröffentlicht. Offizielle URL und Prüfdatum werden gespeichert.

Kommerzielle Nutzung erlaubt. Die offizielle Lizenz erlaubt die kommerzielle Nutzung; sämtliche Auflagen gelten weiterhin.

Alternativen und gleichrangige Varianten

GPT-OSS 20B, gpt-oss-120b-Eagle3-v3, granitelib-rag-gpt-oss-r1.0

Versionsverlauf

openai/gpt-oss/gpt-oss-120b @ 776a162c0c69e2eae8df64b37ac803df6f2dfe928aad74f49583f0532c30e946

Offizielle Quelle

Häufige Fragen

Wie viel VRAM benötigt GPT-OSS 120B?

Die Schätzung hängt von Präzision, Kontext und Parallelität ab und nutzt zertifizierte Daten.

Welche Laufzeitumgebungen unterstützen GPT-OSS 120B?

Geprüfte Upstream-Belege liegen für transformers vor.

Darf GPT-OSS 120B kommerziell genutzt werden?

Die gespeicherte Einstufung ist Kommerzielle Nutzung erlaubt. Maßgeblich sind die offiziellen apache-2.0-Bedingungen.

Offizielle Quellen

Zuletzt geprüft: 2026-09-03