メインコンテンツへスキップ

GPT-OSS · 汎用 · GPT-OSS

GPT-OSS 120B:仕様、GPU 要件、ホスティング、デプロイ

GPT-OSS 120B は GPT-OSS の汎用系列に属する現行バージョンで、公式リビジョンから検証されています。

GPT-OSS 120B の技術デプロイ図
参照デプロイフロー。正確なデータは別途記載します。
総パラメータ117.0B
有効パラメータ5.1B
コンテキスト長131,072 tokens
バージョン状態現行 · 現行
アーキテクチャGptOssForCausalLM
モダリティテキスト
ライセンスapache-2.0
デプロイ状態認証済み構成でデプロイ可能
商用状態商用利用可
公開日2025-08-04

アーキテクチャ、強み、用途

GPT-OSS 120B は OpenAI の公式セルフホスト版で、GPT-OSS 汎用系列、GptOssForCausalLM、117B / 5.1B MoE、検証済み 131,072 トークンコンテキストを備えます。

GPT-OSS 120B は GptOssForCausalLM と 117B / 5.1B MoE を使用します。公開されている場合は 36 層、隠れ幅 2880、注意ヘッド 64 を記録します。

検証済み GptOssForCausalLM
131,072 トークンの検証済みコンテキスト
公式チェックポイント来歴
非公開 LLM 推論
エージェント処理
長文書処理

検証済みチェックポイントと量子化

このバージョンに紐づく、情報源で検証済みの正確なバリアントだけを表示します。

gpt-oss-120b

openai/gpt-oss-120b

公式 · MXFP4 · safetensors

検証済み実行環境: Transformers

精度 / 量子化形式ビット公開元の信頼区分デプロイ状態
MXFP4safetensors4公式検証済み実行環境

推奨ハードウェア

正確なチェックポイント精度に対応する検証済みランタイム構成だけを使用します。重み、KV キャッシュ、負荷、GPU アーキテクチャ、トポロジを確認します。

推定重みメモリ56.12 GB
KV キャッシュ0.14 GB
ランタイム負荷26.69 GB
安全余裕込み合計102.86 GB
技術的に互換性のある参照構成

このチェックポイントについてランタイム、アーキテクチャ、トポロジ、メモリの全条件を満たす現在の在庫はありません。世界の互換ハードウェアは見積り機能で確認してください。

ライセンスとセルフホスティング

117 B の常駐重み全体が選択 GPU に収まる必要があります。コンテキストと同時実行で KV キャッシュが増えます。

GPT-OSS 120B は apache-2.0 で公開され、公式 URL と検証日を保持します。

商用利用可. 公式ライセンスは商用利用を許可していますが、すべての義務は引き続き適用されます。

代替候補と同世代バリアント

GPT-OSS 20B, gpt-oss-120b-Eagle3-v3, granitelib-rag-gpt-oss-r1.0

リリース履歴

openai/gpt-oss/gpt-oss-120b @ 776a162c0c69e2eae8df64b37ac803df6f2dfe928aad74f49583f0532c30e946

公式情報源

よくある質問

GPT-OSS 120B にはどの程度の VRAM が必要ですか?

精度、コンテキスト、同時実行数に依存し、認証済みデータで計算します。

GPT-OSS 120B に対応するランタイムは?

transformers の公式証拠が認証されています。

GPT-OSS 120B は商用利用できますか?

保存区分は商用利用可です。公式 apache-2.0 条件を確認してください。

公式情報源

最終検証日: 2026-09-03