収録 GPU45価格追跡8 日2026年9月3日 から直近 24h の価格データ6,955 件24h 最大の値下げMac Studio M4 Max 128GB-6.7%24h 最大の値上げGeForce RTX 5070 Ti+21.0%データ更新

gpt-oss をローカルで動かすには?バージョン別の必要VRAM

gpt-oss には現在ローカルで動かせるバージョンが 3 個あります。最小の gpt-oss 20B は Q4 量子化で 4GB、最大の gpt-oss 120B は 4GB が必要です。最も安く動かせるデバイスは Tesla V100 16GB(で約 ¥20,097)です。

gpt-oss 各バージョンの必要VRAM

Xianyu
3 バージョン
バージョン公開日コンテキスト
gpt-oss 20BMoE20.9B(有効 3.6B)2025年8月4日128K4別途 RAM 12 GBTesla V100 16GB¥20,097 · 16 GB
gpt-oss Safeguard 20BMoE20.9B(有効 3.6B)2025年9月18日128K4別途 RAM 12 GBTesla V100 16GB¥20,097 · 16 GB
gpt-oss 120BMoE116.8B(有効 5.1B)2025年8月4日128K4別途 RAM 65 GBTesla V100 16GB¥20,097 · 16 GB · エキスパートオフロード

最小VRAM = Q4_K_M の重み + 8K コンテキストの KV キャッシュ + 実行時オーバーヘッド 1GB(切り上げ)。最安デバイスは現在の価格基準の中央値が安い順で最初に収まるものです。

gpt-oss について

gpt-oss は OpenAI が Apache-2.0 で公開しています。本ページは 20.9B から 116.8B までの 3 バージョンを収録。構造パラメータと量子化サイズは Hugging Face などの出典を確認して更新します。

提供元OpenAI
ライセンスApache-2.0
Hugging Face の組織openai