これは2026年で最もよくあるGPU選びです。答えはカードを何に使うかで決まります。ローカルLLMだけを動かすなら中古RTX 3090、ゲームも使う、中古が不安、またはケースや電源が限られるならRTX 5070 Tiです。 帯域幅は936対896 GB/sでほぼ同じなので速度差は5%未満です。違いはVRAMにあり、24GBなら32B Denseの4-bitを動かせますが、16GBではできません。2026年9月5日時点の価格と推移は以下の表を参照してください。価格欄の固定額は中国中古市場の人民元(CNY)を基準とします。
中古RTX 3090か新品RTX 5070 Tiか?ローカルLLMでの24GB対16GB(2026)
简体中文版からの翻訳 · 原文を読む
本文とFAQの数値は2026年9月5日時点です。表には最新の公開済み価格を使用し、収集日は機種ごとに異なる場合があります。

2枚の主要仕様を比較
3090は24GB VRAMとわずかに高い帯域幅、5070 Tiは消費電力、サイズ、新アーキテクチャ、保証で優位です。 リアルタイムデータ:
| 項目 | |||
|---|---|---|---|
| VRAM | 24 GB GDDR6X | 16 GB GDDR7 | 16 GB GDDR6X |
| 帯域幅 | 936 GB/s | 896 GB/s | 717 GB/s |
| BF16 | 142.3 TFLOPS | 175.8 TFLOPS | 195 TFLOPS |
| INT8 | 285 TOPS | 352 TOPS | 390 TOPS |
| 消費電力 | 350 W | 300 W | 320 W |
| インターフェース | PCIe 4.0 x16 | PCIe 5.0 x16 | PCIe 4.0 x16 |
| 発売日 | 2020年9月24日 | 2025年2月20日 | 2022年11月16日 |
| 希望小売価格 | ¥234,103 | ¥116,973 | ¥187,251 |
| eBay(米国中古) | ¥253,781 | ¥179,599 | ¥187,251 |
| GB 単価 | ¥10,574 | ¥11,226 | ¥11,704 |
| 動く最大の密モデル(4-bit、8K) | 32B | 14B | 14B |
| DeepSeek R1 Distill Qwen 14B の速度 | 68 t/s | 65 t/s | 52 t/s |
- 帯域幅はほぼ同じで、これが速度が同等な理由です。5070 TiのGDDR7の高クロックは256-bitバスで相殺され、3090は384-bitです。
- FP8 / FP4演算性能は5070 Tiにのみあります。vLLMのバッチ推論とFP8重みには有効ですが、llama.cppでGGUFを単一ストリーム実行する用途にはほぼ影響しません。
- 消費電力は350W対300Wです。実際の推論ではどちらも公称値の約60%で、年間の電気代差は数十人民元です。
- サイズは3090リファレンスが3スロット・313 mmで、非リファレンスはさらに大きくなります。5070 Tiの多くは2スロットで、ITXケースでは後者だけが選択肢です。
24GBは16GBより何を多く動かせる?
追加の8GBは一段まるごとの差です。24B〜32B Denseモデルの4-bit版と、70Bモデルの2-bit版です。 3090だけが単体で動かせるモデルライブラリの版(4-bit、8Kコンテキスト):
| GeForce RTX 3090 だけで動くモデル | 必要 VRAM GB | GeForce RTX 3090 での速度 t/s |
|---|---|---|
| Gemma 4 26B A4B | 18 | 112 |
| Qwen3.6 27B | 19 | 38 |
| Qwen3.8 27B | 19 | 38 |
| GLM 4.7 Flash | 19 | 144 |
| DeepSeek R1 Distill Qwen 32B | 22 | 32 |
| Qwen3 32B | 22 | 32 |
| Qwen3.6 35B A3B | 22 | 141 |
条件:4-bit、コンテキスト 8K、1 枚構成。カタログ中で両方のカードで動くモデルは 11 本、どちらでも動かないモデルは 2 本。上の表のモデルは GeForce RTX 5070 Ti では 1 本も収まりません。
この表が3090を買う理由のすべてです。DeepSeek R1 Distill Qwen 32B、Qwen3.8 27B、Qwen3 32Bは2026年に家庭でよく動かされるモデルですが、5070 Tiでは3-bit未満へ落とすかCPUオフロードが必要で、速度は半分以上落ちます。
3090と5070 Tiの速度差は?
両方で動くモデルなら速度差は5%以内で、3090専用の32Bモデルは約32 tokens/sです。 推定デコード速度:
| モデル | Qwen3 8B | Gemma 4 12B | DeepSeek R1 Distill Qwen 14B | DeepSeek R1 Distill Qwen 32B |
|---|---|---|---|---|
| 114 | 74 | 68 | 32 | |
| 109 | 71 | 65 | 収まらない | |
| 89 | 58 | 52 | 収まらない | |
| 117 | 76 | 69 | 収まらない |
4-bit、コンテキスト 8K、単一ストリームでの推定デコード速度。* 付きは MoE モデルのエキスパート重みをシステム RAM(70 GB/s と仮定)に置いて動かした場合です。
公開ベンチマークもこの推定と一致します。llama.cppでLlama 3.1 8B Q4_K_Mを動かすと、コミュニティ実測は3090が約120 tokens/s、5070 Tiが約110〜115です。5070 Tiは演算性能が高いため長いプロンプトを読むprefill段階では約30%速いものの、体感を決めるデコード速度はほぼ同じです。

中古3090のリスク
発生しやすい順に、VRAMチップ故障、マイニングカード、給電端子の焼損、ファンベアリングの4つです。最初の2つは取引時に除外できます。
- VRAM故障:背面のGDDR6Xチップ12個はバックプレートで放熱され、100°C超の長期使用で表示乱れやCUDAエラーが出ます。売り手に
memtest_vulkanまたはOCCTのVRAMテストを30分実行して録画してもらい、受取後にも実行します。 - マイニングカード:2021〜2022年には多数の3090が採掘に使われました。PCBの洗浄跡、ねじの分解跡、ファンの明らかな摩耗を確認します。採掘カードも購入不可ではありませんが、より低い価格で買い、VRAMは高温劣化済みと考えます。
- 12-pin / 8-pin端子の焼損:端子が黄変・黒変していないか確認します。
- ファン:ベアリング音は交換でき、費用は低いです。
取引では、閑魚は「验货宝」を使い、eBayは30日返品対応の売り手を選びます。どちらでも返品・交換不可の安値出品は選びません。
価格推移:3090はさらに下がる?
3090の中古価格は2025〜2026年でほぼ横ばいで、同時期の新品GPUより下落幅が小さいです。 直近30日:
| モデル | 現在 | 30 日安値 | 30 日高値 | 30 日変化 | 30d 推移 |
|---|---|---|---|---|---|
| ¥253,781 | ¥253,781 | ¥268,149 | -5.4% | ||
| ¥179,599 | ¥179,599 | ¥190,999 | -6.0% | ||
| ¥187,251 | ¥176,475 | ¥187,251 | +6.1% |
eBay の直近 30 日の中央値。6 時間ごとに 1 点、変化は現在の中央値と期間内で最も古い点との比較です。
3090はすでに6年目ですが、ローカル推論の需要が価格を支えています。24GBのコンシューマーGPUの代替はより高価な4090と5090 D V2だけです。大幅下落を待つ理由はありません。新品の5070 Tiは1年後には中古価格が現在より明らかに下がるため、待てるのはむしろこちらです。
結論:用途別の答え
モデル実行だけなら3090、ゲームもするかスペース・電源が制約なら5070 Ti、どちらも満たさないなら4080を見ます。
- ローカルLLM中心:RTX 3090。追加の8GBは単なる仕様ではなく能力クラスです。
- ゲーム中心で、ときどきモデルを動かす:RTX 5070 Ti。4Kゲーム性能は大幅に高く、DLSS 4、低消費電力、新品3年保証があります。
- 2スロットしかない、または650W電源:RTX 5070 Ti。
- 5070 Tiより予算が厳しい:中古RTX 4080。16GBで最も安価なCUDAカードです。16GB VRAMで動かせるモデルを参照してください。
- 3090を2枚:予算が1万6,000人民元以上で70Bを動かしたいなら、複数GPU入門を参照してください。
よくある質問
RTX 3090とRTX 5070 Tiで大規模モデルを動かすならどちらが速い?
ほぼ同じです。デコード速度は帯域幅で決まり、3090は936 GB/s、5070 Tiは896 GB/sです。8Bモデルの4-bitでは推定114対109 tokens/sです。5070 TiのBlackwellアーキテクチャとFP4演算性能は、llama.cppの単一ストリーム推論にはほとんど効きません。
RTX 5070 Tiの16GBではどのモデルが使えない?
24B〜32BのすべてのDenseモデルの4-bit版です。DeepSeek R1 Distill Qwen 32B、Qwen3.8 27B、Gemma 4 31Bは収まりません。Mistral Small 3.2 24Bも8Kコンテキストだけです。これは速度差ではなく、実行できる能力クラスの差です。
中古3090の最大のリスクは?
VRAMチップの故障とマイニング使用歴です。背面のGDDR6Xチップは高温に長期間さらされると表示乱れやCUDAエラーを起こします。購入前に売り手へ30分間のVRAMストレステストを依頼し、受け取り後にも自分で実行してください。閑魚では検品サービス、eBayでは30日返品対応を使います。
どんな人が5070 Tiを選ぶべき?
4Kゲームもする、ケースに2スロットカードしか入らない、電源が650W以下、または中古リスクを一切負いたくない人です。モデル実行だけでゲームをしないなら3090を選びます。