Tesla T10 の価格・中古相場:実行できるローカルLLMは?
Tesla T10 は 16GB の GDDR6 メモリと 403 GB/s の帯域幅を備えます。価格のデータはまだありません。4-bit 量子化・8K コンテキストなら最大で約 23B パラメータの Dense モデルが収まり、推定 20 tokens/s です。
Amazon.jp
Tesla T10 の価格推移
Amazon.jp
購入リンクにはアフィリエイトタグが含まれる場合がありますが、支払額は変わりません。
Tesla T10 の詳細スペック
- メモリ16 GB · GDDR6
- 帯域幅403 GB/s
- FP16 / BF1680 TFLOPS
- INT8160 TOPS
- バス幅
- 256-bit
- アーキテクチャ
- Turing (TU102)
- コア
- 3,584
- Tensor コア
- 448
- エコシステム
- CUDA
- インターフェース
- PCIe 3.0 x16
- NVLink
- 非対応
- 消費電力
- 150 W
- 補助電源
- 1× 8-pin
- スロット
- 1
- 長さ
- 267 mm
- 種別
- データセンター
- 発売日
- 2020年2月4日
Tesla T10 で動かせるモデルは?
Tesla T10 1 枚で動かせる 50B 以下のモデル、2026 年以降にリリースされたバージョンのみ
| モデル | サイズ | 動作 | 速度 t/s | 最大コンテキスト |
|---|---|---|---|---|
| 3.8 GB | 動く | 72.1 | 128K | |
| 4.1 GB | 動く | 66.3 | 256K | |
| 4.7 GB | 動く | 57.4 | 256K | |
| 10.5 GB | 動く | 100.3 | 256K | |
| 11.8 GB | 動く | 24.1 | 64K | |
| 9.8 GB | 動く | 28.8 | 93K | |
| 11.9 GB | 動く | 114.3 | 75K | |
| 11.8 GB | 動く | 23.2 | 41K | |
| 12.3 GB | 動く | 129.2 | 181K |
| モデル | サイズ | 動作 | 速度 t/s | 最大コンテキスト |
|---|---|---|---|---|
| 5 GB | 動く | 55.8 | 128K | |
| 5.7 GB | 動く | 48.8 | 256K | |
| 7.1 GB | 動く | 39.2 | 256K | |
| 16.9 GB | RAM オフロードが必要 | 35 | 256K | |
| 16.8 GB | 入らない | — | — | |
| 16.5 GB | 入らない | — | — | |
| 18.3 GB | RAM オフロードが必要 | 35 | 198K | |
| 18.3 GB | 入らない | — | — | |
| 22.1 GB | RAM オフロードが必要 | 47.6 | 256K |
| モデル | サイズ | 動作 | 速度 t/s | 最大コンテキスト |
|---|---|---|---|---|
| 8.2 GB | 動く | 34.8 | 128K | |
| 9.5 GB | 動く | 30 | 196K | |
| 12.7 GB | 動く | 22.5 | 183K | |
| 26.9 GB | RAM オフロードが必要 | 23.4 | 256K | |
| 28.6 GB | 入らない | — | — | |
| 29 GB | 入らない | — | — | |
| 31.8 GB | RAM オフロードが必要 | 21.7 | 198K | |
| 32.6 GB | 入らない | — | — | |
| 36.9 GB | RAM オフロードが必要 | 31.1 | 256K |
動く重みも KV キャッシュも VRAM に収まり、速度は VRAM 帯域幅から推定します。
RAM オフロードが必要MoE モデルのみ。エキスパート重みをシステム RAM に置くため、速度は RAM 帯域幅 70 GB/s から推定します。
入らないこの量子化では 1 枚に収まらず、RAM へのオフロードでも動きません。
Tesla T10 2枚・4枚・8枚差しで動かせる LLM は?
2026 年以降リリースの 50B 以上のモデルに必要な枚数(vLLM のテンソル並列、32K コンテキスト)
| モデル | サイズ | 必要枚数 | 合計価格 | 合計 VRAM | 速度 t/s | 合計消費電力 |
|---|---|---|---|---|---|---|
| 78.9 GB | 8 枚 | 価格なし | 128 GB | 69.4 | 1,200 W | |
| 96.8 GB | 8 枚 | 価格なし | 128 GB | 51.9 | 1,200 W | |
| 108.7 GB | 8 枚 | 価格なし | 128 GB | 39.6 | 1,200 W |
| モデル | サイズ | 必要枚数 | 合計価格 | 合計 VRAM | 速度 t/s | 合計消費電力 |
|---|---|---|---|---|---|---|
| 111.3 GB | 8 枚 | 価格なし | 128 GB | 55.2 | 1,200 W |
この量子化では、Tesla T10 を 8 枚使っても 50B 以上のモデルは収まりません。
枚数は 1 / 2 / 4 / 8 枚、各カード VRAM の 90% を使用。速度は 1 枚分の帯域幅から推定し、合計価格は GPU のみです。NVLink 非対応のため、カード間は PCIe 経由です。実際に動くかは vLLM の対応次第です。
他市場の価格
購入リンクにはアフィリエイトタグが含まれる場合がありますが、支払額は変わりません。
よくある質問
Tesla T10 で動かせるモデルの最大サイズは?
Tesla T10 1 枚の VRAM は 16GB の GDDR6 です。4-bit 量子化・8K コンテキストなら最大で約 23B パラメータの Dense モデルが収まり、8-bit では約 13B です。MoE モデルならエキスパートを RAM にオフロードして、Qwen3.6 35B A3B(36B)のようなもっと大きなモデルも動かせます。
Tesla T10 で 70B モデルは動きますか?
1 枚では動きません。4-bit・8K コンテキストで 70B Dense モデルには約 43GB が必要で、Tesla T10 の 16GB を超えます。llama.cpp でレイヤーを 3 枚に分割すれば(合計 48GB)動きます。
Tesla T10 に向いている LLM は?
2026 年リリースのモデルのうち、4-bit で VRAM に丸ごと収まる最大の Dense モデルは Gemma 4 12B で、推定 39.2 tokens/s です。全リストは上の「動かせるモデル」の表にあります。
Tesla T10 で LLM は毎秒何トークン出ますか?
VRAM 帯域から推定すると、4-bit・8K コンテキストで 8B の Dense モデルで約 53.4 tokens/s、14B の Dense モデルで約 31.7 tokens/s です。MoE モデルは 1 トークンごとにアクティブパラメータだけを読むため、ずっと速くなります。実測は推定値の 70%〜100% になることが多いです。
Tesla T10 2枚差しで動かせる LLM は?
vLLM のテンソル並列・4-bit・32K コンテキストでは、Tesla T10 2 枚に 2026 年リリースの 50B 以上のモデルは収まりません。4-bit・32K コンテキストなら最低 8 枚で Qwen3.8 Flash Next が動きます。
Tesla T10 の価格は?
2026年9月29日時点の価格:eBay の中央値 ¥77,871(出品 5 件)、Xianyu の中央値 ¥31,245(出品 9 件)。出品中の掲載価格の中央値で、6 時間ごとに更新します。
LLM 用なら Tesla T10 と GeForce RTX 5060 Ti 16GB のどちらを選ぶべきですか?
GeForce RTX 5060 Ti 16GB は VRAM 16GB・帯域 448 GB/s、Tesla T10 は 16GB・403 GB/s です。14B の Dense モデル(4-bit)では、推定で Tesla T10 が約 31.7 tokens/s、GeForce RTX 5060 Ti 16GB が約 35.1 tokens/s です。