収録 GPU56価格追跡27 日直近 24h の価格データ34,228 件24h 最大の値下げGeForce RTX 4060 Ti 16GB-16.4%24h 最大の値上げRadeon RX 7800 XT+19.1%更新
¥ JPY
日本語

L40S の価格・中古相場:実行できるローカルLLMは?

L40S は 48GB の GDDR6 メモリと 864 GB/s の帯域幅を備えます。価格のデータはまだありません。4-bit 量子化・8K コンテキストなら最大で約 79B パラメータの Dense モデルが収まり、推定 13 tokens/s です。

L40S の価格推移

現在見積もりなし
価格更新日時 —

データ不足のため、推移を表示できません

有効な価格データが十分に集まると、中央値の推移を表示します。

購入リンクにはアフィリエイトタグが含まれる場合がありますが、支払額は変わりません。

L40S の詳細スペック

  • メモリ48 GB · GDDR6
  • 帯域幅864 GB/s
  • FP16 / BF16362.1 TFLOPS
  • FP8 / INT8733 / 733 TOPS
バス幅
384-bit
アーキテクチャ
Ada Lovelace (AD102)
コア
18,176
Tensor コア
568
エコシステム
CUDA
インターフェース
PCIe 4.0 x16
NVLink
非対応
消費電力
350 W
補助電源
16-pin
スロット
2
長さ
267 mm
種別
データセンター
発売日
2023年8月8日

L40S で動かせるモデルは?

L40S 1 枚で動かせる 50B 以下のモデル、2026 年以降にリリースされたバージョンのみ

モデルサイズ動作速度 t/s最大コンテキスト
Gemma 4 E4B8B5 GB動く113.7128K
Qwen3.5 9B9.7B5.7 GB動く100.2256K
Gemma 4 12B12B7.1 GB動く81256K
Gemma 4 26B A4B25.2B(有効 3.8B)16.9 GB動く120.4256K
Qwen3.6 27B27.8B16.8 GB動く36.1256K
Qwen3.8 27B27.8B16.5 GB動く36.8256K
GLM 4.7 Flash30B(有効 3B)18.3 GB動く138.4198K
Gemma 4 31B30.7B18.3 GB動く32.5256K
Qwen3.6 35B A3B36B(有効 3B)22.1 GB動く142.2256K

動く重みも KV キャッシュも VRAM に収まり、速度は VRAM 帯域幅から推定します。

RAM オフロードが必要MoE モデルのみ。エキスパート重みをシステム RAM に置くため、速度は RAM 帯域幅 70 GB/s から推定します。

入らないこの量子化では 1 枚に収まらず、RAM へのオフロードでも動きません。

L40S 2枚・4枚・8枚差しで動かせる LLM は?

2026 年以降リリースの 50B 以上のモデルに必要な枚数(vLLM のテンソル並列、32K コンテキスト)

モデルサイズ必要枚数合計価格合計 VRAM速度 t/s合計消費電力
Qwen3.8 Flash Next176B(有効 6B)111.3 GB4 枚価格なし192 GB94.41,400 W
DeepSeek V4 Flash284B(有効 13B)155.1 GB4 枚価格なし192 GB65.31,400 W
Hy3295B(有効 21B)182.2 GB8 枚価格なし384 GB30.62,800 W
GLM 5.3 Flash320B(有効 18B)199.7 GB8 枚価格なし384 GB45.52,800 W

枚数は 1 / 2 / 4 / 8 枚、各カード VRAM の 90% を使用。速度は 1 枚分の帯域幅から推定し、合計価格は GPU のみです。NVLink 非対応のため、カード間は PCIe 経由です。実際に動くかは vLLM の対応次第です。

L40S のレンタル料金

L40S のレンタルは 1 時間 ¥124 から(RunPod)、1 日 8 時間なら月約 ¥30,241 です。カード購入費(eBay 中央値 ¥1,411,746)は 1 日 4・8・24 時間の利用で、約 8.5 年・4.3 年・1.4 年で回収できます。

方法価格1 日 4 時間1 日 8 時間1 日 24 時間見る
RunPodレンタル36 分前に更新¥124/時間¥15,121/月¥30,241/月¥90,724/月借りる
Vast.aiレンタル36 分前に更新¥126/時間¥15,340/月¥30,681/月¥92,042/月借りる
eBay2 時間前に更新¥1,411,746約 8.5 年で回収電気代 ¥1,320/月約 4.3 年で回収電気代 ¥2,640/月約 1.4 年で回収電気代 ¥7,921/月買う

回収期間は電気代 1kWh ¥31(電力料金目安単価)と定格 350 W で試算。売却額やほかのパーツ代は含みません。

他市場の価格

eBay · 米国
¥1,411,746
18 件の出品
見る
Xianyu · 中国本土
なし
出品なし
見る

購入リンクにはアフィリエイトタグが含まれる場合がありますが、支払額は変わりません。

よくある質問

L40S で動かせるモデルの最大サイズは?

L40S 1 枚の VRAM は 48GB の GDDR6 です。4-bit 量子化・8K コンテキストなら最大で約 79B パラメータの Dense モデルが収まり、8-bit では約 43B です。

L40S で 70B モデルは動きますか?

はい。4-bit・8K コンテキストでは 70B Dense モデルに約 43GB が必要で、L40S の 48GB に収まります。

L40S に向いている LLM は?

2026 年リリースのモデルのうち、4-bit で VRAM に丸ごと収まる最大の Dense モデルは Gemma 4 31B で、推定 32.5 tokens/s です。MoE モデルでは Qwen3.6 35B A3B が最速で、約 142.2 tokens/s です。全リストは上の「動かせるモデル」の表にあります。

L40S で LLM は毎秒何トークン出ますか?

VRAM 帯域から推定すると、4-bit・8K コンテキストで 8B の Dense モデルで約 109.1 tokens/s、14B の Dense モデルで約 66 tokens/s、32B の Dense モデルで約 30.7 tokens/s、70B の Dense モデルで約 14.5 tokens/s です。MoE モデルは 1 トークンごとにアクティブパラメータだけを読むため、ずっと速くなります。実測は推定値の 70%〜100% になることが多いです。

L40S 2枚差しで動かせる LLM は?

vLLM のテンソル並列・4-bit・32K コンテキストでは、L40S 2 枚に 2026 年リリースの 50B 以上のモデルは収まりません。4-bit・32K コンテキストなら最低 4 枚で Qwen3.8 Flash Next、DeepSeek V4 Flash が動きます。

L40S の価格は?

2026年9月29日時点の価格:eBay の中央値 ¥1,411,746(出品 18 件)。出品中の掲載価格の中央値で、6 時間ごとに更新します。

L40S のレンタル料金は 1 時間いくら?

2026年9月29日時点の料金:RunPod は 1 時間 ¥124、Vast.ai は 1 時間 ¥126。いずれも 1 GPU のオンデマンド料金で、ストレージと通信量は含みません。

1 日 8 時間使うなら、L40S は購入とレンタルどちらが得?

eBay の中央値 ¥1,411,746、電気料金 1kWh あたり ¥31 で計算すると、1 日 8 時間使う場合、購入は約 4.3 年で元が取れます(RunPod の 1 時間 ¥124 と比較)。4.3 年以上使うなら購入、それより短いならレンタルがお得です。

LLM 用なら L40S と RTX 6000 Ada のどちらを選ぶべきですか?

RTX 6000 Ada は VRAM 48GB・帯域 960 GB/s、L40S は 48GB・864 GB/s です。70B の Dense モデル(4-bit)では、推定で L40S が約 14.5 tokens/s、RTX 6000 Ada が約 16.1 tokens/s です。