ハードウェア
NVIDIA RTX PRO 6000 Blackwell 96GB
96GBのGDDR7を1,792GB/sで回すワークステーション向けGPUです。 DGX Sparkが「容量で殴る」機械なら、こちらは容量も速度も両方持っている代わりに、電力と価格を要求してくる機械です。
最終更新: 2026年8月3日
本ページはプロモーションが含まれています。商品リンクを経由した購入により、当サイトが報酬を受け取ることがあります。
先に結論
96GBに収まるモデルなら、手元で動かせる中で最速の部類です。帯域1,792GB/sはDGX Sparkの約6.6倍、RTX 4090の約1.8倍。70Bクラスを「待つ」ではなく「使う」速度で回せます。
代償は2つあります。600WのTDPと、250万円級の価格です。電源、ケース、冷却、そして電気代まで含めた設計が必要になります。また96GBという容量は、128GB勢が載せられる200Bクラスには届きません。「容量の上限」より「速度」を買う機械だと理解すると位置づけを間違えません。
スペック
| GPU | NVIDIA RTX PRO 6000 Blackwell | Workstation Edition。2025年3月発表 |
|---|---|---|
| アーキテクチャ | Blackwell(GB202 フル構成) | TSMC 4nm、922億トランジスタ |
| メモリ | 96GB GDDR7 ECC | 512bitバス。誤り訂正付き |
| メモリ帯域 | 1,792GB/s | DGX Sparkの約6.6倍。ここが決定的 |
| コア | CUDA 24,064基 | 第5世代Tensorコア752基、第4世代RTコア188基 |
| 消費電力 | 600W(設定可能TDP) | Max-Q版は300Wでブロワー冷却 |
| インターフェース | PCIe 5.0 x16 | DisplayPort 2.1b ×4 |
どのサイズのモデルが動くか
96GBという容量の壁と、1,792GB/sという速度の余裕。この2つが同時に効きます。 「載るかどうか」で切れる線がはっきりしているのが、ユニファイドメモリ勢との違いです。
| モデル規模 | 目安サイズ | 判定 | 補足 |
|---|---|---|---|
| 7B〜32B クラス(Q4) | 約4〜20GB | 余裕 | 帯域が桁違いなので、体感はクラウドのAPIと変わらない領域。 |
| 70B クラス(Q4) | 約40GB | 余裕 | 理論上限が毎秒40トークン超。このクラスを常用速度で回せるのが最大の価値。 |
| 70B クラス(Q8) | 約70GB | 動く | 量子化を緩めて品質を取る選択ができる。96GBの余裕が効く。 |
| 120B クラス(MXFP4など) | 約60〜70GB | 動く | 載った上で速い。コンテキスト長にも余裕を残せる。 |
| 200B クラス(Q4) | 約100GB以上 | 載らない | 96GBを超えるため単体では不可。ここだけは128GB勢に負ける。 |
速度の目安は「メモリ帯域 ÷ モデルサイズ」で出る理論上限からの逆算で、実測値ではありません。実際にはこれより落ちます。
他の選択肢との比較
| 製品 | メモリ | 帯域 | 消費電力 | 価格の目安 | 性格 |
|---|---|---|---|---|---|
| RTX PRO 6000 Blackwell | 96GB GDDR7 | 1,792GB/s | 600W(設定可能) | 約251万円〜(国内実勢) | 96GBに収まるなら手元で最速。電力と価格が壁。 |
| GeForce RTX 4090 | 24GB GDDR6X | 1,008GB/s | 約450W | 約30万円前後 | 24GBに収まる範囲なら費用対効果で圧勝。 |
| DGX Spark | 128GB ユニファイド | 273GB/s | 約170W | 約100万円〜(国内実勢) | 容量は上だが帯域は約6分の1。性格が正反対。 |
| MacBook Pro M5 Max(128GB) | 128GB ユニファイド | 614GB/s | ノート級 | 約117万円〜 | 容量で上、帯域で下。持ち運べる。 |
いずれもカタログ値です。価格は流通と時期で大きく動くため、購入時に必ず実勢を確認してください。
向く人・向かない人
向く人
- 70Bクラスを常用速度で回したい人
- ファインチューニングや学習まで手元でやりたい人
- 画像・動画生成の枚数をこなしたい人
- CUDAとECCメモリが要る業務用途の人
向かない人
- 200Bクラスを載せたい人(96GBでは足りない)
- 電源・冷却・設置を作り込めない人(600W)
- 24GBで足りる人(RTX 4090が費用対効果で圧勝)
- 静音性や省電力を優先する人
価格と購入導線
2025年3月の発表時のMSRPは8,565ドルでしたが、2026年8月時点でNVIDIA公式マーケットプレイスの掲載は13,250ドルまで上がっています。約16か月で55%の上昇です。
国内はさらに重く、2026年8月時点の楽天市場では600W版が251万〜261万円でした。300WのMax-Q版が240万円で、こちらが最安として上位に出てきます。型番が似ていて混同しやすいので、600Wを前提に電源とケースを組むなら、Max-Qを掴まないよう型番を必ず確認してください。 下のグラフはMax-Qを除いた600W版の最安値を追っています。
楽天の価格推移
価格データを読み込んでいます…
上記は各モールの検索結果へのリンクです。Server EditionやMax-Q版が混在するので、型番を必ず確認してください。
関連記事
ハードウェア
VRAM別・現実的に動かせるモデル早見表
GPUのVRAM容量別に、どのくらいの規模のLLMが現実的に動くかの目安を早見表で整理します。
ハードウェア
ローカルAIの速度は何で決まるのか(メモリ帯域の話)
LLMの生成速度を左右するメモリ帯域の仕組みを噛み砕き、容量と帯域の両面でハード選びを整理します。
ハードウェア
VRAMとユニファイドメモリは何が違うのか
GPU専用VRAM・ユニファイドメモリ・システムRAMの違いを、容量と速度の観点でローカルAI向けに整理します。
基礎知識
量子化(Q4・Q8)とは何か、品質と速度のバランス
モデルを軽くする量子化の仕組みと、Q4・Q8などの選び方の目安を入門者向けに整理します。