あなたが気になっているNVIDIA。その「次の主役」が、もう動き出しています。新世代AIプラットフォーム「Vera Rubin(ヴェラ・ルービン)」が量産に入り、AIを動かすコスト(トークン単価)を最大10分の1に下げるといいます。「NVIDIAはなぜ強いのか」——その答えが、ここに詰まっています。

僕は元コンサルで、TMT(テクノロジー・メディア・通信)領域をずっと見てきました。半導体株が気になる人に、まず一つだけ覚えてほしいことがあります。

NVIDIAの強さは、GPU単体の速さだけでは説明できません。

NVIDIAは約1年ごとに新しいAI半導体を出します。Hopper → Blackwell に続く次が、この「Vera Rubin」です。では、なぜGPUだけでなくCPUとセットの「プラットフォーム」なのか。そして、なぜ(広帯域メモリ)が性能の鍵を握るのか。投資家の目線で、一次情報をもとに噛み砕きます。

ひとことで言うと(初心者向け)

NVIDIAが次世代AIチップ『Vera Rubin』を量産し始めました。新しいRubin GPUと新しいVera CPUを組み合わせた設計で、メモリにはHBM4を最大288GB積みます。前世代のBlackwellより推論が最大5倍速く、AIを動かすコスト(トークン単価)が最大10分の1に下がります。出荷は2026年後半からです。

構造で言うと(投資家向け)も見る
構造で言うと(投資家向け)

Vera RubinはBlackwellの後継世代。Rubin GPUは336億トランジスタ・NVFP4で50PFLOPSの推論性能、HBM4を最大288GB・帯域22TB/s。NVL72ラックで72GPU/36CPU、NVLink6で260TB/s。Blackwell比で推論最大5倍・学習3.5倍・トークン単価最大1/10。2026年6月に量産表明、出荷はH2 2026、Ultraは2027後半。HBM4はSamsung・SK hynix・Micronの3社供給。注目点はHBM4・CoWoS級先端実装・液冷・NVLinkスイッチ。

何が起きたのか

NVIDIAは2026年1月のCESでVera Rubinを発表し、6月のGTC Taipei 2026で量産(フル生産)入りを表明しました。製品は各社から2026年後半に出てきます(DataCenterDynamics)。なお、名前は暗黒物質を観測した天文学者ヴェラ・ルービンから取られています。

ここで大事なのは、これが単体のGPUではないことです。実際は、新型GPU「Rubin」と新型CPU「Vera」を一体で設計した「プラットフォーム」なんです。つまり、NVIDIAが売っているのは、もう「部品」ではありません。むしろ「AI工場まるごと」だと考えると腑に落ちます。

Vera RubinはBlackwellと何が違うのか

一番の違いは、推論の「速さ」と「コスト」です。NVL72ラックでの公表値はこうです(NVIDIA Technical Blog)。

項目Blackwell比
性能最大5倍
性能最大3.5倍
メモリ帯域約2.8倍
トークンあたり推論コスト最大10分の1

数字が並びますが、投資家として効くのは最後の1行です。

トークンあたりの推論コストが、最大10分の1。

なぜなら、AIサービスのもうけは、ほぼ「何トークン処理したか」で決まるからです。だからこそ、その元になるコストが1桁下がることが、NVIDIAが選ばれ続ける本当の理由になります。

チップ単体も進化しました。Rubin GPUは336億個のトランジスタを2枚のダイで構成し、推論向けの演算で50PFLOPS(1秒間に5京回)の性能を持ちます。

一方で、CPUのVeraも侮れません。独自設計のArm系コア「Olympus」を88個積み、GPUにデータを途切れず流し込む「給仕役」を担います。とはいえ、CPUが遅ければGPUは手待ちになります。そのため、ここもAI全体の速度を左右するのです。役割分担は「CPUとGPUの違いは“手数”だった——GPUがAIの主役になれた理由」で解説しています。

そして、72基のRubin GPUと36基のVera CPUを1つのラックに束ねたのが「Vera Rubin NVL72」です。GPU同士を直結する高速配線「NVLink」の第6世代でラック全体260TB/sの帯域を確保し、72基を擬似的に1つの巨大なGPUのように動かします。

Vera Rubinとは何か

Vera Rubinとは、NVIDIAがBlackwellの次に出す次世代のデータセンター向けAIプラットフォームの総称です。具体的には、GPU・CPUに加え、機器間をつなぐネットワーク用の新型チップまで束ね、1つのAIスーパーコンピューターとして提供します。だからこそ、NVIDIAの本当の強みが「システム全体の設計力」にあることは「NVIDIAの強さは、GPUの性能だけでは説明できない」でも触れました。

背景:なぜHBMと実装が性能を決めるのか

ここが、半導体株を持つうえで一番大事なところです。

そもそもAIチップの性能は、演算回路の速さだけでは決まりません。実際は、メモリとどれだけ速く大量にデータをやり取りできるかが上限を決めます。なぜなら、生成AIの推論は巨大なモデルを繰り返し読み出す処理が中心で、演算が速くてもメモリが追いつかなければ性能を出し切れないからです。この関係は「AI半導体の「TOPS」より推論速度を決めるのはメモリ帯域幅だった」で扱っています。

そこで効くのが(広帯域メモリ)です。HBMは、メモリチップを縦に積んでGPUの真横に並べ、太い経路で結んだメモリを指します。その結果、Rubin GPUは第4世代のHBM4を1基あたり最大288GB搭載し、合計22TB/sの帯域を実現します。

ただし、GPUとHBMを1つのパッケージに収めるには、に代表される先端実装が欠かせません。しかも、この工程こそ、いまやAIチップ量産の最大のボトルネックです。やさしい解説は「AIの性能を決めていたのは、GPUより「メモリ」だった」にあります。なお、HBM4はSamsung・SK hynix・Micronの3社が供給します(Tech Times)。

ここで、投資家として外せない視点があります。というのも、Vera Rubinの性能は、NVIDIA一社では完結していないからです。HBM4のメモリメーカー、先端実装、液冷まで、複数の会社がそろって初めて成り立ちます。したがって、「NVIDIAだけ見ていれば安心」ではありません。地味ですが、これを知っているかどうかで見える景色が変わります。

今後どうなるか

出荷は2026年後半に本格化し、さらに高性能な「Vera Rubin Ultra」が2027年後半に控えます。つまり、世代交代のペースは緩みません。

【2026年7月追記】NVIDIAは公式発表で、Vera Rubinの量産出荷を2026年秋に開始すると明言しました。あわせて、エージェントAI(自律的にタスクをこなすAI)のスループットが前世代Grace Blackwell比で大規模環境において10倍になると主張しています(NVIDIA公式・ベンダー主張値)。サプライチェーンは台湾の150社・30カ国350以上の工場に及び、Dell・HPE・Lenovo・Supermicro・Foxconnなどがシステム供給パートナーに名を連ねます。生産計画は「表明」から「日付のある約束」へ進みました(NVIDIA)。

注目は、推論コストの低下がAIサービスの採算ラインをどこまで下げるかです。もしコストが10分の1に近づけば、これまで割に合わなかった用途にもAIが広がります。言い換えれば、AIが「高すぎて使えない」から「使わない方が損」へ動く、その分岐点になり得ます。

全体像をつかみたいなら、まず「AI半導体とは——AIを動かしているのは、ふつうのチップではなかった」と、自社開発が進む「GoogleもAmazonも、AIチップを自分で作り始めた」から読むと、つながりが見えてきます。

この記事のまとめ

  • NVIDIAは次世代AIプラットフォーム「Vera Rubin」を量産入りさせ、2026年後半に出荷を始める。
  • Rubin GPUは336億トランジスタ・推論向けの低精度演算で50PFLOPSの性能を持ち、HBM4を最大288GB・帯域22TB/s搭載する。
  • 新型のVera CPU(88コアのカスタムArm「Olympus」)とRubin GPUを組み合わせ、NVL72ラックで72GPU・36CPUを束ねる。
  • Blackwell比で推論は最大5倍・学習は最大3.5倍、トークンあたりの推論コストは最大10分の1に下がる。
  • 性能の鍵はGPU単体ではなくHBM4と先端実装にあり、メモリ供給はSamsung・SK hynix・Micronの3社が担う。
スポンサーリンク

よくある質問(FAQ)

Q.Vera Rubinとは何ですか?+

Vera Rubinとは、NVIDIAがBlackwellの次に投入する次世代のデータセンター向けAIプラットフォームです。新型の「Rubin GPU」と新型の「Vera CPU」を組み合わせた設計で、名称は暗黒物質を研究した天文学者ヴェラ・ルービンに由来します。2026年1月のCES基調講演で発表され、GTC Taipei 2026(2026年6月)でジェンスン・フアンCEOが量産(フル生産)入りを表明しました。

Q.Vera RubinはBlackwellと比べてどれくらい速くなりますか?+

NVIDIAの公表値では、Vera Rubin NVL72はBlackwellと比べて推論で最大5倍、学習で最大3.5倍の性能を持ち、メモリ帯域幅は約2.8倍です。とくに重要なのが、トークンあたりの推論コストが最大で10分の1に下がる点です。生成AIの運用コストはほぼトークン数で決まるため、コスト効率の改善が事業者にとって大きな意味を持ちます。

Q.HBM4とは何ですか?なぜVera Rubinで重要なのですか?+

HBM4とは、GPUの真横に積み上げて搭載する広帯域メモリ(HBM)の第4世代です。Rubin GPUは1基あたり最大288GBのHBM4を搭載し、合計で最大22TB/sのメモリ帯域幅を実現します。AIの推論では大量のデータをメモリとの間でやり取りするため、メモリの容量と帯域が処理速度を直接左右します。HBM4はSamsung・SK hynix・Micronの3社が供給します。

Q.Vera Rubinはいつ手に入りますか?+

NVIDIAは2026年6月に量産入りを表明しており、Rubinベースの製品はパートナー各社から2026年後半(第3四半期以降)に提供される見込みです。さらに高性能な「Vera Rubin Ultra」は2027年後半に控えています。

用語集

HBM/ High Bandwidth Memory
DRAMを積み重ねて広帯域にした高性能メモリ。AI半導体とセットで使われる。
CoWoS(コーワス)/ Chip on Wafer on Substrate
GPUと記憶用のHBMなど複数のチップを、1枚の土台(インターポーザ)の上に並べて1つのパッケージにまとめるTSMCの先端パッケージング技術。
推論(インファレンス)/ inference
学習済みのAIを実際に使って答えを出す処理。質問に答える・文章を生成するなど、利用時の計算がこれにあたる。
学習(トレーニング)/ training
大量のデータからAIモデルを作り込む処理。膨大な計算力を一度に必要とし、巨大なGPUクラスタを使う。
ASIC(カスタムチップ)/ Application-Specific Integrated Circuit
特定の用途だけに特化して作る専用チップ。汎用品より無駄がなく、決まった処理を安く・省電力でこなせる。

参考資料・引用元

  1. NVIDIA Kicks Off the Next Generation of AI With Rubin — Six New Chips, One Incredible AI Supercomputer一次情報
    NVIDIA Investor Relations(プレスリリース)(2026-01)— 使用箇所: Vera Rubinの発表(2026年1月CES)・Rubin GPUとVera CPUの一体プラットフォーム構成・出荷は2026年後半という公表(要確認)
    https://investor.nvidia.com/news/press-release-details/2026/NVIDIA-Kicks-Off-the-Next-Generation-of-AI-With-Rubin--Six-New-Chips-One-Incredible-AI-Supercomputer/default.aspx
  2. Inside the NVIDIA Rubin Platform: Six New Chips, One AI Supercomputer一次情報
    NVIDIA Technical Blog(2026-01)— 使用箇所: Rubin GPUの336億トランジスタ・NVFP4 50PFLOPS推論/35PFLOPS学習・HBM4最大288GB/22TB/s・NVL72の72GPU/36CPU/260TB/s・Blackwell比で推論5倍/学習3.5倍/帯域2.8倍/トークン単価1/10という数値(要確認)
    https://developer.nvidia.com/blog/inside-the-nvidia-rubin-platform-six-new-chips-one-ai-supercomputer/
  3. NVIDIA CEO announces Vera Rubin chips are in full production during keynote報道
    DataCenterDynamics(2026-06)— 使用箇所: ジェンスン・フアンCEOによる量産(フル生産)入りの表明・出荷時期(2026年後半)・NVL72の100%液冷とモジュール設計(要確認)
    https://www.datacenterdynamics.com/en/news/nvidia-ceo-announces-vera-rubin-chips-are-in-full-production-during-ces-keynote/
  4. Nvidia Vera Rubin Enters Full Production: Samsung, SK Hynix, Micron Named HBM4 Suppliers報道
    Tech Times(2026-06)— 使用箇所: GTC Taipei 2026での量産入り・HBM4供給3社(Samsung・SK hynix・Micron)・Vera Rubin Ultra(2027後半)とHBM4Eサンプル出荷(要確認)
    https://www.techtimes.com/articles/317539/20260602/nvidia-vera-rubin-enters-full-production-samsung-sk-hynix-micron-named-hbm4-suppliers.htm
  5. NVIDIA Vera Rubin Ramps Into Full Production to Power Agentic AI Factories Worldwide一次情報
    NVIDIA(公式ニュースルーム)(2026-05-31)— 使用箇所: Vera Rubinのフル生産ランプ公式発表・量産出荷2026年秋開始・Grace Blackwell比エージェントスループット10倍(大規模環境・ベンダー主張)・台湾150社/30カ国350工場のサプライチェーン・Dell/HPE/Lenovo/Supermicro/Foxconn等のパートナー(検証済み:3-0)
    https://nvidianews.nvidia.com/news/vera-rubin-full-production-agentic-ai-factory

この記事をシェア

XFacebookLINEB!はてブ

コメント

GitHub アカウントでログインしてコメントできます。