KOL Digest
Semianalysis · 2026.09.14 週一 · Substack

Vera Rubin NVL72 Agentic Inference: 67x better Performance per Dollar

看原始內容 2 個主題 · 5 個標的/題材

NVIDIA Vera Rubin NVL72 評測:AgentX 代理推論性價比達 GB300 的 67 倍

  • —AgentX 基準測試揭示 Agent 推論具備多輪對話、長上下文、高前綴重用及子代理並發等特徵,極度考驗架構級協同與 KV 快取調度
  • —在 170 TPS 高互動性場景下,Vera Rubin NVL72 展現出相較 Blackwell 世代達 67 倍的每美元 Token 產出優勢,且端到端延遲大幅縮減至六分之一
$NVDA ↑看多 中期

Vera Rubin NVL72 透過 GPU、Vera CPU、NVLink 6 等六項產品深度協同設計,在 60 至 100 TPS 的主流推論區間達成 Blackwell GB300 的 1.4 至 3 倍性價比,高互動區間優勢更達數十倍。大幅領先的推論每美元產出與租賃回報率將驅使算力買家加速轉向 Rubin 平台,進一步鞏固資料中心市場定價權與獲利能力

$AMD ↓看空 中期

在 DeepSeek V4 Pro 代理工作負載評測中,$AMD MI355X 於 100 TPS 下的每百萬瓦 Token 吞吐量僅為 2.01 百萬,落後 $NVDA Vera Rubin 達 29.5 倍。在次世代代理推論與高階叢集架構上,MI355X 的能效與每美元產出面臨巨大的競爭劣勢

AI算力 ↑看多 中期

AI 工作負載正由單輪對話轉移至複雜的 Agent 代理系統,對高並發、長上下文與低延遲的要求促使算力平台從單晶片過渡至全機櫃深度協同架構。全機櫃協同設計的推論加速架構已成次世代 AI 算力降低單位 Token 成本的核心分水嶺

資料中心電力瓶頸下的每吉瓦獲利:Rubin 平台年化獲利增加 42%

  • —在資料中心電力供給成為主要瓶頸的背景下,算力營運商的核心競爭力已轉變為每吉瓦電力所能創造的營收與獲利上限
  • —導入 DSX MaxLPS 動態功耗調配後,叢集可在相同電力容量下部署更多 GPU,大幅提升電力資源的變現彈性
$NVDA ↑看多 中期

以 DeepSeek V4 Pro 規模模型測算,Vera Rubin 每吉瓦電力每年可產生 1,595 億美元營收與 1,499 億美元獲利,較 GB300 增加 446 億美元獲利與 42% 增幅。在電力受限的資料中心環境中,Rubin 展現的極致能效優勢將使算力營運商享有更充裕的降價競爭空間與超額利潤

AI基建 ↑看多 中期

隨著電力併網延遲成為 AI 擴建的硬約束,資料中心建置重點已從純粹堆疊硬體轉向最大化每百萬瓦吞吐量。具備動態電力調配與超高能效比的 AI 基建方案將成為算力營運商突破電力天花板的必備選擇

每天早上,收件匣見

53 位中英文財經 KOL 的觀點,每天自動整理成一份日報。免費,隨時可退訂。

免費訂閱