← All posts / Industry

Nvidia 告訴最大客戶:明年起 AI 伺服器將漲價超過 15%

彭博報導,Nvidia 已通知最大客戶:搭載 Vera Rubin 與 Grace Blackwell 平台的 AI 伺服器,明年初出貨時價格將上漲超過 15%,記憶體成本飆漲正在改寫 AI 建置的經濟學。

Nvidia 告訴最大客戶:明年起 AI 伺服器將漲價超過 15%

AI 熱潮的下一張帳單剛剛寄達,而且比幾乎所有人編列的預算都貴。根據彭博(Bloomberg)週六發布的報導,Nvidia 部分最大客戶已被正式告知:搭載其 AI 晶片的伺服器價格在許多情況下將上漲超過 15%——漲價將自明年初出貨的系統起生效,其中包括以 Vera Rubin 與 Grace Blackwell 平台打造的旗艦機種。

轉載這則報導的路透社(Reuters)補充了關鍵細節:為大型資料中心營運商——包括 Microsoft、Alphabet 旗下的 Google 與 Oracle——代工組裝伺服器的廠商,已陸續將這波即將到來的漲價轉嫁給自己的客戶。每筆漲幅將取決於系統所用的晶片世代與記憶體配置。Nvidia 並未立即回應置評請求,路透社也表示無法立即核實相關數字,但方向再明確不過:AI 基礎設施單位成本持續下降的時代——至少就目前而言——已經畫下句點。

元兇是記憶體,不是運算晶片

根據報導,最主要的推手是記憶體晶片成本暴漲。這並非新聞——這場擠壓已經醞釀超過一年,如今終於強到足以推升整個機架的標價。

背後的數字相當驚人。分析師預估,伺服器級 DDR5 價格到 2026 年底將較前一年翻倍。不久前還約 150 美元的 64GB DDR5 模組,報價已來到約 500 美元。研究機構 Counterpoint 先前預測,2026 年上半年整體記憶體價格將上漲 50%,其中伺服器用 DRAM 漲勢最猛。在高頻寬記憶體方面,CNBC 今年 1 月報導,AI 記憶體——尤其是 NVL72 機架中 GPU 周圍堆疊的 HBM——實質上已銷售一空,產能早已被預訂一空。

問題的物理結構很單純:AI 資料中心目前吞噬了全球約 70% 的記憶體晶片產出,而每一代 GPU 都比上一代更餓——Vera Rubin 級系統為每顆運算晶片搭配的 HBM 與 LPDDR5X 都多於前一代。SK 海力士(SK Hynix)已警告,這波短缺可能持續到 2030 年之後。當先進 DRAM 與 HBM 產能幾乎全由三星、SK 海力士與美光(Micron)三家掌控,而超大規模雲端業者又與手機、PC 廠搶食其餘產能時,價格只有一個方向可走。

對超大規模雲端業者的意義

對 Microsoft、Google、Oracle、Meta,以及快速增加的「新雲」(neocloud)業者來說,AI 伺服器漲價 15% 以上不是四捨五入的誤差——而是直接重擊定義整個 AI 投資週期的資本支出。Nvidia 的晶片支撐了 AI 基礎設施建置的大半,公司本身已成為整個生態系的代理指標,其財報日如今形同對 AI 需求的季度公投。

時機點很敏感:Nvidia 將於 8 月 26 日發布第二季財報,而這則定價消息在幾天前曝光。投資人屆時不只盯著資料中心營收,更會看毛利率的說明——觀察 Nvidia 能把記憶體通膨轉嫁多少、又得自行吸收多少。從歷史經驗看,Nvidia 一直有足夠定價權把零組件通貨膨脹往下游推——這次的通知看來正是如此。真正的懸念在於:已承諾數千億美元多年期建置計畫的雲端業者,會反擊、延後採購,還是乖乖埋單。

還有值得追蹤的二階效應。如果伺服器物料成本持續攀升,雲端 GPU 租用費率將面臨上漲壓力——偏偏此時業者正為了搶 AI 工作負載而砍低單位 token 價格。Morgan Stanley 等分析機構已警告,雲端費率調漲的高峰可能落在 2026 下半年。本季正在簽多年期 AI 容量合約的企業,最好現在就把價格調升條款談好,而不是等到 2027 年才發現。

資料中心之外的漣漪

這場記憶體危機並未侷限在 AI 機架內。消費級顯示卡已歷經多次漲價——一份廣泛流傳的統計指出,Nvidia 消費產品線今年第三度調漲、幅度達 20–30%。手機與筆電廠正吸收 SK 海力士等業者預警的兩位數零組件成本增幅,其中一部分終將反映到零售價格。彭博的報導引述一位業界人士直白地說:「與其他人一樣,我們也看到主要由 DRAM 與 NAND 價格上漲驅動的投入成本增加。」

與此同時,記憶體廠本身成了這個週期的沉默贏家。三星、SK 海力士與美光在今年前幾個月、短短數週內相繼跨越一兆美元市值——在 DRAM 還是毛利薄如刀片的大宗商品生意時,很少有人能預見這一天。三星在 2026 年第二季以 39% 市占重奪全球 DRAM 營收第一,美光則持續縮小差距,中國的長鑫存储(CXMT)也寫下最佳成績。

結語

過去一年,AI 基礎設施的故事核心是運算稀缺。彭博這則報導讓供應鏈傳遞數月的訊號正式浮上檯面:記憶體如今才是瓶頸,而且貴到足以讓整台伺服器漲價兩位數。Nvidia 正趁著定價權還在時轉嫁成本;超大規模業者會轉嫁給雲端;最終會落在每一個購買 token、GPU 運算小時或筆電的人身上。

這究竟是痛苦的短期陣痛,還是運算成本結構性變貴的起點,取決於記憶體供給的彈性——新產能、HBM4 良率,以及長鑫存储等玩家能否及時推進先進製程到足以扭轉局面的規模。SK 海力士警告短缺可能拖過 2030 年,顯示業界並不押注短期緩解。無論如何,「每美元硬體的 AI 能力只會愈來愈便宜」這個假設,剛剛被砍了 15% 以上。

Nvidia 預計於 8 月 26 日發布財報時說明定價與需求狀況。