NVIDIA 推出 DSX Ready:為支撐 AI 工廠運作的電池與散熱設備掛上認證標章
NVIDIA 新推出的 DSX Ready 認證計畫,依其 AI 工廠參考設計檢驗第三方電力與散熱產品,首批通過名單包括 Tesla、Hitachi Energy 與 LG Energy Solution 的電池儲能系統,以及 Vertiv、LiquidStack 與 LG Electronics 的冷卻液分配單元。
過去兩年,AI 基礎設施的話題幾乎被一個問題壟斷:該選哪款 GPU?但真正在蓋 AI 工廠的人都明白,最難的問題早已悄悄移到別處。電網能把多少百萬瓦(MW)電力送到這個廠址,什麼時候送到?當每個機櫃的耗電量相當於一個小社區時,熱要往哪裡排?在一座造價上百億美元的設施裡,凌晨三點幫浦故障會發生什麼事?
NVIDIA 今天為這些問題的標準化跨出了具體的一步。該公司推出 NVIDIA DSX Ready 認證計畫,用來辨識符合其 DSX AI 工廠參考設計適用要求的第三方電力與散熱產品。計畫首批推出兩個類別:電池儲能系統(BESS)與冷卻液分配單元(CDU)——這正是決定一座 GW 級 AI 園區能否真正運作的兩大實體基礎設施。
DSX Ready 到底是什麼
DSX 是 NVIDIA 用來將「AI 工廠」當作單一系統來設計與營運的傘形平台,涵蓋運算、網路、電力、散熱、廠務設施與軟體。但參考架構能做的有限:當一個依 DSX 設計施工的業主去採購電池或散熱設備時,面對的是一個規格、控制行為與整合介面天差地遠的市場。參考設計不會幫你挑供應商,最終還是得有人決定,哪一台 2 MW 的冷卻單元能真正與工廠其他部分順利搭配。
DSX Ready 就是 NVIDIA 對這個缺口提出的解答。通過計畫各類別審查的產品,會在 DSX 生態系中被列為合格供應項目,讓業主採購時多一層篩選標準,也讓供應商有一條明確路徑證明自家產品的相容性。NVIDIA 把效益歸納為三點:更有信心地評估產品、降低整合風險、更快推進到部署階段。
值得注意的是這個認證「不是」什麼。NVIDIA 自己的文件特別強調,通過 DSX Ready 並不能取代廠址層級的工程設計,也不代表廠址層級的穩定性。一台合格的 CDU 代表它符合功能性要求;業主仍得自行評估它是否符合自家設施的水力配置、空間布局與運轉需求。這個計畫標準化的是積木,不是整棟建築。
首批上榜名單
DSX Ready 啟動時的合格 BESS 方案來自 Hitachi Energy、LG Energy Solution 與 Tesla;合格 CDU 方案則來自 LG Electronics、LiquidStack 與 Vertiv。
Tesla 出現在合格儲能名單上特別耐人尋味——這家為自身工作負載打造 AI 工廠的公司,如今正式成為其他所有人 AI 工廠供應鏈的一員。Vertiv 則宣布其 2.3 MW 冷卻液分配單元是第一款專門取得 DSX Ready 資格的 CDU,躋身首批合格散熱基礎設施供應商之列。隸屬 Trane Technologies 旗下的 LiquidStack 透露,其 GigaModular CDU 平台獲得此認證,而且更重要的是,該公司在 NVIDIA 制定 CDU 認證要求的過程中就參與協作——這意味著至少有一部分認證標準,是由手上已有產品蓄勢待發的供應商共同塑造。
這兩個類別並非隨機挑選,而是精準對應產業一再撞上的兩大瓶頸:電力取得與熱排散。電池儲能讓 AI 工廠能在電網限制下平滑調整用電、參與需量反應計畫,並彌補電力互聯多年後才到位的空窗。至於散熱,在今日的機櫃密度下液冷早已不是選項——直接晶片冷卻加上集中式 CDU 是 NVIDIA 自家參考設計的預設架構,而 CDU 也成了故障影響最大的零組件。
一台 CDU 要證明什麼
LiquidStack 的公告,是目前對 CDU 認證實際測什麼最詳盡的公開說明。相關要求涵蓋水力、熱與控制效能,包括:
- 恆定壓差與恆定流量效能——當機櫃動態加入或離開冷卻迴路時,設備必須維持穩定的水力行為
- 指定運轉條件下的熱效能
- 流量感測器精確度——工廠的遙測數據必須可信
- 冷啟動行為——設備從冷狀態啟動時的表現
- 幫浦失效轉換——幫浦故障時的優雅降級
- 群組控制——多台 CDU 協調運作為一座冷卻機組,而非一排各自為政的獨立設備
最後一項點出了整個計畫背後的哲學。LiquidStack 自己的說法是「AI 工廠的效能不是從 GPU 開始、也不是在 GPU 結束」——一台 CDU 不能只看帳面冷卻容量,因為它的控制邏輯、材料與對變動工況的反應,才決定整個系統是否穩定。群組控制要求則迫使供應商面對實際 AI 園區正在成為的那種協調式、多百萬瓦部署。
BESS 這邊的認證流程則不同:合作夥伴自行執行必要的測試,並在界定的認證範圍內提交佐證數據供 NVIDIA 審查。後續還會陸續推出橫跨基礎設施與軟體的更多類別。
更大的圖像:NVIDIA 持續併吞技術堆疊
拉遠來看,DSX Ready 是 NVIDIA 今年一整年都在執行的策略的又一步。這家公司先定義了 AI 工廠的概念,接著發布參考設計,然後展示實際營運成果——本月稍早在 AI Infra Summit 上,NVIDIA 公布 DSX 電力分配軟體讓雲端業者 Lambda 在固定電力預算下多榨出 24% 的 token 產出。現在,它把權威從運算核心向外延伸到實體廠務:電池、幫浦、熱交換器。
每一步,都把過去由業主自行判斷的決策,轉變成 NVIDIA 背書的決策。對資料中心營運者來說,這是雙面刃。認證計畫確實降低了整合風險——尤其在一個人人宣稱與一切相容的市場裡。但它同時也加深了 NVIDIA 對一條它自己並不製造的供應鏈的引力:來自 AI 運算主導廠商的認證標章,對任何要蓋 DSX 對齊工廠的業主而言,幾乎等於採購必要條件,無論 NVIDIA 是否碰過那些硬體。
基礎設施老字號們似乎已經決定,加入比對抗划算。Vertiv、Trane(透過 LiquidStack)、Eaton 與同業正排隊讓產品通過自家工程師也參與制定的認證要求。競爭者在主導平台上按平台的規則合作——這正是生態系被鎖定的方式。
對一個競相建造耗電量相當於小城市的工廠、標準化早已遲到的產業來說,方向正確。值得觀察的問題是:DSX Ready 的類別會不會持續擴張,直到「認證合格」實質上成為任何想賣東西給 AI 工廠的廠商的必要條件?從 NVIDIA 今年碰過的一切軌跡來看,安全的賭注是:會。
來源
Sources
- [1] https://blogs.nvidia.com/blog/dsx-ready-ai-factories-power-cooling/
- [2] https://liquidstack.com/blog/nvidia-dsx-ready-cdu
- [3] https://www.vertiv.com/en-latam/about/news-and-events/news-releases/2026/vertiv-coolant-distribution-unit-qualified-as-nvidia-dsx-ready-for-ai-factory-infrastructure/
- [4] https://www.nvidia.com/en-us/data-center/products/dsx/dsx-ready/