華為昇騰 950DT 八月登場:中國挑戰輝達的關鍵一步
華為昇騰 950DT AI 晶片配備 144GB HiZQ 記憶體、4TB/s 頻寬與原生 FP8 支援,於 2026 年 8 月亮相,DeepSeek V4.2 可望成為首批採用者,標誌中國 AI 硬體自主化的重大里程碑。
在全球 AI 運算霸權的激烈競爭中,華為即將邁出迄今最重要的一步。這家中國科技巨頭已確認其昇騰 950DT AI 加速器將於 2026 年 8 月亮相,預計第四季開始部署。這款晶片代表華為多年來打造輝達 GPU 生態系統國產替代方案的集大成之作——而它的到來,恰逢地緣政治力量重新形塑全球半導體版圖之際。
昇騰 950DT 是華為 950 晶片家族中針對訓練優化的版本(家族中還包含定位推論的 950PR)。兩者共同構成華為推動中國 AI 運算硬體自給自足的骨幹。
關鍵規格
昇騰 950DT 是一款不容小覷的晶片。根據華為的公告和分析師拆解報告,該晶片的特色包括:
- 144GB HiZQ 2.0 記憶體(華為自研的高頻寬記憶體技術),較 950PR 的 128GB 更大
- 4TB/s 記憶體存取頻寬——較前一代昇騰 910C 的互連頻寬提升 2.5 倍
- 2TB/s 總互連頻寬,可實現無瓶頸的密集叢集部署
- 原生支援 FP8、MXFP8 等低精度格式,針對現代 AI 訓練和推論進行最佳化
- 向量運算能力較先前昇騰世代顯著提升
這款晶片設計用於華為的 Atlas 950 SuperPoD 架構,該架構可擴展至單一叢集內部署多達 8,192 顆昇騰 950DT 晶片。華為宣稱此配置可提供 30 EFLOPS 的 FP8 運算能力和 60 EFLOPS 的 FP4 運算能力——如果屬實,將躋身全球最強大的 AI 訓練叢集之列。
華為對其自研 HiZQ 記憶體技術尤為自豪。與使用 HiZQ 1.0 記憶體的 950PR 不同,950DT 採用 HiZQ 2.0,同時提升了容量和頻寬。這是一個關鍵的差異化優勢:華為是傳統高頻寬記憶體寡佔集團(SK 海力士、三星、美光)之外,少數能自主開發高頻寬記憶體的公司——這項成就讓它免受未來美國可能對記憶體技術實施出口管制的影響。
DeepSeek V4.2:殺手級應用
昇騰 950DT 發表最引人注目的細節,是它與 DeepSeek V4.2 模型的時程高度契合——TrendForce 將 DeepSeek 識別為潛在的早期採用者。這並非巧合,而是深度戰略合作的成果。
DeepSeek 是 2025 年初以 V3 模型轟動全球的中國 AI 實驗室。該公司一直與華為密切合作,確保其模型能在昇騰處理器上原生執行。2026 年 4 月發布的 DeepSeek V4 已針對華為昇騰架構進行特定優化,預計即將推出的 V4.2 將進一步深化這項整合。
兩者的協同效應十分強大:DeepSeek 提供軟體堆疊——模型、訓練框架和推論引擎——而華為提供硬體。兩者共同為中國 AI 開發者提供了一套完整的國產替代方案,取代過去十多年來主導產業的輝達-CUDA 生態系統。
DeepSeek 於 2026 年 7 月傳出自研推論專用 AI 晶片的消息,更增添了想像空間。DeepSeek 的客製化晶片並非與華為競爭,而是針對推論特定工作負載,與側重訓練的昇騰 950DT 形成互補。兩家公司正在打造一個垂直整合的中國 AI 技術堆疊,堪比輝達-CUDA-Azure 或 Google-TPU-Vertex 的組合。
競爭現實:差距仍在
儘管規格亮眼,華為的晶片在實際效能上仍落後輝達的尖端 GPU。根據美國外交關係委員會(CFR)的報告,2025 年華為的 AI 運算總量僅約為輝達的 5%,2026 年降至 4%,若趨勢不變,2027 年將降至 2%。即使昇騰 950PR 的 1.56 PFLOPS FP4 運算能力在紙面上相當亮眼,仍落後輝達的 B300 和 B200 Blackwell 加速器。
效能差距還因軟體生態系的成熟度而加劇。輝達的 CUDA 平台擁有 15 年的領先優勢,幾乎在所有主要的 AI 框架中都有深度優化。華為的 CANN(神經網路運算架構)軟體堆疊已有顯著改善,但仍面臨相容性和效能挑戰,尤其是針對原本在輝達硬體上開發的模型。
然而,對於中國市場而言,這個差距可能不如表面看起來那麼重要。出口管制已切斷了中國企業取得輝達最先進晶片的管道。輝達獲准出口中國的最強晶片 H200,整個 2026 年一直陷於法規審查的泥沼中。在此環境下,華為不需要在全球範圍內擊敗輝達——它只需要「夠好」到能拿下龐大的中國國內市場,而這個市場預計到 2030 年將達到 670 億美元。
地緣政治催化劑
昇騰 950DT 的亮相無法脫離地緣政治脈絡來理解。自 2022 年以來持續收緊的美國出口管制,已實質上切斷了中國取得最先進西方 AI 晶片和製造設備的管道。這種強制性的脫鉤反而弔詭地加速了中國國內半導體的發展。
華為已成為這齣大戲的核心角色。該公司同時開發 AI 加速器(昇騰)、智慧型手機 SoC(麒麟)、網路設備,甚至自建半導體製造能力。中國政府全力支持華為的努力,將 AI 晶片自主視為國家安全問題。
成果已經顯現。華為預期 2026 年晶片相關營收將達到約 120 億美元,較 2025 年的約 75 億美元大幅成長。2025 年,中國製造商合計拿下約 41% 的國內 AI 晶片市占率,華為為領導者。隨著輝達 H200 出貨持續停滯,華為的市占率預計在 2026 下半年進一步擴大。
950DT 對產業的意義
昇騰 950DT 不僅是又一次晶片發表——它代表 AI 硬體版圖的結構性轉變。這是有史以來第一次,出現了一個可信的非輝達、非西方的大規模 AI 訓練和推論替代方案,背後有深厚的軟體生態系(DeepSeek)支撐,並採用自研記憶體技術製造。
對於中國的 AI 實驗室和雲端服務商而言,950DT 及其 SuperPoD 架構提供了一條不依賴美國硬體即可打造前沿規模模型的路徑。對全球半導體產業而言,它標誌著美中科技脫鉤正在產生兩套平行的技術堆疊,它們將在東南亞、中東和非洲等第三方市場日益激烈地競爭。
而對輝達而言,這是一個提醒:其在 AI 訓練硬體領域的近乎壟斷地位並非永久。雖然效能差距依然真實存在,但出口管制、華為持續不斷的投資,以及 DeepSeek 的軟體專業,正在以比許多人預期更快的速度縮小這一差距。
今年八月亮相的昇騰 950DT,很可能被後人銘記為中國 AI 硬體獨立從願景走向現實的時刻。
Sources
- [1] https://www.huaweicentral.com/huawei-confirms-ascend-950dt-ai-chip-to-debut-in-august/
- [2] https://www.trendforce.com/news/2026/06/08/news-huawei-brings-forward-ascend-950dt-deployment-to-august-deepseek-v4-2-seen-as-potential-early-adopter/
- [3] https://www.huawei.com/en/news/2025/9/hc-xu-keynote-speech
- [4] https://tech-insider.org/huawei-ascend-950pr-ai-chip-nvidia-china-2026/
- [5] https://www.tomshardware.com/tech-industry/semiconductors/huawei-unveils-ascend-roadmap-backed-by-in-house-hbm
- [6] https://www.techpowerup.com/344062/huawei-ascend-950-ai-accelerator-pictured
- [7] https://www.cfr.org/articles/chinas-ai-chip-deficit-why-huawei-cant-catch-nvidia-and-us-export-controls-should-remain
- [8] https://www.spheron.network/blog/huawei-ascend-950-vs-nvidia-b300-b200-llm-inference-2026/
- [9] https://www.tomshardware.com/tech-industry/artificial-intelligence/huawei-could-seize-chinas-ai-chip-crown-in-2026-as-nvidias-h200-shipments-stall-in-regulatory-limbo-beijing-pushes-homegrown-ai-hardware-dominance-in-a-market-projected-to-hit-usd67-billion-by-2030
- [10] https://convequity.substack.com/p/huawei-ascend-ai-chip-roadmap-and