一個月十六款模型:日經數據揭示中國實驗室正主宰全球 AI 的發布節奏
中國開發商九月一口氣發布 16 款模型,美中平均發布週期從 125 天壓縮至 44 天——正當 Anthropic 執行長呼籲放慢腳步之際,北京沒有展現任何減速跡象。
單月十六款模型。這是《日經亞洲》2026 年 10 月 7 日報導的核心數字,也可能是迄今為止最清晰的一份量化快照,說明究竟是誰在設定全球 AI 發展的節奏:DeepSeek、小米、阿里巴巴、Z.AI 等中國廠商在九月一個月內推出了十六次模型發布——而時間點恰恰落在 Anthropic 執行長 Dario Amodei 四處奔走、主張產業應該隨著風險升高而放慢腳步的當口。
不過更值得深究的數字是 44。日經針對九家一線實驗室的調查(五家美國廠商,包括 Anthropic 與 OpenAI;四家中國廠商,包括阿里巴巴與月之暗面 Moonshot AI)發現,主要模型發布之間的平均間隔,在 2026 年 4 月至 9 月期間已壓縮至 44 天,遠低於 2023 年 1 月至 2026 年 3 月期間的 125 天。前沿 AI 的迭代節奏在半年內提速了將近三倍——而且是在幾個月內發生,不是幾年。
數據究竟說了什麼
這篇報導中有三項發現值得分開來看,因為它們回答的是不同的問題。
第一,九月的爆發由中國主導。 DeepSeek 自七月起每月都有模型更新;八月過後,阿里巴巴與 Z.AI(北京智譜華章,GLM 系列背後的公司)也接連發布新模型。小米——在中國以外更多人認識的是它的手機而非前沿 AI——也出現在同名單中,這本身就標誌著真正的模型能力已經下沉到多深的地層。
第二,加速是結構性的,不是偶發事件。 九家樣本廠商的平均間隔從 125 天掉到 44 天,不是某一家實驗室單季表現好而已。它反映了整個產業不斷重新發現的同樣動力:更便宜的訓練配方(稀疏混合專家架構、激進蒸餾)、獎勵頻繁調價的推論成本價格戰,以及越來越關鍵的一點——AI 本身正在承擔更多開發工作。日經指出,截至上個月,Claude 已主導 Anthropic 內部 26% 的 AI 研發任務,超過 90% 的任務涉及某種形式的 AI 協作。當工具能寫掉四分之一的研究,發布日曆自然越排越緊。
第三,底層晶片正在走向國產化。 在九月的發布中,科大訊飛與國營的中國電信都推出了訓練與推論全程使用國產晶片的模型。中國電信 AI 九月下旬發布的那款針對單 GPU 部署設計的代理式模型——相容主流開源訓練與推論框架——比任何單一跑分都更能說明問題:這是專門為「出口管制碰不到的硬體」所工程化的能力。
「放慢腳步」的主張遇上了它的對手
過去幾個月,AI 治理領域最響亮的辯論是:前沿實驗室是否應該自願減速。Amodei 是「控速派」的旗手;Sam Altman 則公開表示 AI 帶來的好處值得承受部分風險。日經這份報導落在這場辯論上,不啻一盆冷水:減速只有在一種情況下才是真的——擁有最快迭代能力的各方都上桌參與;而那些一個月發十六款模型的廠商,並不在那張桌子上。
一位 DeepSeek 工程師對日經直言,他不信任 Anthropic 或 OpenAI 會讓先進 AI 保持開放與平價。無論你如何評價這句話,它就是當下的操作性信念——它把西方每一句「克制」的呼籲,在北京眼中都轉譯成「請你在這場呼籲者自己也在跑的競賽中單方面解除武裝」。
商業脈絡讓單方面克制更不切實際。月之暗面最近以約 500 億美元估值完成了一輪融資;DeepSeek 即將完成 120 億美元的募資。這些估值是以「持續發布」為擔保品的。一家實驗室若為了安全暫停,而投資人期待的是月更,這種內部衝突在世界上任何一個國家都沒有被真正解決過。
為什麼「壓縮本身」才是故事
發布節奏過去只是個註腳;現在它就是戰略。更快的週期讓實驗室能在幾週內回應對手的降價、把最新的蒸餾研究直接摺進正在線上服務的權重,並讓開發者注意力——這個生態系中最稀缺的資源——持續保持在自家身上。代價則是評測、紅隊測試與部署後監控在結構上被擠壓。當世代間隔只有六週,對第 N 代的徹底外部稽核往往在第 N+1 代已經將其淘汰之後才姍姍來遲。
這正是「44 天」這個數字裡最安靜的風險,而且它同時朝每個方向切割:用國產晶片發布的中國實驗室要面對它,把平均值拉低的美國實驗室自己也要面對它。Anthropic 針對 DeepSeek、月之暗面與 MiniMax 的蒸餾指控——24,000 個帳號、1,600 萬次對話——也位於同一片緊繃的地景中:競爭與法律壓力在太平洋兩岸雙向流動,而發布時鐘從未停擺。
後續觀察指標
觀察這條新聞線的人不斷提醒,真正的判準是行為而非言詞:Anthropic 或 OpenAI 是否會在第四季公開把自己的發布間隔拉長到超過目前 44 天的水位。若沒有,控速論就只是修辭而非實踐。同時留意中國電信「國產晶片+單 GPU 部署」的模式是否被複製——為受限硬體而設計的能力,是一個鐵了心要制裁免疫的技術堆疊最清晰的訊號。還有資金面:DeepSeek 的 120 億美元與 Moonshot 的 500 億美元估值,定價的都是「繼續加速」,而不是減速。
一個月十六款模型是一個統計數字;半年內全球發布節奏快三倍,則是一次體制變更。整個產業正以一種治理、評測、甚至競爭分析都難以跟上的速度迭代——而目前的數據顯示,被踩得最深的踏板,是油門,不是煞車。
Sources
- [1] https://asia.nikkei.com/business/technology/artificial-intelligence/china-s-deepseek-peers-launch-16-ai-models-in-month-despite-anthropic-warning
- [2] https://aiweekly.co/alerts/nikkei-chinas-deepseek-and-peers-shipped-16-ai-models-in-september-despite
- [3] https://www.hpcwire.com/aiwire/2026/09/25/china-telecom-ai-releases-agentic-model-for-single-gpu-deployment/