為機器時代劃下紅線:美中專家聯合提出軍事 AI 的「核武級」防護機制
在川普與習近平峰會前夕,布魯金斯學會的 Melanie Sisson 與復旦大學的蔣天嬌聯合提出軍事 AI 紅線、對「有意義的人類控制」的共同定義,以及一條 AI 事件軍事熱線。
一個干擾核指揮網路、或以機器速度發動軍事網路行動的 AI 系統,可能讓華盛頓或北京只剩幾分鐘時間判斷:對方政府是不是已經開戰了。這正是美中兩國安全專家如今試圖阻止的情境——他們在本週提出了一套罕見具體的方案:為軍事人工智慧建立「核武級」的防護機制。路透社於 9 月 17 日報導了這份文件,時間就在川普與習近平白宮峰會的前一週。
這些建議來自一個持續運作的 AI 與國家安全「二軌對話」(Track II),由布魯金斯學會外交政策項目與清華大學戰略與安全研究中心共同召集,並獲 Minderoo 基金會支持。該對話自 2019 年起運作至今,最新成果是一對配套文章:布魯金斯 Strobe Talbott 中心資深研究員 Melanie W. Sisson,與復旦大學發展研究院副教授蔣天嬌,於 9 月 9 日發表。讀起來不像學術論文,更像兩國政府級 AI 對談的草稿議程。
雙方提出了什麼
這些建議透過雙邊二軌交流發展而成,目的是為官方政策提供參考,核心是三項具體機制。
第一,針對核武系統的明確紅線。 蔣天嬌主張,應明確禁止 AI 自主決定使用核武,或自主攻擊核指揮、控制與通信網路(NC3)。在 NC3 之外,專家們也呼籲列出關鍵基礎設施部門清單——能源、金融、醫療——事先劃定自主 AI 攻擊的禁區與邊界。
第二,重大網路攻擊須由人類拍板。 Sisson 的文章主張,川普與習近平應達成協議:對彼此 NC3 或關鍵基礎設施發動網路攻擊的決定,只能由人類、而非 AI 做出。其邏輯是將 2024 年拜登與習近平的原則——使用核武的決定應由人類控制——延伸至網路領域,因為網路攻擊可能在毫秒內展開。用 Sisson 的話說,具有戰略效應的攻擊必須體現人類意圖、並可歸責於人類;這是一個很窄的共識點,不需要雙方在更廣泛的網路安全原則上達成一致。
第三,一條專門的美中軍事 AI 熱線。 蔣天嬌提議在既有機制——國防部長熱線與海上軍事安全磋商機制——之上,增設一條專門通報 AI 錯誤或 AI 網路攻擊所引發緊急事件的熱線。他寫道,2023 年的氣球事件應成為警鐘:沒有熱線機制作為保障,AI 驅動的無人機與無人艦艇未來極可能引發更多意外升級。
核心問題:速度
讓這些建議顯得急迫的,是機器速度與人類生理極限之間的錯配。蔣天嬌對他所稱的「速度困境」毫不諱言:在 AI 代理的加持下,網路攻擊以前所未有的速度展開,而 AI 驅動的防禦系統會自動觸發反制。文章描述了一個情境:AI 偵測到針對 NC3 系統的異常流量,於是自動切斷網路或發動反制;對方將這種防禦性反射解讀為網路入侵,雙方的 AI 系統就此進入「自動對抗」模式。在這種超高速交鋒中,他警告,「最後由人類拍板」很可能超出生理極限——意味著人類批准這道保障,悄悄變成了虛設。
歸因問題讓局面更加複雜。網路攻擊極難溯源,關鍵基礎設施可能被國家行為者、駭客組織或恐怖分子等非國家行為者、甚至 AI 代理本身攻擊。如果醫院電網遭 AI 攻擊,政府如何判斷這是授權行動,還是有人刻意嫁禍國家行為者以挑起衝突?沒有可靠的歸因機制,人類問責就無法成立,報復行動反而可能觸發這些防護機制本要防止的非預期升級。
為什麼「有意義的人類控制」需要定義
最野心勃勃的提案,其實是定義層面的。兩國政府都說相信對軍事 AI 的「人類控制」,但蔣天嬌與 Sisson 警告,兩國可能用同一套語言,為截然不同的機器自主程度背書。蔣天嬌的文章回溯到中國國務院總理周恩來對核子試驗「萬無一失」的要求,將其視為人類控制原則的體現;而美國這一脈的討論則源自空軍上校 John Boyd 的 OODA 迴圈。鑒於雙方根本不同的制度框架與戰略文化,專家提議透過定期對話——或成立一個術語工作小組——確保彼此接受對方對「有意義的人類控制」及相關保障機制的定義。
這件事重要,因為定義是讓原則變得可驗證的東西。2024 年的領導人級核武承諾廣受歡迎,但停留在宣示層面。用蔣天嬌的話說,將原則性共識轉化為「可行動的制度安排」,正是這個過程史上一直卡住的地方。
障礙是結構性的
兩國正式採納的進度依然緩慢,文章也沒有迴避原因。華盛頓沒有一個統管 AI 軍備管理的機構:國家安全政策分散在白宮國安會、國務院、五角大廈等單位。北京則相反,已將 AI 議題納入正式軍備管制體系,但美方擔心中央集權式的做法更容易隨政治需要轉向。
兩國政府也對任何可能拖慢自身技術發展的措施保持警惕。川普已警告,廣泛的限制可能讓中國取得優勢;北京則視美國的諸多技術管制——尤其是先進晶片出口管制——為維持美國霸權的企圖。AI 技術的不透明性,使人無法準確評估對手真正的能力,甚至無法區分某個軍事 AI 系統是攻擊性還是防禦性,餵養出典型的安全困境。
不過時機站在推進這一側。這些建議是為一場即將舉行的美中政府級 AI 對話而準備的,而 9 月 24 日的川習國宴——據彭博報導,OpenAI 的 Sam Altman、輝達的黃仁勳與蘋果的 Tim Cook 都將出席——讓兩位決策者在晶片與出口管制談判前夕同處一室。路透社本月另報導,兩國正規劃川普第二任期以來首場專門的 AI 安全會談,華盛頓希望推動對 AI 網路攻擊的聯合監測。
值得記住的先例
二軌對話以前就產出過協議。2024 年 11 月拜登與習近平對「核武使用決定應由人類控制」的確認,就來自多年這類半官方交流。新提案本質上是請兩國政府把同一套劇本再跑一次:先做窄而具體的領導人級承諾,再談可驗證的協議與保障措施。
Sisson 主張,領導人級聲明是就可驗證協議展開雙邊對話的必要前提,也是兩國政府理解利害所在的最強公開訊號。蔣天嬌則希望未來對話納入更廣的議題,包括對致命性自主武器系統的監管。
兩篇文章以罕見的直接方式勾勒利害:目標是降低 AI 故障誤導人類——或完全蓋過人類判斷——並把兩個核武大國推入一場無人選擇的戰爭的風險。9 月 24 日能否產出超越公報的實質成果尚不明朗。但自軍事 AI 從理論變成已部署的基礎設施以來,太平洋兩岸第一次把具體、可談判的機制寫上了紙面——紅線、定義,以及一條在機器出錯時會響起的電話。
Sources
- [1] https://www.brookings.edu/articles/advancing-human-control-of-military-ai/
- [2] https://www.reuters.com/world/china/us-china-security-experts-propose-nuclear-style-safeguards-ai-risks-2026-09-17/
- [3] https://www.thenews.com.pk/amp/1416556-us-chinese-security-experts-propose-nuclear-style-safeguards-for-military-ai
- [4] https://www.japantimes.co.jp/news/2026/09/17/world/politics/us-china-nuclear-ai-safeguards/