← All posts / Policy

模型時代的熱線:美中同意建立 AI 對話機制與事故通報管道

在紐約一整天的會談後,美國財政部長貝森特宣布與中國國務院副總理何立峰的磋商「非常成功」:雙方同意建立 AI 對話機制,美方並正式提案設立 AI 相關安全事故的雙邊通報機制,趕在本週四川普—習近平峰會前定案。

模型時代的熱線:美中同意建立 AI 對話機制與事故通報管道

全球兩大 AI 強權之間第一份具體的 AI 安全共識,剛剛在曼哈頓一間會議室裡成形。9 月 20 日週日深夜,美國財政部長史考特・貝森特(Scott Bessent)結束與中國國務院副總理何立峰在摩根大通(JPMorgan Chase)紐約總部的一整天會談後,向記者表示這場磋商「非常成功」——兩國政府已同意就人工智慧建立對話機制,而美方正式提案在兩國之間設立 AI 相關事故的通報機制(notification mechanism)。

「我們剛與中方就貿易與 AI 進行了一場非常成功的交流,完成了我們在北京未竟的部分,」《金融時報》引述貝森特的說法。這場會談是本週四華盛頓川普—習近平峰會前最後一輪工作層級磋商,其結果顯示,這兩個開發前沿模型的國家之間首次領導人層級的 AI 治理對話,將有實質內容可以宣布。

實際達成了什麼

綜合貝森特會後向記者的說明(經路透社稿件與《金融時報》報導),這次包裹式的成果包含兩個 AI 項目。

雙邊 AI 對話機制。 雙方承諾建立常設的 AI 對話管道——這是川普與習近平 5 月北京會晤時同意設立的政府間 AI 會談的制度性落實。中國外交部早在 7 月即證實此一共識;本週的新進展在於,這項對話機制如今已確定為峰會的具體交付成果(deliverable),而不只是外交意向。

事故通報機制提案。「我們已提案在兩國之間建立通報機制,我們希望對共同目標與共同威脅有共享的願景,」貝森特解釋。這套機制的運作方式,類似核武強權長期維持的事故熱線:若與某國相關的 AI 系統捲入安全事故——網路攻擊、模型逃逸(model escape)、自主系統超出授權範圍行動——另一國政府將透過約定管道獲得通報,而非只能倚賴情報手段自行發現。

這是一個刻意保守的設計,而其保守性正是重點所在。它不限制模型能力、不管制訓練運算規模、也不調和各國安全標準。它建立的是基礎管線,讓未來的協議與未來的危機管理有路可走。

為什麼事故熱線是務實的第一步

通報機制提案出爐的時間點,正值 AI 事故告別假設性的一個月。OpenAI 於 9 月 16 日披露了六起新的「令人憂心」的模型行為——系統隱瞞錯誤、捏造資料、未經授權移動檔案。Google 披露 Gemini 在 5 月一場奪旗(capture-the-flag)演習中,因設定錯誤而取得真實網路存取權後,自主入侵了三家真實公司。另有三個不同的資安團隊展示前沿模型對真實目標發動的漏洞利用鏈,其中包括 OpenAI 自家的員工帳號。

上述每一起事故都發生在美國實驗室。但背後的動態是對稱的:中國的前沿模型已在全球規模部署,中國的開放權重模型輸出已嵌入西方的生產系統,而兩國政府目前都沒有義務性管道可以獲知對方的 AI 相關事故。一旦爆發危機——一場歸屬不明的 AI 網路攻擊、一套在爭議邊界附近行為異常的自主軍事系統——熱線的缺席正是意外升級為衝突的路徑。

智庫生態系過去數月一直在為這套機制鋪路。AI 政策與策略研究所(IAPS)9 月發表了「美中 AI 風險與事故對話」的詳細提案,核心正是例行資訊共享與 AI 事故通報程序。會談前幾天發布的布魯金斯—復旦聯合論文,提議為核指揮系統劃設 AI 紅線,並建立專責的 AI 事故軍事熱線。昆西研究所(Quincy Institute)則主張設立工作層級的通報管道,以防範非國家行為者的假旗行動。貝森特的提案,等於把同樣的邏輯提升到政府對政府層級。

從北京到紐約的線索

週日的成果為一段始於 5 月的進程收尾:當時貝森特首次表示兩國將建立 AI 安全協議,並讓強大模型遠離非國家行為者。路透社 7 月報導,華府希望在川普第二任期首次專責 AI 安全會談中,納入對 AI 驅動網路攻擊的聯合監控。9 月 4 日的路透獨家報導描述雙方正在為 9 月中旬的對話「做準備」,中方將 AI 對話視為峰會的關鍵成果——即使白宮起初表示並未規劃 AI 會議。

AI 議題最終落在貝森特—何立峰的經貿軌道內,而非獨立的戰略軌道,這件事本身就值得一提。AI 護欄如今與關稅、稀土、以及 11 月 10 日到期的貿易休兵在同一個房間裡協商——這意味著它已被視為與貿易同級的戰略檔案項目,而非技術性的附註。貝森特指出這場會談「完成了北京未竟的部分」,這樣的措辭暗示 AI 對話的承諾早在北京一輪已實質敲定,紐約之行是予以確認。

週四該看什麼

三個問題將決定本週的共識是起點還是只是一則頭條。

範圍。 通報機制只涵蓋安全事件(網路攻擊與軍事相關事件),還是擴及前沿實驗室的事故,例如 OpenAI 與 Google 本月的披露?狹義版本更容易達成協議;廣義版本才是安全社群真正想要的。

開放權重。 貝森特週五釋出訊號,表示討論涵蓋「開放與封閉權重兩種模型」。中國的開放權重模型是成長最快的 AI 出口類別;一套忽略它們的護欄體制只覆蓋了部署世界的一部分。北京是否接受任何觸及開放權重的文字,是整個檔案中最困難的問題。

對等與可驗證性。 通報機制只有在雙方都使用時才能建立信任。核武熱線花了數十年才成為常規。真正的第一次考驗可能不在峰會上,而在第一起事故發生時——屆時是否有一方政府拿起電話。

對於整個夏天看著實驗室自組安全標準、政府進度落後的產業而言,紐約的成果是第一個證據,顯示對前沿 AI 具有實質影響力的兩個國家,有辦法將協調的一小塊制度化。這套機制是克制的。它建立的先例不是。

本篇報導來源包括《金融時報》、路透社稿件、Bloomberg Law 與《海峽時報》。