← All posts / Policy

「讓對手批改你的作業」:馬斯克提案「測試鞍具」跨實驗室互相審查——北京回應減速訴求「危言聳聽」

馬斯克在 All-In 峰會提案:xAI、OpenAI、Anthropic、Google、Meta 與「三四家領先中國公司」應在模型發布前互跑對方建造的「test harness」安全測試——在業界領袖週末連署呼籲減速、川普稱之為「騙局」、北京斥為「危言聳聽」的此週,一套純民間的橫向安全機制。

「讓對手批改你的作業」:馬斯克提案「測試鞍具」跨實驗室互相審查——北京回應減速訴求「危言聳聽」

AI 產業多年來最團結的一波安全呼籲進入第三天,問題已經不是前沿實驗室該不該減速——而是究竟誰有資格檢查它們的作業。Elon Musk 週一在洛杉磯的 All-In 峰會上給出了他的答案:讓對手來批改。

提案內容

Musk 在台上呼籲頂尖 AI 公司合作,在模型對外公開之前先互相測試。他點名的名單幾乎涵蓋整個前沿:他自己的 xAI(已於 2026 年 2 月被 SpaceX 收購)、OpenAI、Anthropic、Google、Meta,以及「三四家領先的中國公司」。

機制是 Musk 所稱的 「test harness」(測試鞍具):每家實驗室允許競爭對手對尚未發布的前沿模型執行標準化評測套件,探測危險能力與安全失效。

「與其自己批改自己的作業,至少讓競爭對手來批改你的作業,在他們發現疑慮時 raise the alarm(拉響警報)。」

Musk 對這個想法的侷限並不諱言。他承認同儕審查「可能不是完美方案」——但「找出問題的機率會大幅提高」。他也坦承,與 xAI 競爭的實驗室尚未同意這項提案,目前它就只是一項提案。「我在這裡建議的是,這是往正確方向邁出的一步,而且是我們能很快做到的事,」他說,並補充:「我認為中國可能會同意。」

這個框架至關重要。Musk 提的不是政府強制的牌照制度,也不是國際條約,而是一種橫向問責結構:實驗室監督實驗室,而且是由商業對手——最有動機找出彼此弱點的一方——擔任第一道防線。

為什麼是現在:扭轉辯論的一個週末

Musk 的提案並非憑空出現。它落地於一連串事件之後——AI 產業自己的領袖們剛剛發起多年來最協調的一次克制呼籲:

  • Anthropic 執行長 Dario Amodei 發表文章,提議為前沿 AI 開發「放慢步調」,並建議實驗室接受「嵌入式評估者」的第三方評測,由其從內部查核安全實務。
  • Musk 與 OpenAI 執行長 Sam Altman 都公開支持 Amodei 的減速呼籲——兩位宿敵 CEO 之間難得的一致表態。
  • 這一切的導火線之一是 Jacob Coxon:這位研究員(先前任職於 OpenAI)辭去 Anthropic 職務後寫道,領先實驗室正在「拿我們的性命當賭注」。Anthropic 對齊研究負責人 Evan Hubinger 隨即附和:「Jacob 是對的——我們真的真心相信 AI 可能殺死所有人類!我個人認為未來十年內機率超過 10%。」

在這個背景下,Musk 的 test harness 顯然是想把空泛的減速修辭轉譯成具體而快速的行動。Amodei 的「嵌入式評估者」需要招募、認證、建立信任;而對手互跑的測試鞍具,理論上只需要競爭對手之間的一通電話。

華府的答案:「騙局」

白宮完全不買帳。川普總統週一在 Truth Social 連發多則貼文,稱對 AI 的恐懼是 「hoax」(騙局) 與 「scam」(詐術),明確拒絕加強監管的呼籲。他主張任何為 AI 設速的做法都會讓中國佔上風——據一則報導,他甚至打趣說「AI 唯一需要的護欄,就是一位高 IQ 的總統」。

國家經濟委員會主任 Kevin Hassett 週二告訴 CNBC,民間部門才是處理 AI 疑慮的「正確場所」;政府會持續監控產業,並在必要時動用「執法手段,確保企業負責任行事」。

這個立場藏著一層深深的諷刺:拒絕監管 AI 的政府,等於是默許了 Musk 提案的那種產業自律。如果華府不造護欄,護欄就只能靠競爭對手互相探測模型來搭建——或者根本不會存在。

眾議院議長 Mike Johnson 週二在記者會上呼應「騙局」之說,稱這些警告「比 RUSSIA, RUSSIA, RUSSIA 騙局或全球暖化騙局還要離譜」。

北京的答案:「危言聳聽」

中國走得更遠。中國外交部發言人週一稱 AI 公司的減速呼籲是 「危言聳聽(fear mongering)」,此一說法出自路透社刊出的英譯。

這個回應幾乎擊沉了 Musk 計畫的國際面向。他的提案預設「三四家領先中國公司」願意把前沿模型交給 OpenAI、Anthropic 與美國情報圈周邊機構檢查——而且華府也會容忍中國實驗室反過來對美國前沿模型跑 test harness。Musk 自己的猜測(「中國可能會同意」)如今對上的是北京官方把整場減速運動定性為恐嚇戰術。

這也讓 Amodei 週末親口承認的困境更加尖銳——他稱中國是其減速提案的「最艱難難題」:美國實驗室單方面克制既無法驗證、也不會被對等回報;而互相驗證需要的美中信任,目前根本不存在。兩國預定九月中旬舉行的 AI 安全會談——包括讓雙方實驗室共同「警察」AI 指揮的網路攻擊的構想——仍屬暫定且未確認。

分析:沒有審計員的對抗式審計

剝掉地緣政治的外衣,Musk 的提案其實是一個相當有意思的治理設計——可以說是檯面上最務實的一個。

誘因論證很強。 自我評測有明顯的利益衝突:沒有實驗室想找出那個會延後自家發布的結果。競爭對手恰恰相反——他們最有動機找出彼此的缺陷,也擁有最深厚的技術人才來做這件事。把這種對抗關係制度化為發布前測試協議,等於把市場競爭轉化為安全資源。

但跨國版本的信任問題是致命的。 讓對手跑 test harness,意味著把發布前的模型存取權交給敵手——奉上探測、逆向工程與基準測試的機會。美國實驗室把前沿存取交給中國實驗室(或反之)會觸及出口管制、國安審查與間諜法。國內版本——xAI 測 OpenAI 的模型、Anthropic 測 Google 的——相對可行,也與先前報導中 Anthropic、OpenAI、Google 之間低調的前沿標準合作相呼應。但它只涵蓋半個世界的前沿。

而且它替代不了辯論真正的主題。 週末那波警告談的是步調——下一世代的模型究竟該不該訓練。Test harness 評測的是你已經建造的東西;它不會讓建造變慢。而同時堅稱「沒有什麼能關閉開源」的 Musk,實際上提供的是一種繼續競速的方式——只不過由其他賽車手來檢查你的煞車。

而這可能正是它成為唯一有機會的提案的原因:它不要求任何人停下來,不需要條約,幾通電話就能啟動。至於有沒有任何實驗室真的拿起電話——在美國總統稱風險是騙局、中國稱憂慮是危言聽聽的這一週——那才是真正的測試。