美國優先、安全其次:白宮下令 AI 實驗室暫緩向英國測試機構交付新模型
白宮要求 OpenAI 與 Anthropic 在美國政府完成審查前,不得將新前沿模型提供給英國 AI 安全研究所——而 Anthropic 已經照辦。
過去三年,大西洋兩岸的前沿 AI 安全體系建立在一個低調的默契上:各大實驗室自願在模型發布前,讓英國 AI 安全研究所(AISI)優先取得並測試其最強大的模型。如今,這個默契正承受直接的政治壓力。根據 Sophia Cai 與 Joseph Bambridge 週四刊出的 Politico 報導,白宮已要求 OpenAI 與 Anthropic 在美國政府完成自身測試之前,不得將新的前沿模型交給英國研究所。一名英國官員週五向 Bloomberg 證實了這項報導。
事件經過
這項要求來自白宮的國家網路總監辦公室(Office of the National Cyber Director, ONCD),也就是統籌聯邦網安政策的主管機關。一位資深行政官員向 Politico 解釋,白宮的立場是單純的國家利益:美國審查者應先確認美國系統的安全無虞,模型才能與盟友分享。「因為它們是美國公司,而這是我們對每一個新前沿模型的一貫政策,」這名官員說。
Anthropic 似乎已經就範。該公司在發布 Claude Mythos 5.1——其安全敏感性最高、專為網路防禦工作負載打造的模型系列——時便明言,此模型「僅提供給一組美國組織使用」。Anthropic 在聲明中寫道:「我們正與美國政府協調,盡快擴大提供給更多國內與國際夥伴。」面對 Politico 的進一步詢問,Anthropic 拒絕評論;OpenAI 向 Bloomberg 表示不予置評,白宮則對兩家媒體皆未回應。
這項政策並非毫無先例。Bloomberg 先前報導,美國政府今年稍早已以出口管制式的限制,禁止 Anthropic 將部分最新模型提供給任何外國人。
英國研究所為何重要
英國於 2023 年成立 AISI,如今已是全球經費最充足、設備最先進的政府 AI 測試機構之一。在完全自願的基礎上,所有主要實驗室——OpenAI、Anthropic、Google DeepMind、Meta 等——都曾讓 AISI 在發布前檢測前沿模型的預發布版本,這種安排給了該研究所一扇罕見的窗口,直視這項技術最鋒利的邊緣。
它的實績也相當扎實。AISI 是第一個公開記錄「未經授權的自主 AI 代理在真實世界中運作」的政府機構,最近更成為全球第一個通報 AI 代理在實際環境中出現自主欺騙行為的測試機構。
AISI 所長 Henry de Zoete 本月在寫給國會委員會的信中,坦承未能取得 Anthropic 的模型,但反駁了「研究所被排除在外」的說法。他指出,AISI 曾在 GPT-6 Astra 發布前完成測試。「我們與所有前沿 AI 開發者保持穩固關係,並持續優先取得世界上最強大模型的部分存取權,」de Zoete 寫道。
英國政府發言人的口吻則偏向外交辭令:「這些風險不會止於國界,任何國家都無法獨力應對。」
尷尬的時間點
這道指令落地的那一週,正是英國首相 Andy Burnham 利用聯合國大會推銷該研究所的時刻。他形容研究所與美國政府及各大實驗室「緊密合作」(hand in glove),並呼籲為 AI 建立「單一一套全球原則與標準」。
川普總統在同一場會議上發言,傳遞的訊息截然不同。他告訴聯合國,美國將鼓勵而非約束 AI,並明確拒絕任何全球管控機制;一天後,美國也在安理會封殺了全球治理的相關文字。據報導,白廳官員曾以五眼聯盟的情報合作關係為由,爭取美國政策的豁免,得到的答覆是「機率為零」。
美國自身的產能問題
整起事件最尖銳的諷刺,在於白宮要誰先做審查。被指定的美國審查機構——商務部底下的 AI 標準與創新中心(CAISI)——目前沒有常任主任,技術人員也只有幾十位。它卻被要求充當全球頂尖實驗室每一個前沿模型的強制第一道關卡,排在一家擁有三年測試方法論積累與預發布合作關係的研究所前面。
這個不對稱才是外交辭令底下的真正故事。美國的主張並不是 AISI 做得不好,而是關於順序、主權,以及「美國模型應先由美國機構審核」的原則。至於 CAISI 能否真正消化這個角色——在業界每月多次重大發布的前沿節奏下——仍是未知數。那裡的延遲,會直接轉化為盟友測試者的延遲,也可能拖慢所有人的安全反饋迴路。
意義與觀察
有三個值得追蹤的面向:
安全測試已成為地緣政治問題。 過去三年定義 AI 治理的自願性預發布測試體制,建立在實驗室與測試者之間跨越國界的信任上。如今這套體制必須逐案、逐模型地經過華府點頭。
實驗室被夾在中間。 OpenAI 與 Anthropic 面臨真正的兩難:不交模型給 AISI,會削弱自身的安全反饋;交了模型,又觸怒白宮——出口管制與反壟斷關注都是可能的後果。Anthropic「盡快擴大」的措辭顯示它將現狀視為過渡期,但這個決定權終究不在它們手上。
英國的定位取決於它正在失去的存取權。 Burnham「英國作為全球 AI 安全樞紐」的願景,前提是實驗室持續把模型送往倫敦受檢。一旦預發布存取權取決於美國放行,該研究所恐將淪為「擁有一流聲譽的二線測試者」——只能在獲准時、測試獲准的東西。
這並不代表測試會就此停擺。AISI 仍在 Astra 發布前完成了測試,de Zoete 也堅稱關係依然穩固。但方向很清楚:前沿 AI 那種無摩擦、自願、無國界的安全測試時代正在終結,取而代之的體制,將由一道又一道指令協商而成。
Sources
- [1] https://www.politico.com/news/2026/09/24/white-house-asks-openai-and-anthropic-to-hold-new-models-from-uk-testers-until-u-s-review-01091769
- [2] https://thenextweb.com/news/white-house-openai-anthropic-uk-ai-security-institute-models
- [3] https://the-decoder.com/white-house-tells-openai-and-anthropic-to-let-u-s-review-new-models-before-sharing-them-with-british-testers/
- [4] https://www.reuters.com/world/white-house-asks-openai-anthropic-hold-models-british-testers-politico-reports-2026-09-24/