自願制度的第一堂課:Anthropic 跳過英國 AI 安全測試,結果什麼事都沒發生
Anthropic 未將最新模型送交英國 AI 安全研究所(AISI)上市前測試,且不會受到任何處罰——就在同一週,英國首席國務大臣 Louise Haigh 在工會大會上警告,政府必須「正視 AI 開發者的警告」並建立防護欄。
週二下午,英國首席國務大臣 Louise Haigh 站上布萊頓工會大會(TUC Congress)的講台,發表了本屆政府迄今最嚴肅的 AI 公開談話。她說,AI 對公共服務、企業與科學突破具有「巨大潛力」——但如果「沒有建立正確的防護欄,顯然會對我們的國家安全與社會帶來巨大風險」。
「我們有一項莊嚴的義務,必須減輕這些風險,確保 AI 帶來的是社會的利益,而非損害,」Haigh 告訴與會代表,並強調政府必須「正視那些站在技術發展最前線者的警告」,且應「準備好與國際夥伴合作」,將公共安全與國家安全列為優先。
然而就在數小時後,《衛報》的一則獨家報導,揭示了這些華麗言詞與英國實際執法機制之間的巨大鴻溝:Anthropic 拒絕將其最新模型送交 AI 安全研究所(AI Security Institute, AISI)進行上市前測試,且不會面臨任何制裁。這是自願評估制度建立以來,第一次有大型前沿實驗室直接選擇退出——也最清楚地證明,在「自願安全安排」這個詞裡,真正承擔所有工作的是「自願」兩個字。
框住這一週的獨家報導
故事始於 9 月 8 日。《金融時報》報導,Anthropic 未將其最新模型交付 AISI 的部署前評估流程——這是該研究所自 2023 年成立(並於 2025 年初從「安全」更名為「保安」研究所)以來,首次有主要開發商拒絕配合。英國没有任何法律強制要求實驗室參與 AISI 測試;整套制度建立在諒解備忘錄與實驗室的善意之上。
當善意用盡,研究所手裡什麼籌碼都沒有。没有罰款、没有暫停營運,甚至没有一紙正式譴責。《衛報》揭露「不會有制裁」這個結果,把一則原本冷門的程序性小新聞,變成了關於英國整體 AI 治理路線的憲政級質問:一個既無法強制測試、也無法懲罰拒絕測試的制度,究竟算什麼安全制度?
時機讓身處風暴中心的 Anthropic 格外尷尬。過去兩週,Anthropic 是整個業界最響亮的「節制」倡導者:執行長 Dario Amodei 在 9 月 12 日發表的《我們必須為前沿減速》(We Must Pace the Frontier)一文中,呼籲各前沿實驗室協調放慢能力提升的速度——這個立場獲得 OpenAI、Google DeepMind 與 Elon Musk 公開支持。共同創辦人 Jack Clark 更進一步,向 BBC 表示由第三方持有的 AI「緊急開關」(kill switch)最終可能必須強制化,是社會「最終可能會想立法規範」的事。
一邊呼籲對所有人課以約束性規則、一邊自己拒絕一項自願性檢查的實驗室,成了「自願治理模式為何撐不住競爭壓力」最尖銳的例證。
一個各說各話的政府
Haigh 的演講,只是本週內閣多重聲音中的一種。商業大臣 Jonathan Reynolds 在 BBC Radio 4 的《Today》節目上,呼籲大家既不要掉以輕心,也不要「過度渲染」。被問到 Clark 的緊急開關構想時,他回答:「我不認為那是思考如何管理風險的有用方式——我不太確定那在實務上意味著什麼。」Reynolds 並警告,過度監管可能讓英國失去取用外國模型的機會,反而使國家「更不安全」。
這與上週內閣辦公室正式拒絕跨黨派「緊急開關」修法案的立場一脈相承——理由是英國「不能只是把 AI 關掉」,在國內封鎖模型並無法阻止它們在其他地方被開發或濫用。
這種矛盾是結構性的:政府想同時成為全球最可信的 AI 安全發聲者,以及歐洲最有吸引力的 AI 投資目的地。在守法是自願且免費的年代,兩個目標還能安然共存。Anthropic 的拒絕,把這道選擇題逼上了檯面。
國會開始拉動槓桿
西敏寺的回應迅速而程序化。主持下議院商業與貿易委員會的工黨議員 Liam Byrne,已致函 AISI 所長 Henry de Zoete,要求他到國會作證。Byrne 在信中引用了公眾對「不受約束、治理不足的人工智慧發展」日益升高憂慮,並質疑「現行 AI 安全治理的充分性」。
在 Byrne 之前,聯合人權委員會上週已呼籲英國建立法定 AI 框架——此前一份報告認定 AI 技術已造成多起侵害人權的事件。「包括英國在内,世界上没有任何地方現行的 AI 立法與監管方式是合格的,」工黨議員 Alex Sobel 表示。
甚至連 OpenAI——一家與部署前承諾有著複雜歷史的公司——都據報敦促部長們趁政治窗口仍開時立法,將約束性規則精準聚焦於少數前沿實驗室,而非更廣泛的新創生態系。
最具份量的提案來自前財政部首席秘書 Darren Jones:他希望首相 Andy Burnham 在英國明年主辦 G20 高峰會時,把國際 AI 監管列入議程。不過 Jones 也附帶了一個會讓所有熟悉英國監管史的人心有戚戚的警告:「我擔心的是,我們走上經典的西敏寺路線——設一個新監管機構,然後不小心扼殺了這個國家的 AI 生態系。」
工會把勞工帶進賽局
如果部長們談的是國家安全,布萊頓的工會大會談的則是工作——而且提供了本週最具體的證詞。與會代表通過動議,敦促政府提出國家 AI 計畫,並抵抗「大科技遊說團」的影響。
TUC 秘書長 Paul Nowak 稱 AI 是「對勞工與整體社會清楚而現存的危險」,並敦促 Burnham 利用 G20 主席國身分推動全球監管,確保這項技術「讓每個人受益,而不只是超級富豪」。Unite 工會秘書長 Sharon Graham 則說,勞工與公共安全「在 AI 議題的辯論中完全被遺忘了」。
具體案例比抽象口號更駭人。教師描述 AI 系統已進入教室,用來錄影並評估教師表現;Unite 代表描述起重機操作員被錄影分析,用以訓練未來取代他們的自動化模型,而大貨車司機則活在全天候監控之下。「我們的金融與 IT 員工,被雇主視為一筆可以省下的成本,而 AI 就是拿來省錢的工具,」Unite 的 Pat Dowling 說。
Haigh 在演講後回答提問時,暗示了政府打算站在辯論的哪一邊:「凡是 AI 讓工作更有生產力的地方,成果都應該由勞工共享,而不是只進股東或科技新貴的口袋。」
更大的風暴
這一切都非發生在真空裡。英國的辯論,正逢 AI 產業史上最戲劇性的「業內人警告」兩週:Anthropic 研究員 Evan Hubinger 評估未來十年 AI「可能消滅全人類」的機率超過 10%;Jacob Coxon 公開辭去 Anthropic 職務,警告「未來兩年人類的命運」;Bilal Chughtai 今夏離開 Google DeepMind 後,於週一晚間警告「AI 有可能殺死我們所有人」,而且「我們可能正在耗盡避免這個結局的時間」;OpenAI 研究員 Dan Selsam 則聲稱,強大模型「很可能會說服人們一切都很好」,並「極具說服力地主張人類應該把權力交給它們」。
與此同時,美國總統 Donald Trump 週二則把整個議題斥為無稽,稱 AI 毀滅人類的恐懼是一場「騙局」(HOAX),堅持 AI 唯一需要的防護欄就是「一位強而聰明的總統」——這提醒著英國:無論建立起什麼框架,在英語圈盟友之中,它基本上得獨自前行。
接下來看什麼
值得關注的焦點是程序性的,但後果深遠:AISI 首長是否會出席 Byrne 委員會的聽證;政府是否會把本週的言詞轉化成一部真正有執法權的 AI 法案;以及 Burnham 會擁抱 Jones 的 G20 提案,還是把它留給更低調的外交管道。
更深層的教訓,已經透過 Anthropic 事件意外送達。英國的前沿安全制度在壓力下被測試了恰好一次,結果已載入公共紀錄:一家實驗室說不,然後什麼事都没發生。正如《衛報》報導出爐後一位西敏寺觀察家的評語——這件事「清楚示範了英國安全安排中『自願』一詞的真正含義」。
Haigh 說得對,這些警告確實應該被正視。她的政府現在要回答的問題是:光靠「正視」,算不算一項政策。
Sources
- [1] https://www.theguardian.com/technology/2026/sep/15/uk-must-heed-warnings-from-ai-experts-minister-louise-haigh
- [2] https://www.bbc.com/news/articles/crvgyq7wljzwo
- [3] https://www.resultsense.com/news/2026-09-16-anthropic-aisi-no-sanctions/
- [4] https://www.ft.com/content/560e1c8b-f163-4fd6-b604-e905550ac870
- [5] https://www.the-independent.com/news/uk/politics/louise-haigh-donald-trump-andy-burnham-government-liam-byrne-b3050656.html