主權級的安全賭注:加拿大與德國豪擲 3 億加幣投資 Bengio 的 LawZero
兩國政府聯手資助一套有別於前沿實驗室路線的方案:以「安全by design」的 Scientist AI,為所有人正在部署的代理系統充當護欄。
週三下午,在蒙特婁的 ALL IN 大會上,AI 的資金史上出現了一幕少見的場景:兩個國家政府聯手開出一張巨額支票——不是買算力,也不是投資前沿實驗室,而是投給 AI 安全。加拿大與德國宣布,將向圖靈獎得主 Yoshua Bengio 創立的非營利組織 LawZero 承諾最高 3 億加元 的聯合資金。這是迄今為止「安全by design」AI 獲得的最大一筆公共投入,也是一場刻意的豪賭:賭的是「先衝再說、出事再補」之外,還存在另一條技術路線。
發布時機經過安排。德國正是本屆 ALL IN 的「榮譽國」,兩國今年二月才共同簽署主權科技聯盟。LawZero 這筆資金讓這條軸線再加深一層——同一天,多倫多的 Cohere 也完成了與德國 Aleph Alpha 的整併。渥太華與柏林正在清楚地搭建一條既不屬於矽谷、也不屬於北京的跨大西洋 AI 走廊。
這筆錢到底買什麼
根據《環球郵報》報導,這筆承諾由兩國分攤(加拿大份額經由戰略應變基金撥付),指定用途有三:
- 人才。 擴編 LawZero 的國際科學研究團隊——主責官員表示,這筆資金將創造「數以百計」的全職職缺。在記者會上這樣說的是 Evan Solomon,加拿大的 AI 與數位創新部長——一個兩年前幾乎不存在的內閣職位。
- 主權算力。 在加拿大境內建立專屬運算基礎設施,與蒙特婁的 Hypertec 與 5C 合作。這不是租雲端,而是錨定在加拿大土地上的基礎設施,官方明確以「主權」來框架它。
- 歐洲據點。 LawZero 將在柏林設立新辦公室,嵌入德國的創新生態——用德國數位化部長 Karsten Wildberger 的話說,是「強化我們的技術主權」。
被資助的技術
LawZero 的旗艦計畫是 Scientist AI,而它的設計哲學,正是對整個業界正在規模化的「代理式」範式的直接否定。目前的前沿系統被訓練成自主行動、追求目標;Scientist AI 被設計成反其道而行:透明推理、產出可靠且基於證據的結論,並且「不受自身目標污染」。
真正有趣的是它的部署定位。Scientist AI 被擺在監督者的位置——一套為別人部署的代理模型充當護欄的系統。實際上,這是一個以「理解其他 AI 在做什麼」為職責的 AI:標記失準或欺瞞行為、適時介入——一層獨立的安全機制,不與被監督系統共享任何誘因結構。Bengio 的論證是:一個沒有經過目標導向強化學習訓練的監督者,可以在評估一個目標導向的代理時,不繼承它的盲點。
這個框架在本週變得格外具體。就在資金宣布的同一週,西班牙資料保護局披露了其所謂首例由自主 AI 代理「端到端」完成的個人資料侵害事件——偵察、登入、應用探測、資料竄改、存取發票,全程無人類導引。同時,OpenAI 發布了失準行為通報框架,並披露六起先前未通報的安全事件。Bengio 在聲明中說:「近來的事件證明,安全本身就是一種核心能力:科學創新與公眾安全必須、也能夠同步推進。」
為什麼是非營利,為什麼是政府
LawZero 以非營利組織的形式運作,「以確保其不受市場與政府壓力影響——這些壓力可能危害 AI 安全」。它在 Bengio 創辦的蒙特婁 Mila 研究所孕育而成,董事會與顧問委員會的組成刻意保留相當的非技術色彩:董事會主席是 Nike Foundation 創辦人 Maria Eitel;紐西蘭前總理 Jacinda Ardern、瑞典前總理 Stefan Löfven、作家 Yuval Noah Harari 與 Mila 執行長 Valerie Pisano 並列其中。初始資金來自慈善界——蓋茲基金會、Schmidt Sciences、Future of Life Institute、NVIDIA、Jaan Tallinn——規模約 3,000 萬美元。週三的承諾比那高出一個數量級,而且出資方是國庫,不是捐贈人。
這改變了組織的性質。這個規模的政府資金,讓 LawZero 從倡議型計畫變成準基礎設施——更接近國家實驗室的概念,而且一次有兩個。它也回答了 AI 安全領域專業化以來一直懸著的問題:讓高獲利系統變安全這種不賺錢的工作,誰來買單?加拿大與德國現在給出了一個答案,並順勢在自己想要的結果上下了注:用 Solomon 的話說,是「反映我們的價值與利益」、「以加拿大的條件」打造的 AI。
這場豪賭並非沒有張力。作為前沿模型護欄的監督者,影響力取決於採用率——OpenAI、Anthropic 與 Google 近月已悄悄討論自組產業標準組織負責測試與稽核,沒有理由保證大實驗室的內部安全團隊會聽命於一個外部、政府支持的監督者。而「安全by design」目前仍是一個研究假設,與其說是產品——Scientist AI 的可靠性宣稱,遲早要面對所有安全機制最終都會遭遇的對抗性壓力。
但結構性的訊號才是重點。在 ALL IN 現場,Bengio 被用法語問到:研究者警告 AI 可能在十年內威脅人類,是否太聳動?他的回答只有一個字:不。「我懷著刻在骨子裡的急迫感在做這件事,」他說。從本週起,有兩個政府也感受到了這份急迫,並用大約 3 億加元為這份感覺背書。前沿實驗室有它們的首都;現在,安全陣營也有了。
Sources
- [1] https://www.prnewswire.com/news-releases/lawzero-receives-a-commitment-of-up-to-300m-in-joint-funding-from-canada-and-germany-302880694.html
- [2] https://betakit.com/yoshua-bengios-lawzero-receives-300-million-backing-from-canada-and-germany-to-pursue-safer-ai-ambitions/
- [3] https://theglobeandmail.com/
- [4] https://lawzero.org/en