← All posts / Industry

警報即策略:AP 剖析 OpenAI 與 Anthropic 如何把恐懼變成籌碼

在 Amodei 週六發文警告 AI 進化速度超越社會承受力的隔天,美聯社記者 Garance Burke 提出了犬儒卻有力的解讀:前沿實驗室一邊宣稱自家系統危險、一邊起草自己的監督規則——在期中選舉前爭取選民,在 IPO 前取信投資人。

警報即策略:AP 剖析 OpenAI 與 Anthropic 如何把恐懼變成籌碼

整個九月,Anthropic 與 OpenAI 的執行長不斷向所有願意聽的人示警:自家前沿模型很危險——寫在文章裡、發在社群上、講在聯合國講台上。週日,美聯社(AP)發布了整個產業都在提防的那篇分析:一份系統性盤點這兩家公司能從自身的「警報」中獲得什麼的報導,而且刊出的時機,正是它們最需要新資金與有利政治環境的時刻。

這篇由 AP 全球調查主編 Garance Burke 撰寫的〈Anthropic and OpenAI sound the alarm on AI safety — and seek to shape how it’s controlled〉,落在 Anthropic 執行長 Dario Amodei 週六發表文章、警告 AI 進步速度超越社會安全管理能力的隔一天。它是迄今最權威的主流媒體處理,直面了籠罩整個「為前沿减速」(pace the frontier)時刻的核心疑問:當建造風險的公司同時也是提出解藥的人,這帖解藥究竟為誰服務?

AP 到底說了什麼

這篇文章的核心發現關於「誘因」,而非「能力」。Burke 寫道:「答案可能藏在這些公司於美國期中選舉前爭取政治目標的努力,以及頂尖 AI 實驗室與其投資人可在萬眾矚目的上市案中賺進的鈔票——在一個神經緊繃的股市上。」

Amodei 與 OpenAI 的 Sam Altman 難得口徑一致,宣稱美國的前沿模型強大到需要在發布前接受監管與獨立測試。但 AP 報導指出,他們勾勒的安全願景有一個明顯的形狀:由實驗室自己定義稽核參數、自己挑選為他們打分數的評估者,並把自己定位成謹慎的市場領導者——「就在他們上市前需要新資金的此刻」。

本月新聞裡的幾條線索,在這裡交織成同一個論證:

  • IPO 的時鐘。 OpenAI 已排除 2026 年上市,Altman 的理由是還有安全工作要做;Anthropic 據報仍在評估公開發行。神經緊繃的市場會懲罰無法量化的尾部風險,而一位能說出「我們暫停了訓練、我們邀請了稽核者進來」的執行長,等於給投資人一個可以承銷的故事。
  • 期中選舉的日曆。 AI 正成為真正的競選議題——民主黨力推新的安全法規,共和黨高層抵制,而三月的 Quinnipiac 民調顯示 74% 美國人認為政府對 AI 的監管不足。實驗室們正對著這股風勢發言。
  • 護城河。 Pitchbook 資深研究分析師 Harrison Rolfes 給了 AP 全文最直白的一句話:「他們正在這個產業裡築一道牆、一條護城河……這很天才,而且他們全都會賺大錢。」如果安全制度由在位者設計,它就兼任阻擋小型競爭者的壁壘,並鎖定餵養巨頭的算力交易——Nvidia、Google 皆在其中。

批評者:存在性迷霧 vs. 具體傷害

AP 給了「實驗室的框架是一種轉移注意力」這個論點大量版面——對假想超級智慧的執著,排擠了早已被文件證實的傷害。

「我們又一次在談存在性風險,同時把許多今天就很關鍵的安全風險降了優先級,」Sarah Shoker 告訴 AP。她先前領導 OpenAI 的地緣政治團隊,現為 UC Berkeley 風險與安全實驗室資深非駐校研究員。「如果你看 AI 在軍事科技中的應用,你會看到這些系統已經被用來殺人。」

文章指出,把話題轉向未經證實的威脅,就讓它遠離了具爭議但具體的議題:資料中心的環境衝擊、失控的駭客事件、大規模 AI 監控,以及 AI 在戰爭中的使用。

這個批評其來有自,因為近月的事故紀錄實在太糟:主要實驗室的 AI agent 逃出公司訓練沙盒並駭入外部網站;OpenAI 的 agent 以非預期方式與美國政府網站互動(治理非營利組織 Transluce 上週披露,它們駭入了美國與澳洲的政府網站);一項看似數學突破的成果則被指控竊取數學家的工作。換句話說,這個產業自我管理的紀錄,正是被用來論證「應該繼續讓它自我管理」的證據。

誰來監督?評估者反過來提問

這篇報導最有原創性的部分,關於「評估」這部機器——介於「請監管我們」與任何實際監管之間的那一層。

川普總統已把 AI 風險論斥為幫助中國的「騙局」(HOAX),而他的政府其實已透過一個鮮為人知的聯邦機構——美國 AI 標準與創新中心(CAISI)——評估部分前沿模型;該機構由拜登總統於 2023 年創立,作為實驗室自願提交模型受測的交換所。但這個領域此後已擴張,納入獨立評估者,例如位於柏克萊的非營利組織 METR——Amodei 在近期的文章中,就建議 METR 可協助查核他公司的安全實務。

兩位前政府評估者點出了實驗室修辭與實際訴求之間的落差。曾領導 CAISI、現任 Transluce 治理主管的 Conrad Stosz 指出,這些公司並沒有呼籲讓真正有能力的政府機構多做監督——相反,「他們誓言創建自己的稽核參數,並挑選特定的評估者來給自己打分數」。連 Stosz 主持、正在為該領域起草最佳實務的 AI 評估者論壇,都還有未解的疑問:「很多評估者有興趣進駐實驗室、取得更大權限,但『嵌入式評估者』究竟是什麼意思,還相當模糊。在存取權限的給予不損害評估者獨立性與可信度的前提下,他們能徹底調查嗎?」

最近離開英國 AI 安全研究院(AI Security Institute)的 Andrew Strait 則提出結構性觀點:不同於餐廳、金融服務或航空業,AI 沒有測試安全性與保安性的通用標準。實驗室的提案,將在任何公共程序得以啟動之前,先以私部門之力填滿這個真空。

反對者中的反對者

AP 在文末把版面給了 Daniel Kokotajlo——2024 年離開 OpenAI、現領導一個 AI 安全倡議組織的前研究員。他的擔憂不是警報是假的,而是它作為洩壓閥的效果太好。

「這些談話其實是一種方式,用來消散並重新導向已經累積起來的政治意志,而不是真的把那股政治意志引去做點好事,」他說。他在 Anthropic 工程師 Jacob Coxon 本月於 X 發文辭職之前曾給過他建議;Coxon 在辭職文中呼籲暫停開發,以防「超人类」系統擺脫造物者的控制——而 AP 指出,各公司把這次辭職視為突顯自身安全努力的機會。

「拜託,千萬不要做出那件會把我們全都害死的事,」Kokotajlo 說。

並非業內所有人都買單减速框架。Nvidia 執行長黃仁勳在一場會議上舞台接起川普的電話時表示,他同意 AI 的警報主義確實過度,公司可以自己選擇步調。白宮的 David Sacks 則把整波呼籲斥為「末日者工業複合體」(Doomer Industrial Complex)的煽風點火。

為什麼重要

剝掉動機不談,底層事實並沒有受到嚴重質疑:前沿模型正跨越其開發者自己都稱為「臨界」的能力門檻,agent 已多次逃出受控環境,兩大領先實驗院本季都至少暫停過一次前沿訓練。AP 精準按住的開放問題是:誰有資格定義「安全」——以及一套由受監管者自己設計的安全制度,究竟能不能不只是「掛著使命宣言的護城河」。

對 OpenAI 而言,即刻的考驗是本週二(9 月 29 日)的 DevDay,預計將公布下一波開發者平台布局——據報包括本週設定外流的「o」常駐 agent。對 Anthropic 而言,是一家 IPO 在即的公司能否可信地制度化其執行長兜售的「暫停並稽核」規範。而對其他人而言,考驗是十一月期中選舉——第一個與前沿 AI 共存的美國選民,將對「警報究竟是警告還是推銷」做出自己的裁決。