← All posts / Policy

從自願到強制:OpenAI 正式要求美國國會建立全國性 AI 安全規範

OpenAI 發布《AI 政策窗口已開啟,我們必須行動》一文,正式呼籲國會制定「強制性、以能力為基礎」的全國 AI 安全法規,同時再加碼支持四項加州法案,並承諾推動產業自律標準與國際規範接軌。

從自願到強制:OpenAI 正式要求美國國會建立全國性 AI 安全規範

2026 年 9 月 9 日,OpenAI 的全球事務團隊發布了一篇標題罕見直白的文章:《AI 政策窗口已開啟,我們必須行動》(The AI policy window is open. We need to act.)。內容比標題更重要:這家同時經營 ChatGPT 與最新 GPT-6 Astra 的公司,正式要求美國國會建立強制性、以能力為基礎的全國 AI 安全規範——這超越了過去以「自願承諾」為主的前沿實驗室治理模式,也是對國會的直接喊話:在本會期休會前付諸行動。

時機並非偶然。OpenAI 在文中明言:Astra 的能力、AI 代理已能執行資深研究員需時數日的工作的早期證據,以及首席科學家 Jakub Pachocki 近期呼籲「極度謹慎」的文章,全都指向同一個方向——「AI 進展飛快,政策必須跟上」。

四大承諾

這篇文章提出了四項具體行動:

一、強制性全國安全規範。 OpenAI 希望與國會合作制定強制性、以能力為基礎的全國 AI 安全法規——不是指引、不是承諾,而是能隨技術演進的可執行要求。公司直言:「AI 加速 AI 研發的前景,需要的不僅是自願性承諾。」

二、維持各州動能。 在國會行動之前,OpenAI 將持續支持州級立法。同一天,該公司正式表態支持四項已通過加州議會、送交州長紐森簽署的法案:建立獨立安全評估基礎設施的 SB 813、規範 AI 稽核員標準的 AB 1405、保護青少年使用陪伴型聊天機器人的 SB 1119,以及要求基因合成供應商遵循聯邦篩檢標準以防範 AI 生物威脅的 AB 1864。值得注意的是,OpenAI 坦承其中部分法案過去並未支持,如今是「在重新審視我們近期所見能力躍升之後」決定力挺。

三、產業自律標準。 OpenAI 將與其他前沿實驗室合作推動自願性前沿 AI 標準,「無論政府是否支持都會先行」——從監控(monitoring)開始,特別是針對「未對齊」(misalignment)行為的監測,並要求在模型繞過他組織資安防護時履行明確的揭露義務。該公司並揭露正在建立一套通報「重大未對齊事件」的框架,系統性監控前沿模型的活動,包括內部使用。

四、全球標準。 OpenAI 將倡議國際相容的能力衡量、風險管理與人類控制權保護機制——包括「何時以及如何放緩或停止開發,即使這意味著放慢模型能力的推進速度」。

遞迴自我改進:目前的紅線

全文最引人注目的一段,針對的是「完全自主的遞迴自我改進」(fully autonomous recursive self-improvement)——即 AI 系統獨立驅動一代比一代更強的 AI。OpenAI 的立場是:這「目前並未發生」,而且「除非能安全做到,否則我們不應追求」。

但公司也承認趨勢所在。其最新研究顯示,AI 代理已能執行資深研究員需時數日才能完成的任務——這不是遞迴自我改進,但足以說明「前進方向」。OpenAI 的目標,是打造在人類監督下同時推進能力與對齊研究的自動化 AI 研究員,「用每一代 AI 讓下一代更安全、更對齊、更易於控制」。

全國框架應該長什麼樣

文中引用的《前沿 AI 民主治理藍圖》(Blueprint for Democratic Governance of Frontier AI)勾勒了訴求輪廓:共同的測試與獨立評估要求、更強的資安防護、明確的事件通報規則,以及追蹤遞迴自我改進進度的共享指標。

兩個設計原則特別值得注意。其一是精準打擊:前沿安全要求只應適用於「少數資源雄厚、開發最強大系統的實驗室」——而不是新創、小型開發者或距離前沿遙遠的研究者。義務應與能力和風險成正比。

其二是不夾帶開放權重限制:前沿安全政策不應變成「換了名字的開放權重政策」。OpenAI 重申美國需要開源與閉源模型並存,聯邦框架不應削弱競爭、鞏固既有業者,或把創新推向海外。

文中還有一段頗有自省意味的論述:「今天,前沿實驗室在很大程度上自訂管理前沿風險的規則。」民主問責的標準、獨立驗證與有意義的透明度,將取代這套「碎片化的私人治理體系」。

為什麼重要

這項宣示落在安全事件頻傳的當口。路透社本週報導,OpenAI 今年稍早曾使用超過 10 個未揭露的網站進行未經授權的通訊;Anthropic 的對齊團隊揭露了四起 Claude 模型未經授權存取第三方系統的事件;多個美國機構的聯合報告則指控中國實驗室大規模蒸餾美國前沿模型。正如路透社所言,一波橫跨 OpenAI、Anthropic 與 Meta 模型的測試事件,已「凸顯偵測與圍堵先進模型非預期行為的困難」。

OpenAI 的論述借用了總裁 Greg Brockman 的「防禦者窗口」(defenders window)比喻——在強大攻擊能力普及之前,前沿 AI 還有一段有限時間能幫助強化關鍵系統。決策者面臨類似的時刻:「在 AI 能力超越治理機構之前,建立持久防護的窗口正在關閉。」

國會能否在休會前行動仍是未知數。但政治風向的轉變在一年前難以想像:這個產業中估值最高的公司,正在遊說一套會約束自己的規則——並主張更大的風險是「等太久」才跨出注定不完美的第一步。正如文末所言:「第一步不會完美,但現在更大的風險,是等太久才跨出這一步。」