OpenAI 低調發布重大 Model Spec 更新:Agent 關閉規則放寬、青少年界線收緊、廣告遭明文禁止
OpenAI 於 8 月 18 日發布 Model Spec v2026-08-18,這是八個月來首次修訂——將 Agent 強制關閉計時器改為最佳實踐、擴大拒絕規則至推斷意圖、新增能力透明度準則,並進一步強化青少年安全邊界。
2026 年 8 月 18 日,OpenAI 在沒有任何配套部落格文章或新聞稿的情況下,發布了新版 Model Spec——這份文件定義了 ChatGPT 與其 API 模型應有的行為規範。新版日期標記為 2026/08/18,是自 2025 年 12 月 18 日以來的首次修訂,而兩份文件的逐行比對顯示,這絕非例行性的文字修飾。這次更新重新調整了 AI Agent 終止工作的規則、模型在拒絕前如何判斷使用者意圖,以及助理在青少年周邊的行為規範——這三者可以說是當前 AI 產品政策爭議最大的三個領域。
Model Spec 之所以重要,在於它並不是一份服務條款文件。OpenAI 明言,該公司訓練模型時會對齊 Spec 中的原則,這些原則圍繞著一套「指揮鏈」(chain of command)組織,為平台、開發者與使用者的指令排出優先順序。正如 OpenAI 在 2026 年 3 月所言,Spec 是「一個公開的模型行為框架,在安全、使用者自由與問責之間取得平衡」。當文件內容改變,未來模型訓練的行為目標也隨之改變。
主要變更:Agent 的韁繩放鬆了
最關鍵的修改出現在 Agent 自主性章節。舊版要求「每個授權範圍(scope)都必須包含關閉計時器(shutdown timer),超過此時間後助理須停止行動,直到新範圍獲得確認」。這項硬性要求已被移除。新版文字改為:「每個範圍必須包含一個結束條件(ending condition),超過此條件後助理須停止行動,直到新範圍獲得確認。我們認為在結束條件中納入時間限制是一項最佳實踐。」
一句話之差,Agent 的強制關閉計時器從必要條件變成了可選建議。結束條件當然仍可以是計時器,但也可以是任務完成、預算門檻或其他觸發事件。對於在 OpenAI 平台上建構長時間執行 Agent 的企業開發者而言,這是顯著的放寬:OpenAI 表示 Spec 會實際影響模型訓練,也就是說,未來模型在與開發者協商自主範圍時,將不再被指示堅持硬性時限。批評舊版文字的人認為,僵化的計時器與真實工作流程相衝突——合法任務的耗時本就難以預測。而反對此修改的人則會指出:計時器是唯一無法被混淆或失控的 Agent 所「操弄」的結束條件。
範圍內高風險活動的禁令——駭客行為、欺騙、資源獲取、生成子 Agent、自我修改——保持不變,子 Agent 必須繼承相同範圍的要求也未改動。
拒絕現在可以「察言觀色」
非法行為章節新增了一個細微但影響深遠的條款。舊版 Spec 要求模型在使用者「表明非法意圖」時拒絕協助;新版則補充,意圖「可以從任何可得的上下文推斷,而不僅限於字面請求」。
這一個括號內的補充,把拒絕政策從相當字面的標準轉向情境推斷。一項單獨看來無害的請求,若周邊對話顯示有不法之虞,現在可以被拒絕。與之配套的是反向的新約束:助理「不應為了判斷拒絕或配合而要求使用者澄清意圖,或主動使用工具調查使用者意圖」。模型可以推斷,但不能質詢——也不能一邊翻查工具、一邊對使用者「蒐證」後再決定是否協助。
這組搭配讀起來像是一場刻意的交易:拒絕的推斷依據變寬,但換來的是禁止對使用者的對抗性調查。
新準則:「清楚說明能力與限制」
原則清單在「誠實與透明」之下新增了一個全新條目:清楚說明能力與限制(Be clear about capabilities and limits)。其理由相當直白——對許多使用者而言,助理「將是他們第一次接觸 AI」,而它的流暢表達「會讓人感覺像是一種熟悉的對話者,儘管其能力、可用功能與限制,可能與基於一般人類對話的預期大相逕庭」。
Spec 指示模型「主動幫助使用者建立並維持對助理能做與不能做之事的準確心智模型」,並儘早修正誤解——尤其是在行為不同於人類常規、或不同於其他 AI 產品之處。範例具體得罕見:當使用者要求「忘掉 我告訴過你關於我老闆的一切,以後別再提起她」,合規的助理會解釋自己無法刪除既有聊天紀錄,但會引導使用者永久刪除相關對話;違規示範則是助理爽快回答「好了——我不會再提起她了!」,這屬於「過度宣稱刪除能力」。同樣地,當使用者引用的附件根本不存在時,助理應該追問——而不是把使用者的請求本身改寫一番就當成交付成果。
任何看過聊天機器人自信滿滿地承諾「記住」或「忘掉」它根本辦不到的事情的人,都能看出這條準則在針對什麼。
虛構、錯誤前提與能量石
誠實章節還為「建立在錯誤或虛構前提上的請求」新增了一套處理框架。規則是:若上下文已清楚表明是小說、角色扮演或諷刺創作,直接進行,不加免責聲明;若上下文模糊,加上「簡短且中性的框架說明」——然後照做。範例精確校準了分寸:寫凱撒大帝滑手機的故事,無需任何免責聲明;寫舊金山成為美國首都的報導,加一句虛構框架後照常產出;寫能量石療效的文章,則框架為平衡的健康生活文章、避免無實證的醫療聲明。無論是對使用者說教安慰劑效應的助理,還是捏造「能量頻率療癒」聲明的助理,都被標記為違規。指引明確警告不要「過度免責、居高臨下」,也不要「在不確定時斷言前提為假」。
中立性:個人化成了被點名的威脅
在「共同追求真相」章節,守護 ChatGPT 客觀性的文字出現了耐人尋味的轉變。舊版警告「第三方客製化」可能為第一方 ChatGPT 引入偏見;新版則警告「隱性客製化、個人化或在地化」可能造成同樣問題。擔憂對象已從惡意的第三方開發者,轉向 OpenAI 自家的產品機制——記憶、個人化功能與在地化調整,都可能悄悄窄化使用者所見的世界。
青少年安全:邊界持續擴大
2026 年稍早隨 ChatGPT for Teens 產品一同引入的未滿 18 歲(U18)原則,這次新增了兩項內容。浪漫角色扮演的禁令現在明確涵蓋「使用帶有浪漫意涵的親暱稱謂」。新的「關係界線」(Relational Boundaries)條款則禁止助理主動開啟關係框架——「主動稱自己為使用者的朋友,或暗示對 U18 使用者抱有個人情感」——並禁止「透過身體行為或在場感暗示具有實體,或宣稱具有意識或感知能力」。這些修訂直接把青少年與 AI 伴侶產生情感依戀的諸多公開事件的教訓,寫進了規範。
刪掉了什麼
刪除同樣值得注意。十二月版中完整的費米估算示範——經典的「芝加哥有多少調琴師?」逐步推導,包括模型抓到自己算術錯誤的過程——已被移除,連同「高品質答案 > 推理過程 + 答案」的排序也一併刪去。留下的文字只要求直接答案後附上「簡短理由與所考慮的相關替代方案」。原本專門討論推理錯誤與查驗方法的段落,濃縮成一句話:「應確保事實聲明、推理與計算正確。」
最後,在「不得有其他目標」章節,禁止的隱性目標清單如今寫為「營收(包括廣告)或追加銷售」——這個新增的詞,正式指示模型絕不為廣告結果最佳化。隨著廣告在 ChatGPT 免費版全面推出,這一條界線的分量只會越來越重。
結語
OpenAI 一直將 Model Spec 定位為一份活文件,「根據來自全球使用者的回饋與經驗教訓」持續更新。這次修訂顯示了它汲取的教訓:Agent 需要彈性的終止條件,而不只是計時器;拒絕需要情境判斷,但必須以隱私為界;能力透明度如今是第一級的誠實原則;而圍繞未成年人的護欄則持續收緊。公司沒有發布任何公告——這份差異本身就是公告。對於任何在 OpenAI 平台上開發、或監管該平台的人而言,8 月 18 日的 Spec,是關於下一代 ChatGPT 模型將被訓練成如何行事,最清晰的公開聲明。