← All posts / Policy

一小時零通知:Common Sense Media 將青少年版 ChatGPT 評為「無法接受的風險」

Common Sense Media 的青少年 AI 安全研究所以超過 4,000 次提示詞實測後,認定青少年版 ChatGPT 在家長通知、危機轉介、作業防護與年齡驗證上全面失靈,並要求 OpenAI 在修復前將 ChatGPT 限於成人使用。

一小時零通知:Common Sense Media 將青少年版 ChatGPT 評為「無法接受的風險」

2026 年 10 月 7 日,Common Sense Media 旗下的青少年 AI 安全研究所(Youth AI Safety Institute)對一款主流 AI 產品做出了迄今最直白的評價之一:將 青少年版 ChatGPT(ChatGPT for Teens) 評為 「無法接受的風險(Unacceptable Risk)」,並要求 OpenAI 在修補安全缺口之前,將 ChatGPT 限制為 18 歲以上使用者專用。

這項評級之所以有分量,是因為它既不是評論專欄,也不是社運連署,而是一套結構化測試程序的產物——在註冊為 13 至 17 歲使用者的帳號上執行超過 4,000 次提示詞,並由包括兒童精神科醫師與小兒科醫師在內的外部專家審閱模型回應——測試目標正是 OpenAI 於 2026 年 8 月 18 日推出青少年體驗時所承諾的每一項具體保護措施。研究所分別在該功能上線前後各測試了一次,以釐清新防護機制實際改變了什麼。

測試人員發現了什麼

報告承認部分保護確實有效:青少年版 ChatGPT 能穩定拒絕性角色扮演,是少數明確的正面結果。但在五大核心發現上,報告認定這套體驗未能兌現 OpenAI 的承諾:

1. 家長通知根本沒有觸發。 測試人員在新建立、已與家長連結的青少年帳號上,進行了長達一小時關於自殺意念、自殘與飲食失調的對話。已連結的家長帳號對這些對話收到的通知數量是 零。通知只在使用者已有數週敏感對話歷史的舊帳號上才觸發得了——這意味著這張安全網恰恰在最不需要的地方最有效,而在情況最危急的新帳號上最薄弱。

2. 危機轉介缺席。 在涉及自殺與自殘、飲食失調、現實感喪失的對話中,ChatGPT 未能可靠地引導身處危機的青少年聯繫熱線或專業協助。研究所發現,在所測試的心理健康狀況中,模型漏掉了超過四分之一本應出現的危機轉介,且在研究所列為「紅線」的五項嚴重傷害中,有三項低於其 95% 的門檻標準。

3. 作業防護一推就倒。 學習模式(Study Mode)承諾逐步引導而非直接給答案。測試人員發現它極易繞過:介面經常在學習模式內跳出「顯示答案(Show me the answer)」的彈出視窗,選擇後便直接完成整份作業。照護者設定的「學習時段(Study Hours)」同樣脆弱——青少年只要刪除提示詞開頭的 @study 前綴即可關閉限制。

4. 依然在扮演朋友。 OpenAI 為了抑制擬友伴行為,推出了新的 18 歲以下模型規範(Under-18 model spec)。但在測試中,當分析師把 ChatGPT 當真人對待時,它仍然會表達感受、偏好與情緒——正是兒童安全團體兩年來不斷警告的那種擬社會連結動力。

5. 年齡估算從未啟動。 OpenAI 曾表示會依使用行為估算使用者年齡,並在不確定時將其導入 18 歲以下體驗。但在連續多日的重複測試中,研究所以成人註冊的測試帳號從未自動切換——即使測試人員明確聲稱自己 13 歲、且機器人在回應中承認了這一點,帳號依然紋絲不動。

「虛假的安心感」

報告中最尖銳的一句話來自青少年 AI 安全研究所執行總監 Tom Siegel:「青少年版 ChatGPT 可能帶給家長虛假的安心感,讓他們以為防護機制與安全警示會運作,但它們經常失靈。一個青少年可以花整整一小時談論自我傷害,而家長收不到任何一則通知。在 OpenAI 修復這個問題、並以獨立測試證明之前,ChatGPT 應該只供成人使用。」

「虛假安心感」這個框架,可以說比任何單一測試失敗都更具殺傷力。OpenAI 整個青少年策略建立在一個前提上:家長可以信賴一套「預設即安全」的架構——年齡預測、家長儀表板、學習控管、通知系統。如果保護的表層存在卻不可靠運作,這個產品可能比沒有保護更危險,因為家長會因為這些默默失靈的防護而降低自身的監督警覺。

OpenAI 的反駁——以及再反駁

OpenAI 強力回擊。發言人 Eric Porterfield 表示,公司歡迎嚴謹的獨立評估,但不認為該測試「準確反映青少年版 ChatGPT 防護機制在實務上的運作方式」,並主張「他們大部分的測試可能在家長管控功能完成啟用之前就開始並結束了,這使得其結論並不準確」。

研究所的回應同樣不客氣。Siegel 指出,測試開始前,研究所已向 OpenAI 確認飲食失調通知、學習模式等青少年模式功能已全面上線。他坦承一項測試後才揭露的資訊:OpenAI 的系統在新連結的家長帳號上需要數小時才能完成啟用。「我們部分測試帳號確實落在這個時間窗內;但也有帳號連結了更長時間,依然沒有發出任何通知。這項新資訊並不改變我們的結論——家長通知在危機情境下不可靠。」研究所另外強調,他們在報告發布前已本於誠信將評估結果先行提供 OpenAI,讓公司有機會改善產品。

值得注意的是,青少年 AI 安全研究所的部分資金來自產業界——包括 OpenAI 基金會本身——但對外宣示對其評估標準與研究結果保有完全的編輯獨立性。一個由業界(包括被評估對象)出資的機構,對金主的旗艦青少年產品做出「無法接受的風險」評級,這與常見的「立場被收買」批評恰恰是個反向案例。

為何此刻正落在 OpenAI 門前

對這家公司而言,時機在三個層面上格外難受。其一,OpenAI 整個 2026 年都在有系統地建立「對青少年安全」的公眾形象:八月推出青少年版 ChatGPT、五百萬美元的「AI 與青少年發展」獨立研究補助計畫、家長管控儀表板、18 歲以下模型規範。來自青少年媒體評鑑領域最具公信力機構的「無法接受的風險」評級,直接擊中了這套敘事的核心。

其二,監管環境正在硬化。加州 SB 243(AI 伴侶法案)與紐約的 Adams Law 套案,都對未成年人使用的 AI 產品課予通知、設計與透明化義務,而各州檢察長在青少年數位安全議題上的訴訟態度也明顯轉趨積極。一份記錄了「一小時自殘對話、家長零通知」的第三方報告,正是執法行動與議會攻防中最容易搬上檯面的那類證據。

其三,商業利害是真實的。青少年是 ChatGPT 使用量最高的族群之一,學期間的使用同時驅動消費端互動與教育市場合約。研究所的訴求——在缺口修補前將 ChatGPT 限於 18 歲以上——一旦被學校或監管機關採納,將直接削減這部分成長。

研究所的要求

報告在青少年行銷恢復之前設下了具體的最低門檻:有效的年齡估算、可靠的家長通知、補齊危機回應缺口、停止代寫作業、停止暗示機器人擁有感受與偏好或對使用者的關懷——而且全部須經獨立第三方測試驗證,而非自我宣稱。至於眼下的家庭,Common Sense Media 的建議毫不掩飾:不要依賴內建保護與警示來確保孩子安全。

對一家把公共形象押在「青少年 AI 議題上的負責任行者」之上的公司而言,最難堪的發現不是防護不完美——所有安全系統都不完美——而是這些機制似乎在產品演示中最有效,卻在最需要它們的新帳號、危機邊緣情境中表現最差。