← All posts / Industry

Codex 突破 2 千萬用戶,配額卻離奇流失

OpenAI 以免費用量重置慶祝 Codex 跨越 2 千萬活躍用戶——就在幾小時前,工程負責人才把配額流失潮歸咎於「sub2api」,開發者群起反駁。

Codex 突破 2 千萬用戶,配額卻離奇流失

2026 年 8 月 21 日,OpenAI 的 Codex 工程負責人 Thibault「Tibo」Sottiaux 宣布 Codex 與 ChatGPT Work 的活躍用戶突破 2 千萬。為了慶祝這個里程碑,OpenAI 給每位訂閱者發放了一個可自行選擇時機兌換的「預存用量重置」(banked usage reset)。這本該是一場單純的慶功——但它恰恰落在 Codex 歷史上最頑固的痛點上:X、OpenAI 社群論壇與 Discord 上的開發者正回報用量配額以離奇到近乎不可能的速度流失,而且對官方說明極度不買帳。

成長數字確實驚人

無論如何評價這場風波,Codex 的採用曲線都相當驚人。2026 年初,產品約有 60 萬週活躍用戶;6 月初達 500 萬、7 月 14 日 800 萬、7 月 21 日 1,000 萬、8 月 13 日 1,500 萬,最後在 8 月 21 日跨過 2,000 萬——八個月內成長約 33 倍,主要動能來自 GPT-5.6 的推出,以及 OpenAI 把 Codex 直接整併進 ChatGPT 成為統一工作區的決策。透過一連串 X 上的里程碑公告,Sottiaux 已成為 Codex 對外的主要面孔,並預告還有更多消息。

但成長速度也正是理解這場爭議的背景。OpenAI 一直積極補貼用量以搶佔開發者:推出 5 倍 Codex 用量的 $100 Pro 方案,明擺著要 undercut Anthropic 的 Claude;幾乎每個成長節點都發放重置——Sam Altman 最初承諾每新增 100 萬用戶就重置配額(上限 1,000 萬),後來遠遠超出原訂上限。當用量八個月成長 33 倍、而底層算力擴充較慢時,總有東西要讓位。800 萬用戶里程碑後的上下文窗口縮減是早期訊號,這一波配額投訴可能是下一個。

開發者實際看到的狀況

這些回報具體、有紀錄,部分甚至精確到 token:

  • 一位月付 $200 的 Pro 20x 用戶回報,整週配額不到兩天就燒完。
  • 一位論壇用戶在觸頂後加購了 2,500 額外點數,結果兩小時內全部消失——而分析頁面顯示零筆用量事件。
  • 一位資深訂閱者說,實際有效的週配額只剩一個月前的約十分之一:過去消耗 20–30 億 token 都沒問題,現在約 3,800 萬 token 就觸頂。

目前取證最詳盡的是 8 月 22 日提交的 GitHub issue #40067。一位 Windows 上的 ChatGPT Plus 用戶回報:8 月 21 日早上週配額還顯示約 99%,幾小時內歸零,之後所有請求都回傳 HTTP 429 usage_limit_reached。該用戶透過 ChatGPT OAuth(非 API key)執行本地 agent,做的是例行工作:排程簡報、檔案讀取、整合測試。其本地日誌可對帳的量是 107 次成功模型呼叫、約 939 萬 gross input tokens(約 88.9% 命中快取);但 Codex 自家伺服器端的分析,卻在同一天記錄了 8,170 萬 tokens——將近本地可驗證量的九倍。而在歷史上可比較的一天(8 月 12 日),約 9,670 萬 tokens 也只消耗約 60% 配額。

issue 作者提出的疑問,正是許多用戶想問的:用量是否被重複計算、跨 OAuth 介面錯誤歸因、被看不見的背景任務灌水,還是 GPT-5.6 的週配額權重改了卻沒有文件說明?值得注意的還有:自 GPT-5.6 用量制度改革後,帳戶上原本的 5 小時量錶已不再顯示——社群流傳的一種理論是,週配額被誤套用到舊 5 小時窗口的速率上。此說未經證實,但正因為大量用戶同時觀察到同樣的斷崖式消耗而迅速傳開。

OpenAI 的解釋:「sub2api」

在 2 千萬里程碑貼文的幾小時前,Sottiaux 另發了一則推文串談限流行為。他表示 OpenAI 不會在不與社群溝通的情況下更改限額;承認該週部分用戶的快取命中率確實比先前的穩態差(並承諾隔日更新);並說團隊在許多受影響帳號中找到一個共同模式——使用 「sub2api」:一種把 ChatGPT 訂閱轉換成 API 形式流量、再分享或轉售給多人的做法。他直批這不受支援,且會觸發 OpenAI 的詐欺防制系統;同時澄清使用官方客戶端、或支援 Sign in With ChatGPT 的開源工具(如 Pi、OpenCode)「完全沒問題」。

反應相當尖銳。有用戶認為這番說明形同對所有人的詐欺指控——有人直呼「難以接受」。更多人則表明從未碰過 sub2api、只透過官方客戶端使用 Codex,卻仍遭遇激烈流失。daily.dev 對此事件的整理點出社群核心不滿:OpenAI 一邊準備付費用量的重置,一邊限額「離奇」加速流失,而 sub2api 的說法根本無法涵蓋這些有憑有據的案例。

是模式,不是單一事件

這已是 2026 年至少第三次 Codex 用量投訴迫使 OpenAI 回應。三月,官方狀態頁承認一個 bug 導致用量消耗快於預期。六月下旬,公司證實濫用與詐欺防制系統錯誤地對合法帳號限流,緊急處理並全面重置;數百名開發者回報異常消耗,部分 $200 方案帳號連同加購點數在數小時內耗盡(Business Insider 當時亦有報導)。再往前,五月時團隊也曾將一次損害快取命中率的已回滾優化定位為根因,並為所有帳號重置限額。

正因這段歷史,預存重置再怎麼受歡迎,也難以平息質疑。Sottiaux 自己的 2 千萬貼文就承認了矛盾:團隊「在整體用量系統中未偵測到異常」,但調查仍在進行。

為什麼這件事的重要性超出 Codex 本身

這起事件是 Agent AI 產品經濟學的個案研究。程式編寫 agent 是第一個重度用戶單次工作階段就消耗數百萬 token 的 AI 品類:快取成了第一線的成本槓桿,配額核算實質上就是一套計費系統,必須透明、可稽核。當量錶和收據對不上——本地記錄 939 萬 tokens 對上伺服器端 8,170 萬——信任會迅速瓦解,因為開發者恰恰是最有能力驗算的那群人。

它也揭示了每一家急著補貼 agent 滲透率的實驗室共同面對的結構性風險:八個月成長 33 倍的用量,終將撞上無法同步擴張的基礎設施。重置與里程碑點數能粉飾個別事件,但「固定月費訂閱」對上「近乎無上限的 agent 工作負載」的根本矛盾不會消失。Anthropic、Google 與 xAI 在把訂閱制 agent 推進日常工程工作流的同時,都面臨同一套算術。

目前記分板上寫著:2 千萬用戶、每位訂閱者一個預存重置、一個有著九倍 token 差異的未結 GitHub issue,以及一群已經聽過太多次「修好了」的社群。下一個值得關注的具體訊號,是承諾中的快取命中率更新,以及 OpenAI 是否願意公布可稽核的分介面用量明細——唯有那個改變,能讓開發者「驗證」而非「相信」自己的配額帳算得攏。