Ox Alpha:一個匿名前沿模型,讓整個 AI 圈瞬間沸騰
一個名為 Ox Alpha 的「隱身」模型悄悄現身 OpenRouter:百萬 token 上下文、前沿級基準成績、將近一週的免費暢用。沒有人知道它是誰做的。
一個沒有名字、沒有實驗室、沒有發布會的 AI 模型,此刻正占據整個產業的話題中心。2026 年 8 月 20 日,一個代號僅為 stealth/ox-alpha 的模型出現在 OpenRouter 上——短短幾天內,開發者、基準測試獵人和矽谷觀察家全都在拼命追問:它到底是誰做的?
沒有官方宣告,沒有論文,沒有來自知名前沿實驗室的基準部落格文章。只有一個 API 端點、為期一週的免費使用窗口,以及一份直接挑戰 OpenAI、Anthropic 與 Google 最昂貴模型的性能數據。
Ox Alpha 到底是什麼
剝開神祕外衣,它的規格表其實非常具體。根據 OpenRouter 上的 listing,Ox Alpha 是一個專為三件事設計的推理模型:高效率編碼、持續性 agent 工作,以及真實世界的生產環境負載。核心數字如下:
- 1,048,576 token 上下文窗口——完整的 1M token 上下文,與史上部署過的最大上下文模型同級
- 131,072 token 最大輸出——足以在單次生成中產出整個程式碼庫或長篇報告
- 原生多模態——接受文字、圖片、影片、音訊與 PDF 文件作為輸入
- 約一週的免費使用期——預覽期間幾乎不限用量
多模態支援正是這個模型真正不尋常之處。多數「隱身」或預覽模型上線時只有純文字 API;Ox Alpha 卻在第一天就支援五種輸入模態,這種等級的基礎設施投資,全世界只有少數幾個組織有能力大規模支撐。
在編碼基準測試上,社群的早期實測結果相當驚人。獨立測試回報它在 DeepSWE 上拿到約 80% 的分數——這是一項衡量多步驟除錯與 issue 解決能力的持續性軟體工程基準,據報在同一測試組合上領先 GPT-5.6 與 Claude 目前的旗艦模型。而在「持續性 agent 工作」(也就是模型必須橫跨數十次工具呼叫維持連貫性的長時間任務)這個項目上,Ox Alpha 看起來不只是能打,而是真正突出。
OpenRouter 的「隱身」機制
這個模型是透過 OpenRouter 的 stealth 計畫發布的,而這個計畫的存在正是為了這類測試。用 OpenRouter 自己的話說:「Ox Alpha 是一個隱身模型。它由一個選擇在預覽期間保持匿名的第三方提供商開發與營運。」
這不是什麼隨機的匿名上傳。Stealth 計畫讓既有實驗室能夠在不掛名的情況下,透過 OpenRouter 的路由基礎設施部署模型——藉此蒐集真實使用數據、壓力測試服務容量,並在正式公開發布前觀察開發者實際上如何使用這個模型。The Next Web 特別指出,提供商在預覽期間會保留每一筆對話與查詢——換句話說,這個免費週對幕後那位而言,也是一場超大規模的資料蒐集行動。
開發者們自然沒有浪費時間。由於 Ox Alpha 走的是標準 OpenRouter API,它可以直接接入既有工具鏈——已經有人把它塞進 Claude Code、接上各種 agent 框架、並拿真實的生產程式碼庫去轟它。回報描述它能讀取專案 context 檔案、呼叫工具,並撐過數小時的編碼 session 而不出現長時間 agent 執行常見的退化現象。
是誰做的?指紋鑑識大戰
「身分之謎」讓這個故事變成了一場真正的產業推理劇。主要理論按社群熱度排列如下:
一、智譜的 GLM-5.3。 最詳盡的指紋分析(由 OrcaRouter 發布)指向智譜 AI 下一代的 GLM 模型——「大概率是 Flash 版」。理由包括:回應風格指紋、tokenizer 特徵,以及智譜想在正式發布前用匿名方式讓新模型與西方前沿實驗室正面對決的合理性。
二、另一家中國實驗室。 Business Insider 與 TechStrong 都報導,業界觀察家普遍懷疑是某家中國實驗室,但沒有指名。中國的前沿實驗室有著匿名部署與突襲式發布的紀錄;尤其是「免費一週」這個模式,與幾家中國提供商過去搶攻開發者心智的手法高度吻合。
三、科大訊飛的 Hy4。 Reddit r/opencode 上有一篇討論串主張答案是科大訊飛的 Hy4 模型,理由是它是「唯一能以這種規模提供服務、又夠新且夠熱門」的候選者。
四、某個我們還沒想到的對象。 一則廣為流傳的 Hacker News 留言聲稱「我已經確認 Ox Alpha 是什麼模型了,但我不能說」——這自然沒有平息猜測,反而火上加油。
不過,「指紋鑑識」這件事本身,或許比答案更有意思。AI 社群已經發展出一整套非正式的模型鑑識學——比對 tokenizer 行為、錯誤訊息措辭、推理軌跡結構與回應節奏——因為匿名前沿發布如今已是反覆出現的模式,而不是一次性的奇聞。
這種發布模式為什麼重要
撇開身分猜謎的樂趣,Ox Alpha 的出現其實說明了前沿模型市場正在如何改變。
匿名發布正在成為策略,而非意外。 不掛名發布,讓實驗室能在品牌不構成先入為主判斷的情況下,測量市場對純能力的觀感。如果一個模型以「Ox Alpha」之名贏得基準測試,這場勝利毫無歧義;既沒有大牌的光環加成,也沒有冷門品牌的懲罰。對舊金山—倫敦軸心之外的實驗室來說,這是迫使市場只看作品本身的手段。
免費一週是前沿規模的獲客手段。 七天內近乎無限地免費使用一個前沿級模型,是這個產業近年最激進的配銷操作。提供商付出的是真金白銀——1M 上下文的推理可不便宜——但換到的是廣告買不到的東西:開發者在窗口期間對模型建立真實依賴,以及「免費期結束後怎麼辦」的大量討論。
Agent 續航力是新的戰場。 Ox Alpha 把定位放在「持續性 agent 工作」而非單發基準分數,反映了 2026 年開發者真正的痛點。一個能在整個工作 session 中橫跨工具呼叫、檔案編輯與情境切換維持連貫的模型,價值遠超一個在靜態測試集拿高分的模型——而市場現在已經明確地在為這項差異定價。
OpenRouter 已成為產業的發射台。 Stealth 計畫讓 OpenRouter 變成一個中立的中繼場:任何實驗室——西方的、中國的或其他的——都能在幾小時內把模型推到全世界最挑剔的使用者面前。這是前沿能力揭露方式的一個結構性轉變。
當免費週結束之後
免費使用窗口正在倒數。窗口關閉時,提供商得做選擇:用真實名字揭露這個模型,把累積的好感轉換成付費客戶;或者把它撤回隱身狀態,只留下蒐集到的數據。兩種結局都有資訊量——揭露會證實指紋派的理論並重排前沿排行榜;無聲撤退則告訴我們,這場發布純粹是一次測量演練。
對開發者來說,實際建議很簡單:窗口現在是開的,一個前沿級、1M 上下文、多模態且近乎免費的推理模型,是成本極低的實驗對象。把它指向你最難的 agent 工作負載,看看「持續性工作」的宣稱能不能在你的程式碼庫裡活下來——趁著還沒有人拔插頭、或者還沒有人標上價格之前。
過去兩年,AI 產業不斷學到一件事:下一個前沿模型可能來自任何地方。Ox Alpha 的貢獻則是證明了它還可以來自「沒有地方」——沒有名字、沒有面孔、沒有新聞稿——卻依然在七十二小時內站上話題頂端。
Sources
- [1] https://openrouter.ai/stealth/ox-alpha
- [2] https://www.straitstimes.com/world/mystery-ai-model-ox-alpha-draws-developers-with-free-access
- [3] https://www.businessinsider.com/ox-alpha-ai-model-mystery-2026-8
- [4] https://thenextweb.com/news/ox-alpha-stealth-model-openrouter-anonymous-provider
- [5] https://www.orcarouter.ai/blog/ox-alpha-stealth-model-what-we-know
- [6] https://techstrong.ai/articles/mystery-ai-ox-alpha-surfaces-on-openrouter-fueling-speculation-over-frontier-chinese-tech/
- [7] https://kingy.ai/blog/ox-alpha-free-opencode-stealth-model/
- [8] https://news.ycombinator.com/item?id=49381896