← All posts / Models

沉默的工作馬:Kimi K2.8 Preview 一夜之間接管 kimi-for-coding

Moonshot 低調完成原地換引擎——K2.8 Preview 全面接管 kimi-for-coding 的所有請求,帶來接近 K3 的效能、百萬 token 上下文,以及更便宜的推理。

沉默的工作馬:Kimi K2.8 Preview 一夜之間接管 kimi-for-coding

當整個產業週末都在爭論 AI 發展是否該踩剎車時,Moonshot AI(月之暗面)做了完全相反的事:它悄悄替 Kimi Code 換掉了引擎。2026 年 9 月 11 日,該公司宣布 K2.8 Preview 已全面上線——而且因為 model ID 沒有改變,成千上萬的開發者一覺醒來就拿到了更強的模型,一行設定都不用動。

實際發生了什麼

Kimi Code 是 Moonshot 的代理式編碼產品,透過穩定的 model ID 對外提供服務。主力 ID kimi-for-coding 先前路由到 K2.7 Code;9 月 11 日全面部署後,所有打到這個 ID 的請求都改由 K2.8 Preview 服務。這種升級刻意做到無感:釘住 kimi-for-coding 的客戶端、第三方工具、CI 管線與 IDE 整合全部照常運作。

「原地升級」正在成為 Moonshot 的招牌動作,就像雲端大廠推送基礎設施改善一樣——你不需要遷移,直接受惠。對編碼工具來說,換模型通常意味著 context cache 失效、工作流程要重新適應;保持 ID 不變不是小禮貌,而是「升級」與「遷移專案」之間的界線。

K2.8 Preview 在產品線中的位置

Kimi Code 的模型矩陣現在是三個模型、四個 model ID:

  • K3(k3)——旗艦:2.8 兆參數的 MoE 模型,100 萬 token 上下文,Moderato 會員起可用,1M 上下文保留給 Allegretto 以上方案。
  • K3-256k(k3-256k)——同一個旗艦但上限 256K 上下文,quota 消耗約為 1M 版的一半。
  • K2.8 Preview(kimi-for-coding)——新的預設模型:「效能接近 K3,但思考更有效率」,定位在程式碼補全與日常開發任務,全體會員可用,且所有會員層級都能用 1M 上下文。
  • K2.7 Code HighSpeed(kimi-for-coding-highspeed)——上一代模型,輸出速度 5–6 倍,適合對延遲敏感的補全場景。

這個定位本身就是故事。K2.8 Preview 是走量的模型——每個訂閱者預設接觸到的那一個——而 K3 仍是高階推理旗艦。Moonshot 明確地把預設路徑優化在「具成本效益的思考」,而不是極限峰值效能。

更有效率的思考,可調的推理強度

技術上最有趣的變化是推理效率。K2.7 Code 已經有明顯進步——Moonshot 當時公布推理 token 用量比 K2.6 減少 30%——K2.8 Preview 進一步做到「顯著更有效率的思考」,同時編碼與代理能力「全面提升」。

K2.8 Preview 也繼承了 K3 的三段式思考控制:reasoning_effort 分為 low / high / max,預設 max。路由規則很務實:如果你完全關閉思考,K3 系列與 K2.8 Preview 的請求都會交給 K2.8 Preview(無思考模式)處理——也就是說,較輕的模型默默吸收了大批量、低深思需求的流量。這是刻意的成本架構:只有明確要求深度推理時才付費,其餘全部交給高效模型。

這種對效率的執著其來有自。代理式編碼燒 token 的方式很殘酷:一次長程編碼 session 可能觸發數百次連續工具呼叫,每一次都要重讀上下文;推理 token 在這個迴圈裡相乘之後就是帳單的大頭。在不傷害模型困難任務判斷力的前提下壓縮這些 token,正是 2026 年編碼代理經濟學的決勝點。

被大家忽略的 1M 上下文細節

公告裡最激進的決定反而最低調:K2.8 Preview 的完整 100 萬 token 上下文,開放給每一個會員層級。對比 K3——1M 上下文需要 Allegretto 以上方案,而且官方還特地做了 256K 版本,就是因為全窗口存取的 quota 消耗約兩倍。

對日常開發工作——長時間重構、多檔案除錯、整個 repo 的理解,也就是 kimi-for-coding 設計的目標場景——最低層級就能用百萬 token 上下文,實質改變了編碼代理能「記住」什麼。中型程式庫整個塞進單一窗口、不需要檢索架構,現在是每個付費使用者的基本配備,而不是高級方案的特權。

多模態,而且專有——一個戰略分岔

K2.8 Preview 支援文字加上影像與影片輸入(K3 的 1M 版吃影像和影片;256K 版僅影像)。預設編碼模型內建多模態,直接解鎖最常見的代理工作流——截圖轉 UI 修復、設計稿轉元件、錯誤照片轉診斷。

但授權值得注意:K2.8 Preview 是專有模型,僅透過 API 提供。這是 Moonshot 戰略上的一個明顯分岔。這家公司靠開放權重打出全球名聲——K2.7 Code 釋出時直接開源,K3 旗艦的權重也在七月公開。K2.8 Preview 打破了這個慣例:高效的工作馬是閉源的,只透過自家平台提供,靠它正在變得更有吸引力的會員方案來變現。

把它和 Moonshot 近期的商業動作放在一起看——一般與編碼會員拆分、傳聞中圍繞 K3 代管的超大型雲端分潤談判、香港 IPO 申請、以及 K3 需求推動 ARR 破 10 億美元的估計——整個圖像就很清楚了:開放權重是旗艦的行銷通路與前沿宣言;專有的中階模型才是訂閱收入複利成長的地方。傑作免費送,日常用車拿來賣。

意義何在

對開發者來說,計算很簡單:如果你本來就在用 Kimi Code,你的預設模型一夜之間變強了,長上下文變便宜了,而且是免費的。如果你還沒用,「夠好」的預設模型與付費旗艦之間的差距又縮小了一次——一個 Preview 級模型現在就標榜著接近旗艦的編碼效能與更有效率的推理。

對產業來說,K2.8 Preview 是今年主旋律的又一個數據點:旗艦模型搶頭條,但決定輸贡的是量產那一層。Moonshot 的賭注是——決定誰能長成基礎設施級營收的,不是頂端的極限跑分,而是預設層的高效思考。發布備註裡那個從未改變的 model ID,也許才是整份公告裡最有戰略意義的一行。