← All posts / Models

Gemini 3.7 Flash:Google 編碼主力模型降價 50%

Google 在 3.6 Flash 發布僅三週後就推出 Gemini 3.7 Flash——DeepSWE 編碼評測從 49% 躍升至 65.3%,價格砍半。

Gemini 3.7 Flash:Google 編碼主力模型降價 50%

三週。這是 Google 從發布 Gemini 3.6 Flash 到推出繼任者 Gemini 3.7 Flash(2026 年 8 月 13 日)之間的全部時間。光是這個更新節奏,就說明了前沿模型市場的轉向:以往需要一年的發布週期,現在壓縮到一個月內完成,而競爭焦點不再只是智慧能力本身,而是「每一美元能買到多少智慧」——尤其是目前主導 API 流量的編碼與 Agent 工作負載。

這次發布了什麼

Google 將 Gemini 3.7 Flash 自我定位為「迄今最聰明的編碼與 Agent 工作馬模型」。這個定位很重要:它不是要爭奪絕對能力王座的旗艦(那屬於 Pro 與 Ultra 層級),而是企業與開發者每天消耗數百萬 token 的那一級模型——程式碼生成、除錯、Agent 工具迴圈,以及大量的知識處理工作。

相較於上一代 Flash,主要提升非常具體:

  • DeepSWE v1.1:65.3%,前一版 Flash 約為 49%——在現今最艱難的 Agent 軟體工程評測之一上,提升超過 16 個百分點。
  • FrontierCode:43.6%,前一版為 34.4%。
  • Terminal-Bench 2.1:85.8%,前一版為 78%——對於關注模型自主操作終端機的人來說,這是個驚人的數字。

廠商自行提交的評測數據照慣例需要保持懷疑,但這次比較對象是 Claude Sonnet 5 與 GPT-5.6 Terra,而且第三方評測追蹤網站也已開始獨立記錄這些數據。

價格策略

入門定價是最鋒利的武器:每百萬輸入 token 0.75 美元、每百萬輸出 token 3.75 美元,明確標示為比 Gemini 3.6 Flash 便宜 50%,且價格保證至 2026 年底。2027 年 1 月 1 日起,費率將翻倍為 1.50/7.50 美元。

這個結構是一場附帶期限的客戶爭奪戰。Google 實質上在年底前補貼使用者遷移到 3.7 Flash,賭的是一旦 Agent 管線、評測框架與提示詞堆疊都針對這個模型調校完畢,轉換成本就會把客戶留到價格恢復正常之後。對手也注意到了——社群評測討論串很快指出,3.7 Flash 仍比 DeepSeek 的 Flash 級模型貴上數倍,但明顯低於能力相當的西方競爭對手。

技術規格

技術輪廓對追蹤 Gemini 3 家族的人來說並不陌生:

  • 1M token 上下文視窗(1,048,576 tokens),最大輸出 64k–65k tokens。
  • 可調式思考等級——低、中、高三段——讓開發者能針對每個請求,在延遲、成本與推理深度之間取捨。
  • 原生函式呼叫、多模態理解,以及與 Gemini 3 系列相同的完整工具鏈。

可調式思考等級是暗藏戰略意義的功能。Agent 工作負載很少在每一步都需要最強推理;一個架構良好的管線,可以在規劃時用高思考等級、在機械式工具呼叫時用低思考等級。這種逐請求的粒度,讓架構設計直接轉化為成本節省。

三週更新週期為何重要

Google 在 3.6 Flash 之後三週就推出 3.7 Flash,等於是軍備競賽的加速。Flash 層級是流量所在——它是程式碼助理、客戶端 Agent 與企業自動化裡的預設引擎。誰掌握工作馬層級,誰就掌握 API 帳單。

這一招也壓縮了整個中階定價市場的空間。當一個擁有自有 TPU 基礎設施的超大規模業者,能在一夜之間把具競爭力的模型砍價一半,存活者只會是兩種:要麼是近乎零毛利經濟學的開放權重模型,要麼是能力真正無可取代的前沿模型。

後續觀察

接下來有兩個關鍵時間點。明顯的是 2027 年 1 月 1 日,入門價到期,市場將檢驗 Google 的圈地策略是否轉化為持久市占率。另一個更微妙的時間點,是 OpenAI 與 Anthropic 何時跟進調降中階價格——LinkedIn 簡報已經把這場價格戰稱為 2026 年 8 月的「主戰場」。

對開發者而言,實際建議很簡單:如果你的工作負載以編碼與 Agent 為主,3.7 Flash 在入門價期間是目前西方主要供應商中 CP 值最好的選擇之一。在年底之前,先用你自己的評測跑過一遍再說。

Gemini 3.7 Flash 現已透過 Gemini API、Google AI Studio、Vertex AI 與 OpenRouter 提供。