← All posts / Models

Google 推出 Gemini 3.7 Flash:程式開發與智慧代理的強力引擎,價格砍半

Google 的 Gemini 3.7 Flash 在前代 3.6 Flash 發布僅三週後問世,在軟體工程與智慧代理工作流程上取得大幅進展,並以 50% 的促惠價格 0.75 美元/百萬輸入 token 上線。

Google 推出 Gemini 3.7 Flash:程式開發與智慧代理的強力引擎,價格砍半

2026 年 8 月 13 日,Google 正式發布 Gemini 3.7 Flash,這是 Gemini 3 模型家族的最新成員,官方形容其為「迄今為止最強大的程式開發與智慧代理工作模型」。此次發布距離上一代 Gemini 3.6 Flash 僅僅相隔三週,展現出極為激進的迭代節奏——過去需要數個季度完成的開發週期,如今被壓縮到了短短數週之內。

這次發布之所以立即引發廣泛關注,原因很簡單也極具吸引力:Google 將 API 價格直接砍半。Gemini 3.7 Flash 以促惠價 每百萬輸入 token 0.75 美元、每百萬輸出 token 3.75 美元 上線——相比前代 Flash 模型的 1.50/7.50 美元定價,降幅高達 50%。此優惠價格將持續至 2026 年 12 月 31 日,之後將恢復為每百萬 token 1.50/7.50 美元的標準定價。

核心升級:推理、程式開發與智慧代理

Gemini 3.7 Flash 的核心改進在於對模型推理基礎的演算法升級。Google 特別強調了三個取得「顯著」進展的領域:軟體工程、知識型工作以及網頁開發工作流程。

最受矚目的基準測試成績來自 DeepSWE v1.1——這是一項長程軟體工程評估,旨在測試模型完成複雜、多步驟程式開發任務的能力。在這項測試中,Gemini 3.7 Flash 達到了 65.3%,而前代 Gemini 3.6 Flash 僅為 49.0%——超過 16 個百分點的躍升,使其逼近 GPT-5.6 Terra 等頂級模型的水準。對於正在打造 AI 程式開發工具和自主智慧代理的開發者而言,這項指標意義重大:DeepSWE v1.1 衡量的不只是模型能否生成正確的程式碼片段,更是能否在整個程式庫中導航、理解跨檔案依賴關係,並產出可運作的修補程式。

Google 同時強調了在除錯與問題修復方面的改善。根據官方部落格文章,3.7 Flash「能更好地應對障礙、在指令模糊時主動釐清意圖,並產出更穩健、更易維護的程式碼」。這些特質恰恰是區分「適合做展示用的玩具模型」與「能成為真正開發夥伴的模型」的關鍵所在。

靈活的思考層級控制

Gemini 3.7 Flash 在架構設計上最有趣的新功能之一,是其可調節的思考深度。開發者現在可以根據延遲和成本需求,上下調整模型的推理深度:

  • 低度思考:降低首 token 延遲與成本,適合不需要深度推理的簡單查詢。
  • 中度思考:平衡的預設模式,適用於一般任務。
  • 高度思考:最大化推理品質,適用於複雜的多步驟問題。

這種精細度對於生產環境部署至關重要。處理常規客服查詢的聊天機器人,不需要與重構大型程式庫的智慧代理消耗同等的認知資源。能夠按請求調整這一參數——而非在不同模型層級之間切換——讓開發者對成本與品質的權衡擁有了精準的控制力。

大規模多模態處理

Gemini 3.7 Flash 延續了 Gemini 家族標誌性的多模態能力。模型支援 100 萬 token 的上下文視窗,可在單一提示中處理多達 3,000 張圖片,並接受每個檔案最大 7 MB 的內嵌資料。這使其非常適合需要結合長篇文字、程式碼與視覺輸入的任務——例如分析一批 UI 設計稿與其對應的前端程式碼,或處理內含圖表的冗長技術文件。

多模態處理能力也延伸到了 Google 大力推廣的智慧代理應用場景。Gemini Enterprise Agent Platform 的技術文件將 3.7 Flash 定位為專為「多步驟編排、全端程式碼重構與通用推理」優化的模型——這三大支柱正是 Google 眼中下一代 AI 開發工具的核心。

早期採用者的真實回饋

Google 的發布資料中包含了來自合作夥伴的實測回饋,描繪出的是生產環境中真正有意義的改善,而非僅追求基準測試分數的提升:

開發工具公司共同創辦人兼技術長 Gregor Zunic 報告指出:「Gemini 3.7 Flash 智慧代理比 3.6 Flash 便宜 35%,觀察到提示快取命中率提升了 8%,且工具錯誤更少。」這樣的組合——更低成本、更高快取效率、更少失敗模式——正是企業團隊將 AI 智慧代理從試驗專案擴展到全面部署所需要的。

一家法律科技合作夥伴指出,3.7 Flash「在法律工作方面是對先前 Flash 模型的重大改進」,將「全部通過」準確率提升了 2.6 分。這一點尤為重要,因為法律工作要求的是精確而非創意——一個編造出看似合理但實際錯誤的法律引註的模型,比沒有還糟糕。這項改善表明 Google 的演算法升級正在高風險領域轉化為真正的可靠性提升。

更廣闊的背景:一場動真格的價格戰

50% 的降價並非憑空發生。AI API 市場已進入了激烈的商品化階段,各家提供商在每 token 成本上的競爭,與在基準測試分數上的較量一樣激烈。Google 此舉對 OpenAI 和 Anthropic 等競爭對手施加了壓力,迫使它們為旗艦模型的溢價定價提出正當理由。

但 Google 的策略在此更為精妙。它並非單純對現有模型打折,而是以更低的價格推出一款真正改良過的模型——借助其垂直整合的 TPU 基礎設施,吸收了其他提供商可能不得不轉嫁給客戶的成本。2026 年底的促惠定價也是一種獲客工具:讓開發者現在就開始在 Gemini 上構建,即使日後價格恢復正常,轉換成本也會讓他們留下來。

快速的發布節奏——3.5 Flash、3.6 Flash,再到如今的 3.7 Flash,短短數週內三次迭代——也傳遞了關於 Google 迭代能力的訊息。當競爭對手可能每季度發布一次重大模型更新時,Google 正在證明其基礎設施能夠以匹配這一領域驚人發展速度的步調,支援持續的模型改進與部署。

可用性與取得方式

Gemini 3.7 Flash 已透過多個管道立即開放使用:

  • Gemini API,透過 Google AI Studio 與 Gemini API
  • Vertex AI,在 Google Cloud 上
  • Gemini Enterprise Agent Platform
  • 第三方提供商,包括已上架該模型的 OpenRouter

模型可透過 Google AI 開發者文件(ai.google.dev)存取,詳細的定價與技術規格可在 Google Cloud 定價頁面和 DeepMind 模型卡片中查閱。

對開發者意味著什麼

對於正在打造 AI 應用的團隊而言,Gemini 3.7 Flash 代表了真正的價值主張。改善的程式開發能力、靈活的思考層級控制、百萬 token 上下文視窗,再加上半價的促惠方案,共同構成了極具說服力的評估理由——尤其是在涉及智慧代理程式開發、文件分析與複雜多步驟推理的工作場景中。

更深層的問題在於:Google 的步伐是否可持續?短時間內三次 Flash 發布,暗示著要麼擁有非凡的改進管線,要麼是在急於維持市場地位。無論答案為何,開發者都是最直接的受益者。每百萬 token 輸出 20 美元的時代似乎越來越遙遠,而 Gemini 3.7 Flash 正是最新、也最銳利的訊號——表明 AI API 的經濟學正在果斷地向買方傾斜。


本文基於 Google 官方公告、DeepMind 模型文件、VentureBeat 報導、路透社報導及 OpenRouter API 資料撰寫。所有基準測試數據均來自 Google 公布的資料。