← All posts / Models

Gemma 下載量突破 10 億次:Google 的開放權重模型已從軌道部署到深海

Google DeepMind 宣布 Gemma 開放模型累積下載量突破 10 億次,社群變體超過 10 萬個,部署範圍從軌道上的衛星到印度的全國健康應用。

Gemma 下載量突破 10 億次:Google 的開放權重模型已從軌道部署到深海

Google 在 2024 年初推出 Gemma,作為前沿 Gemini 模型的輕量級開放權重(open weights)夥伴。兩年半後的今天,這個模型家族跨過了一個 Google 其他模型產品線從未觸及的門檻:累積下載量突破 10 億次。這項由 Google DeepMind 副總裁 Clement Farabet 與產品總監 Olivier Lacombe 於 2026 年 8 月 20 日發布的公告,同時揭露開發者已發布超過 10 萬個不同的 Gemma 變體——為特定語言、任務與硬體目標而調校的微調版本與衍生模型。

這是 Google 自 Gemma 家族問世以來,首次公布累積採用總量,而成長曲線相當陡峭:上一個官方檢查點是 2025 年 5 月的 1.5 億次下載。在約十五個月內達到 10 億次,意味著生態系的下載速度不減反增——即使開放權重領域的競爭在這段期間變得更加激烈。

為什麼變體數量比下載次數更重要

下載量是一個不完美的計分板。模型權重會被下載、鏡像、重新上傳到各個平台,而一次下載也無法說明模型實際被使用的頻率。Google 與這個里程碑一同公布的另一個數字,更能反映生態系的真實樣貌:由外部開發者發布的超過 10 萬個 Gemma 變體。這是「人們試用一次的模型」與「人們在其上建立事業與研究計畫的模型」之間的差別。

Google 以這些變體的部署場景來框架這個里程碑,而其地理與環境分佈之廣,相當罕見。

在軌道上運行的 Gemma

最引人注目的部署完全不在地球上。NASA、衛星新創 Satlyt 與軌道運算公司 Starcloud 的團隊,正讓 Gemma 直接在軌道上運行——進行衛星上的影像分析、判斷哪些影像值得占用珍貴的下行頻寬,以及路由衛星間的通訊。

其中 NASA 的案例紀錄最完整。該機構的噴射推進實驗室(JPL)於 2026 年稍早,在一枚 Loft Orbital 衛星上搭載了 4 位元壓縮版的 Gemma 3 4B,IEEE Spectrum 將其報導為首個在軌道上以視覺語言模型分析衛星自身感測器影像的示範。這套名為 NAVI-Orbital 的系統,在 7,960 張影像的地面基準測試中達到 88% 的分類準確率,並對法國土魯斯與阿根廷海岸進行了即時影像處理——全部在一塊 Nvidia Jetson Orin AGX 模組上完成。該硬體的限制之大,使得這個 40 億參數模型 8 GB 的記憶體佔用,反而成為讓一切可行的關鍵規格。

印度的一億公民

回到地面,Google 引述的最大單一部署在印度。該國的國家健康局(National Health Authority)將 Gemma 4 與 Google 開源的 Medical Data Toolkit 整合進 Aarogya Setu 2.0——一款在 Android 上擁有超過 1 億次下載的應用程式。Gemma 4 將複雜的醫療報告轉換為標準化數位格式,協助民眾管理並安全地跨醫療院所分享自己的健康數據,展示了開放權重模型能在全國規模下處理敏感且關鍵的資訊。

從癌症治療路徑到海豚

在研究領域,耶魯大學與 Google 的研究人員以 Gemma 為基礎,打造了能解讀單細胞「語言」的 C2S-Scale 模型。Google 表示,C2S-Scale 發現了一條新穎的癌症治療路徑,並隨後在活體細胞中獲得驗證——該公司稱這是 AI 系統首次產出經此方式確認的新穎機制性治療路徑。Google 的領域專用模型 MedGemma 也正支援各種臨床應用開發,從全印醫學科學研究院(AIIMS)的門診分流,到烏干達鄉村第一線醫療人員的工具。

而在公告中最與眾不同的計畫之一,是與喬治亞理工學院與 Wild Dolphin Project 合作的 DolphinGemma——它將 Gemma 變體應用於預測海豚發聲的序列,是一項解碼跨物種溝通的長期研究努力。

一個兼作產品發表的里程碑

除了數字之外,Google 也藉此公告在 GitHub 上推出了 Awesome Gemma 儲存庫——一個收錄社群專案、微調模型、教學與開發者工具的策展目錄,定位為其所謂「Gemmaverse」的官方索引。該公司還指出,近期在 Kaggle 舉辦的 Gemma Challenge 吸引了超過 1,600 個以解決真實問題為目標的專案投稿,得獎者將於近期公布。

戰略解讀

這樣的框架方式,決定了我們該如何解讀這個里程碑。Google 並不銷售 Gemma;這個模型家族是它在開放權重開發「預設基礎」競賽中,對 Meta Llama 的回應,而下載量正是兩家實驗室共同公布的計分板。10 億下載的數字無法反映的是,這些下載有多少轉化為持續的使用——Google 並未提供按模型世代或平台的細分數據。

更持久的訊號,存在於 Google 精選展示的部署案例中:同一血統的模型權重,運行在功耗受限的衛星電腦上、全國性健康應用程式內,以及細胞生物學研究管線裡。這樣的跨度——從 40 億參數的邊緣模型到研究級系統——正是 Google 的論述:即使前沿 Gemini 系統維持閉源,開放權重在其模型產品線中仍具戰略核心地位。

隨著 Gemma 4 成為當前世代、集中式社群目錄上線,以及採用率的持續複利成長,開放權重競賽本週傳達的訊息很明確:小型模型的 10 億下載時代不是即將到來——它已經到來。