← All posts / Industry

從被開除的共同創辦人到 DeepMind 副總裁:Barret Zoph 的動盪二十個月,終點竟是回到 Google

一月才因與執行長 Mira Murati 決裂而被 Thinking Machines Lab 開除、回鍋 OpenAI 又不到半年即離職的 Barret Zoph,如今重返 Google DeepMind 擔任研究副總裁,負責強化學習與後訓練。

從被開除的共同創辦人到 DeepMind 副總裁:Barret Zoph 的動盪二十個月,終點竟是回到 Google

今年一月,Barret Zoph 才被他共同創辦、估值 120 億美元的 Thinking Machines Lab 開除,導火線是與執行長 Mira Murati 決裂。到了這個星期四,他拿下了業界最資深的研究職位之一:Google DeepMind 研究副總裁(VP of Research),將負責強化學習(RL)與後訓練(post-training)。

對一位過去二十個月經歷宛如矽谷八點檔的研究者來說,這是一次快得驚人的「平反」。對 Google 而言,這同樣是一個再明確不過的訊號:2026 年一整年都在流失資深 AI 人才的 Google,如今願意用職銜與職權,把一位證明過自己後訓練功力的領導者請回來。

一場樸素官宣的「回家」

Zoph 親自在 X 上宣布了這項消息。「很興奮宣布我要加入 Google DeepMind!」他寫道,「我的 AI 職涯始於 Google Brain Residency 計畫,很期待回鍋。」

「回家」的框架並不誇張。Zoph 在 Google Brain 待了約六年——這個研究團隊已在 2023 年併入 Google DeepMind——之後才在重塑整個領域的第一波人才遷徙潮中離開。路透社報導,他將出任研究副總裁,此前他在 OpenAI 也曾任同級職位。能在兩家前沿實驗室之間完成罕見的「平行移動」,恰恰說明資深 AI 人才市場已經流動到了什麼程度。

在 DeepMind,他的職責範圍是強化學習與後訓練——也就是透過微調、RLHF、工具使用與推理訓練,把预訓練好的原始模型打造成真正有用、對齊、能幹活的代理(agent)。以目前業界共識來說,這是前沿 AI 最兵家必爭的一塊戰場。

AI 職涯史上最狂的二十個月

要理解為何 Google 這步棋讓人側目,得先重播一次時間軸。

2015–2021,Google Brain 時期。 Zoph 透過 Google Brain Residency 計畫入行,一待六年,累積了極具影響力的研究成果。他早期關於神經架構搜尋(Neural Architecture Search)的研究——用機器學習來設計神經網路——早於現代基礎模型時代,至今仍被廣泛引用。他後來成為 Google 後訓練方向的關鍵領導者之一。

2021–2024,OpenAI 時期。 他轉任 OpenAI 研究副總裁(後訓練),團隊負責對齊、工具使用,以及讓 ChatGPT 與 GPT-4 級模型從「流暢」變成「好用」的推理行為訓練。

2024–2026,Thinking Machines Lab 時期。 Zoph 與前 OpenAI 技術長 Mira Murati 共同創辦 Thinking Machines Lab,出任技術長(CTO)。這家新創以 120 億美元估值募資,成為全球最受矚目的新實驗室之一。

2026 年 1 月,被開除。 根據《華爾街日報》報導,Murati 告知員工 Zoph 在「表現與行為」上有問題;報導並指出他與一名同事有未申報的親密關係。Zoph 週一才向 Murati 表示考慮離職,週三就被開除。Murati 隨後任命 PyTorch 共同創造者 Soumith Chintala 接任 CTO。Zoph 與共同創辦人 Luke Metz、Sam Schoenholz 一同回鍋 OpenAI。

2026 年 8 月,再次離開。 重新加入 OpenAI 不到六個月,Zoph 又走了——而這次的落點是 Google。

DeepMind 為何此刻需要他

時機點絕非偶然。Google DeepMind 整個 2026 年在人才戰線上處於罕見的守勢。光是在八月,Fortune 報導的 Zeki Data 分析就顯示:DeepMind 在歐洲、中東與非洲(EMEA)頂級 AI 人才的市占率,從 2022–23 年的 49% 崩落至 2025–26 年的 18.6%;人才流入流出比從 12:1 掉到只剩 2:1。過去一年離開 DeepMind 的研究者中,有 25% 被 Anthropic 吸收。

實驗室今年夏天也換了領導層,由 Koray Kavukcuoglu 接掌執行長,任務是讓 Gemini 在與 OpenAI、Anthropic 的競爭中不被甩開——而這場競賽目前的勝負手,已經不在預訓練規模,而在後訓練功夫:推理、工具使用、代理可靠性。

這正是 Zoph 的本命。他曾在兩家前沿實驗室(OpenAI 與 Thinking Machines 創始團隊)執掌後訓練,是極少數跨多個組織大規模操盤過後訓練的人。對一個急著縮小產品品質差距的 DeepMind 來說,這份履歷的分量,壓過了難堪離職的包袱——Google 押的是:那些戲劇性事件屬於新創特有的問題,而非工程能力的問題。

這件事對人才市場的啟示

這樁人事案是 AI 人才市場最鮮活的最新註腳:擁有前沿後訓練經驗的資深研究者,如今身價如同職業運動的明星球員,而忠誠度是一年一談的。

有三個動態值得注意:

人才戰爭已經雙向化。 過去幾年流向是單行的——Google 培養人才,OpenAI 與新創收割(Noam Shazeer 六月從 DeepMind 跳槽 OpenAI 就是代表作)。Zoph 這一步證明 Google 現在能把流失的資深領導者贏回來,而且一到位就給副總裁級職權。

行為風險會被定價,但不再是死刑。 一位因未申報行為問題被開除的共同創辦人,換作以往早已「放射性污染」。六個月後,他手握 DeepMind 研究副總裁的職銜。後訓練領導人才的稀缺性,實質上為 C 級以下的所有人創造了一個「原諒市場」。

後訓練是新時代的預訓練。 當算力與資料在各實驗室之間趨於均等,決勝點就落在預訓練之後:RL 環境、代理訓練、對齊管線。各實驗室的人力佈局正隨之調整,而 Zoph 在 DeepMind 拿到「強化學習+後訓練」的授權,是 Google 對「Gemini 差距在哪」最直白的招認。

接下來看什麼

對 Zoph 而言,DeepMind 這份工作是寫下第二幕的機會——在職涯起點的大樓裡,背靠 Alphabet 的資源,任務清晰:把 Gemini 的後訓練體系做到世界頂級。

對 Thinking Machines Lab 來說,這段往事已徹底翻頁;公司在技術長 Soumith Chintala 帶領下持續推進產品。對 OpenAI 來說,回鍋的領導者六個月內再度離開,雖然只是小裂痕,卻讓「回娘家的人都會留下」的敘事出現了縫隙。

而對整個業界,訊息再直白不過:在 2026 年的 AI 經濟裡,頂級研究者不只是換工作——他們會「換回去」。從 Google Brain 到 OpenAI、到新創、再回家的循環,如今連戲劇性事件在內,不到兩年就能繞完一圈。Zoph 的救贖之路會不會以 Gemini 追上 ChatGPT 與 Claude 作結,已經成了未來一年最值得低頭注視的問題之一。