← All posts / Industry

Meta 砍掉 Token 用量績效指標,卻在同時把 Hatch 自主代理塞進員工手裡

在一場由請假員工提起的訴訟之後,Meta 廢除以 AI 採用率衡量績效的做法,同時推出員工還不太敢信任的自主代理工具 Hatch。

Meta 砍掉 Token 用量績效指標,卻在同時把 Hatch 自主代理塞進員工手裡

過去大約一年,有一個數字悄悄決定著 Meta 數千名工程師的考評:他們用了多少 AI。內部儀表板追蹤「AI 採用率」,排行榜統計 token 消耗量,員工被貼上「AI Native」「AI First」「AI Enabled」等標籤。而本週,Meta 告訴員工:這個時代結束了——績效評核「將不會使用 AI 採用儀表板或 token 數量來評估影響力」。

這項政策轉向最早由 The Information 報導、Wired 跟進證實,時機卻相當微妙。就在 Meta 退役這些衡量指標的同時,它正把迄今最自主的內部 AI 工具——名為 Hatch 的代理程式——交到員工手上。一隻手收走了量尺,另一隻手遞上了機器。

實際改了什麼

更新後的考評指引移除了所有以 AI 使用量作為個人影響力衡量的表述。原本圍繞「AI 驅動影響力」建立的框架,被換成「成果可以由 AI 或其他方式支持」的措辭。全公司的工程師都被告知:AI 採用儀表板和 token 計數在評估工作中不扮演任何角色。

Meta 發言人 Tracy Clayton 表示,公司評估的是員工的貢獻,而且「AI Native」標籤從未被用於績效評估——這個說法遭到部分在職員工質疑,因為過去一年這些標籤確實出現在內部考評資料中。

這項改變並非憑空而來。早在今年四月,公司就在員工「刷榜」之後移除了內部 token 用量排行榜,之後更因用量暴增而直接限制員工的 AI 使用額度。排行榜短暫的一生清楚示範了核心問題:當你衡量 token,你得到的就只有 token。有員工反映,同事們開始「衝 prompt 量」——為了爬上排行榜,連瑣碎任務都讓 AI 工具持續運轉。

籠罩著這些指標的訴訟

這個時間點很難與訴訟切割。今年七月,26 名 Meta 現任與離職員工在奧克蘭聯邦法院提告,主張五月一波裁員(約 8,000 人)中使用的 AI 系統,不成比例地挑中了曾請醫療假、育嬰假或申請身心障礙合理調整的員工。

其中一名原告主張,她的 AI 採用分數在休假後下降,因為系統把她的請假期間當成表現缺口計入,而不是將其排除在計算之外。換句話說,這個「中立」的指標,把請受法律保護的假變成了一種懲罰。法律界此後普遍把此案視為教科書級案例:代理指標——那些看起來客觀的數字——可以把偏見「洗」進人事決策裡。

Meta 堅稱裁員是由人、而非 AI 做出的決定。但隨著證據開示(discovery)逼近,讓任何 AI 使用分數留在績效考評流程附近,都成了公司無法再負擔的法律風險。收回這些指標成本很低;在法庭上捍衛它們的代價可能高得多。

Hatch 要的是另一種信任

與此同時,Hatch——Meta 已在企業裝置上內部測試數週的代理工具——正被推廣到全公司。與聊天機器人不同,Hatch 能瀏覽網頁並操作其他應用程式:預約行程、整理行事曆、代替使用者在各種服務之間行動。公開發表據傳在計畫中,但尚未宣布。

早期測試者回報了一個考評政策轉向反而更加凸顯的矛盾現象:token 用量反正一直在漲,因為代理工具天生就是消耗大戶。而員工們對於把 Hatch 接上個人信箱、行事曆和其他帳號心存猶豫——不是因為政策禁止,而是因為一個對你數位生活擁有寫入權限的自主代理,可能會犯下後果嚴重的錯誤。

這種遲疑其來有自。Meta 先前曾暫停一個利用工作裝置蒐集 AI 訓練資料的專案,因員工反彈而叫停,那次事件侵蝕了員工對公司 AI 工具的整體信任。如今部分員工只用 Hatch 處理低風險的個人庶務——訂行程、整理一週安排——與任何真正重要的事物保持距離。

內部討論中還流傳著一個更沉默的恐懼:Hatch 帶來的生產力提升,最終可能成為縮編團隊的理由。Meta 希望員工擁抱的工具,在最壞的情況下,正是讓其中一些人變得多餘的同一個工具。移除 token 考評對這種焦慮毫無幫助——甚至可以說,它拿走了員工唯一能拿來證明自己 AI 使用「有被看見」的具體指標。

大局:從採用率指標走向成果導向

Meta 的撤退,是業界第一波「內部 AI 衡量」浪潮落幕最明顯的訊號。2024 到 2025 年,各家科技公司爭相量化 AI 採用——儀表板、訓練配額、使用分數——背後的假設是「被衡量的才會被採用」。兩年過去,結果出爐:被衡量的採用只會產生表演。員工讓模型空轉、排行榜獎勵量而非值,而當這些指標碰上受保護的休假權利時,它們本身就變成法律風險。

如今宣示的理念是純成果導向:工作做完了沒?做得好不好?AI 是手段,不是成績。這對請假員工更公平、也更難造假,但它同時把重擔移回管理者身上——他們必須在沒有代理數字可依賴的情況下判斷產出品質,而這正是大多數組織過去兩年來為了擁抱儀表板而逐漸退化的能力。

對 Meta 而言,這番計算也有競爭考量。Hatch 唯有在員工放心把真正的工作和帳號交給它時才可能成功。強制採用——或者只是「使用量會被打分數」的觀感——只會產生交差了事的行為,無法提供一個代理平台真正需要的深度回饋。由真正有動機的員工自願使用,所產生的訓練訊號,遠比任何排行榜都來得有價值。

後續觀察

三件事能告訴我們這次政策轉向是實質還是表面。第一,「AI Native」標籤和儀表板是真正從內部工具中消失,還是只從考評文字裡消失。第二,奧克蘭訴訟的進展——如果證據開示挖出把採用分數連上裁員排名的文件,這次撤退看起來就會是先見之明而非原則堅持。第三,Hatch 的公開發表:如果它帶著個人帳號整合上線、且員工大規模自願接入,信任就贏了;如果上線後遇到的還是內部測試時的那種遲疑,Meta 將學到一件事——企業 AI 最稀缺的資源不是 token,而是相信。

這個產業教訓適用於 Meta 之外的所有公司。今天还在用 AI 使用量給員工打分的公司,明天就會收穫同樣的訴訟和同樣的表演。衡量成果,讓代理自己掙它的 token。