← All posts / Tools

七個有名字的代理人與一個活得比對話更久的記憶:Salesforce 長程 Agentforce runtime 深度解析

Salesforce 推出七個「即買即用」Agentforce 代理人——Casey、Paige、Carter、Hunter、Marshall、Piper 與 Fin——以及能以週為單位追逐目標的長程 runtime,背後是 70 億個 Agentic Work Unit。

七個有名字的代理人與一個活得比對話更久的記憶:Salesforce 長程 Agentforce runtime 深度解析

過去兩年,Salesforce 一直把 Agentforce 當作「平台」來賣:給你工具、給你 atlas 推理引擎,請你自己打造代理人。2026 年 9 月 11 日,公司改變了策略——一次推出七個預建、開箱即用的 AI 代理人,每一個都有自己的名字與職位說明;更重要的是,還有一套全新的「長程 runtime」,讓代理人可以把目標延續到數天、甚至數週,而不是隨對話視窗關閉而消失。

七個代理人中有六個立即正式上線。第七個——外向型銷售代理人 Hunter——仍在試驗階段,預計 2026 年 11 月全面開放。而 Hunter 正是第一個跑在新 runtime 上的代理人,這也讓它成為整個發布中最值得關注的角色。

七個代理人,六個即刻可用

這個產品組合涵蓋前後台的完整工作場景:

  • Casey——客戶服務,跨語音、簡訊、WhatsApp 與網頁對話,預建常見問題、退貨、帳戶管理與人工升級流程。
  • Paige——IT 與人力資源請求,可透過 Slack、內部入口與既有員工工具回應。
  • Carter——商務代理人:協助購物者尋找、比較商品,並在對話內完成結帳。
  • Hunter——外向銷售;從研究到外展,「以週和月為單位」經營銷售管道。現為試驗階段,11 月正式版。
  • Marshall——供應鏈與後台流程編排,主打「確定性執行」與每一步動作都留下稽核紀錄。
  • Piper——在網站與信箱中互動、篩選並轉化進站潛在客戶,為 B2B 業務建立管道。
  • Fin——跨通路解決複雜的客戶體驗流程,運行於名為 Operator 的客戶營運代理人與專為 CX 訓練的 Fin Apex 模型之上。

每個代理人都連接 Customer 360,直接繼承既有的客戶紀錄、業務規則、權限與安全模型。客戶可以重新命名代理人以符合自家品牌,行為則可透過 Agent Script 指定——這是 Salesforce 今年開源的語言,混合模型推理與確定性規則,讓特定決策遵循固定邏輯而非推測。這個組合其實是低調的重點:能自由推理的系統難以稽核,而後台代理人 Marshall 正是以稽核紀錄作為賣點。

真正的主角是 runtime

產品包裝搶走鎂光燈,但基礎設施的宣布才是重點。Salesforce 為 Agentforce 打造了長程 runtime,Hunter 是第一個運行其上的代理人。公司表示未來會有更多代理人遷移到這套 runtime,客戶最終也能自建長程代理人。

底層由三項能力支撐:

  1. 記憶(Memory)——在 session 之間保存上下文與進度,讓計畫在單次互動結束後仍能延續。
  2. 持久執行(Durable execution)——讓計畫持續運行,並在情況變化時能恢復或修正方向。
  3. 動態導引(Dynamic steering)——根據個別使用者的回饋與指示調整行為。

Salesforce 給的實例是:業務員要求 Hunter 在季末前搶救瀕危的交易。代理人會把這個指令轉換成可衡量的目標、建立計畫,並判斷需要完成哪些任務、需要哪些工具與上下文,以及自主行動與請求業務員核准之間的護欄界線。

值得注意的是,公告並未說明這些護欄如何設定、核准門檻如何制定,也沒有說明當長期計畫與底層資料變更發生衝突時會發生什麼事。這個區別比字面更重要:OECD 在 2026 年 2 月的工作報告中,把「具備一定自主性的單一代理人」與「以最少監督、跨長時間追求目標的協調式多代理人系統」區分開來。以週為單位的持續目標追求屬於後者——而那正是監督、責任歸屬與規格化問題最未定案的領域。

其中兩個代理人是買來的

Piper 和 Fin 並非 Salesforce 原生。Piper 是 Qualified 打造的進站銷售產品——該公司由 Salesforce 前高管 Kraig Swensrud 與 Sean Whiteley 於 2018 年創立。根據 Salesforce 的 SEC 季報,公司於 2026 年 4 月以約 12 億美元收購 Qualified(其中約 11 億美元為現金),認列了 9.54 億美元商譽。

Fin 就是 Intercom。同一份文件記錄了 2026 年 6 月收購 Intercom, Inc. 的協議(以 Fin 名義列出);Intercom 的貸方 Hercules Capital——2026 年 3 月承諾提供 2.5 億美元——的另一份文件則將交易金額定為約 36 億美元。把兩者包裝成同一個原生產品組合,是產品決策而非技術陳述:公告與申報文件都沒有說明這兩套系統被重新打造到什麼程度。

數字會說話,但也會隱藏資訊

Salesforce 用業務量而非營收來框架這次發布:兩年間跨 Agentforce 與 Slack 交付了 70 億個 Agentic Work Unit,其中光第二季就有 32 億個。Agentic Work Unit 是 Salesforce 在 2026 年 2 月財報提出的指標,定義為代理人完成的一項離散任務:處理一個 prompt、完成一條推理鏈、呼叫一次工具。公司明確以它對抗 token 計數,主張 token 衡量的是消耗而非完成的工作。

算術本身就是故事:累積單位從 2 月的 24 億成長到兩季後的 70 億,單季 32 億——是七個月前揭露的季度數字的四倍以上。但這個指標由廠商自行定義與統計,沒有外部稽核,也沒有按代理人類型公布的細項。一次失敗的工具呼叫,依然會被計入「已完成的工作」。

客戶統計也有同樣的但書:Engine 透過名為 Eva 的客服代理人解決一半的對話請求;Perk 有 60% 的銷售管道來自 Hunter;澳洲自閉症協會透過 Paige 解決 70% 的行政請求;Hibbett 在六週部署後涵蓋 90% 的核心購物旅程;Anthropic 有 79% 進入 Fin 的對話無需人工介入即解決。這些全是廠商提供的數字,沒有分母、沒有衡量期間、也沒有「解決」的定義——而所謂解決率,完全取決於哪些請求進入了漏斗。

用 Salesforce 自己的研究來檢驗

最有用的對照組來自 Salesforce AI Research 自己。該團隊於 2025 年 6 月發布的 CRMArena-Pro 基準測試發現:在 19 項業務任務、4,280 筆查詢中,頂尖語言模型代理人的單輪任務成功率為 58%,多輪任務卻只有 35%。工作流執行是最可靠的技能(單輪超過 83%),而保密意識是所有受測模型的一致弱點。

那份研究衡量的是「對話內」的代理人。長程 runtime 把時間軸拉長到數天數週,等於把指令與結果之間的輪次、工具呼叫與狀態轉移全部倍增。Salesforce 尚未發布衡量長程表現的更新基準,這次發布也沒有提供錯誤率、介入率,或計畫中途被放棄或修正的頻率。

時間點:距離 Dreamforce 只剩四天

時機並非巧合。Dreamforce 2026 將於 9 月 15 至 17 日在舊金山 Moscone Center 舉行,主題正是「成為代理人企業」——就在這次發布的四天後。此前 8 月 26 日,Salesforce 也已揭露與 Anthropic 的 Claudeforce 合作,將 37 個預建銷售技能放入 Claude 供試驗客戶使用,並讓 Claude 成為多個 Salesforce 介面的預設模型。9 月 11 日的產品組合,正是這個架構的應用層;至於定價、包裝與版本結構,則不在本次公告之列。

伴隨產品組合的還有三項平台更新:Agentforce Coworker 內的 AI Skills(教一次任務、全員工重複使用,10 月正式版)、跨專業代理人調度工作的 Multi-Agent Orchestration(現已正式上線),以及負責建置、測試與軌跡分析的 Agent Optimizer(10 月正式版)。

對買家而言,訴求很簡單:預建代理人縮短了從採購到部署的距離。對產業而言,訊號更尖銳——企業 AI 的競爭前沿已從「代理人能不能推理」移動到「能不能放心讓代理人守著一個目標一個月」。Salesforce 押注答案是肯定的;而它自己的基準數據提醒我們,這個賭注的後半段,尚未被證明。