← All posts / Models

不是代理殼,是地基:Salesforce 的 Koa 把 27 年 CRM 知識燒進自家推理模型

Salesforce 以 NVIDIA 開放權重的 Nemotron 3 Super 120B 為基底,用 GRPO 後訓練出首款自家 CRM 推理模型 Koa,將 CRM 任務錯誤率降至三分之一,且權重完全掌握在自己的信任邊界內。

不是代理殼,是地基:Salesforce 的 Koa 把 27 年 CRM 知識燒進自家推理模型

在今日(9 月 15 日)於舊金山開幕的 Dreamforce 2026 上,Salesforce 與 NVIDIA 共同發表了 Koa——Salesforce 首款自研 CRM 推理模型。這是「終結代理殼(wrapper)時代」最明確的訊號:與其向前沿實驗室租用推理能力,Salesforce 選擇以 NVIDIA 開放權重的 Nemotron 3 Super 120B 基礎模型進行後訓練(post-training),打造出一個真正理解企業運作的專家模型——理解一筆交易的結構、一個服務案的生命週期,以及各行業各異的工作流程。

Marc Benioff 的說法相當直白:「Salesforce 最有價值的資產不是平台本身,而是數十年累積、關於企業實際運作的知識。透過 Koa,這些知識被放進了模型本身。」黃仁勳則從晶片端回應:開放的 Nemotron 模型讓 Salesforce「有地基把數十年的企業專業轉化為專屬 AI」。

Koa 究竟是什麼

Koa 並不是在聊天模型上貼一層微調。由 Salesforce AI Research 25 位作者同步發表於 arXiv(2609.15066)的技術報告指出,這是一個以 GRPO(Group Relative Policy Optimization)強化學習對 Nemotron-3-Super-120B 進行後訓練而成的企業語言模型——與 DeepSeek-R1 之後重塑推理模型訓練的 RL 演算法同屬一族。

報告中有兩個關鍵細節:

  • 完全未使用客戶資料訓練。 訓練語料全部來自合成情境,模擬超過 14 個產業的企業工作流程——製造、金融服務、醫療、旅遊等。對受監管客戶而言,這是信任與授權上的關鍵:他們的紀錄不會滲入模型權重。
  • 核心貢獻是「模擬到獎勵」(simulation-to-reward)管線。 系統將工作流程規格展開為附帶人物設定(persona)的多輪任務,並以成功使用工具完成資料相依請求作為任務達成獎勵。在企業領域,這些規格以 Agent Script——Salesforce 建構 Agentforce 代理的宣告式語言——撰寫;在公開工具使用領域則直接合成工作流結構。同一套模擬與接地獎勵機制同時驅動兩者的 GRPO 訓練。

在強化學習之外,團隊並運用 NVIDIA NeMo RL、NeMo Gym 與 NeMo AutoModel 進行監督微調(SFT)——NVIDIA 的開放後訓練工具鏈在生產級企業管線中發揮實效,而非僅止於展示。

數據:CRM 任務錯誤率降至三分之一

在 Salesforce 自家的 CRM Bench——涵蓋更新商機、派工案件、安排後續追蹤等真實任務的基準測試——Koa 在 CRM 操作上達到或超越一線模型的水準,且錯誤數僅為三分之一。相對於開放權重的基底模型,arXiv 評測顯示 Koa 在公開工具使用、代理推理與企業 CRM 基準上全面進步,其中以多輪工具使用的增益最為顯著。報告對定位也毫不諱言:Koa 超越了一個強力的專有基準模型,但仍低於最強的前沿模型——這是用通用能力上限換取企業可靠性的刻意取捨。

這個定位至關重要。對 CIO 而言,一個每次都能正確派工、工具呼叫確實落在真實資料結構上的模型,比一個能贏得數學奧林的模型更有價值。

權重在誰手裡,才是真正的故事

Salesforce 完全掌握模型權重,後訓練與推論全數在自己的信任邊界內進行。對企業買家而言,這讓「專屬模型」從行銷話術變成了架構事實:推論期間沒有任何客戶資料流出 Salesforce 基礎設施,模型可以像任何內部資產一樣被治理、稽核與版本管理。

同樣的原則也延伸到政府市場。NVIDIA 開放模型與加速運算將導入 Salesforce 的公共部門平台 Missionforce,包括將採購、供應商管理與後勤流程數位化的 Missionforce Operations。後訓練的 Nemotron 模型將部署於私有雲、機密網路乃至完全實體隔離(air-gapped)的環境,以各機關自身的作業資料與術語訓練。Missionforce Operations 現已於美國區域正式供應;後訓練 NVIDIA 模型將於 2026 年 10 月提供給特定客戶。

從試點走向生產

Koa 已在 Salesforce 內部上線——包括一個協助員工在 Slack 中查找資訊、完成日常任務的代理——並開始進入客戶試點,名單包括 1-800Accountant、Baxter Credit Union(BCU)、Engine、Formula 1、UChicago Medicine 與 Xero。目前以 Agentforce 選定試點客戶形式提供,預計 2026 年冬季於美國區域正式上市。

這份試點名單恰恰是專業推理最快產生價值的領域橫斷面:稅務會計(1-800Accountant)、須理解會員長期目標的信用合作社(BCU)、環環相扣的差旅管理(Engine),以及醫院後台協調(UChicago Medicine)。Engine 執行長 Elia Wallen 的需求描述一針見血:「我們要的不是聽起來很有自信的模型,而是能精確推理複雜多步驟問題的模型。」

更大的轉變:開放權重成為企業籌碼

Koa 最具深意的事實在於它的起點。NVIDIA 將 Nemotron 以開放權重形式釋出,為「握有專屬領域資料、但不想預訓練前沿模型」的企業開闢了一條新路:取一個夠強的開放基底,套用規格驅動的強化學習,然後完全擁有成果。Salesforce 是迄今公開走上這條路的最大企業,而且附上了技術報告與具名試點客戶。

這也深化了 NVIDIA 在矽晶片之外的戰略位置。每一個由 Nemotron 衍生的企業模型,都把 NVIDIA 的軟體棧(NeMo,乃至其 GPU)更深地嵌進客戶工作負載——既賣鏟子,也開鏟子保養廠。

對整個 AI 產業而言,Koa 標記了一個分水嶺:「企業 AI」從此不再等同於「掛商業方案的前沿模型」,而是自有、專精、可驗證邊界的模型,住企業的信任邊界之內。可以預期,本週關注 Dreamforce 的每一家大型軟體公司,都會向自家的模型團隊提出同一個令人不安的問題:我們的模型,為什麼不是自己的?