評分者和自訂評分者 (Beta 版)
分數 (Beta 版) 是 Agentforce Studio 中的評估元件,可分析工作人員工作階段,並針對 Agentforce Optimization 和 Analytics 產生分數、維度和度量。將 Salesforce 標準評分與 KPI 的自訂評估配對、使用「下一代測試」建立自訂評分、將評分套用至工作階段,並使用「最佳化」和 Analytics 中的輸出來排定工作人員改善的優先順序。
必要版本
| 提供版本:具有 Einstein for Sales、Einstein for Platform、Einstein for Service、Einstein 1 Service 或 Einstein GPT Service 附加元件的 Enterprise、Performance 及 Unlimited Edition。若要購買附加元件,請連絡您的 Salesforce 帳戶主管。 |
評分器是 Beta 版服務,受「 協議中的 Beta 版服務條款 - Salesforce.com 」約束,如果由客戶執行,則為書面「統一試用協議」,以及「 產品條款目錄」中的適用條款。使用此 Beta 版服務由客戶自行決定。
評分在最佳化和分析中的顯示位置
- Next Gen Testing — 建立自訂評分器作為新或現有測試套件的一部分、精簡並發佈。
- 評分中心 (Agentforce Studio) — 檢視、啟用和管理評分者的中心位置。
- 工作階段和意圖表格 — 工作階段顯示評分器結果;依自訂評分器維度篩選與分析。
- 工作階段頁面 — 工作階段會顯示相關聯的評分標籤和評分。
- Analytics 顯示面板 — 自訂評分器度量會顯示為報告的度量。
考量事項與限制
- 適用於具有 Salesforce Foundations 或 Agentforce 1 版本的 Lightning Experience Enterprise、Performance 和 Unlimited Edition,其中已啟用「工作人員最佳化」和 Analytics。
- 「自訂評分器」為 Beta 版,不需要 Agentforce 以外的額外授權。
- 在 Beta 版期間,僅支援工作階段層級評分器。
- Agentforce 員工工作人員 (AEA) 工作人員類型不支援自訂評分器。
- SDR 工作人員類型會顯示在「計分中心」,但不會顯示在「最佳化 UI」工作人員下拉式清單中。
- 佈建 STDM 時,會建立標準評分 (A&D、品質評分)。如果遺失,請檢查佈建問題。
- 您必須先複製標準評分器再進行編輯;Beta 版期間不支援直接編輯。
- 以運算式為基礎的評分器需要布林值輸出類型。
- 不建議使用 0–1 級數值評分器,因為 LLM 在非常窄的數值範圍中執行不佳。
- 「測試中心」工作階段未由自訂評分者評分。「測試中心」工作階段不會收到結束時間戳記,因此不會觸發自訂評分器評估的資料動作。
概觀
評分器會評估工作人員工作階段,並產生分數、維度 (文字值) 和度量 (數值)。他們是 Agentforce Optimization 和 Observability 的一部分。它們會根據可設定的工作階段百分比自動執行,並在「最佳化」和 Analytics 中呈現結果,因此管理員和開發人員可以持續改善工作人員績效。
有兩種類型的評分器:
- Salesforce 提供立即可用的 標準評分器。
- 您的組織會定義自訂評分,以評估業務特定的條件。
標準評分
標準評分器是使用 STDM 佈建自動建立的預先建立評估。它們會在沒有額外客戶組態的工作人員工作階段上執行。
目前標準評分
- 放棄分數 — 表示客戶是否在工作人員解決其問題之前提早結束工作階段。
- 偏差分數 — 表示工作人員是否成功地將需要人工升級的互動轉移。
- 品質分數 — 根據預先定義的 Salesforce 條件測量整體工作階段品質。
標準評分器在使用者介面中使用保留的位置,且與自訂評分器清單分開。
您無法直接編輯標準分數。複製以使用修改的邏輯建立新的自訂版本。
自訂評分
自訂評分器可讓您定義評估邏輯並將其套用至工作階段。他們使用 LLM as a judge 方法 (提示式評估) 或以運算式為基礎的邏輯,以根據您的條件來標記、評分或分類工作階段。
您在 Agentforce Studio 的「下一代測試」(NGT) 中建立自訂評分器。請參閱在 Agentforce Studio 中設定並執行測試 (Beta 版)。如需詳細資訊,請參閱 Slack 上的 下一代測試。
自訂評分會對照工作階段執行,並在「可觀察」中呈現自訂評分與維度。
自訂評分如何運作
自訂評分器受到提示範本的支援,其會在工作階段結束時自動作為批次工作執行。在評分器在工作階段上執行後,工作階段會與該評分器相關聯,標籤和評分會顯示在「最佳化」和 Analytics 中。
- 評分器是對可設定的工作階段百分比 (範例率) 執行的提示範本。
- 評分會在工作階段結束時套用,而不會在即時對話期間套用。工作階段必須收到結束時間戳記,才能觸發評分資料動作。
- 結果會在「可觀察性」中顯示為自訂度量。
- 您也可以使用
executeAgentforceScoresJob可叫用動作手動觸發評分。 - 評分不會影響工作人員在即時對話期間的延遲或績效,因為評分會在工作階段結束後執行。
評分器組態
關鍵字欄位
| 欄位 | 描述 |
|---|---|
scorerApiName |
分數的唯一 API 名稱。 |
status |
評分者的生命週期狀態 (例如,「草稿」或「可用」)。 |
isDraft |
布林值。表示此分數定義是否為草稿。 |
versionNumber |
評分器定義的整數版本。 |
engine |
評估引擎:LLM 型或運算式型。 |
inputScope |
細微性:工作階段層級 (Beta 版和一般可用性的預設值) 或互動層級 (已計畫)。 |
dataType |
評分的輸出類型 (例如文字或數字)。 |
scorerValues / valuesSpecification |
提供僅一個。定義評分的輸出標籤或數值範圍。 |
promptTemplateRef |
參照至 LLM 型評估的提示範本。範本必須為啟用中。 |
agentApiName |
選擇性。將評分器與特定工作人員建立關聯。僅允許一個工作人員 API 名稱。 |
samplingRate |
評分器執行的工作階段百分比。 |
驗證規則
scorerApiName必須不存在。promptTemplateRef必須存在且已啟用。- 針對「文字」資料類型:評分器值必須存在;只有一個值必須有
isFallback: true;只有一個值必須有isSystemFallback: true(只有當isFallback也是 true 時)。 - 針對數值資料類型:沒有回復值;值必須剖析為有效的雙重值。如果您使用
valuesSpecification:step必須大於 0;min必須小於max;threshold為選擇性,但必須介於min和max之間。 - 評分值數目上限:101.
輸出類型
- 文字 (標籤) — 評分器會將一組預先定義的字串標籤指派給每個工作階段 (例如「已解決」、「已捨棄」或「已升級」)。用於種類分類。
- 數值—評分器會傳回定義範圍中的數字 (例如 0–5)。適用於品質評分與連續評分。LLM 在離散級度 (例如 0–5) 上的效能通常比窄 0–1 範圍更佳。
- 布林值 (延展或 future) — 傳回 true 或 false。以運算式為基礎的評分器支援。
生產環境中的執行分數
從評分器索引標籤啟用
建立並測試自訂評分器後,請從 Agentforce 最佳化中的「評分器中心」啟用該評分器。啟用可讓評分器以設定的範例率在即時工作階段上執行。
| 存取和檢視 Agentforce 最佳化 | 指派「存取 Agentforce 最佳化」和「Data Cloud 使用者」權限集 |
| 使用評分器索引標籤 (Beta 版) | 指派 Agentforce Scorer Beta 版權限集 (不需要 Agentforce 之外的其他授權) |
| 建立評分器 | 指派「Next Gen 測試」(NGT) 存取權限集 |
| 啟用評分器 | 指派 AgentforceScorerActivation 權限集 (預設包含在管理員設定檔中) |
從 Salesforce 流程執行
我們提供新的可叫用動作 TriggerAgentBulkScoring,以在歷程記錄工作階段上非同步地執行自訂評分。此動作接受多個工作階段和評分,可透過以下方式存取:
- Salesforce 流程
- REST API
- Apex
動作名稱: TriggerAgentBulkScoring
| 輸入參數 | 類型 | 描述 |
|---|---|---|
InputIds |
List<String> | 最多 500 個唯一工作階段識別碼的清單。 |
InputScope |
列舉 | 評分範圍:工作階段、時刻或互動。 |
ScoresApiNames |
List<String> | 要執行評分的開發人員名稱上限為 10 個。 |
重要備註
- 所有工作階段識別碼和
scorerApiNames都必須屬於相同的工作人員。 - 請在執行之前確認評分器版本為「可用」。
REST API
將 POST 要求傳送至標準動作 REST 端點。
/services/data/v66.0/actions/standard/triggerAgentBulkScoring
裝載範例:
{
"inputs": [
{
"inputIds": ["019c9442-b760-7d62-837c-8ab80ecc0fc2"],
"inputScope": "Session",
"scorerApiNames": ["language_classifier"]
}
]
}在「流程」中使用 executeAgentforceScoresJob 可叫用動作。動作會接受工作階段識別碼與評分清單,並將工作提交至評估管道。常見用途包括:
- 歷程記錄工作階段上的執行評分器
- 批次分析和自訂報告
- 與 Agentforce 網格的整合
中繼資料 API
使用 Salesforce 中繼資料 API 建立和管理自訂評分,讓您可以在 Pro-code 和 DevOps 工作流程 (包括 CI/CD 銷售管道) 中部署評分。
使用個案
| 使用個案 | 使用者目標 | 評分如何協助 |
|---|---|---|
| 監視工作人員品質 | 瞭解工作人員解決客戶問題的程度 | 標準評分 (品質評分、A&D) 會自動執行,並在沒有設定的 Analytics 中呈現結果 |
| 評估業務特定成果 | 測量自訂 KPI (例如主題分類或合規性) | 自訂評分器會將您的 LLM 提示套用至工作階段,並將結果公開為自訂維度 |
| 重複和改善工作人員 | 在較弱工作階段中尋找模式並限定指示 | 可觀察性會顯示每個工作階段的評分結果,因此您可以逐層細分標記的互動 |
| 生產前測試評分器 | 請在啟用前確認新評分員的行為如預期 | Agentforce Studio 中的 測試中心支援根據測試個案建立、執行和精簡評分。 |
| 大規模執行評分 | 評估歷程記錄工作階段的大批次 | executeAgentforceScoresJob 支援批次處理與自訂報告 |
| 以程式碼管理評分 | 透過 CI/CD 部署評分器 | 中繼資料 API 支援啟用 Pro-Code 建立和管理 |
| 自訂評估條件 | 調整或延長立即可用的評分 | 複製標準評分器以使用修改的提示邏輯建立自訂版本 |

