得分器和自定义得分器 (Beta)
得分器 (Beta) 是 Agentforce Studio 中的评估组件,用于分析客服人员会话,并为 Agentforce 优化和 Analytics 生成分数、维度和评测。将 Salesforce 标准得分与 KPI 的自定义评估配对,使用下一代测试创建自定义得分器,将其应用于会话,并使用优化和 Analytics 中的输出来确定客服人员改进的优先级。
所需的 Edition
| 适用于:Enterprise、Performance 和 Unlimited Edition,带有 Einstein for Sales、Einstein for Platform、Einstein for Service、Einstein 1 Service 或 Einstein GPT Service 加载项。要购买加载项,请联系您的 Salesforce 客户主管。 |
得分器是 Beta 服务,受 Agreements - Salesforce.com 中的 Beta 服务条款或书面统一试点协议(如果由客户执行)以及产品条款目录中的适用条款的约束。使用此 Beta 版服务由客户自行决定。
得分器在优化和 Analytics 中的显示位置
- 下一代测试 — 创建自定义得分器作为新的或现有测试套件的一部分,对其进行完善和发布。
- 得分中心(Agentforce Studio) -- 查看、激活和管理得分器的中心位置。
- 会话和意图表 — 会话显示得分器结果;按自定义得分器维度筛选和分析。
- 会话页面 — 会话显示关联的得分器标签和分数。
- Analytics 仪表板 — 自定义得分器评测显示为报表的度量。
注意事项和限制
- 适用于 Lightning Experience in Enterprise、Performance 和带有 Salesforce Foundations 的 Unlimited Edition,或启用了客服人员优化和 Analytics 的 Agentforce 1 Edition。
- 自定义得分器在 Beta 版本中,除了 Agentforce 之外,不需要额外的许可证。
- 在 Beta 期间,仅支持会话级得分器。
- Agentforce 员工客服人员 (AEA) 客服人员类型不支持自定义得分器。
- SDR 客服人员类型会显示在得分器中心中,但不会显示在优化 UI 客服人员下拉列表中。
- 标准得分器(A&D、质量得分)在配置 STDM 时创建。如果缺少,请检查配置问题。
- 您必须在编辑标准得分器之前复制它;在 Beta 期间不支持直接编辑。
- 基于表达式的得分器需要布尔值输出类型。
- 不推荐 0–1 级的数值得分器,因为 LLM 在非常窄的数值范围上表现不佳。
- 测试中心会话不会由自定义得分器评分。测试中心会话不会收到结束时间戳,因此触发自定义得分器评估的数据操作永远不会触发。
概览
得分器评估客服人员会话,并生成分数、维度(文本值)和评测(数值)。它们是 Agentforce 优化和可观察性的一部分。它们根据可配置百分比的会话自动运行,并在优化和 Analytics 中显示结果,因此管理员和开发人员可以不断提高客服人员的性能。
有两种类型的得分器:
- Salesforce 提供了现成的标准得分器。
- 自定义得分器由贵组织定义,以评估特定于业务的标准。
标准得分器
标准得分器是使用 STDM 配置自动创建的预构建评估。它们在客服人员会话上运行,无需额外的客户配置。
当前标准得分者
- 放弃分数 — 表示客户是否在客服人员解决问题之前提前结束会话。
- 转移分数 — 表示客服人员是否成功转移了需要人为升级的交互。
- 质量得分 — 根据预定义的 Salesforce 标准衡量整体会话质量。
标准得分器使用用户界面中的保留位置,并与自定义得分器列表分开。
您不能直接编辑标准得分器。复制它以使用修改的逻辑创建新的自定义版本。
自定义得分器
自定义得分器允许您定义评估逻辑并将其应用于会话。他们使用 LLM 作为判断者的方法(基于提示的评估)或基于表达式的逻辑来根据您的条件对会话进行标记、评分或分类。
您可以在 Agentforce Studio 的下一代测试 (NGT) 中创建自定义得分器。见在 Agentforce Studio (Beta) 中设置和运行测试。有关更多信息,请查看下一代 Slack 测试。
自定义得分器针对会话运行,并在可观察性中显示自定义得分和维度。
自定义得分器的工作方式
自定义得分器由提示模板支持,该模板会在会话结束时自动作为批处理作业运行。得分器在会话上运行后,会话与该得分器相关联,标签和分数会显示在优化和 Analytics 中。
- 得分器是在可配置会话百分比(采样率)上运行的提示模板。
- 分数在会话结束时应用,而不是在实时对话期间。会话必须收到结束时间戳,才能触发评分数据操作。
- 结果在可观察性中显示为自定义评测。
- 您也可以使用
executeAgentforceScoresJob可调用操作手动触发得分器。 - 评分器不会影响客服人员在实时对话期间的延迟或性能,因为评分在会话结束后运行。
得分器配置
关键字段
| 字段 | 备注 |
|---|---|
scorerApiName |
得分器的唯一 API 名称。 |
status |
得分器的生命周期状态(例如草稿或可用)。 |
isDraft |
布尔型。表示此得分器定义是否为草稿。 |
versionNumber |
得分器定义的整数版本。 |
engine |
评估引擎:基于 LLM 或基于表达式。 |
inputScope |
粒度:会话级(默认为 Beta 版和一般可用性)或交互级(计划)。 |
dataType |
得分器的输出类型(例如,文本或数字)。 |
scorerValues / valuesSpecification |
仅提供一个。定义得分器的输出标签或数值范围。 |
promptTemplateRef |
对基于 LLM 的评估的提示模板的引用。模板必须处于活动状态。 |
agentApiName |
可选。将得分者与特定客服人员关联。仅允许一个客服人员 API 名称。 |
samplingRate |
得分器针对的会话百分比。 |
验证规则
scorerApiName不得已存在。promptTemplateRef必须存在并处于活动状态。- 对于文本数据类型:得分器值必须存在;恰好一个值必须有
isFallback: true;恰好一个值必须有isSystemFallback: true(仅在isFallback也为真时)。 - 对于数值数据类型:无回退值;值必须解析为有效双精度。如果您使用
valuesSpecification:step必须大于 0;min必须小于max;threshold是可选的,但必须介于min和max之间。 - 得分器值的最大数量:101.
输出类型
- 文本(标签 ) — 得分器将一组预定义字符串标签中的一个分配给每个会话(例如,已解决、已放弃或已升级 ) 。用于分类。
- 数字 — 得分器返回一个定义范围内的数字(例如 0–5)。适用于质量评级和连续得分。LLM 通常在离散规模(例如 0–5)上比在狭窄的 0–1 范围上表现更好。
- 布尔值(扩展或未来 ) — 返回真或假。支持基于表达式的得分器。
在生产中运行得分器
从得分器选项卡激活
创建并测试自定义得分器后,从 Agentforce 优化中的得分器中心激活它。激活允许得分器以配置的样本速率在实时会话上运行。
| 访问和查看 Agentforce 优化 | 分配 Access Agentforce 优化和 Data Cloud 用户权限集 |
| 使用得分器选项卡 (Beta) | 分配 Agentforce Scorer Beta 权限集(除了 Agentforce 之外,不需要额外的许可证) |
| 创建得分器 | 分配下一代测试 (NGT) 访问权限集 |
| 激活得分器 | 分配 AgentforceScorerActivation 权限集(默认包含在管理员简档中) |
从 Salesforce 流运行
我们提供新的可调用操作 TriggerAgentBulkScoring,以在历史会话上异步执行自定义得分器。此操作接受多个会话和得分器,可通过以下访问:
- Salesforce 流
- REST API
- Apex
操作名称:TriggerAgentBulkScoring
| 输入参数 | 类型 | 描述 |
|---|---|---|
InputIds |
列表<String> | 最多 500 个唯一会话 ID 的列表。 |
InputScope |
枚举 | 评分的范围:会话、时刻或交互。 |
ScoresApiNames |
列表<String> | 要执行的得分器最多 10 个开发人员姓名。 |
重要备注
- 所有会话 ID 和
scorerApiNames必须属于同一个客服人员。 - 请确保得分器版本在执行前可用。
REST API
向标准操作 REST 端点发送 POST 请求。
/services/data/v66.0/actions/standard/triggerAgentBulkScoring
负载示例:
{
"inputs": [
{
"inputIds": ["019c9442-b760-7d62-837c-8ab80ecc0fc2"],
"inputScope": "Session",
"scorerApiNames": ["language_classifier"]
}
]
}在流中使用executeAgentforceScoresJob可调用操作。该操作接受会话 ID 和得分器列表,并向评估漏斗提交作业。常见用途包括:
- 在历史会话上运行得分器
- 批处理分析和自定义报表
- 与 Agentforce 网格集成
元数据 API
使用 Salesforce 元数据 API 创建和管理自定义得分器,以便您可以在支持代码和 DevOps 工作流中部署得分器,包括 CI/CD 漏斗。
用例
| 用例 | 用户目标 | 得分器如何帮助 |
|---|---|---|
| 监控客服人员质量 | 了解客服人员解决客户问题的效果 | 标准得分器(质量得分、A&D)自动运行,无需配置即可在 Analytics 中显示结果 |
| 评估特定于业务的结果 | 衡量自定义 KPI(例如,主题分类或合规性) | 自定义得分器将 LLM 提示应用于会话,并将结果显示为自定义维度 |
| 迭代和改进客服人员 | 在弱会话中查找模式并优化说明 | 可观察性显示每个会话的得分结果,以便您可以深入了解标记的交互 |
| 在生产前测试得分器 | 确认新得分器在激活前的行为符合预期 | Agentforce Studio 中的测试中心支持根据测试用例创建、运行和调整得分器。 |
| 按比例运行得分器 | 评估大批量历史会话 | executeAgentforceScoresJob 支持批处理和自定义报表 |
| 将得分器作为代码管理 | 通过 CI/CD 部署得分器 | 元数据 API 支持支持支持代码创建和管理 |
| 自定义评估条件 | 调整或扩展现成的评分 | 复制标准得分器,以使用修改的提示逻辑创建自定义版本 |

