Loading
构建适用于服务的 AI 解决方案
目录
选择筛选器

          没有结果
          没有结果
          以下是一些搜索提示

          检查关键字的拼写。
          使用更普遍的搜索词。
          选择更少的筛选器,并扩大搜索范围。

          搜索所有 Salesforce 帮助
          测试多个意图预测

          测试多个意图预测

          通过批量测试多个话语,而不是一次测试一个,评估机器人预测意图的准确性。此方法有助于评估意图准确性,并确定意图配置中的差距。批量测试有助于识别错误分类的话语,并使用预测度量评估整体模型性能。以前,测试话语需要手动逐个验证。批量测试通过分析大型数据集并返回合并的预测汇总来简化流程。

          所需的 Edition

          查看支持版本
          所需用户权限
          构建和管理 Einstein Bot:

          自定义应用程序

          修改元数据

          管理机器人

          使用批量测试:

          • 在单个请求中评估最多 1000 个话语
          • 比较预期和预测的意图
          • 查看每个预测的置信度分数
          • 使用汇总度量分析整体性能

          您可以通过两种方式执行批量测试:

          • 测试自定义话语:提供话语和预期意图的数据集,以评估特定场景。
          • 使用现有机器人数据进行测试:评估机器人中已经配置的所有话语,以生成完整的性能汇总。

          这两种方法对应于不同的 API 端点。

          在开始前,打开 Einstein 机器人和 Einstein for Intent,并构建模型。打开批处理输入测试器试点权限,并在机器人概述页面上打开跨语言意图模型 (意图 V3)。

          备注
          备注 请联系 Salesforce 客户支持,以打开批量输入测试器试用权限。如果您关闭跨语言意图模型,Salesforce 会使用意图标准 V2(适用于单语言)或意图多语言 2.5(适用于多语言)构建模型。

          批量测试的工作原理

          批量测试根据机器人的意图模型评估话语,并返回:

          • 您可以使用一组话语或选定的机器人版本启动评估请求。
          • 意图模型处理每个话语,并预测最相关的意图。
          • 在提供时,系统会将预测意图与预期意图进行比较。
          • 系统会为每个预测分配置信度分数和评级。
          • 系统会生成包含整体性能度量的预测汇总。
          • 系统会返回所有评估话语的综合结果。

          了解预测结果

          要了解机器人对话语进行分类的准确性并确定需要改进的领域,请查看预测结果。

          每个话语结果。对于每个话语,系统将返回:

          • 预测意图:模型识别的意图
          • 预测结果:表示预测意图是否匹配预期意图(通过、失败或未处理)
          • 置信度得分:表示预测正确的可能性

          摘要度量。系统提供汇总度量来帮助评估整体性能:

          • 成功率:正确预测的话语百分比
          • 失败计数:错误预测的话语数量
          • 意图覆盖率:为至少一个话语正确预测的意图百分比
          • 错误计数:机器人无法处理的话语数量

          注意事项

          在使用批量测试时,请记住这些注意事项:

          • 您一次最多可以评估 1000 个话语。
          • 结果取决于意图训练数据的质量。
          • 审查失败的预测,以提高意图准确性。
          • 单个话语的错误不会停止整体评估。

          有关 API 详细信息,请查看连接 REST API 开发人员指南中的机器人话语意图预测资源

           
          正在加载
          Salesforce Help | Article