Scorers en aangepaste scores (bèta)
Scorers (bèta) zijn evaluatiecomponenten in Agentforce Studio die agentsessies analyseren en scores, dimensies en meeteenheden produceren voor Agentforce Optimalisering en Analytics. Koppel Salesforce-standaardscores aan aangepaste evaluaties voor uw KPI's, maak aangepaste scorers met behulp van Next Gen Testing, pas ze toe op sessies en gebruik de uitvoer in Optimalisering en Analytics om prioriteit te geven aan verbeteringen van agenten.
Vereiste editions
| Beschikbaar in: Enterprise, Performance en Unlimited Edition met een uitbreiding Einstein for Sales, Einstein for Platform, Einstein for Service, Einstein 1 Service of Einstein GPT Service. Neem voor het aanschaffen van uitbreidingen contact op met uw Salesforce Account Executive. |
Scorers zijn een bètaservice die is onderworpen aan de Voorwaarden voor bètaservices bij overeenkomsten - Salesforce.com of een schriftelijke gecombineerde proefovereenkomst indien uitgevoerd door de klant, en van toepassing zijnde voorwaarden in de Productvoorwaardendirectory. Gebruik van deze bètaservice is naar eigen goeddunken van de klant.
Waar scorers worden weergegeven in Optimalisering en Analytics
- Next Gen Testing: aangepaste scorers maken als onderdeel van een nieuwe of bestaande testreeks, deze verfijnen en publiceren.
- Scorer Hub (Agentforce Studio) — Centrale plaats om scorers weer te geven, te activeren en te beheren.
- Sessies en intents-tabel — Sessies tonen scorerresultaten; filter en analyseer op aangepaste scorerdimensies.
- Sessiepagina — Sessies tonen gekoppelde scorerlabels en scores.
- Analytics-dashboards: aangepaste scorermeeteenheden worden weergegeven als meetgegevens voor rapportage.
Overwegingen en beperkingen
- Beschikbaar in Lightning Experience in de Enterprise, Performance en Unlimited Edition met Salesforce Foundations of Agentforce 1 Edition waarin Optimalisering van agenten en Analytics zijn ingeschakeld.
- Aangepaste scores zijn in bèta en vereisen geen extra licentie buiten Agentforce.
- Tijdens bèta worden alleen scorers op sessieniveau ondersteund.
- Aangepaste scorers worden niet ondersteund voor agenttypen van Agentforce Employee Agent (AEA).
- Type SDR-agent wordt wel weergegeven in de Scorer Hub, maar niet in de vervolgkeuzelijst voor agenten van de Optimaliserings-UI.
- Standaardscorers (A&D, Kwaliteitsscore) worden gemaakt wanneer STDM wordt aangeleverd. Als ze ontbreken, controleert u op een leveringsprobleem.
- U moet een standaardscorer klonen voordat u deze bewerkt. Direct bewerken wordt niet ondersteund tijdens bèta.
- Op expressies gebaseerde scorers vereisen een Booleaans uitvoertype.
- Numerieke scorers op een schaal van 0–1 worden niet aanbevolen, omdat LLM's slecht presteren op zeer smalle numerieke bereiken.
- Testcentrumsessies worden niet gescoord door aangepaste scorers. Testcentrumsessies krijgen geen eindtijdstempel, waardoor de gegevensactie die de evaluatie van aangepaste scorers activeert, nooit wordt geactiveerd.
Overzicht
Scorers evalueren agentsessies en genereren scores, dimensies (tekstwaarden) en meeteenheden (numerieke waarden). Ze maken deel uit van Agentforce Optimalisering en Waarneembaarheid. Ze worden automatisch uitgevoerd op basis van een configureerbaar percentage sessies en worden zichtbaar in Optimalisering en Analytics, zodat beheerders en ontwikkelaars de prestaties van agenten continu kunnen verbeteren.
Er zijn twee soorten scorers:
- Standaardscorers worden kant-en-klaar geleverd door Salesforce.
- Aangepaste scorers worden door uw organisatie gedefinieerd om bedrijfsspecifieke criteria te evalueren.
Standaardscorers
Standaardscorers zijn vooraf samengestelde evaluaties die automatisch worden gemaakt met STDM-leveringen. Ze worden uitgevoerd op agentsessies zonder extra klantconfiguratie.
Huidige standaardscorers
- Score voor verlaten: geeft aan of de klant de sessie voortijdig heeft beëindigd voordat de agent het probleem heeft opgelost.
- Omleidingsscore — Geeft aan of de agent met succes een interactie heeft omgeleid, zodat er geen menselijke escalatie nodig was.
- Kwaliteitsscore: meet de algemene sessiekwaliteit op basis van vooraf gedefinieerde Salesforce-criteria.
Standaardscorers gebruiken een gereserveerde locatie in de gebruikersinterface en staan los van de lijst van aangepaste scorers.
U kunt een standaardscorer niet rechtstreeks bewerken. Kloon deze om een nieuwe aangepaste versie met gewijzigde logica te maken.
Aangepaste scores
Met aangepaste scorers kunt u evaluatielogica definiëren en toepassen op sessies. Ze gebruiken een LLM-as-a-judge-benadering (op aanwijzing gebaseerde evaluatie) of op expressie gebaseerde logica om sessies te labelen, scoren of classificeren op basis van uw criteria.
U maakt aangepaste scorers in Next Gen Testing (NGT) in Agentforce Studio. Zie Tests instellen en uitvoeren in Agentforce Studio (bèta). Zie Next Gen Testing on Slack voor meer informatie.
Aangepaste scorers worden uitgevoerd tegen sessies en maken aangepaste scores en dimensies zichtbaar in Waarneembaarheid.
Hoe aangepaste scores werken
Een aangepaste scorer wordt ondersteund door een aanwijzingssjabloon die automatisch als batchtaak wordt uitgevoerd wanneer de sessie eindigt. Nadat een scorer een sessie heeft uitgevoerd, wordt de sessie gekoppeld aan die scorer en worden labels en scores weergegeven in Optimalisering en Analytics.
- Een scorer is een aanwijzingssjabloon die wordt uitgevoerd op een configureerbaar percentage sessies (voorbeeldscore).
- Scores worden toegepast aan het einde van de sessie, niet tijdens het live gesprek. Sessies moeten een eindtijdstempel krijgen om de actie voor scoregegevens te activeren.
- Resultaten worden in Waarneembaarheid weergegeven als aangepaste meeteenheden.
- U kunt scorers ook handmatig via een trigger activeren met behulp van de aanroepbare actie
executeAgentforceScoresJob. - Scorers hebben geen invloed op de latentie of prestaties van de agent tijdens live gesprekken, omdat scores worden uitgevoerd nadat de sessie is beëindigd.
Configuratie van scorer
Sleutelvelden
| Veld | Beschrijving |
|---|---|
scorerApiName |
Unieke API-naam voor de scorer. |
status |
Levenscyclusstatus van de scorer (bijvoorbeeld Concept of Beschikbaar). |
isDraft |
Booleaans. Geeft aan of deze scorerdefinitie een concept is. |
versionNumber |
Geheel getal van de definitie van de scorer. |
engine |
Evaluatie-engine: Op LLM of expressie gebaseerd. |
inputScope |
Granulariteit: sessieniveau (standaard voor bèta en algemene beschikbaarheid) of interactieniveau (gepland). |
dataType |
Uitvoertype voor de scorer (bijvoorbeeld Tekst of Numeriek). |
scorerValues / valuesSpecification |
Geef er precies één op. Definieert uitvoerlabels of het numerieke bereik voor de scorer. |
promptTemplateRef |
Verwijzing naar de aanwijzingssjabloon voor op LLM gebaseerde evaluatie. De sjabloon moet actief zijn. |
agentApiName |
Optioneel. Koppelt de scorer aan een specifieke agent. Er is slechts één agent-API-naam toegestaan. |
samplingRate |
Percentage sessies waar de scorer tegenaan loopt. |
Validatieregels
scorerApiNamemag niet al bestaan.promptTemplateRefmoet bestaan en actief zijn.- Voor het gegevenstype Tekst: scorerwaarden moeten bestaan; precies één waarde moet
isFallback: truehebben; precies één moetisSystemFallback: truehebben (alleen wanneerisFallbackook true (waar) is). - Voor het gegevenstype Numeriek: geen reservewaarden; waarden moeten worden geparseerd als geldige dubbele waarden. Als u
valuesSpecificationgebruikt:stepmoet groter zijn dan 0;minmoet kleiner zijn danmax;thresholdis optioneel, maar moet tussenminenmaxliggen. - Maximale aantal scorerwaarden: 101.
Uitvoertypen
- Tekst (labels): de scorer wijst een van een set vooraf gedefinieerde tekenreekslabels toe aan elke sessie (bijvoorbeeld Opgelost, Stopgezet of Geëscaleerd). Gebruik voor categorische classificatie.
- Numeriek: de scorer retourneert een getal in een gedefinieerd bereik (bijvoorbeeld 0–5). Geschikt voor kwaliteitsbeoordelingen en continue scores. LLM's presteren doorgaans beter op discrete schalen (zoals 0–5) dan op smalle 0–1-bereiken.
- Booleaans (stretch of future): retourneert true (waar) of false (onwaar). Ondersteund voor op expressies gebaseerde scorers.
Scorers uitvoeren in productie
Activeren vanaf tabblad Scorer
Nadat u een aangepaste scorer hebt gemaakt en getest, activeert u deze vanuit de Scorer Hub in Agentforce Optimalisering. Door activering kan de scorer live sessies uitvoeren met de geconfigureerde voorbeeldscore.
| Agentforce Optimalisering openen en weergeven | De machtigingensets Toegang Agentforce Optimalisering en Data Cloud-gebruiker toewijzen |
| Tabblad Scorer gebruiken (bèta) | De machtigingenset Agentforce Scorer bèta toewijzen (er is geen extra licentie buiten Agentforce vereist) |
| Een scorer maken | De machtigingenset Next Gen Testing (NGT) toewijzen |
| Een scorer activeren | De machtigingenset AgentforceScorerActivation toewijzen (standaard opgenomen in het beheerdersprofiel) |
Uitvoeren vanuit Salesforce Flow
We bieden een nieuwe aanroepbare actie, TriggerAgentBulkScoring, om aangepaste scorers asynchroon uit te voeren voor historische sessies. Deze actie accepteert meerdere sessies en scores en is toegankelijk via:
- Salesforce-stroom
- REST-API
- Apex
Actienaam TriggerAgentBulkScoring:
| Invoerparameter | Type | Beschrijving |
|---|---|---|
InputIds |
Lijst<Tekenreeks> | Lijst van maximaal 500 unieke sessie-ID's. |
InputScope |
Enum | Bereik van de score: Sessie, Moment of Interactie. |
ScoresApiNames |
Lijst<Tekenreeks> | Maximaal 10 ontwikkelaarsnamen voor de uit te voeren scorers. |
Belangrijke notities
- Alle sessie-ID's en
scorerApiNamesmoeten tot dezelfde agent behoren. - Zorg ervoor dat de scorerversie Beschikbaar is vóór uitvoering.
REST-API
Verzend een POST-aanvraag naar het REST-eindpunt van de standaardactie.
/services/data/v66.0/actions/standard/triggerAgentBulkScoring
Voorbeeld van payload:
{
"inputs": [
{
"inputIds": ["019c9442-b760-7d62-837c-8ab80ecc0fc2"],
"inputScope": "Session",
"scorerApiNames": ["language_classifier"]
}
]
}Gebruik de aanroepbare actie executeAgentforceScoresJob in Flow. De actie accepteert een lijst van sessie-ID's en -scorers en dient een taak in bij de evaluatiepijplijn. Veel voorkomende toepassingen zijn:
- Scorers uitvoeren voor historische sessies
- Batchanalyse en aangepaste rapportage
- Integratie met Agentforce Grid
API voor metagegevens
Maak en beheer aangepaste scorers met de Salesforce-API voor metagegevens zodat u scorers kunt implementeren in pro-code- en DevOps-werkstromen, inclusief CI/CD-pijplijnen.
Gebruikscases
| Gebruikscase | Gebruikersdoel | Hoe scorers helpen |
|---|---|---|
| Kwaliteit van agenten bewaken | Begrijpen hoe goed de agent problemen van klanten oplost | Standaardscorers (Kwaliteitsscore, A&D) worden automatisch uitgevoerd en tonen resultaten in Analytics zonder configuratie |
| Bedrijfsspecifieke uitkomsten evalueren | Aangepaste KPI's meten (bijvoorbeeld onderwerpclassificatie of naleving) | Aangepaste scorers passen uw LLM-aanwijzingen toe op sessies en geven resultaten weer als aangepaste dimensies |
| Agenten herhalen en verbeteren | Patronen vinden in zwakke sessies en instructies verfijnen | Observeerbaarheid toont scorerresultaten per sessie, zodat u kunt doorklikken naar gesignaleerde interacties |
| Testscorers vóór productie | Bevestig dat een nieuwe scorer werkt zoals verwacht vóór activering | Het Testing Center in Agentforce Studio ondersteunt het maken, uitvoeren en verfijnen van scorers op basis van testcases. |
| Scorers uitvoeren op schaal | Grote batches historische sessies evalueren | executeAgentforceScoresJob ondersteunt batchverwerking en aangepaste rapportage |
| Scorers beheren als code | Scorers implementeren via CI/CD | API-ondersteuning voor metagegevens maakt het maken en beheren van pro-code mogelijk |
| Evaluatiecriteria aanpassen | Kant-en-klare scores aanpassen of uitbreiden | Een standaardscorer klonen om een aangepaste versie te maken met gewijzigde aanwijzingslogica |

