Vous êtes ici :
Choisir des évaluations
Les évaluations mesurent les performances de votre agent IA dans des domaines clés. Les évaluations par défaut comprennent la précision des réponses, l'assertion des sous-agents et l'assertion des actions. Pour mieux répondre à vos objectifs de test, vous pouvez ajouter des évaluations axées sur la qualité, telles que l'exhaustivité, la cohérence, la concision, la latence et l'adhésion aux instructions. La sélection de la combinaison appropriée d'évaluations renvoie les connaissances dont vous avez besoin pour affiner et améliorer stratégiquement votre agent.
Éditions requises
![]() Cet article s'applique : |
Centre de test Agentforce hérité dans Configuration |
![]() Cet article ne s'applique pas : |
Nouveau centre de test dans Agentforce Studio (bêta) |
| Disponible avec : Lightning Experience |
| Disponible avec : Enterprise Edition, Performance Edition, Unlimited Edition et Developer Edition. Les licences complémentaires requises varient selon le type d'agent. |
| Autorisations utilisateur requises | |
|---|---|
| Pour créer des tests dans le Centre de test : | Gérer les agents IA ET les autorisations requises pour votre type d'agent |
-
Sélectionnez les évaluations que vous souhaitez exécuter. Les évaluations par défaut sont toujours testées, mais vous pouvez sélectionner Métriques de qualité de réponse pour orienter vos tests vers des zones spécifiques. Les évaluations de la qualité des réponses mesurent les trois critères de qualité clés du Centre de test Agentforce : précision (informations correctes), pertinence (intention et contexte), et voix et ton (évaluation du style et de l'alignement de la marque).
Évaluation Définition Évaluations par défaut Évaluation de la réponse Nous envoyons l'énoncé test à l'agent et enregistrons la réponse. Un juge du grand livre détermine la réponse attendue, la compare à la réponse de l'agent et attribue un score.
Le champ Réponse attendue doit refléter la réponse que vous attendez de l'agent. Une erreur fréquente consiste à inclure des instructions sur la réponse, par exemple « l'agent doit mentionner le numéro de la commande et être poli ». Cela produit des scores imprécis.
Assertion de sous-agent Les énoncés de test générés par l'IA sont conçus pour inciter votre agent à sélectionner les sous-agents qui lui ont été attribués. Par conséquent, l'évaluation de l'assertion des sous-agents détermine si votre agent a sélectionné les sous-agents appropriés en fonction de l'énoncé. Assertion d'action De la même façon que l'assertion du sous-agent, les énoncés tests générés par l'IA sont conçus pour inciter votre agent à sélectionner des actions spécifiques. L'assertion d'action vérifie que l'agent sélectionne les actions appropriées et inclut toutes les actions attendues en fonction de l'énoncé. Évaluations de la qualité des réponses Exhaustivité Vérifie si l'agent a suffisamment couvert le contenu voulu, y compris toutes les informations importantes attendues de l'énoncé. Cohérence Détermine si la réponse a été transformée en langage conversationnel grammaticalement correct. Par exemple, si des informations ont été extraites d'objets Salesforce et livrées sous forme de données brutes telles que des structures JSON. Concision Détermine si la réponse est courte mais précise. Latence Temps d'exécution du test, mesuré en millisecondes. Adhésion aux instructions Vérifie si l'agent interprète et suit pleinement les instructions du sous-agent, en traitant les points clés et en fournissant les informations requises. En savoir plus sur l'adhésion aux instructions dans l'aide. - Vérifiez vos sélections de tests, puis cliquez sur Enregistrer et exécuter. La génération de tests consomme des crédits. Par conséquent, assurez-vous d'être satisfait de votre configuration avant de l'exécuter.
Lorsque Agentforce a terminé de générer les tests, ils sont affichés dans le Centre de test. Lorsque le statut est Prêt à exécuter, pour exécuter directement les tests, cliquez sur Exécuter les tests ou téléchargez-les sous forme de fichier CSV pour effectuer des modifications. Après la modification, chargez le fichier CSV dans le Centre de test pour effectuer des tests sur vos requêtes mises à jour.
L’IA générative peut générer des cas tests pour des objets Compte, Piste, Opportunité et Contact. Avec des instructions spécifiques dans la description, il peut également créer des requêtes test pour des objets personnalisés et l'action Répondre aux questions avec Knowledge. Par exemple, pour des objets personnalisés, utilisez une description similaire à : « Générer des cas tests pour [nom de l'objet personnalisé]. Voici quelques exemples d'énoncés : [exemple d'énoncé associé à un objet personnalisé], [exemple d'énoncé associé à un objet personnalisé]. " Pour que l'IA crée des cas tests pour l'action Répondre aux questions avec Knowledge, utilisez une description similaire à celle-ci: « Générez des cas tests pour l’action Répondre aux questions avec Knowledge. Utilisez les articles Knowledge suivants pour générer des tests : [titre d'un article], [titre d'un article]. »


