Selezione dei punteggi dei modelli di prompt
Scegliere i punteggi da applicare ai casi di test. Ogni scorer valuta una dimensione diversa dell'output del modello di prompt e restituisce un risultato superato o non superato.
Versioni (Edition) richieste
| Disponibile nelle versioni: Lightning Experience |
| Disponibile in: Enterprise Edition, Performance Edition, Unlimited Edition e Developer Edition. Le licenze aggiuntive richieste variano a seconda del tipo di agente. |
| Autorizzazioni utente necessarie | |
|---|---|
| Per creare test nel Centro test: | Gestione delle griglie Agentforce E Gestione dei test Agentforce |
-
Selezionare i punteggi da applicare ai casi di test.

Per informazioni su come visualizzare i punteggi e il ragionamento del giudice LLM dopo un'esecuzione, vedere Utilizzo dei risultati.
Capocannoniere Descrizione Coerenza Restituisce un passaggio o un errore a seconda che la risposta sia strutturata logicamente, facile da seguire e priva di errori grammaticali. Un passaggio indica che la risposta comunica chiaramente; un errore indica che la risposta può essere confusa, disgiunta o difficile da leggere. Concisione Restituisce un passaggio o un errore a seconda che la risposta sia appropriatamente breve senza sacrificare la precisione. Un passaggio indica che la risposta evita una lunghezza inutile; un errore indica che la risposta può essere dettagliata o riempita di contenuti non pertinenti. Completezza Restituisce un passaggio o un errore a seconda che la risposta risponda completamente alla query includendo tutte le informazioni necessarie. Un passaggio indica che la risposta copre ciò che è stato chiesto; un errore indica che la risposta omette le informazioni chiave o indirizza solo parzialmente l'input. Fattorietà Restituisce un passaggio o un errore a seconda che le informazioni nella risposta siano effettivamente corrette. Un passaggio indica che la risposta contiene informazioni accurate; un errore indica che la risposta contiene errori o richieste non supportate. Istruzione Stai seguendo Restituisce un punteggio di 1, 3 o 5 in base al grado di aderenza della risposta alle istruzioni definite nel modello di prompt. Un punteggio di 5 (Alto) indica che la risposta ha seguito completamente le istruzioni. Un punteggio di 3 (Incerto) indica che l'osservanza non può essere determinata in modo definitivo. Un punteggio di 1 (Basso) indica che la risposta si discosta dalle istruzioni. Corrispondenza risposta Restituisce un punteggio basato sulla vicinanza della risposta del modello di prompt all'output previsto fornito. Utilizza un LLM giudice per confrontare la risposta con la colonna Output previsto. Un punteggio più alto indica una corrispondenza più vicina. Per eseguire questo scorer, è necessario includere una colonna Output previsto nel file CSV. -
Fai clic su Salva.
La suite di test viene creata e visualizzata nella visualizzazione griglia. Per eseguirla, aprire la suite di test e fare clic su Esegui test.
Questo articolo ha risolto il problema?
Facci sapere, così possiamo migliorare!

