Remarque
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de vous connecter ou de modifier des répertoires.
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de modifier des répertoires.
[Cet article fait partie de la documentation en version préliminaire et peut faire l’objet de modifications.]
Après avoir créé un ensemble de tests avec des conversations, effectuez une évaluation pour mesurer la performance de votre agent. L’évaluation traite chaque conversation et produit des résultats notés basés sur la méthode de test sélectionnée.
Important
- Il s’agit d’une fonctionnalité en préversion prête pour la production.
- Les versions préliminaires prêtes pour la production sont soumises à des conditions d’utilisation supplémentaires.
Prerequisites
- Un agent créé et sauvegardé avec le harnais GitHub Copilot. Voir Créer un assistant (version préliminaire).
- Au moins une évaluation avec des conversations. Voir Créer un jeu de tests pour un assistant (version préliminaire).
Pour effectuer une évaluation pour un agent :
- Ouvrez votre agent dans Copilot Studio.
- Sélectionnez l’onglet Evaluate (Évaluer).
- Dans le menu déroulant Évaluation , sélectionnez l’évaluation que vous souhaitez effectuer.
- Ajoutez au moins une conversation au jeu de tests si ce n’est pas déjà fait.
- Dans le volet Configurer le jeu de tests, vérifiez :
- Le nom de l’évaluation est défini.
- La méthode de test est configurée (par exemple, Qualité générale).
- Sélectionnez Évaluer pour démarrer l’évaluation. L’évaluation traite chaque conversation de l’ensemble de test. En fonction du nombre de conversations, ce processus peut prendre plusieurs minutes.
Tip
Faites la même évaluation plusieurs fois. Chaque exécution est enregistrée séparément, ce qui vous permet de comparer les résultats d’une exécution à l’autre et de voir comment les modifications apportées à votre agent influent sur la qualité.
Ré-exécution d’une évaluation
Après avoir modifié les instructions, connaissances ou outils de votre agent, relancez l’évaluation pour mesurer l’impact :
- Dans l’onglet Évaluer, sélectionnez l’évaluation que vous souhaitez relancer dans le menu déroulant Évaluation.
- Sous Résultats récents, sélectionnez Évaluer le jeu de tests à nouveau ou sélectionnez l’icône de la fonction
Évaluer le jeu de tests dans le jeu de tests pour relancer une exécution. - Comparez les résultats de la nouvelle exécution avec ceux des exécutions précédentes pour voir si les changements ont amélioré ou dégradé les performances.