หมายเหตุ
การเข้าถึงหน้านี้ต้องได้รับการอนุญาต คุณสามารถลอง ลงชื่อเข้าใช้หรือเปลี่ยนไดเรกทอรีได้
การเข้าถึงหน้านี้ต้องได้รับการอนุญาต คุณสามารถลองเปลี่ยนไดเรกทอรีได้
[บทความนี้เป็นเอกสารก่อนการนำออกใช้ และอาจเปลี่ยนแปลงได้]
หลังจากที่คุณสร้างชุดทดสอบที่มีการสนทนาแล้ว ให้รันการประเมินผลเพื่อวัดประสิทธิภาพของเจ้าหน้าที่ของคุณ การประเมินจะประมวลผลการสนทนาแต่ละครั้งและให้คะแนนตามวิธีการทดสอบที่เลือก
สำคัญ
- นี่คือคุณลักษณะรุ่นพรีวิวที่พร้อมสำหรับการใช้งานจริง
- พรีวิวที่พร้อมสำหรับการใช้งานจริงอยู่ภายใต้ข้อกำหนดการใช้งานเพิ่มเติม
Prerequisites
- เอเจนต์ที่สร้างและบันทึกด้วยฮาร์เนส GitHub Copilot ดูสร้างเอเจนต์ (พรีวิว)
- ประเมินอย่างน้อยหนึ่งครั้งด้วยการสนทนา โปรดดู สร้างชุดการทดสอบสำหรับเอเจนต์ (พรีวิว)
วิธีรันการประเมินสําหรับเอเจนต์:
- เปิดเอเจนต์ของคุณใน Copilot Studio
- เลือกแท็บ ประเมิน
- ในเมนูแบบเลื่อนลง Evaluation ให้เลือกการประเมินที่คุณต้องการรัน
- เพิ่มการสนทนาอย่างน้อยหนึ่งรายการลงในชุดการทดสอบหากคุณยังไม่ได้ทำ
- ใน แผงกำหนดค่าชุดการทดสอบ ให้ตรวจสอบว่า:
- การประเมิน ชื่อ ถูกตั้งค่าเรียบร้อยแล้ว
- วิธีการทดสอบ ได้รับการกำหนดค่าแล้ว (ตัวอย่างเช่น: คุณภาพทั่วไป)
- เลือก ประเมินผล เพื่อเริ่มการประเมิน การประเมินจะประมวลผลการสนทนาแต่ละครั้งในชุดการทดสอบ กระบวนการนี้อาจใช้เวลาหลายนาที ทั้งนี้ขึ้นอยู่กับจำนวนการสนทนา
คำแนะนำ
รันการประเมินซ้ําหลายครั้ง แต่ละรันจะถูกบันทึกแยกกัน เพื่อให้คุณสามารถเปรียบเทียบผลลัพธ์ระหว่างรันและดูว่าการเปลี่ยนแปลงเอเจนต์ของคุณส่งผลต่อคุณภาพอย่างไร
เรียกใช้การประเมินอีกครั้ง
หลังจากที่คุณเปลี่ยนคําแนะนํา ความรู้ หรือเครื่องมือของตัวแทนแล้ว ให้รันการประเมินซ้ําเพื่อวัดผลกระทบ:
- บนแท็บ Evaluate ให้เลือกการประเมินที่คุณต้องการดำเนินการซ้ำจากเมนูดรอปดาวน์ Evaluation
- ภายใต้ Recent results ให้เลือก Evaluate test set again หรือเลือก Evaluate test set ไอคอน
ภายในชุดการทดสอบเพื่อเริ่มการประเมินใหม่ - เปรียบเทียบผลลัพธ์ของการรันใหม่กับรันก่อนหน้าเพื่อดูว่าการเปลี่ยนแปลงเหล่านั้นดีขึ้นหรือทําให้ประสิทธิภาพลดลง