หมายเหตุ
การเข้าถึงหน้านี้ต้องได้รับการอนุญาต คุณสามารถลอง ลงชื่อเข้าใช้หรือเปลี่ยนไดเรกทอรีได้
การเข้าถึงหน้านี้ต้องได้รับการอนุญาต คุณสามารถลองเปลี่ยนไดเรกทอรีได้
เมื่อผลการประเมินพบความล้มเหลว ความท้าทายถัดไปคือการพิจารณาว่าควรดำเนินการอย่างไรต่อไปกับผลลัพธ์เหล่านั้น เฟรมเวิร์กการคัดกรองและการแก้ไขช่วยให้คุณมีวิธีที่มีโครงสร้างในการตีความคะแนน วินิจฉัยความล้มเหลว ระบุความเป็นเจ้าของ และแมปปัญหากับการแก้ไขที่เฉพาะเจาะจง โดยไม่ต้องไล่ตามสาเหตุที่แท้จริงที่ไม่ถูกต้องหรือปรับคะแนนให้เหมาะสมโดยแยกจากกัน บทความนี้จะแนะนำเป้าหมาย โครงสร้าง และข้อกำหนดเบื้องต้นของเฟรมเวิร์ก เพื่อให้คุณสามารถทำงานผ่านผลการประเมินอย่างเป็นระบบ และย้ายเอเจนต์ของคุณไปสู่ความพร้อมในการใช้งานจริง
สิ่งที่เฟรมเวิร์กช่วยคุณทำได้
กรอบงานนี้มีแนวทางที่เป็นระบบในการเปลี่ยนจากผลลัพธ์ไปสู่การดำเนินการโดยช่วยคุณ:
- ตีความคะแนนการประเมินในบริบท
- จัดลำดับความสำคัญของความล้มเหลวตามความเสี่ยงและผลกระทบ
- วินิจฉัยสาเหตุที่กรณีทดสอบล้มเหลว
- แยกแยะระหว่าง:
- ปัญหาการตั้งค่าการประเมิน
- ปัญหาการกำหนดค่าเอเจนต์
- ข้อจำกัดของแพลตฟอร์มหรือความสามารถ
ปัญหาที่ได้รับการวินิจฉัยแต่ละรายการจะจับคู่กับการดำเนินการแก้ไขที่เฉพาะเจาะจงและสามารถทดสอบได้
เป้าหมายไม่ใช่การปรับคะแนนให้ดีขึ้นแบบแยกส่วน แต่เพื่อมุ่งเน้นความพยายามในการปรับปรุงลักษณะการทำงานของเอเจนต์ในโลกจริง
ในภาพรวมของวงจรชีวิต เฟรมเวิร์กนี้รองรับการปรับปรุงอย่างต่อเนื่อง:
- ออกแบบ และ สร้างเอเจนต์
- ประเมินลักษณะการทำงานด้วยการทดสอบที่มีโครงสร้าง
- คัดแยกและแก้ไขปัญหาโดยใช้บทความชุดนี้
- ประเมินใหม่และทำซ้ำเมื่อเอเจนต์พัฒนา
โดยการมองว่าผลการประเมินเป็นสัญญาณที่นำไปปฏิบัติได้ คุณจะสามารถเปลี่ยนจากการทดลองไปสู่การสร้างเอเจนต์ที่ทำซ้ำได้และพร้อมสำหรับการใช้งานจริงได้อย่างมีประสิทธิภาพ
โครงสร้างของกรอบงาน
กรอบงานถูกจัดเป็นสี่ชั้นของการคัดกรอง แต่ละชั้นเป็นการวิเคราะห์ในระดับที่ลึกขึ้น ตั้งแต่การตีความคะแนน ไปจนถึงการวินิจฉัยสาเหตุที่แท้จริง และการระบุรูปแบบเชิงระบบ
- เลเยอร์ 1: ตีความคะแนนการประเมินและประเมินความพร้อม: ผลลัพธ์หมายถึงอะไร และเอเจนต์พร้อมที่จะปรับใช้หรือไม่
- เลเยอร์ 2: ความล้มเหลวในการคัดกรอง: เหตุใดจึงล้มเหลว และใครต้องดำเนินการ
- เลเยอร์ 3: แมปรูปแบบความล้มเหลวกับกลยุทธ์การแก้ไข: ควรเปลี่ยนแปลงอะไรเป็นพิเศษ
- ชั้นที่ 4: วิเคราะห์รูปแบบและปรับปรุง: ความล้มเหลวเปิดเผยปัญหาเชิงระบบอะไรบ้าง?
เฟรมเวิร์กนี้ยังประกอบด้วยตัวอย่างที่ใช้งานได้จริงที่แสดงการประยุกต์ใช้เฟรมเวิร์กแบบครบวงจร และเทมเพลตบันทึกความล้มเหลวเพื่อช่วยคุณติดตามข้อค้นพบและการตัดสินใจ
คู่มือสรุปแบบรวดเร็วให้เวอร์ชันย่อของกระบวนการคัดกรองและการแก้ไขสำหรับใช้ระหว่างการดำเนินงาน
ชนิดสาเหตุหลัก
ความล้มเหลวในการประเมินจะจับคู่กับหนึ่งในสามชนิดสาเหตุที่แท้จริงโดยพิจารณาจากเจ้าของหรือผู้ที่ต้องดำเนินการ
| ชนิดสาเหตุหลัก | เจ้าของ | คำอธิบาย |
|---|---|---|
| ปัญหาการตั้งค่าการประเมิน | ผู้เขียนการประเมิน | กรณีทดสอบ, คำตอบที่คาดหวัง หรือผู้ให้คะแนนอาจผิดพลาด เอเจนต์อาจทำงานได้อย่างถูกต้อง |
| ปัญหาการกำหนดค่าเอเจนต์ | ตัวสร้างเอเจนต์ | เอเจนต์สร้างการตอบสนองที่ไม่ถูกต้องซึ่งสามารถแก้ไขได้ผ่านการเปลี่ยนแปลงการกำหนดค่า |
| ปัญหาข้อจำกัดของแพลตฟอร์ม | ทีมแพลตฟอร์ม | ลักษณะการทำงานของแพลตฟอร์มเป็นสาเหตุของปัญหาและไม่สามารถแก้ไขได้ผ่านการกำหนดค่า |
หลักการการออกแบบ
หลักการออกแบบเป็นแนวทางในการนำกรอบงานไปใช้ในทางปฏิบัติเพื่อให้แน่ใจว่าการคัดแยกและการแก้ไขมีประสิทธิภาพ
| หลักการ | ความหมายในทางปฏิบัติ |
|---|---|
| เริ่มต้นด้วยผลการประเมิน: | เริ่มต้นด้วยอัตราการผ่านจริงและกรณีทดสอบที่ล้มเหลว ไม่ใช่สมมติฐานที่เป็นนามธรรม |
| กำจัดงานที่ไม่ถูกต้องก่อน | ตรวจสอบการตั้งค่าการประเมินก่อนตรวจสอบเอเจนต์เพื่อไม่ให้ความพยายามสูญเปล่า |
| สาเหตุหลัก→ผู้รับผิดชอบ→การดำเนินการ | ตรวจสอบให้แน่ใจว่าแต่ละเส้นทางการวินิจฉัยระบุผู้รับผิดชอบที่ชัดเจนและการดำเนินการที่เป็นรูปธรรม |
| ตรวจสอบการจัดประเภท | ประเมินซ้ำหลังการแก้ไข หากความล้มเหลวยังคงอยู่ ให้คัดกรองใหม่ |
| คาดว่าสาเหตุหลายประการร่วมกัน | รับทราบว่าความล้มเหลวเพียงครั้งเดียวอาจมีสาเหตุหลายประการ |
| คำนึงถึงความแปรปรวน | คำนึงถึงความแปรปรวนของโมเดลและตัวให้คะแนน ดำเนินการประเมินซ้ำเพื่อยืนยันผลลัพธ์ |
โครงสร้างชุดการประเมินผล
ประสิทธิผลของการคัดกรองขึ้นอยู่กับโครงสร้างชุดการประเมิน
- ชุดที่มีโครงสร้างอย่างดี (จัดตามสัญญาณคุณภาพหรือสถานการณ์) สร้างผลคะแนนที่เข้าใจได้และสนับสนุนการคัดกรองอย่างมีประสิทธิภาพ
- ชุดที่มีโครงสร้างไม่ดี (มีสัญญาณผสมและขอบเขตไม่ชัดเจน) ส่งผลให้ได้ผลลัพธ์ที่มีข้อมูลรบกวนและการวินิจฉัยที่ไม่ชัดเจน
หากคะแนนตีความได้ยาก ควรพิจารณาจัดโครงสร้างชุดการประเมินใหม่ก่อนวิเคราะห์ความล้มเหลวแต่ละกรณี
ก่อนที่คุณเริ่มต้น
คุณต้องมีผลการประเมินที่พร้อมใช้งาน รวมถึงสถานะผ่านหรือไม่ผ่านสำหรับแต่ละกรณีทดสอบ หากคุณยังไม่ได้ดำเนินการประเมิน ให้ทำตามขั้นตอนใน การประเมินเอเจนต์ด้วยการทดสอบอัตโนมัติ และดู การออกแบบและดำเนินการประเมินเอเจนต์ เพื่อรับคำแนะนำเพิ่มเติม
ขั้นตอนถัดไป
เริ่มต้นด้วยการตีความผลการประเมินของคุณเพื่อกำหนดความพร้อม