Microsoft Copilot Studio 中由 GitHub Copilot 驱动的代理中的预览标签提供了一个交互式测试环境,您可以在发布前与代理聊天、调试其行为并查看对话历史。
注释
本文的功能由 GitHub Copilot 框架驱动,该工具使用 Copilot 积分进行基于使用量的计费。 在GitHub Copilot harness驱动的代理计费概览中,了解更多关于Copilot积分的信息。
基于使用量的计费适用于使用、构建、测试和评估代理。 这些操作可能会消耗Copilot积分。
在“预览”中可以执行的操作
预览选项卡提供了一套全面的测试和调试工具:
- 交互式聊天:向您的智能体发送消息,并实时查看其回复。 该聊天体验与智能体发布后用户与其交互的方式完全一致。
- 提示建议:预览界面会显示来自智能体配置中的对话开场白,以便您快速测试常见场景。
- 活动跟踪:查看详细的思维链(CoT)跟踪记录,该记录展示了您的智能体如何处理每条消息,包括它查询了哪些知识来源、调用了哪些工具以及遵循了哪些推理步骤。
- 对话历史记录:查看与您的智能体进行的过往测试对话。
- 响应反馈:通过点赞或点踩对智能体的响应进行评分,并提供书面反馈以追踪质量问题。
预览布局选项
预览选项卡支持多种视图,以适应您的工作流程:
- 开发者视图:默认视图,在聊天界面中包含推理卡片,以便您在测试时查看智能体的推理过程。
- 最终用户预览:开启最终用户预览功能,即可像最终用户一样体验智能体界面,且不显示调试信息。
您可通过预览页眉中的最终用户预览切换按钮在不同视图间切换。
何时使用“预览”与“评估”
| Scenario | 使用“预览” | 使用“评估” |
|---|---|---|
| 开发过程中的快速交互式测试 | ✓ | |
| 调试特定响应或工具调用 | ✓ | |
| 迭代优化指令或知识库 | ✓ | |
| 跨多个测试用例衡量质量 | ✓ | |
| 发布前进行可重复的自动化测试 | ✓ | |
| 比较不同智能体版本的结果 | ✓ |
这两种方法相辅相成。 先使用“预览”进行探索和优化,再使用“评估”进行大规模验证。
主要功能
聊天功能
在预览选项卡中测试时,您可以:
- 发送文本消息并进行多轮对话
- 查看采用丰富格式呈现的智能体响应
- 复制智能体响应以供审查或记录
- 通过点赞或点踩对响应进行评分
- 通过反馈弹出窗口提供详细反馈,包括文字评论
- 启动新对话以在干净的上下文中进行测试
活动追踪
活动追踪可精确展示智能体如何处理每条消息:
- 推理链步骤:查看智能体遵循的推理节点
- 知识来源引用:查看智能体调用的知识来源及其引用的文献
- 工具执行:查看工具、连接器、流程或技能的调用时间及其返回的结果
- 错误详情:识别并排查处理过程中发生的错误
在活动跟踪中选择任何来源或工具卡片,即可直接跳转至构建选项卡中的相应组件进行编辑。
更多信息请参阅使用活动跟踪调试您的智能体。
对话历史
预览选项卡会保存您的测试对话历史记录。 您可以:
- 查看过去的对话及其结果
- 按状态(全部、失败、进行中、已完成、需要授权或需要输入)筛选对话
- 查看先前对话的记录和推理步骤,以验证智能体的行为
- 查看每个会话的详细指标,包括步骤/轮次、持续时间、最后一步以及处理该请求的模型
更多信息请参阅管理预览对话。