Important
此功能目前为预览版。
管道运维代理是 Microsoft Fabric 中的一项由人工智能驱动的功能,帮助您自动监控、诊断和优化数据管道执行。 与通用AI代理不同,该功能专为Fabric流水线操作设计。
直接内置于流水线体验中,代理分析流水线运行、日志和性能信号,无需人工调查即可提供可操作的洞察。 代理不断循环:观察、分析、推荐和行动。
这种方法让你从被动调试转向主动的管道操作。
为什么要用运维代理?
大规模管理管道通常需要:
- 手动查看运行历史和日志
- 多项活动的故障诊断
- 解读性能瓶颈
- 构建自定义查询或仪表盘
运维代理通过自动化这些工作流程来减少这些工作量。
主要优势
- 加速故障排除:快速识别管道故障的根本原因。
- 减少人工工作:消除手动收集日志和信号的需求。
- 主动监控:通过持续分析及早发现问题。
- 提升流水线可靠性:在大规模下保持稳定的生产级工作流程。
- 可行的建议:获得针对性的指导,优化表现和健康。
如何使用操作代理
Fabric Data Factory 集成了操作智能体,并会自动使用管道上下文。
从管道画布上的 主页 功能区访问操作代理。
选择一个流水线场景并生成你的代理。 选择你的预配置代理,以及代理是否监控你当前的流水线,还是监控你工作区中的所有流水线。
Note
目前,运维代理仅支持健康监测场景。
选择 创建 以生成你的代理人。
创建代理后,选择 “打开代理配置 ”以查看您的运营代理项。
该代理支持自动上下文注入,并使用:
- 流水线执行日志
- 活动级元数据
- 性能和运行时信号
你不需要手动设置或配置代理。 代理会随着时间监控流水线行为,并基于观察到的模式构建洞察,包括:
- 故障的根本原因分析
- 瓶颈和异常的检测
- 优化建议
- 问题提醒或通知
在你的运营代理项中,你可以编辑代理指令来更新操作手册。 你可以扩展代理的具体操作,跟踪日志,并为代理添加更多上下文以便监控。
在运营代理项的顶部色带中选择 “开始 ”来运行你的代理。 代理通过Teams向你发送流水线监控洞察。
核心功能
| Capability | Description |
|---|---|
| 管道健康监测 | 跟踪成功率和失败率、执行模式以及跨次运行的异常行为。 |
| 失效诊断 | 分析管道和活动层级的故障,以识别可能的根本原因。 |
| 性能优化 | 识别运行缓慢的活动,并检测影响流水线性能的瓶颈。 |
| 主动警报 | 根据观察到的趋势和状况,尽早发现问题。 |
| 场景驱动设置 | 快速开始使用针对管道场景量身定制的模板。 |
示例方案
诊断失败的管道
当 Fabric Data Factory 管道失败时,运维代理可以:
- 分析执行日志和历史
- 识别失败的活动
- 提供一个可能的根本原因
- 建议下一步解决方案
优化管道性能
对于运行缓慢的 Fabric Data Factory 管道,操作代理可以:
- 检测长期活动
- 突出低效之处
- 建议有针对性的改进
大规模监控管道健康状况
对于拥有多个 Fabric 流水线的生产环境,运维代理可以:
- 持续跟踪管道健康状态
- 识别异常失效模式
- 在风险升级前发现风险
何时使用操作代理
在以下情况下使用运维代理:
- 你大规模运行生产流水线。
- 你需要更快的故障诊断。
- 你需要主动监控和洞察。
- 你想减少手动操作的开销。