管道运营代理(预览版)

Important

此功能目前为预览版

管道运维代理是 Microsoft Fabric 中的一项由人工智能驱动的功能,帮助您自动监控、诊断和优化数据管道执行。 与通用AI代理不同,该功能专为Fabric流水线操作设计。

直接内置于流水线体验中,代理分析流水线运行、日志和性能信号,无需人工调查即可提供可操作的洞察。 代理不断循环:观察、分析、推荐和行动。

这种方法让你从被动调试转向主动的管道操作。

为什么要用运维代理?

大规模管理管道通常需要:

  • 手动查看运行历史和日志
  • 多项活动的故障诊断
  • 解读性能瓶颈
  • 构建自定义查询或仪表盘

运维代理通过自动化这些工作流程来减少这些工作量。

主要优势

  • 加速故障排除:快速识别管道故障的根本原因。
  • 减少人工工作:消除手动收集日志和信号的需求。
  • 主动监控:通过持续分析及早发现问题。
  • 提升流水线可靠性:在大规模下保持稳定的生产级工作流程。
  • 可行的建议:获得针对性的指导,优化表现和健康。

如何使用操作代理

Fabric Data Factory 集成了操作智能体,并会自动使用管道上下文。

  1. 从管道画布上的 主页 功能区访问操作代理。

    截图显示了管道画布中带有操作代理选项的 Home 功能区。

  2. 选择一个流水线场景并生成你的代理。 选择你的预配置代理,以及代理是否监控你当前的流水线,还是监控你工作区中的所有流水线。

    Note

    目前,运维代理仅支持健康监测场景。

    截图显示操作代理的流水线选择对话框。

  3. 选择 创建 以生成你的代理人。

    截图显示代理创建进度,包含添加知识源、设定业务目标和添加代理指令的步骤。

  4. 创建代理后,选择 “打开代理配置 ”以查看您的运营代理项。

    截图显示成功创建的代理确认,带有“打开代理配置”链接。

    该代理支持自动上下文注入,并使用:

    • 流水线执行日志
    • 活动级元数据
    • 性能和运行时信号

    你不需要手动设置或配置代理。 代理会随着时间监控流水线行为,并基于观察到的模式构建洞察,包括:

    • 故障的根本原因分析
    • 瓶颈和异常的检测
    • 优化建议
    • 问题提醒或通知

    在你的运营代理项中,你可以编辑代理指令来更新操作手册。 你可以扩展代理的具体操作,跟踪日志,并为代理添加更多上下文以便监控。

  5. 在运营代理项的顶部色带中选择 “开始 ”来运行你的代理。 代理通过Teams向你发送流水线监控洞察。

    截图显示了操作代理的项目功能区,其中包含“保存”、“还原到上次保存状态”、“开始”、“停止”和“在 Teams 中打开”选项。

    截图显示了运维代理发出的Teams通知,包含管道故障监控洞察。

核心功能

Capability Description
管道健康监测 跟踪成功率和失败率、执行模式以及跨次运行的异常行为。
失效诊断 分析管道和活动层级的故障,以识别可能的根本原因。
性能优化 识别运行缓慢的活动,并检测影响流水线性能的瓶颈。
主动警报 根据观察到的趋势和状况,尽早发现问题。
场景驱动设置 快速开始使用针对管道场景量身定制的模板。

示例方案

诊断失败的管道

当 Fabric Data Factory 管道失败时,运维代理可以:

  • 分析执行日志和历史
  • 识别失败的活动
  • 提供一个可能的根本原因
  • 建议下一步解决方案

优化管道性能

对于运行缓慢的 Fabric Data Factory 管道,操作代理可以:

  • 检测长期活动
  • 突出低效之处
  • 建议有针对性的改进

大规模监控管道健康状况

对于拥有多个 Fabric 流水线的生产环境,运维代理可以:

  • 持续跟踪管道健康状态
  • 识别异常失效模式
  • 在风险升级前发现风险

何时使用操作代理

在以下情况下使用运维代理:

  • 你大规模运行生产流水线。
  • 你需要更快的故障诊断。
  • 你需要主动监控和洞察。
  • 你想减少手动操作的开销。