生成代理或工作流后,首先选择谁运行其基础结构。 这是在由 Microsoft 管理的 Foundry 托管代理和自托管之间作出的运维选择;它与客户端用来访问你的代理所使用的协议是相互独立的。
选择托管模型
| Foundry 托管代理 | 自托管 | |
|---|---|---|
| 谁操作基础结构? | Microsoft Foundry 代理服务运行容器、缩放、会话生命周期和平台集成。 | 应用程序在 Web 服务、容器、运行时或现有基础结构中运行。 |
| 您使用的是什么? | 您的智能体代码和 Foundry 配置。 | 路由、身份、授权、请求策略、存储、部署、扩缩容以及原生客户端库。 |
| 在以下情况下选择此选项 | 你需要由 Microsoft 管理的代理托管。 | 需要应用程序级控制,或者必须与现有基础结构集成。 |
| 从此处开始 | 在 Foundry 中托管代理 | 自行托管代理框架应用程序 |
Microsoft Foundry 托管代理现已正式发布。 当前 Python 自托管软件包处于预发布阶段;有关特定软件包生命周期的信息,请参阅自托管指南。
对于 Azure Functions 触发器、持久化执行或长期运行的编排,请使用持久化扩展。 这是一种采用 Durable Task 基础结构的自主管理托管方案。
单独选择协议
宿主模型不确定协议。 例如,OpenAI 响应协议适用于这两种模型:
- Foundry 托管智能体公开了受管响应和调用端点,并支持 Microsoft 365 频道的 Activity 协议。
-
通过自承载 ,应用程序可以使用响应帮助程序通过自己的框架、路由和策略公开
/responses终结点。
选择主机后,选择适合方案的客户端集成:
- 用于与 Responses 和 Chat Completions 兼容的 API 的 OpenAI 兼容端点。
- 使用A2A 托管,通过代理到代理协议公开代理框架代理。
- 用于调用远程 A2A 兼容代理的 A2A 代理服务。
- 用于基于 Web 的代理应用程序的 AG-UI。
- Telegram 机器人用于自托管的原生 Telegram 机器人 API 集成。
- MCP 工具,用于将智能体或工作流作为原生 MCP 工具对外提供。
后续步骤
更深入: