你当前正在访问 Microsoft Azure Global Edition 技术文档网站。 如果需要访问由世纪互联运营的 Microsoft Azure 中国技术文档网站,请访问 https://docs.azure.cn。

从GitHub模型迁移到 Microsoft Foundry 模型

重要

GitHub模型于 2026 年 7 月 30 日停用。 操场、模型目录、推理 API 和自带密钥 (BYOK) 支持不再对任何客户可用。 有关详细信息,请参阅GitHub文档中的GitHub模型。

如果应用程序仍调用GitHub模型推理终结点,请按照本文中的步骤将其迁移到 Microsoft Foundry 模型。 GitHub模型是独立于GitHub Copilot的服务,与GitHub Copilot无关。

本文介绍如何通过在Azure订阅中部署 Foundry Tools 资源,将生成 AI 应用程序从已停用的 GitHub Models 服务移动到 Microsoft Foundry 模型。 这两个服务使用相同的推理 API,因此你通常只需更改代码中的终结点和凭据。

先决条件

你需要:

迁移到 Foundry 模型

不同于设有速率限制且可免费使用的 GitHub Models,Foundry Models 的使用将根据你选择的部署类型按量计费,费用计入你的 Azure 订阅。

将 GitHub Models 端点和令牌替换为 Foundry Models 端点和密钥:

  1. 使用Azure帐户登录到 Foundry 门户。

    提示

    如果登录 Foundry (经典) 体验,请切换右上角导航中的 New Foundry 切换器以切换到新的 Foundry 体验。

  2. 按照 “部署模型 ”中的步骤部署所选模型,在 Playground 中测试模型,并使用代码推断已部署的模型。

  3. 在 Foundry 主页上,复制 API 密钥和Project终结点,并使用它们代替应用程序中GitHub模型终结点和个人访问令牌。

  4. 通过从 Playground 或代码发送测试提示来验证迁移是否正常工作。 如果收到响应,则模型已准备好使用。

重要

不同于 GitHub Models(其中所有模型都已预先配置好),Foundry Tools 资源允许你控制终结点中哪些模型可用,以及它们采用哪种配置。 在 model 参数中指示模型之前,请添加你计划使用的任意数量的模型。 了解如何向资源 添加更多模型 。

在 IDE 中使用 Foundry 模型

GitHub模型操场不再可用。 要从编辑器试验模型,请将你的 Foundry 部署作为自带密钥 (BYOK) 语言模型添加到 Visual Studio Code:

  1. 在Visual Studio Code中,在“聊天”视图中打开模型选取器,然后选择“管理语言模型”(齿轮图标),或者从命令面板运行“聊天:管理语言模型”命令。

  2. 选择“添加模型”,然后从提供程序列表中选择Azure。

  3. 输入模型的组名称,然后输入从 Foundry 门户复制的终结点 URL 和 API 密钥。

  4. 在聊天中选择模型选取器中的模型。

或者,在语言模型编辑器中选择“ 安装模型提供程序 ”,并安装 用于 VS Code 的 Foundry 工具包 扩展,该扩展将 Foundry 的云托管模型和本地模型添加到模型选取器。

有关详细信息,请参阅Visual Studio Code中的语言模型。

探索其他功能

Foundry Models 支持GitHub模型未提供的功能:

  • Model 目录 - 浏览、比较和评估来自Azure、合作伙伴和开源社区的模型。
  • 无密钥身份验证 - 无需管理 API 密钥即可对基于令牌的身份验证使用Microsoft Entra ID。
  • 内容筛选 - 为部署配置内容安全筛选器。
  • 速率限制 - 为资源中的特定模型设置自定义速率限制。
  • 部署类型 - 从多个部署 SKU 中进行选择,例如按令牌付费、预配和批处理。

排查常见问题

问题 分辨率
对GitHub模型终结点的请求失败 GitHub模型推理 API 于 2026 年 7 月 30 日停用。 按照本文所述,将应用程序指向 Foundry Models 终结点。
您所在的区域不提供此模型 通过在模型卡的“快速事实”部分中选择“查看可用性”来检查模型的区域可用性。 切换到受支持区域中的项目。
密钥交换后的身份验证错误 验证是否已从 Foundry 门户复制正确的密钥。 在 Foundry 主页中,复制 API 密钥 和 项目终结点,即可查看你的密钥和终结点。
迁移后出现速率限制错误 Foundry 模型速率限制取决于 部署类型。 纵向扩展或选择更高的吞吐量部署。