什么是 Windows AI APIs?

显示各种 Windows AI APIs图标的图像。

Windows AI Foundry 通过整套 Windows AI APIs 以及通过 Windows 机器学习 (ML) 启用的硬件抽象 AI 推理能力,提供各种人工智能 (AI) 功能。 Windows AI APIs 支持 AI 功能,无需查找、运行或优化自己的机器学习(ML)模型。 支持Windows AI Foundry 的模型在受支持的Windows 11设备上本地运行(包括具有 NPU 的AI+ PC、具有支持的 GPU 的设备以及满足建议的 CPU 规范的设备),并且可以在后台连续运行。

支持的硬件

Windows AI APIs 正在从 Copilot+ PC 扩展到支持更广泛的硬件。 下表显示了每个 API硬件的当前硬件支持。

注释

在 AI+ PC 上,受支持的 APIs 始终在 NPU 上运行。 GPUCPU 列用于说明如何扩展到非 Copilot+ 设备——它们并不是在 AI+ PC 上可选择启用的替代后端。

API NPU (AI+ PC) GPU CPU
Phi 二氧化硅 ✅ 可用 ✅ 可用 (NVIDIA 和 AMD ❌ 不支持
文本识别(OCR) ✅ 可用 ❌ 不支持 ❌ 不支持
语音识别 ✅ 可用 ❌ 不支持 ✅ 可用(可选、可移动)
视频超分辨率 ✅ 可用 ❌ 不支持 ✅ 可用
图像超分辨率 ✅ 可用 ❌ 不支持 ❌ 不支持
图像说明 ✅ 可用 ❌ 不支持 ❌ 不支持
图像分段 ✅ 可用 ❌ 不支持 ❌ 不支持
对象擦除 ✅ 可用 ❌ 不支持 ❌ 不支持
图像生成 ✅ 可用(可选、可移动) ❌ 不支持 ❌ 不支持

注释

NVIDIA GeForce RTX 30 系列和更新版本(6+ GB vRAM)和 AMD Radeon RX 9060 系列和更新版本(6+ GB vRAM)上提供了对 Phi 硅的 GPU 支持。 GPU 推理要求启用开发人员模式面向开发人员>>)和直接从制造商安装的最新 GPU 驱动程序(请参阅 Phi 硅 - GPU 驱动程序要求)。 视频超分辨率和语音识别在任何 CPU 上运行,但在满足 推荐规格 (4 个物理核心、3 GHz 或更高基时钟、32 MB 或更多 L3 缓存)的设备上表现最佳。 有关详细信息和运行时检查,请参阅各个 API 页面。

模型可用性

底层 AI 模型到达设备的方式取决于 API:

  • Phi Silica — 在 Copilot+ PC 上,该模型已预安装在 NPU 上。 在 GPU 和 CPU 设备上,模型 预安装 — 首次调用 EnsureReadyAsync应用时会按需下载该模型。 下载文件可达数 GB,并通过 Windows 更新在后台运行。 最终用户可以在“设置>>”中删除或重新安装模型。 在触发下载之前,应用应先检查 GetReadyState 并显示同意对话框。 有关建议的 UX 模式,请参阅 Phi 硅 - 模型可用性和下载
  • AI 映像生成 - 仅在 NPU 上运行,但由于其安装大小, 模型未预安装 。 应用首次调用EnsureReadyAsync时会按需下载它,用户稍后可以在“设置>>”中删除它。 在触发下载之前,应用应先检查 GetReadyState 并显示同意对话框。 有关建议的 UX 模式,请参阅 AI 映像生成 - 模型可用性和下载
  • 视频超分辨率 — VSR 模型随 Windows 应用 SDK 在所有受支持的硬件路径上一同提供。 没有首次运行时下载、征得用户同意的步骤或可移除的模型。 请参阅 视频超分辨率 - 建议的 CPU 规范
  • 语音识别 — 在 Copilot+ PC 上,该模型已预安装在 NPU 上。 在仅 CPU 设备上,模型预安装 — 首次调用应用EnsureReadyAsync时会按需下载该模型,用户稍后可以在“设置>>”中删除它。 在触发 CPU 下载之前,应用应先检查 GetReadyState 并显示同意对话框。 有关建议的 UX 模式,请参阅 语音识别 - 模型可用性和下载

请参阅 Windows AI APIs with WinUI 示例应用 ,了解如何与 WinUI 配合使用 Microsoft Foundry on Windows 。

重要

下面是 Windows AI 功能和当前支持的 Windows 应用 SDK 版本列表。 有关简要说明,请参阅本主题后面的可用功能概述APIs

[版本 2.2.2-experimental9(2026 年 6 月实验版)] - GPU 上的 Phi Silica(需要 Windows Insider Experimental Channel 内部版本)

版本 1.8.0 (1.8.250907003) - Phi 二氧化铁 (有限访问功能)对话摘要 (文本智能)对象擦除

版本 1.8 预览版 (1.8.0-preview) - LoRA 微调用于 Phi Silica文本改写器语气风格(文本智能)

个人预览版 - 语义搜索

版本 1.7.1 (1.7.250401001) - 所有其他功能APIs

构建第一个支持 AI 的 Windows 应用

小窍门

为了提高可访问性和可读性,此页面默认显示静态图像。 在某些情况下,可以单击图像以查看动画版本。

若要使用 Visual Studio 和一些简单的 Windows AI APIs生成第一个 Windows 应用,只需满足先决条件并使用 Windows AI APIs开始生成应用时提供的示例代码。

在此处,你可以跳转到一些简短教程,这些教程利用特定的 Windows AIAPIs(例如 Phi 硅演练图像处理演练OCR 演练)构建应用。

在你的电脑上试用 APIs 和模型

AI Dev Gallery 是Microsoft应用商店提供的演示应用,可让你快速下载、试用和使用 Windows AI APIs 和模型。

在 AI Dev Gallery中,选择 APIs 菜单项,然后选择 Phi Silica 示例。 如果模型已在设备上可用,则该示例将立即运行。 否则,请选择 “请求模型 ”以下载模型。 下载后,将激活该示例。 了解关于AI Dev Gallery的更多信息,请参阅什么是AI Dev Gallery?

可用 APIs 的概述

以下是一些可以在您的 Windows 应用中利用的现成 AI 功能:

Phi 硅石

重要

Phi Silica 正在被新的设备端模型 Aion Instruct 取代。 Aion Instruct 将于 2026 年 10 月开始向 Windows Insider Preview 设备推送,并于 2026 年 11 月向零售版设备推送,届时 Phi Silica 将被移除。 有关迁移的详细信息和时间表,请参阅Phi Silica 入门

与大型语言模型(LLM)类似,Phi 硅是一种小型语言模型(SLM),由Microsoft研究开发,用于在本地设备上执行语言处理任务(请参阅从 Phi 硅开始)。 Phi 硅专为具有神经处理单元(NPU)或受支持的 GPU 的Windows设备而设计,允许文本生成和聊天功能直接在设备上以高性能、硬件加速的方式运行。 皮硅在中国不可用。

显示一个 AI 聊天提示为 "介绍你自己" 并使用 Phi Silica 功能生成响应的动画 gif。

文本识别

文本识别 APIs 支持识别图像中的文本,以及在不同类型的文档(如扫描的纸张文档、PDF 文件和数字相机捕获的图像)的本地设备上转换到可编辑和可搜索的数据(请参阅 AI 文本识别入门)。

一个动画 gif,其中显示了使用文本覆盖层识别的屏幕截图中的单词,可以使用文本识别功能将其复制到文件或剪贴板。

图像处理

缩放和锐化图像(图像超分辨率),识别图像中的对象(图像对象提取器),生成图像的自然语言描述(图像说明),并从图像中删除对象(对象擦除)。 请参阅 AI 映像入门

图像超分辨率

图像超分辨率 APIs 支持图像锐化和缩放。

一个动画 gif,显示了图像与使用图像超分辨率功能进行锐化和缩放的单词和图片混合。

另请参阅 图像超分辨率

图像对象提取程序

Image 对象提取器 APIs 支持识别图像中的对象。

一张动态 GIF 图,上面一名男子抬起一只脚,然后选择 “删除背景”,使用图像对象提取器功能将该男子图像隔离到白色背景上。

另请参阅 Image 对象提取程序

图像说明

图像说明 APIs 以自然语言描述图像。

注释

图像说明功能在中国不可用。

一个动画 gif,显示了一只睡着的狗,使用自然语言弹出的图像描述,描述一只蓬松、毛茸茸的狗舒适地躺在沙发上休息,这是图像描述功能的一部分。

另请参阅 图像说明

对象擦除

可以使用对象擦除 APIs 从图像中删除对象。

一个动画 GIF,展示了用户使用对象擦除功能从图像中移除对象的过程。

另请参阅 对象擦除

计划的功能

计划以下功能,但尚未可供使用:

  • 实时翻译(尚不支持)。 通过查看口述内容的字幕(即使音频内容采用不同于系统首选语言的语言),帮助所有人使用 Windows(包括失聪或听力障碍的人)更好地了解音频。

内容审核

了解 Windows AI APIs如何审查内容,以及如何调整敏感度筛选器。 请参阅 Windows AI APIs的内容安全审查

使用 AI 功能时,建议查看:在 Windows上开发负责任的生成 AI 应用程序和功能。

其他资源

另请参阅