¿Qué es la IAAPIs de Windows?

Imagen en la que se muestran los iconos de varias inteligencias artificiales de Windows APIs.

Windows AI Foundry ofrece una variedad de funcionalidades de inteligencia artificial (IA) a través de un conjunto de Windows AI APIs y capacidades de inferencia de IA abstraídas del hardware habilitadas mediante Windows Machine Learning (ML). La inteligencia artificial de Windows habilita las funcionalidades de inteligencia artificial APIs sin necesidad de encontrar, ejecutar o optimizar su propio modelo de aprendizaje automático (ML). Los modelos que potencian Windows AI Foundry se ejecutan localmente en dispositivos Windows 11 compatibles, incluidos Copilot+ PCs con NPU, dispositivos con GPU compatibles y dispositivos que cumplen las especificaciones de CPU recomendadas y se pueden ejecutar continuamente en segundo plano.

Compatibilidad del hardware

Windows AI APIs se están expandiendo más allá de Copilot+ PCs para admitir una gama más amplia de hardware. En la tabla siguiente se muestra la compatibilidad actual de hardware para cada API.

Nota:

En un PC Copilot+, las funciones compatibles APIs siempre se ejecutan en la NPU. Las columnas GPU y CPU describen la ampliación a dispositivos sin Copilot+; no son opciones alternativas por las que se pueda optar en un PC Copilot+.

API NPU (Copilot+ PC) Unidad de Procesamiento Gráfico (GPU) Unidad Central de Procesamiento (CPU)
Phi Silica ✅ Disponible ✅ Disponible (NVIDIA y AMD) ❌ No es compatible
Reconocimiento de texto (OCR) ✅ Disponible ❌ No es compatible ❌ No es compatible
Reconocimiento de voz ✅ Disponible ❌ No es compatible ✅ Disponible (opcional, extraíble)
Super resolución de vídeo ✅ Disponible ❌ No es compatible ✅ Disponible
Super resolución de imágenes ✅ Disponible ❌ No es compatible ❌ No es compatible
Descripción de la imagen ✅ Disponible ❌ No es compatible ❌ No es compatible
Segmentación de imágenes ✅ Disponible ❌ No es compatible ❌ No es compatible
Borrado de objeto ✅ Disponible ❌ No es compatible ❌ No es compatible
Generación de imágenes ✅ Disponible (opcional, extraíble) ❌ No es compatible ❌ No es compatible

Nota:

La compatibilidad de GPU para Phi Silica está disponible para la serie 30 de NVIDIA GeForce RTX y posteriores (6+ GB vRAM), y para la serie 9060 de AMD Radeon RX y posteriores (6+ GB vRAM). La inferencia de GPU requiere que el modo de desarrollador esté habilitado (sistema>de configuración>para desarrolladores) y el controlador de GPU más reciente instalado directamente desde el fabricante (consulte PhiLice : requisitos de controladores de GPU). La super resolución de vídeo y el reconocimiento de voz se ejecutan en cualquier CPU, pero funcionan mejor en los dispositivos que cumplen las especificaciones recomendadas (4 núcleos físicos, 3 GHz o un reloj base superior, 32 MB o más de caché L3). Consulte las páginas individuales API para obtener más información y una comprobación en tiempo de ejecución.

Disponibilidad del modelo

La forma en que el modelo de IA subyacente alcanza un dispositivo depende de API:

  • Phi Silica — En los equipos Copilot+, el modelo viene preinstalado en la NPU. En dispositivos GPU y CPU, el modelo no está preinstalado; se descarga bajo demanda la primera vez que tu aplicación llama a EnsureReadyAsync. Las descargas pueden ser varios GB y ejecutarse en segundo plano a través de Windows Update. Los usuarios finales pueden quitar o reinstalar el modelo en Configuración>Componentes de IA del sistema>. Las aplicaciones deben comprobar GetReadyState primero y mostrar un cuadro de diálogo de consentimiento antes de desencadenar la descarga. Consulte PhiLice : disponibilidad del modelo y descarga para obtener el patrón de experiencia de usuario recomendado.
  • Generación de imágenes de IA: solo se ejecuta en la NPU, pero el modelo no está preinstalado debido a su tamaño de instalación. Se descarga bajo demanda la primera vez que tu aplicación llama a EnsureReadyAsync, y los usuarios pueden eliminarla más adelante en Configuración>Sistema>Componentes de IA. Las aplicaciones deben comprobar GetReadyState primero y mostrar un cuadro de diálogo de consentimiento antes de desencadenar la descarga. Consulte Generación de imágenes de IA: disponibilidad del modelo y descarga para obtener el patrón de experiencia de usuario recomendado.
  • Video Super Resolution — el modelo VSR se distribuye con SDK de Aplicaciones para Windows en todas las configuraciones de hardware compatibles. No hay ninguna descarga de primera ejecución, paso de consentimiento o modelo extraíble. Consulte Video Super Resolution : especificaciones de CPU recomendadas.
  • Reconocimiento de voz — En los PC Copilot+, el modelo está preinstalado en la NPU. En los dispositivos solo con CPU, el modelo no viene preinstalado — se descarga bajo demanda la primera vez que tu aplicación llama a EnsureReadyAsync, y los usuarios pueden eliminarlo más tarde en Configuración>Sistema>Componentes de IA. Las aplicaciones deben comprobar GetReadyState primero y mostrar un cuadro de diálogo de consentimiento antes de desencadenar la descarga en la CPU. Consulte Reconocimiento de voz: disponibilidad del modelo y descarga para el patrón de experiencia de usuario recomendado.

Consulta la aplicación de ejemplo de Windows AI APIs con WinUI para obtener información sobre cómo usar Microsoft Foundry on Windows con WinUI.

Importante

A continuación se muestra una lista de las características de windows AI y la versión de SDK de Aplicaciones para Windows en la que se admiten actualmente. Consulte Resumen de lo disponible APIs más adelante en este tema para obtener descripciones breves.

[Versión 2.2.2-experimental9 (junio de 2026 experimental)] - Phi Silica en GPU (requiere una compilación del canal experimental de Windows Insider)

Versión 1.8.0 (1.8.250907003) - PhiLice (característica de acceso limitado), Resumen de conversación (Inteligencia de texto), Borrado de objetos

Versión preliminar 1.8 (1.8.0-preview) - Ajuste de LoRA para Phi Silica, Tono de reescritura de texto (Inteligencia de texto)

Versión preliminar privada : búsqueda semántica

Versión 1.7.1 (1.7.250401001) - el resto APIs

Compilación de la primera aplicación de Windows con tecnología de IA

Sugerencia

Para mejorar la accesibilidad y la legibilidad, esta página muestra imágenes fijas de forma predeterminada. En algunos casos, puede hacer clic en una imagen para ver una versión animada.

Para compilar la primera aplicación de Windows con Visual Studio y alguna inteligencia artificial APIssencilla de Windows, solo tiene que cumplir los requisitos previos y usar el código de ejemplo proporcionado en Introducción a la creación de una aplicación con la IA APIsde Windows.

Desde allí, puede acceder a breves tutoriales para crear una aplicación que aprovecha funciones específicas de IA de Windows APIs, como la guía de Phi Silica, la guía de imágenes y la guía de OCR.

Pruebe las APIs y los modelos en su PC

AI Dev Gallery es una aplicación de demostración, disponible en la Microsoft Store, que te permite descargar, utilizar y probar rápidamente modelos y AI de Windows APIs.

En AI Dev Gallery, seleccione el elemento de menú de la pestaña Windows AI APIs y, a continuación, seleccione el ejemplo phiLice. Si el modelo ya está disponible en el dispositivo, ese ejemplo se ejecutará inmediatamente. De lo contrario, seleccione Solicitar modelo para descargar el modelo. Una vez descargado, ese ejemplo se activará. Obtenga más información sobre el AI Dev Gallery en ¿Qué es el AI Dev Gallery?.

Información general sobre la disponibilidad APIs

Estas son algunas características de inteligencia artificial listas para usar que puede acceder desde la aplicación de Windows:

PhiLice

Importante

Phi Silica está siendo sustituido por Aion Instruct, un nuevo modelo que se ejecuta en el dispositivo. Aion Instruct comienza a distribuirse en dispositivos Windows Insider Preview en octubre de 2026 y en dispositivos de venta al público en noviembre de 2026, momento en el que se quitará Phi Silica. Consulte Introducción a PhiLice para obtener detalles de transición y escala de tiempo.

De forma similar a los modelos de lenguaje grande (LLM), PhiLice es un modelo de lenguaje pequeño (SLM) desarrollado por Microsoft Research para realizar tareas de procesamiento de lenguaje en un dispositivo local (consulte Get started with PhiLice). Phi Silica está diseñado para dispositivos Windows con una unidad de procesamiento neuronal (NPU) o una GPU compatible, lo que permite que las funciones de generación de texto y conversación funcionen con alto rendimiento y aceleración por hardware directamente en el dispositivo. PhiLice no está disponible en China.

Un gif animado que muestra un mensaje de chat de IA que dice preséntate y una respuesta que se genera mediante la función Phi Silica.

Reconocimiento de texto

El reconocimiento de texto permite el reconocimiento APIs de texto en una imagen y la conversión en un dispositivo local de diferentes tipos de documentos (como documentos de papel escaneados, archivos PDF e imágenes capturadas por una cámara digital) en datos editables y buscables (consulte Introducción al reconocimiento de texto de IA).

Gif animado que muestra palabras en una captura de pantalla que se reconocen con superposiciones de texto que se pueden copiar en un archivo o portapapeles mediante la característica de reconocimiento de texto.

Imágenes

Escalar y afilar imágenes (Super resolución de imágenes), identificar objetos dentro de una imagen (Extractor de objetos de imagen), generar descripciones en lenguaje natural de imágenes (Descripción de imagen) y quitar objetos de imágenes (Erase de objetos). Consulte Introducción a la creación de imágenes de IA.

Superresolución de imágenes

La superresolución de imágenes APIs habilita el ajuste y el escalado de imágenes.

GIF animado que muestra una imagen con una combinación de palabras e imágenes que se ajustan y se escalan mediante la característica Superresolución de imágenes.

Consulte también Superresolución de imágenes.

Extractor de objetos de imagen

El Extractor APIs de objetos de imagen permite identificar objetos dentro de las imágenes.

Un gif animado que muestra a un hombre levantando un pie fuera del suelo y seleccionando Quitar fondo para aislar la imagen del hombre en un fondo blanco mediante la característica Extractor de objetos de imagen.

Consulte también Extractor de objetos de imagen.

Descripción de la imagen

La descripción APIs de la imagen describe las imágenes en lenguaje natural.

Nota:

Las características de descripción de la imagen no están disponibles en China.

Un gif animado que muestra a un perro dormido que muestra una descripción de la imagen usando lenguaje natural leyendo un perro peludo y desgreñado acostado en un sofá descansando cómodamente, usando la función Descripción de la imagen.

Consulte también Descripción de la imagen.

Borrado de objeto

Puede usar el borrado APIs de objetos para quitar objetos de imágenes.

Gif animado en el que se muestra una imagen en la que el usuario quita objetos del uso de la característica Borrado de objetos.

Consulte también Borrado de objetos.

Características planeadas

Las siguientes funcionalidades están planeadas pero aún no están disponibles para su uso:

  • Traducción en vivo (todavía no compatible). Ayude a todos los usuarios que usan Windows(incluidos aquellos que son sordos o sordos) a comprender mejor el audio mediante la visualización de subtítulos del contenido hablado (incluso cuando el contenido de audio está en un idioma diferente del idioma preferido del sistema).

Moderación de contenido

Obtenga información sobre cómo la inteligencia artificial APIsde Windows modera el contenido y cómo puede ajustar los filtros de confidencialidad. Consulte Moderación de seguridad de contenido con la inteligencia artificial APIsde Windows.

Al usar características de IA, se recomienda revisar: Desarrollar aplicaciones y características de IA generativas responsables en Windows.

Recursos adicionales

Consulte también