Oharra
Baimena behar duzu orria atzitzeko. Direktorioetan saioa has dezakezu edo haiek alda ditzakezu.
Baimena behar duzu orria atzitzeko. Direktorioak alda ditzakezu.
Foundry Agent Service es una plataforma administrada para crear, implementar y escalar agentes de IA. Desarrolle con cualquier framework, cualquier modelo compatible del catálogo de modelos de Foundry y un único punto de entrada para la inferencia de modelos y las herramientas.
Foundry se encuentra en cualquier parte del espectro de código declarativo a completo: defina un agente de solicitud o un agente de mensajes basado en voz y deje que Foundry lo ejecute, empaquete su propio código como agente hospedado o llame a la API de respuestas desde un agente que ya se ejecuta en otro lugar. Elija cómo compilar describe cada opción.
Servicio de agente de un vistazo
| Componente | Qué hace |
|---|---|
| Tiempo de ejecución del agente | Hospeda y escala agentes de indicaciones y agentes hospedados. Administra conversaciones, llamadas a herramientas y ciclo de vida del agente. |
| Cajas de herramientas | Seleccione un conjunto de herramientas una vez, como: búsqueda web, búsqueda de archivos, intérprete de código, servidores MCP y funciones personalizadas. Después, compártelos entre agentes a través de un único punto de conexión de MCP administrado con autenticación centralizada, gobernanza y control de versiones. |
| Modelos | Funciona con muchos modelos del catálogo de modelos de Foundry, como GPT-4o, Llama y DeepSeek. Intercambia modelos sin cambiar el código del agente. |
| Observabilidad | Seguimiento de un extremo a otro, métricas, evaluaciones e integración de Application Insights. Vea cada decisión que tome el agente y mida su calidad. |
| Optimización | El optimizador de agentes (versión preliminar) evalúa el comportamiento de los agentes y genera automáticamente mejores instrucciones, habilidades, descripciones de herramientas y selección de modelos para agentes de prompt y agentes alojados. |
| Identidad y seguridad | Identidad de Microsoft Entra, RBAC, filtros de contenido y aislamiento de red virtual. Confianza de nivel empresarial integrada. |
| Publicación | Versiona los agentes, crea puntos de conexión estables y compártelos a través de Microsoft Teams, Microsoft Copilot y el Registro de agentes de Entra. |
Elección de cómo compilar
Sugerencia
¿Creando tu primer agente? Comience con un agente de indicaciones usando ya sea el portal de Foundry o la guía de inicio rápido para crear un agente de indicaciones con código.
Foundry proporciona varias maneras de compilar, desde una sola llamada de modelo a un agente totalmente contenedorizado. Elige tu camino según lo que quieras hacer:
- ¿Quiere gestionar lo mínimo posible el texto?Empiece con un agente de prompts. Configurar instrucciones, un modelo y herramientas; Foundry lo ejecuta sin código ni infraestructura.
- ¿Quieres una experiencia de voz administrada en tiempo real?Cree un agente de solicitud basado en voz. Configure la experiencia de voz y conéctela a través de Voice Live sin hospedar el código de orquestación usted mismo.
- ¿Quieres el control total en Foundry?Implemente un agente hospedado. Trae tu propio código y framework en un contenedor; Foundry lo ejecuta con un endpoint administrado, escalado e identidad.
- ¿Ya se ha ejecutado el código del agente en otro lugar?Llame directamente a la API de respuestas para usar los modelos y herramientas de Foundry, sin ningún recurso de agente para administrar.
Los agentes de solicitud, los agentes de mensajes basados en voz y los agentes hospedados son los tipos de agente que se tratan en esta introducción. En la sección siguiente se desglosa el valor de cada uno para que pueda elegir con confianza.
Tipos de agente
El servicio de agente ofrece tres tipos de agente. Su elección determina cuánto desarrolla usted frente a cuánto gestiona Foundry:
- Agentes de prompts: el camino más rápido. Defina instrucciones, un modelo y herramientas y Foundry ejecuta el agente sin código ni infraestructura para administrarlo.
- Agentes de instrucciones de voz: agentes de voz en tiempo real gestionados. Configure el modelo, las instrucciones, el audio y las herramientas y conéctese al agente a través de Voice Live.
- Agentes alojados: el máximo control. Traiga su propio código y marco, y Foundry lo ejecuta como un contenedor con un punto de conexión administrado, el escalado y la identidad.
Agentes de solicitud
Los agentes de solicitud se definen completamente a través de la configuración, incluidas las instrucciones, la selección de modelos y las herramientas. Créelos en el portal de Foundry para empezar rápidamente, o defínelos mediante programación con los SDKs o la API REST para integrarlos con sus flujos de trabajo de CI/CD. De cualquier forma, Foundry ejecuta el agente por usted. No hay ningún código de aplicación que se mantenga y no haya contenedores ni paquetes para optimizar, escalar ni supervisar la seguridad.
Dos rutas de acceso para empezar:
- Portal primero: cree un agente de forma interactiva en el portal de Foundry, pruárelo en el área de juegos y, a continuación, llámelo desde el código de la aplicación.
- Code-first: defina el agente mediante el SDK o la API REST en la canalización de implementación, habilitando el control de versiones, la revisión de código y el lanzamiento automatizado.
Mejor para: Introducción a herramientas internas, rápidas, agentes de producción que no necesitan lógica de orquestación personalizada y equipos que quieran un entorno de ejecución administrado sin sobrecarga de infraestructura.
Agentes de instrucciones por voz
Los agentes de mensajes basados en voz son agentes administrados para conversaciones habladas en tiempo real. Configure un modelo, instrucciones, configuración de audio, saludo opcional y herramientas en la definición del agente. Foundry Agent Service administra el ciclo de vida del agente y usa Voice Live para el reconocimiento de voz, la toma de turnos, la interacción del modelo y la síntesis de voz.
Los agentes con indicaciones de voz admiten modelos administrados y, cuando sea compatible, la implementación de su propio modelo. Se conecta al agente a través de un WebSocket en tiempo real en lugar de enviar solicitudes de texto individuales. Para conocer la configuración y los idiomas de cliente admitidos, consulte Inicio rápido: Creación de un agente de mensajes basado en voz. Para conocer los límites de arquitecturas de voz, recursos y versión preliminar actual, consulte Funcionamiento de los agentes basados en voz.
Ideal para: experiencias de voz orientadas al cliente, escenarios de centro de llamadas y aplicaciones que necesitan interacción de audio de baja latencia sin implementar el servicio de orquestación de voz usted mismo.
Agentes hospedados
Agentes hospedados son agentes basados en código que creas con Agent Framework, LangGraph, el OpenAI Agents SDK, el Anthropic Agent SDK, el GitHub Copilot SDK o tu propio código. Envíe el agente como una imagen de contenedor o un archivo de .zip del código fuente (Foundry compila la imagen automáticamente al traer un archivo de .zip) y Foundry lo ejecuta con un punto de conexión administrado, escalado automático, una identidad Microsoft Entra dedicada, persistencia de estado de sesión y observabilidad de un extremo a otro.
En segundo plano, el código del agente llama al punto de conexión del proyecto Foundry para la inferencia de modelos y la orquestación de herramientas, lo que le proporciona acceso a los modelos Foundry desde el catálogo y un conjunto unificado de herramientas de plataforma: herramientas estándar como búsqueda de archivos, intérprete de código y búsqueda web, además de herramientas adicionales como SharePoint, WorkIQ y Fabric IQ.
Ideal para: agentes que invocan su propio código personalizado; en segundo lugar, lógica de orquestación personalizada, sistemas multiagente y protocolos personalizados (webhooks, voz, AG-UI) cuando se quiere tener un control total sobre la lógica del agente, mientras se deja que Foundry se encargue del alojamiento, el escalado y la identidad.
Comparación de tipos de agente
| Agentes de solicitud | Agentes de instrucciones por voz | Agentes hospedados | |
|---|---|---|---|
| Superficie de edición | Portal, SDK o REST | Definición del agente a través del portal, el SDK o REST | Agent Framework, LangGraph, SDK de agentes de OpenAI, SDK de agente de Anthropic, SDK de GitHub Copilot, código personalizado |
| Modelos de Foundry + herramientas de la plataforma | Sí | Sí, a través de Voice Live y de las herramientas de agente configuradas | Sí (a través de la API de respuestas en el punto de conexión del proyecto Foundry) |
| Compatibilidad con capacidades | Sí | Sí | Sí |
| Código en tiempo de ejecución para mantener | Ninguno | Ninguno para la orquestación de voz gestionada | Sí: la lógica del agente |
| Cómputo para administrar | Ninguno: totalmente administrado | Ninguno: totalmente administrado | Computación en contenedores, gestionada por Foundry |
| Punto de conexión administrado | Sí | Sí, WebSocket en tiempo real | Sí |
| Autoscale | Automático, administrado por Foundry; escala según el volumen de solicitudes | Administrado por Foundry and Voice Live | Automático, administrado por Foundry; escala instancias de contenedor por sesión y volumen de solicitudes |
| Identidad del agente (Entra) | Sí | Sí | Automático, dedicado para cada agente |
| Modelo de costo | Inferencia por llamada + uso de herramientas | Uso de Voice Live y del modelo; consulte los precios del servicio. | Inferencia por solicitud + uso de herramientas + cómputo en contenedor |
| Mejor para | Inicio rápido, agentes de producción sin orquestación personalizada | Interacciones habladas en tiempo real sin hospedar código de orquestación de voz | Agentes que invocan código personalizado; en segundo lugar, lógica de orquestación personalizada |
Uso de la API de respuestas para agentes efímeros
Al llamar a la API de respuestas directamente desde su propio código, se crea un agente efímero: la definición del agente (instrucciones, herramientas y modelo) reside en el código de la aplicación en lugar de como un recurso persistente en Foundry. Cada llamada ensambla el agente en el proceso y lo ejecuta en la API de respuestas, por lo que no hay ningún agente para crear, actualizar ni eliminar en Foundry.
Use este patrón cuando desee:
- Lógica del agente que viene con tu aplicación. Mantén las versiones de las definiciones junto con el resto del código mediante el control de versiones y las revisiones de código, en lugar de como un recurso independiente de Foundry que alguien tenga que mantener sincronizado con la aplicación.
- Capacidades de fundición sin sobrecarga de recursos. Sigues teniendo modelos de catálogo, herramientas de plataforma, datos restringidos al proyecto, autenticación en nombre de otro y observabilidad y gobernanza en el nivel de proyecto. Todo ello a través del punto de conexión del proyecto de Foundry.
Consulte Inicio rápido: Uso de la API de respuestas para obtener información.
Funcionamiento de los agentes basados en voz
Los agentes de indicaciones de voz mantienen conversaciones orales en tiempo real. El agente se configura en el portal de Foundry o a través del SDK, lo prueba con un micrófono y lo hace disponible a través de una experiencia del explorador o un canal de número de teléfono. Foundry gestiona el ciclo de vida del agente y la orquestación de voz, por lo que no tienes que alojar esa infraestructura tú mismo.
Importante
Los agentes basados en voz y algunas funcionalidades relacionadas de supervisión, evaluación, avatar, WebRTC y telefonía están en versión preliminar. Las funcionalidades de versión preliminar se proporcionan sin un contrato de nivel de servicio y no se recomiendan para cargas de trabajo de producción hasta que revise sus requisitos de soporte técnico, seguridad, cumplimiento y disponibilidad.
Los agentes basados en voz admiten dos arquitecturas de modelo.
Voz a voz nativa
Caller audio
-> realtime speech model
-> spoken response
Esta arquitectura está optimizada para la conversación natural y de baja latencia. El modelo en tiempo real controla directamente la entrada y salida habladas. La configuración admitida y las familias de voz dependen del modelo seleccionado.
Modelo de texto en cascada
Caller audio
-> speech recognition
-> text model
-> speech synthesis
-> spoken response
Esta arquitectura proporciona un modelo de texto más amplio y Azure opciones de voz. También proporciona un control explícito sobre la transcripción, las listas de frases, la detección de turnos y las respuestas provisionales, pero cada fase contribuye a la latencia de un extremo a otro.
Recursos principales
Un agente de voz creado por el portal típico usa:
- Un recurso de Foundry y un proyecto.
- Un agente de instrucciones por voz con control de versiones.
- Un modelo de Voice Live totalmente administrado o un modelo válido implementado por el cliente.
- Capacidades de Azure Speech en Foundry Tools para transcripción o síntesis cuando la arquitectura seleccionada lo requiera.
- Application Insights para seguimientos, supervisión y datos de evaluación.
- Azure Communication Services y Azure Event Grid para llamadas entrantes de extensibilidad de Teams Phone, o una conexión a un proyecto de Twilio para canales de números de teléfono de Twilio.
No es necesario implementar un modelo de audio independiente cuando se usa un modelo de Voice Live totalmente administrado. La disponibilidad y el comportamiento del modelo se cargan dinámicamente para el recurso y la región.
Admite límites en el portal actual
| Capacidad | Comportamiento actual basado en voz |
|---|---|
| Pruebas del navegador | Compatible con el área de juegos del agente. |
| Vista previa de la aplicación web | Disponible cuando el endpoint del agente admite el protocolo Responses. |
| Números de teléfono | Extensibilidad de Teams Phone y Twilio. |
| SIP directo | Actualmente no se ofrece como flujo de cliente compatible. |
| publicación de aplicaciones de Microsoft Teams y Microsoft 365 Copilot | La tarjeta de agente de texto estándar no se muestra actualmente en el diseño de canales basados en voz. No describa esto como la vía de integración con el teléfono. |
| Avatar | Contenido visual del navegador a través de WebRTC; las personas que llaman por teléfono solo reciben audio. |
| Monitoring | Las tarjetas de resumen por voz, el desglose de tokens y los gráficos de latencia de la conexión requieren Application Insights. |
| Tracing | Los seguimientos de voz usan una sola vista orientada a seguimiento porque los seguimientos de voz no tienen una API response_idde respuestas . |
| Evaluación | Se admite la evaluación de conversaciones completas a partir de conversaciones existentes. Las evaluaciones de un solo turno y de conversaciones simuladas no son compatibles actualmente con los agentes de voz. |
| Creación de conjuntos de datos a partir de trazas | La acción trace-page no está disponible actualmente para los agentes de voz. |
Disponibilidad y precios
La disponibilidad depende de la región del recurso Foundry, el modelo seleccionado, la voz seleccionada, la suscripción y las características de versión preliminar habilitadas. Compruebe el portal antes de confiar en un modelo específico.
Entre los posibles cargos se incluyen la entrada y salida del modelo de IA generativa, el reconocimiento de voz y la síntesis, el entrenamiento y el hospedaje de voz personalizados, el uso del avatar, la ingesta y retención de Application Insights, Azure Communication Services llamadas y números de teléfono, Microsoft Teams y servicios de telefonía, así como herramientas y servicios de datos conectados. Para más información sobre los costos, consulte Precios de los agentes basados en voz.
Documentación del agente de voz
| Artículo | Úsela para |
|---|---|
| Crea un agente de prompts por voz | Cree un agente de voz administrado, conéctese a una sesión en directo y complete un turno hablado. |
| Configuración de un agente de voz | Elija un modelo y configure la transcripción, los idiomas, las voces, los avatares, la detección de turnos, la mejora de audio, las respuestas provisionales y las herramientas. |
| Integración de un canal de telefonía | Integre la extensibilidad de Teams Phone o Twilio con un agente de voz. |
| Seguimiento, supervisión y evaluación del agente de voz | Seguimiento, supervisión y evaluación de conversaciones de voz. |
| Procedimientos recomendados para agentes basados en voz | Aplique controles de instrucciones, latencia, reconocimiento, seguridad, privacidad, transferencia, pruebas y lanzamiento. |
Compatibilidad con modelos
El servicio de agente funciona con muchos modelos disponibles en el catálogo de modelos Foundry. Para obtener la lista completa, consulte el portal de Foundry.
Herramientas y cuadros de herramientas
Los agentes actúan en el mundo a través de herramientas. Foundry ofrece herramientas integradas, como búsqueda web, búsqueda de archivos, intérprete de código y memoria, al tiempo que le permite agregar herramientas personalizadas a través de funciones, especificaciones de OpenAPI y servidores MCP. Para obtener el conjunto completo, consulte la información general del cuadro de herramientas.
Un cuadro de herramientas agrupa esas herramientas en una sola unidad reutilizable. Seleccionas las herramientas una sola vez, y Foundry las expone a través de un único endpoint gestionado compatible con MCP que cualquier agente o entorno de ejecución puede consumir, independientemente del framework. Los kits de herramientas centralizan la autenticación, la gobernanza y el control de versiones, de modo que puedes actualizar las herramientas en un solo lugar en lugar de tener que reconfigurar todos los agentes. Cree una nueva versión, pruébela y remuévala al valor predeterminado cuando esté listo. Para obtener más información, consulte ¿Qué es el cuadro de herramientas en Foundry?.
Conexión y autenticación en servidores remotos de MCP
Foundry admite servidores MCP remotos que puede agregar al agente, como el servidor MCP de Azure DevOps. Conecte la organización de Azure DevOps para habilitar el acceso al agente y configure un subconjunto de herramientas disponibles para controlar qué acciones pueden realizar los agentes. También puede conectar servidores MCP personalizados hospedados en Azure Functions mediante el punto de conexión de webhook de MCP de Functions (/runtime/webhooks/mcp) para exponer herramientas personalizadas a los agentes.
Entre las opciones de autenticación admitidas para los servidores MCP y otras conexiones de herramientas se incluyen:
- Acceso basado en claves
- Microsoft Entra (utilizando la identidad administrada del agente o la del proyecto)
- Paso de identidad OAuth (En nombre de)
- Acceso no autenticado, cuando corresponda
Estas opciones de autenticación también se aplican al conectar servidores MCP remotos, con credenciales y ámbitos administrados en la configuración de la herramienta.
Ciclo de vida de desarrollo
El servicio de Agente admite el flujo de trabajo completo de construir-probar-desplegar-monitorizar.
- Crear: defina un agente de solicitud en el portal o con el SDK, o escriba un agente hospedado que llame a la API de respuestas.
- Prueba: chatea con tu agente en el entorno de pruebas para agentes o ejecútalo localmente. Las integraciones de servidores MCP, incluidos los servidores MCP personalizados hospedados en Azure Functions, se pueden probar directamente en el entorno de pruebas para validar la conectividad, los permisos y el comportamiento de las herramientas antes de publicarlas.
- Seguimiento: inspeccione todas las llamadas a modelos, la invocación de herramientas y la decisión con el seguimiento del agente.
- Evaluar: ejecutar evaluaciones para medir la calidad y detectar regresiones.
- Optimizar: mejore automáticamente las instrucciones del agente hospedado mediante el optimizador de agentes.
- Publicar: Convierta su agente en un recurso administrado con un extremo estable.
- Monitor: realice un seguimiento del rendimiento y la confiabilidad con métricas de servicio y paneles.
Para ver un tutorial detallado, consulte Ciclo de vida de desarrollo del agente.
Funcionalidades empresariales
El servicio de agente proporciona infraestructura de nivel empresarial para cada agente que implemente:
- Identidad del agente: cada agente puede tener una identidad de Microsoft Entra dedicada, lo que permite el acceso seguro y con ámbito a los recursos y las API sin compartir credenciales. Las identidades del agente se pueden autenticar en servidores MCP externos, incluidos los hospedados en Azure Functions, y el acceso directo de OAuth On-Behalf-Of (OBO) se admite cuando se configura.
- Redes privadas: ejecute agentes dentro de la red virtual Azure para el aislamiento de red completo y el cumplimiento de los requisitos de residencia de datos. Hay conectividad de red privada disponible para agentes de indicaciones. Los agentes hospedados admiten Bring-Your-Own Azure Virtual Network (BYO VNet), donde cada sesión se ejecuta en una sandbox aislada de máquina virtual conectada a tu VNet.
- Control de acceso basado en roles: permisos granulares a través de Microsoft Entra y Azure RBAC. Controlar quién puede crear, invocar y administrar agentes.
- Seguridad del contenido: los filtros de contenido integrados ayudan a mitigar los riesgos de inyección de mensajes (incluida la inyección entre mensajes) y a evitar salidas no seguras.
Para obtener instrucciones de configuración del entorno, consulte Configuración del entorno.
Publicación y uso compartido
El servicio de agente proporciona control de versiones integrado y publicación para que los agentes puedan pasar de desarrollo a producción con confianza.
- Control de versiones: al iterar en el agente, se crea automáticamente una instantánea de las versiones. Revierte a cualquier versión anterior o compare los cambios entre versiones.
- Publicación: promueva un agente a un recurso administrado con un punto de conexión estable. Los agentes publicados heredan los controles de acceso e identidad de empresa configurados para el proyecto y se pueden invocar mediante programación.
- Distribución: compartir agentes publicados a través de Microsoft Copilot y Teams y del Registro de agentes de Entra, para poner sus agentes donde sus usuarios ya trabajan. Foundry Agent Service admite los protocolos OpenResponses y Activity para la publicación en Microsoft 365, un protocolo Invocations para la integración flexible de puntos de conexión con aplicaciones y servicios personalizados, y el protocolo A2A para la comunicación entre agentes. A2A v1.0 está disponible con carácter general y v0.3 permanece en versión preliminar.
Seguridad, privacidad y cumplimiento
El servicio de agente está diseñado para cargas de trabajo empresariales en las que necesita controles seguros sobre la identidad, las redes, el control de datos y la seguridad.
- Controles de seguridad: use límites de protección integrados para ayudar a reducir las salidas no seguras y mitigar los riesgos de inyección de solicitudes, incluidos los ataques de inyección entre solicitudes (XPIA).
- Controles de aislamiento de red y residencia de datos: utilice redes virtuales y sus propios recursos para satisfacer sus requisitos.
- ** Traiga sus propios recursos: use sus propios recursos de Azure (por ejemplo, almacenamiento, Búsqueda de Azure AI y Azure Cosmos DB para el estado de la conversación) para satisfacer las necesidades de cumplimiento y operativas. Consulte Usar sus propios recursos.
- Guía de inteligencia artificial : Para obtener un conjunto más amplio de recomendaciones y recursos de gobernanza, consulte Responsible AI for Microsoft Foundry.
Contenido relacionado
- Configuración del entorno
- Ciclo de vida de desarrollo del agente
- Implementación del primer agente hospedado
- Introducción al cuadro de herramientas de Foundry
- Implementación del primer agente hospedado
- Crea un agente de prompts por voz
- Procedimientos recomendados para agentes basados en voz
- Catálogo de herramientas
- Cuotas, límites y soporte regional
- Para obtener ayuda o para conectarse con la comunidad, únase a la Microsoft AI Discord.