Agenti in Microsoft Foundry

Foundry Agent Service è una piattaforma gestita per la creazione, la distribuzione e il ridimensionamento degli agenti di intelligenza artificiale. Sviluppa con qualsiasi framework, qualsiasi modello supportato del catalogo dei modelli di Foundry e un singolo punto di accesso per l'inferenza dei modelli e gli strumenti.

Foundry ti soddisfa ovunque nello spettro, dal codice dichiarativo al codice completo: definisci un agente prompt o un agente di prompt basato su voce e consenti a Foundry di eseguirlo, creare un pacchetto di codice personalizzato come agente ospitato o chiamare l'API Risposte da un agente già eseguito altrove. Scegliere come compilare tratta ogni percorso.

Servizio Agente in sintesi

Componente Che cosa fa
Runtime dell'agente Agenti in modalità host e su scala, agenti in modalità host e agenti ospitati. Gestisce conversazioni, chiamate agli strumenti e ciclo di vita dell'agente.
Casella degli strumenti Curare un set di strumenti una sola volta, ad esempio ricerca Web, ricerca di file, interprete del codice, server MCP e funzioni personalizzate. Quindi condividerli tra gli agenti tramite un singolo endpoint MCP gestito con autenticazione centralizzata, governance e controllo delle versioni.
Modelli Funziona con molti modelli del catalogo dei modelli Foundry, ad esempio GPT-4o, Llama e DeepSeek. Scambiare modelli senza modificare il codice dell'agente.
Osservabilità Tracciamento end-to-end, metriche, valutazioni e integrazione con Application Insights. Vedere ogni decisione presa dall'agente e misurarne la qualità.
Ottimizzazione Agent Optimizer (anteprima) valuta il comportamento dell'agente e genera automaticamente istruzioni, competenze, descrizioni degli strumenti e selezioni di modelli migliori per gli agenti prompt e gli agenti ospitati.
Identità e sicurezza Identità Microsoft Entra, controllo degli accessi in base al ruolo, filtri del contenuto e isolamento della rete virtuale. Affidabilità di livello aziendale integrata.
Pubblicazione Assegnare la versione agli agenti, creare endpoint stabili e condividere tramite Microsoft Teams, Microsoft Copilot e il Registro degli agenti Entra.

Scegli come eseguire la build

Tip

Crei il tuo primo agente? Iniziare con un agente di prompt usando il portale di Foundry o l'avvio rapido per creare un agente di prompt con il codice.

Foundry offre diversi modi per creare, da una singola chiamata a un modello a un agente completamente containerizzato. Scegliere il percorso in base a ciò che si sta tentando di eseguire:

  • Si desidera gestire meno testo possibile?Iniziare con un agente di prompt. Configurare istruzioni, un modello e strumenti; Foundry lo esegue senza codice o infrastruttura.
  • Vuoi un'esperienza vocale in tempo reale gestita?Creare un agente prompt basato su voce. Configurare l'esperienza vocale e connetterla tramite Voice Live senza ospitare manualmente il codice di orchestrazione.
  • Vuoi il controllo completo in Foundry?Distribuire un agente ospitato. Usa il tuo codice e framework in un container; Foundry lo esegue con un endpoint gestito, scalabilità e gestione delle identità.
  • Eseguire già il codice dell'agente altrove?Chiamare direttamente l'API Risposte per usare i modelli e gli strumenti Foundry, senza alcuna risorsa agente da gestire.

Gli agenti di prompt, gli agenti di prompt basati sulla voce e gli agenti ospitati sono i tipi di agenti presentati in questa panoramica. La sezione successiva suddivide il valore di ognuno in modo da poter scegliere con sicurezza.

Tipi di agente

Il servizio Agent offre tre tipi di agente. La tua scelta determina quanto sviluppi tu e quanto viene gestito da Foundry:

  • Agenti prompt: il percorso più veloce. Definire istruzioni, un modello e strumenti e Foundry esegue l'agente senza codice o infrastruttura da gestire.
  • Agenti vocali basati su prompt: agenti vocali gestiti in tempo reale. Configurare il modello, le istruzioni, l'audio e gli strumenti, quindi connettersi all'agente tramite Voice Live.
  • Agenti ospitati: il maggior controllo. Porta il tuo codice e il tuo framework e Foundry li esegue in un contenitore con un endpoint gestito, scalabilità e gestione delle identità.

Agenti di prompt

Gli agenti prompt vengono definiti interamente tramite la configurazione, incluse le istruzioni, la selezione del modello e gli strumenti. Crearli nel portale foundry per una guida introduttiva o definirli a livello di codice con gli SDK o l'API REST per l'integrazione con i flussi di lavoro CI/CD. In entrambi i casi, Foundry esegue l'agente per l'utente. Non è disponibile alcun codice dell'applicazione da gestire e non sono presenti contenitori o pacchetti per ottimizzare, ridimensionare o monitorare la sicurezza.

Due percorsi per iniziare:

  • Portal-first: creare un agente in modo interattivo nel portale foundry, testarlo nel playground, quindi chiamarlo dal codice dell'applicazione.
  • Code-first: definire l'agente usando l'SDK o l'API REST nella pipeline di distribuzione, abilitando il controllo della versione, la revisione del codice e l'implementazione automatizzata.

Ideale per: iniziare rapidamente, strumenti interni, agenti di produzione che non necessitano di logica di orchestrazione personalizzata e team che vogliono un runtime gestito senza sovraccarico dell'infrastruttura.

Agenti prompt vocali

Gli agenti di prompt basati su voce sono agenti gestiti per conversazioni parlate in tempo reale. Configurare un modello, istruzioni, impostazioni audio, saluto facoltativo e strumenti nella definizione dell'agente. Il servizio Foundry Agent gestisce il ciclo di vita dell'agente e utilizza Voice Live per il riconoscimento vocale, la gestione dei turni di parola, l'interazione con il modello e la sintesi vocale.

Gli agenti di prompt vocali supportano i modelli gestiti e, ove supportato, la distribuzione di un proprio modello. Ci si connette all'agente tramite un WebSocket in tempo reale anziché inviare singole richieste di testo. Per la configurazione e le lingue client supportate, vedere Avvio rapido: Creare un agente prompt basato su voce. Per le architetture vocali, le risorse e i limiti di anteprima correnti, vedere Funzionamento degli agenti basati su voce.

Ideale per: esperienze vocali rivolte ai clienti, scenari di call center e applicazioni che necessitano di interazione audio a bassa latenza senza implementare manualmente il servizio di orchestrazione vocale.

Agenti ospitati

gli agenti Hosted sono agenti basati sul codice compilati con Agent FrameworkLangGraph, OpenAI Agents SDK, Anthropic Agent SDK, GitHub Copilot SDK, o il proprio codice. Distribuisci il tuo agente come immagine contenitore oppure come file .zip del tuo codice sorgente (Foundry crea l'immagine per te quando fornisci un file .zip) e Foundry lo esegue con un endpoint gestito, scalabilità automatica, un'identità Microsoft Entra dedicata, persistenza dello stato a livello di sessione e osservabilità end-to-end.

Sotto le quinte, il codice dell'agente chiama l'endpoint del progetto Foundry per l'inferenza del modello e l'orchestrazione degli strumenti, che consente di accedere ai modelli Foundry dal catalogo e a un set unificato di strumenti della piattaforma: strumenti standard come la ricerca di file, l'interprete del codice e la ricerca Web, oltre a strumenti aggiuntivi come SharePoint, WorkIQ e Fabric IQ.

Ideale per: agenti che richiamano il proprio codice personalizzato; in secondo luogo, logiche di orchestrazione personalizzate, sistemi multi-agente e protocolli personalizzati (webhook, interfacce vocali, AG-UI) quando si desidera il pieno controllo sulla logica dell'agente, affidando al contempo a Foundry la gestione di hosting, scalabilità e identità.

Confrontare i tipi di agente

Agenti di prompt Agenti prompt vocali Agenti ospitati
Area di creazione Portale, SDK o REST Definizione dell'agente tramite il portale, l'SDK o REST Agent Framework, LangGraph, OpenAI Agents SDK, Anthropic Agent SDK, GitHub Copilot SDK, codice personalizzato
Modelli Foundry + strumenti per la piattaforma Sì Sì, tramite Voice Live e gli strumenti dell'agente configurati Sì (tramite l'API Risposte nell'endpoint del progetto Foundry)
Supporto delle competenze Sì Sì Sì
Codice di runtime da gestire Nessuno Nessuno per l'orchestrazione vocale gestita Sì, la logica dell'agente
Calcolo da gestire Nessuno, completamente gestito Nessuno, completamente gestito Calcolo del contenitore, gestito da Foundry
Endpoint gestito Sì Sì, WebSocket in tempo reale Sì
Scalabilità automatica Automatico, gestito da Foundry; si adatta al volume delle richieste Gestito da Foundry e Voice Live Automatico, gestito da Foundry; ridimensiona istanze del contenitore per sessione e volume di richieste
Identità dell'agente (Entra) Sì Sì Automatico, dedicato a ciascun agente
Modello di costo Inferenza per chiamata e utilizzo degli strumenti Uso di Voice Live e del modello; vedere prezzi del servizio Inferenza per chiamata + utilizzo degli strumenti + elaborazione in container
Migliore per Avvio rapido, agenti di produzione senza orchestrazione personalizzata Interazioni vocali in tempo reale senza ospitare il codice di orchestrazione vocale Agenti che richiamano codice personalizzato; in secondo luogo, logica di orchestrazione personalizzata

Usare l'API Risposte per gli agenti temporanei

Quando si chiama l'API Risposte direttamente dal proprio codice, si compila un agente temporaneo: la definizione dell'agente (istruzioni, strumenti e modello) risiede nel codice dell'applicazione anziché come risorsa persistente in Foundry. Ogni chiamata assembla l'agente all'interno del tuo processo e lo esegue tramite l'API Responses, quindi in Foundry non c'è alcun agente da creare, aggiornare o eliminare.

Usare questo modello quando si vuole:

  • Logica dell'agente inclusa nella tua app. Le versioni di definizione insieme al resto del codice tramite il controllo del codice sorgente e la revisione del codice, anziché come risorsa Foundry separata che un utente deve mantenere sincronizzata con l'app.
  • Funzionalità di Foundry senza sovraccarico di risorse. Si dispone ancora di modelli del catalogo, strumenti della piattaforma, dati con ambito di progetto, autenticazione On-Behalf-Of e osservabilità e governance a livello di progetto. Tutto tramite l'endpoint del progetto Foundry.

Per informazioni , vedere Guida introduttiva: Usare l'API Risposte .

Funzionamento degli agenti basati su voce

Gli agenti basati su prompt vocali gestiscono conversazioni vocali in tempo reale. È possibile configurare l'agente nel portale foundry o tramite l'SDK, testarlo con un microfono e renderlo disponibile tramite un'esperienza browser o un canale con numeri di telefono. Foundry gestisce il ciclo di vita dell'agente e l'orchestrazione vocale, quindi non devi ospitare tu stesso tale infrastruttura.

Importante

Gli agenti basati su voce e alcune funzionalità correlate di monitoraggio, valutazione, avatar, WebRTC e telefonia sono disponibili in anteprima. Le funzionalità di anteprima vengono fornite senza un contratto di servizio e non sono consigliate per i carichi di lavoro di produzione finché non si esaminano i requisiti di supporto, sicurezza, conformità e disponibilità.

Gli agenti basati su voce supportano due architetture di modello.

Riconoscimento vocale nativo

Caller audio
  -> realtime speech model
  -> spoken response

Questa architettura è ottimizzata per una conversazione naturale a bassa latenza. Il modello in tempo reale gestisce direttamente l'input parlato e l'output. Le impostazioni supportate e le famiglie vocali dipendono dal modello selezionato.

Modello di testo a catena

Caller audio
  -> speech recognition
  -> text model
  -> speech synthesis
  -> spoken response

Questa architettura offre una più ampia scelta di modelli di testo e di voci di Azure. Fornisce anche un controllo esplicito sulla trascrizione, sugli elenchi di frasi, sul rilevamento dei turni e sulle risposte provvisorie, ma ogni fase contribuisce alla latenza end-to-end.

Risorse principali

Un tipico agente vocale creato dal portale usa:

  • Una risorsa e un progetto di Foundry.
  • Un agente di prompt basato su voce con controllo delle versioni.
  • Un modello Voice Live completamente gestito o un modello distribuito dal cliente idoneo.
  • funzionalità vocali di Azure in Foundry Tools per la trascrizione o la sintesi quando richieste dall'architettura selezionata.
  • Application Insights per tracce, monitoraggio e dati di valutazione.
  • Servizi di comunicazione di Azure e Griglia di eventi di Azure per le chiamate in ingresso dell’estendibilità di Teams Phone, oppure una connessione a un progetto Twilio per i canali con numeri di telefono Twilio.

Non è necessario distribuire un modello audio separato quando si usa un modello Voice Live completamente gestito. La disponibilità e il comportamento del modello vengono caricati dinamicamente per la risorsa e l'area.

Limiti di supporto nel portale corrente

Capability Comportamento corrente basato su voce
Test del browser Supportato dal playground dell'agente.
Anteprima dell'app Web Disponibile quando l'endpoint dell'agente supporta il protocollo Responses.
Numeri di telefono Estendibilità di Teams Phone e Twilio.
SIP diretto Attualmente non è disponibile come flusso di clienti supportato.
pubblicazione delle app Microsoft Teams e Microsoft 365 Copilot La scheda standard dell’agente testuale non viene attualmente visualizzata nel layout dei canali vocali. Non descriverlo come percorso di integrazione con il telefono.
Avatar Output visivo del browser su WebRTC; i chiamanti telefonici ricevono solo l'audio.
Monitoring Le schede di riepilogo per voce, il dettaglio dei token e i grafici della latenza di connessione richiedono Application Insights.
Tracciamento Le tracce vocali usano una singola vista incentrata sulla traccia perché non dispongono della Responses API response_id.
Valutazione È supportata la valutazione dell'intera conversazione a partire da conversazioni esistenti. La valutazione a turno singolo e la valutazione di conversazioni simulate non sono al momento supportate per gli agenti vocali.
Creazione di set di dati dalle tracce L'azione "trace-page" al momento non è disponibile per gli agenti vocali.

Disponibilità e prezzi

La disponibilità dipende dall'area delle risorse Foundry, dal modello selezionato, dalla voce selezionata, dalla sottoscrizione e dalle funzionalità di anteprima abilitate. Controllare il portale prima di basarsi su un modello specifico.

I potenziali addebiti includono input e output dei modelli di IA generativa, riconoscimento e sintesi vocale, addestramento e hosting di voci personalizzate, utilizzo di avatar, acquisizione e conservazione dei dati in Application Insights, chiamate e numeri di telefono di Servizi di comunicazione di Azure, servizi di Microsoft Teams e di telefonia e strumenti connessi e servizi dati. Per informazioni dettagliate sui costi, vedere Prezzi per gli agenti basati su voce.

Documentazione dell'agente vocale

Article Usalo per
Creare un agente basato sulla voce per i prompt Creare un agente vocale gestito, connettersi a una sessione live e completare un turno parlato.
Configurare un agente vocale Scegliere un modello e configurare trascrizione, lingue, voci, avatar, rilevamento dei turni, miglioramento audio, risposte provvisorie e strumenti.
Integrare un canale di telefonia Integra l'estendibilità di Teams Phone o Twilio con un agente vocale.
Traccia, monitoraggio e valutazione dell'agente vocale Traccia, monitoraggio e valutazione delle conversazioni vocali.
Procedure consigliate per gli agenti basati su voce Applicare controlli di istruzioni, latenza, riconoscimento, sicurezza, privacy, passaggio, test e rilascio.

Supporto del modello

Il servizio Agent funziona con molti modelli disponibili nel catalogo dei modelli Foundry. Per l’elenco completo, consulta il portale Foundry.

Strumenti e caselle degli strumenti

Gli agenti agiscono sul mondo attraverso strumenti. Foundry offre strumenti predefiniti come la ricerca Web, la ricerca di file, l'interprete del codice e la memoria, consentendo inoltre di aggiungere strumenti personalizzati tramite funzioni, specifiche OpenAPI e server MCP. Per l'elenco completo, consulta la panoramica della toolbox.

Una casella degli strumenti raggruppa tali strumenti in una singola unità riutilizzabile. Gli strumenti vengono curati una sola volta e Foundry li espone dietro un endpoint compatibile con MCP gestito che qualsiasi agente o runtime può utilizzare, indipendentemente dal framework. Le toolbox centralizzano l'autenticazione, la governance e il controllo delle versioni, così puoi aggiornare gli strumenti in un unico punto invece di riconfigurare ogni agente. Crea una nuova versione, testala e impostala come predefinita quando è tutto pronto. Per altre informazioni, vedere Che cos'è la casella degli strumenti in Foundry?.

Connettersi ed eseguire l'autenticazione ai server remoti MCP

Foundry supporta server MCP remoti che è possibile aggiungere all'agente, ad esempio il server MCP Azure DevOps. Connettere l'organizzazione Azure DevOps per abilitare l'accesso agli agenti e configurare un subset di strumenti disponibili per controllare quali azioni gli agenti possono eseguire. È anche possibile connettere server MCP personalizzati ospitati in Funzioni di Azure usando l'endpoint webhook MCP di Funzioni (/runtime/webhooks/mcp) per esporre strumenti personalizzati agli agenti.

Le opzioni di autenticazione supportate per i server MCP e altre connessioni degli strumenti includono:

  • Accesso basato su chiave
  • Microsoft Entra (usando l'identità gestita dell'agente o l'identità gestita del progetto)
  • Passaggio dell'identità OAuth (On-Behalf-Of)
  • Accesso non autenticato, se appropriato

Queste opzioni di autenticazione si applicano anche quando si connettono server MCP remoti, con credenziali e ambiti gestiti nella configurazione dello strumento.

Ciclo di vita dello sviluppo

Il servizio Agent supporta completamente il flusso di lavoro di costruzione, test, distribuzione e monitoraggio.

  1. Crea: definire un agente prompt nel portale o con l'SDK oppure scrivere un agente ospitato che chiama l'API Risposte.
  2. Test: chattare con l'agente nel playground degli agenti o eseguirlo localmente. Le integrazioni del server MCP, inclusi i server MCP personalizzati ospitati in Funzioni di Azure, possono essere esercitate direttamente nel playground per convalidare la connettività, le autorizzazioni e il comportamento degli strumenti prima della pubblicazione.
  3. Tracciamento: ispeziona ogni chiamata al modello, ogni invocazione di strumenti e ogni decisione con il tracciamento dell'agente.
  4. Valutazione: eseguire valutazioni per misurare la qualità e rilevare le regressioni.
  5. Ottimizzazione: migliorare automaticamente le istruzioni dell'agente ospitato usando l'utilità di ottimizzazione dell'agente.
  6. Pubblica: alzare di livello l'agente a una risorsa gestita con un endpoint stabile.
  7. Monitoraggio: tenere traccia delle prestazioni e dell'affidabilità con metriche e dashboard del servizio.

Per una procedura dettagliata, vedere Ciclo di vita di sviluppo dell'agente.

Funzionalità aziendali

Il servizio Agent offre un'infrastruttura di livello aziendale per ogni agente distribuito:

  • Identità agente: ogni agente può avere un'identità Microsoft Entra dedicata, abilitando l'accesso sicuro e con ambito alle risorse e alle API senza condividere le credenziali. Le identità dell'agente possono eseguire l'autenticazione in server MCP esterni, incluse quelle ospitate in Funzioni di Azure e il pass-through OAuth On-Behalf-Of (OBO) è supportato quando configurato.
  • Rete privata: eseguire agenti all'interno della rete virtuale Azure per l'isolamento completo della rete e la conformità ai requisiti di residenza dei dati. È disponibile una rete privata per gli agenti più reattivi. Gli agenti ospitati supportano la funzionalità Bring Your Own Rete virtuale di Azure (BYO VNet), in cui ogni sessione viene eseguita in una sandbox isolata su una VM connessa alla tua rete virtuale.
  • Controllo degli accessi basato sui ruoli: autorizzazioni granulari tramite Microsoft Entra e Azure RBAC. Controllare chi può creare, richiamare e gestire gli agenti.
  • Sicurezza dei contenuti: i filtri dei contenuti integrati contribuiscono a mitigare i rischi di prompt injection (inclusa la cross-prompt injection) e a prevenire output non sicuri.

Per istruzioni sull'installazione dell'ambiente, vedere Configurare l'ambiente.

Pubblicazione e condivisione

Il servizio Agent offre il controllo delle versioni e la pubblicazione predefiniti in modo che gli agenti possano passare dallo sviluppo alla produzione con sicurezza.

  • Controllo delle versioni: durante l'iterazione dell'agente viene creato automaticamente uno snapshot delle versioni. Eseguire il rollback a qualsiasi versione precedente o confrontare le modifiche tra le versioni.
  • Pubblicazione: alzare di livello un agente a una risorsa gestita con un endpoint stabile. Gli agenti pubblicati ereditano l'identità dell'organizzazione e i controlli di accesso configurati per il progetto e possono essere richiamati a livello di codice.
  • Distribuzione: Condividi gli agenti pubblicati tramite Microsoft Copilot e Teams e il Registro agenti di Entra, portando i tuoi agenti dove i tuoi utenti già lavorano. Il servizio agente Foundry supporta i protocolli OpenResponses e Activity per la pubblicazione Microsoft 365, un protocollo chiamate per l'integrazione flessibile degli endpoint con app e servizi personalizzati e il protocollo A2A per la comunicazione da agente a agente. A2A v1.0 è disponibile a livello generale e v0.3 rimane in anteprima.

Sicurezza, privacy e conformità

Il servizio Agent è progettato per carichi di lavoro aziendali in cui sono necessari controlli sicuri sull'identità, sulla rete, sulla gestione dei dati e sulla sicurezza.

  • Controlli di sicurezza: usare protezioni integrate per ridurre gli output non sicuri e attenuare i rischi di inserimento dei prompt, inclusi gli attacchi XPIA (Cross-Prompt Injection).
  • Controlli di isolamento della rete e residenza dei dati: usare le reti virtuali e le risorse di proprietà per soddisfare i requisiti.
  • Porta le tue risorse: usa le tue risorse Azure (ad esempio, archiviazione, Azure AI Search e Azure Cosmos DB per lo stato della conversazione) per soddisfare le esigenze operative e di conformità. Consulta Usa le tue risorse.
  • Responsible AI guidance: per un set più ampio di raccomandazioni e risorse di governance, vedere Responsible AI for Microsoft Foundry.