Agentes no Microsoft Foundry

O Foundry Agent Service é uma plataforma gerenciada para criar, implantar e dimensionar agentes de IA. Desenvolva com qualquer framework, qualquer modelo compatível do catálogo de modelos do Foundry e um único ponto de entrada para inferência de modelos e ferramentas.

A foundry atende a você em qualquer lugar do espectro de código declarativo a completo: defina um agente de prompt ou um agente de prompt baseado em voz e deixe o Foundry executá-lo, empacote seu próprio código como um agente hospedado ou chame a API de Respostas de um agente que você já executou em outro lugar. Escolha como criar aborda cada opção.

Serviço de Agente: Visão Geral

Componente O que ele faz
Ambiente de execução do agente Hospeda e dimensiona agentes de prompt e agentes hospedados. Gerencia conversas, invocações de ferramentas e ciclo de vida do agente.
Caixas de ferramentas Faça a curadoria de um conjunto de ferramentas uma vez, como: pesquisa na Web, pesquisa de arquivos, interpretador de código, servidores MCP e funções personalizadas. Em seguida, compartilhe-os entre agentes por meio de um único ponto de extremidade MCP gerenciado com autenticação centralizada, governança e controle de versão.
Modelos Funciona com muitos modelos do catálogo de modelos do Foundry, como GPT-4o, Llama e DeepSeek. Troque modelos sem alterar o código do agente.
Observabilidade Rastreamento de ponta a ponta, métricas, avaliações e integração do Application Insights. Veja cada decisão que seu agente toma e meça sua qualidade.
Otimização O otimizador de agente (versão preliminar) avalia o comportamento do agente e gera automaticamente melhores instruções, habilidades, descrições de ferramentas e seleções de modelo para agentes de prompt e agentes hospedados.
Identidade &segurança Microsoft Entra Identity, RBAC, filtros de conteúdo e isolamento de rede virtual. Confiança de nível empresarial incorporada.
Publicação Gerencie versões de agentes, crie endpoints estáveis ​​e compartilhe-os por meio do Microsoft Teams, do Microsoft Copilot e do Entra Agent Registry.

Escolher como criar

Dica

Criando seu primeiro agente? Comece com um agente de prompt usando o portal do Foundry ou o início rápido para criar um agente de prompt com código.

O Foundry oferece várias maneiras de criar, desde uma única chamada a um modelo até um agente totalmente conteinerizado. Escolha seu caminho com base no que você está tentando fazer:

  • Quer o mínimo de trabalho para gerenciar textos?Comece com um agente de prompts. Configurar instruções, um modelo e ferramentas; A Foundry a executa sem código ou infraestrutura.
  • Quer uma experiência de voz gerenciada em tempo real?Crie um agente de prompt baseado em voz. Configure a experiência de voz e conecte-a por meio do Voice Live sem hospedar o código de orquestração por conta própria.
  • Quer controle total no Foundry?Implantar um agente hospedado. Traga seu próprio código e estrutura em um contêiner; o Foundry o executa com um ponto de extremidade gerenciado, escalabilidade e gerenciamento de identidade.
  • Já executou o código do agente em outro lugar?Chame a API de Respostas diretamente para usar modelos e ferramentas do Foundry, sem nenhum recurso de agente para gerenciar.

Agentes de prompt, agentes de prompt baseados em voz e agentes hospedados são os tipos de agente abordados nesta visão geral. A próxima seção divide o valor de cada um para que você possa escolher com confiança.

Tipos de agente

O Serviço de Agente oferece três tipos de agente. Sua escolha define o quanto você cria em comparação com o quanto o Foundry gerencia:

  • Agentes de prompt: o caminho mais rápido. Defina instruções, um modelo e ferramentas e o Foundry executa o agente para você sem código ou infraestrutura para gerenciar.
  • Agentes de prompt por comando de voz: agentes por voz gerenciados em tempo real. Configure o modelo, as instruções, o áudio e as ferramentas e conecte-se ao agente por meio do Voice Live.
  • Agentes hospedados: o máximo de controle. Traga seu próprio código e framework, e Foundry o executa em um contêiner com endpoint gerenciado, escalabilidade e identidade.

Agentes de prompt

Você define os agentes de prompt inteiramente por meio da configuração, incluindo instruções, seleção de modelo e ferramentas. Crie-os no portal do Foundry para um início rápido ou defina-os programaticamente com os SDKs ou a API REST para integrar com seus fluxos de trabalho de CI/CD. De qualquer forma, o Foundry executa o agente para você. Não há nenhum código de aplicativo a ser mantido e nenhum contêiner ou pacote para otimizar, dimensionar ou monitorar a segurança.

Dois caminhos para começar:

  • Portal-first: crie um agente interativamente no portal do Foundry, teste-o no playground e depois chame-o a partir do código do aplicativo.
  • Code-first: defina o agente usando o SDK ou a API REST no pipeline de implantação, habilitando o controle de versão, a revisão de código e a distribuição automatizada.

Melhor para: introdução rápida, ferramentas internas, agentes de produção que não precisam de lógica de orquestração personalizada e equipes que desejam um runtime gerenciado sem sobrecarga de infraestrutura.

Agentes de prompt baseados em voz

Agentes de prompt por comando de voz são agentes gerenciados para conversas faladas em tempo real. Configure um modelo, instruções, configurações de áudio, saudação opcional e ferramentas na definição do agente. O Foundry Agent Service gerencia o ciclo de vida do agente e usa o Voice Live para reconhecimento de fala, tomada de turnos, interação de modelo e síntese de fala.

Os agentes de prompt por voz oferecem suporte a modelos gerenciados e, quando compatível, à implantação do seu próprio modelo. Você se conecta ao agente em um WebSocket em tempo real em vez de enviar solicitações de texto individuais. Para obter a configuração e os idiomas de cliente com suporte, consulte Início Rápido: Criar um agente de prompt baseado em voz. Para obter as arquiteturas de voz, os recursos e os limites de visualização atuais, consulte Como os agentes baseados em voz funcionam.

Melhor para: experiências de voz voltadas para o cliente, cenários de call center e aplicativos que precisam de interação de áudio de baixa latência sem implementar o serviço de orquestração de voz por conta própria.

Agentes hospedados

Hosted agents são agentes baseados em código que você cria com Agent FrameworkLangGraph, o SDK OpenAI Agents, o SDK do agente Anthropic, o SDK GitHub Copilot, ou seu próprio código. Envie seu agente como uma imagem de contêiner ou um arquivo .zip do código-fonte (o Foundry cria a imagem para você quando você traz um arquivo .zip) e o Foundry a executa com um ponto de extremidade gerenciado, dimensionamento automático, uma identidade de Microsoft Entra dedicada, persistência de estado no nível da sessão e observabilidade de ponta a ponta.

Nos bastidores, o código do agente chama o endpoint do seu projeto Foundry para inferência de modelos e orquestração de ferramentas, dando acesso aos modelos do Foundry disponíveis no catálogo e a um conjunto unificado de ferramentas da plataforma: ferramentas padrão, como busca de arquivos, interpretador de código e pesquisa na web, além de ferramentas adicionais como SharePoint, WorkIQ e Fabric IQ.

Melhor para: agentes que fazem chamadas ao seu próprio código personalizado; secundariamente, lógica de orquestração personalizada, sistemas multiagente e protocolos personalizados (webhooks, voz, AG-UI) nos quais você deseja ter controle total sobre a lógica do agente, enquanto o Foundry cuida da hospedagem, do dimensionamento e da identidade.

Comparar tipos de agente

Agentes de prompt Agentes de prompt baseados em voz Agentes hospedados
Superfície de criação Portal, SDK ou REST Definição do agente por meio do portal, SDK ou REST Agent Framework, LangGraph, OpenAI Agents SDK, Anthropic Agent SDK, GitHub Copilot SDK, código personalizado
Modelos Foundry + ferramentas da plataforma Sim Sim, por meio do Voice Live e das ferramentas de agente configuradas Sim (via a API Responses no endpoint do projeto Foundry)
Suporte a habilidades Sim Sim Sim
Código de runtime a ser mantido Nenhum Nenhum para a orquestração de voz gerenciada Sim, sua lógica de agente
Computação a ser gerenciada Nenhum, totalmente gerenciado Nenhum, totalmente gerenciado Computação de contêiner, gerenciada pela Foundry
Endpoint gerenciado Sim Sim, WebSocket em tempo real Sim
Autoscale Automático, gerenciado pela Foundry; escala de acordo com o volume de solicitações Gerenciado por Foundry e Voice Live Automático, gerenciado pela Foundry; dimensiona instâncias de contêiner por sessão e volume de solicitação
Identidade do agente (Entra) Sim Sim Automático, dedicado para cada agente
Modelo de custo Inferência por chamada + uso de ferramenta Uso do Voice Live e de modelos; consulte os preços do serviço Inferência por chamada + uso de ferramentas + computação em contêineres
Melhor para Início rápido, agentes de produção sem orquestração personalizada Interações faladas em tempo real sem hospedar código de orquestração de voz Agentes que chamam código personalizado; em segundo lugar, lógica de orquestração personalizada

Usar a API de Respostas para agentes efêmeros

Ao chamar a API de Respostas diretamente do seu próprio código, você cria um agente efêmero: a definição do agente (instruções, ferramentas e modelo) reside no código do aplicativo, em vez de como um recurso persistente na Foundry. Cada chamada monta o agente em seu processo e o executa na API de Respostas, portanto, não há nenhum agente para criar, atualizar ou excluir no Foundry.

Use esse padrão quando desejar:

  • Lógica do agente enviada com seu aplicativo. As versões das definições ficam junto com o restante do seu código, por meio do controle de versão e da revisão de código, em vez de mantê-las como um recurso separado do Foundry que alguém precisa manter sincronizado com o aplicativo.
  • Recursos do Foundry sem a sobrecarga do recurso. Você ainda obtém modelos de catálogo, ferramentas de plataforma, dados com escopo de projeto, autenticação On-Behalf-Of, além de governança e observabilidade em nível de projeto. Tudo via ponto de extremidade de projeto no Foundry.

Confira o início rápido: use a API de Respostas para obter informações.

Como os agentes baseados em voz funcionam

Agentes de prompt por comando de voz conduzem conversas faladas em tempo real. Configure o agente no portal do Foundry ou por meio do SDK, teste-o com um microfone e disponibilize-o por meio de uma experiência do navegador ou de um canal de número de telefone. A Foundry gerencia o ciclo de vida do agente e a orquestração de voz, para que você não hospede essa infraestrutura por conta própria.

Importante

Os agentes baseados em voz e alguns recursos relacionados de monitoramento, avaliação, avatar, WebRTC e telefonia estão em versão prévia. Os recursos de visualização são fornecidos sem um contrato de nível de serviço e não são recomendados para cargas de trabalho de produção até que você examine seus requisitos de suporte, segurança, conformidade e disponibilidade.

Os agentes baseados em voz dão suporte a duas arquiteturas de modelo.

Conversão nativa de fala para fala

Caller audio
  -> realtime speech model
  -> spoken response

Essa arquitetura é otimizada para uma conversa natural de baixa latência. O modelo em tempo real lida diretamente com entrada e saída faladas. As configurações com suporte e as famílias de voz dependem do modelo selecionado.

Modelo de texto em cascata

Caller audio
  -> speech recognition
  -> text model
  -> speech synthesis
  -> spoken response

Essa arquitetura oferece mais opções de modelos de texto e de vozes do Azure. Ele também fornece controle explícito sobre transcrição, listas de frases, detecção de turnos e respostas provisórias, mas cada estágio contribui para a latência de ponta a ponta.

Recursos principais

Um agente de voz criado pelo portal típico usa:

  • Um recurso e um projeto da Foundry.
  • Um agente de prompt por voz versionado.
  • Um modelo do Voice Live totalmente gerenciado ou um modelo qualificado implantado pelo cliente.
  • Capacidades do Azure Speech no Foundry Tools para transcrição ou síntese, conforme exigido pela arquitetura selecionada.
  • Application Insights para rastreamentos, monitoramento e dados de avaliação.
  • Serviços de Comunicação do Azure e Grade de Eventos do Azure para extensibilidade de chamadas de entrada do Teams Phone, ou uma conexão de projeto Twilio para canais de números de telefone da Twilio.

Você não precisa implantar um modelo de áudio separado ao usar um modelo do Voice Live totalmente gerenciado. A disponibilidade e o comportamento do modelo são carregados dinamicamente para seu recurso e região.

Limites de suporte no portal atual

Capability Comportamento atual baseado em voz
Teste de navegador Compatível com o ambiente de testes de agentes.
Visualizar aplicativo Web Disponível quando o endpoint do agente oferece suporte ao protocolo Responses.
Telefones Extensibilidade do Teams Phone e Twilio.
SIP direto Atualmente, não é oferecido como um fluxo de cliente suportado.
Publicação do aplicativo Microsoft Teams e Microsoft 365 Copilot O cartão padrão do agente de texto não é exibido atualmente no layout dos Canais por voz. Não descreva isso como o caminho de integração telefônica.
Avatar Saída visual do navegador pelo WebRTC; os chamadores de telefone recebem somente áudio.
Monitorização Cartões de resumo específicos por voz, detalhamento de tokens e gráficos de latência de conexão exigem o recurso Application Insights.
Rastreamento Os rastreamentos de voz usam uma única visualização orientada a rastreamento porque não têm uma API de Responses response_id.
Avaliação Há suporte para a avaliação de conversas completas a partir de conversas existentes. Atualmente, não há suporte para avaliações de turno único e de conversa simulada para agentes de voz.
Criação de conjunto de dados a partir de rastreamentos A ação de rastreamento de página não está disponível no momento para agentes de voz.

Disponibilidade e preços

A disponibilidade depende da região de recursos do Foundry, do modelo selecionado, da voz selecionada, da assinatura e dos recursos de visualização habilitados. Verifique o portal antes de contar com um modelo específico.

Os possíveis encargos incluem entrada e saída de modelos de IA generativa, reconhecimento e síntese de fala, treinamento e hospedagem de voz personalizada, uso de avatar, ingestão e retenção no Application Insights, chamadas e números de telefone do Serviços de Comunicação do Azure, serviços do Microsoft Teams e de telefonia, e ferramentas conectadas e serviços de dados. Para obter detalhes de custo, consulte Preços para agentes baseados em voz.

Documentação do agente por voz

Artigo Use para
Criar um agente de prompt baseado em voz Crie um agente de voz gerenciado, conecte-se a uma sessão ativa e conclua um turno de fala.
Configurar um agente de voz Escolha um modelo e configure transcrição, idiomas, vozes, avatares, detecção de turnos, aprimoramento de áudio, respostas provisórias e ferramentas.
Integrar um canal de telefonia Integre a extensibilidade do Teams Phone ou o Twilio a um agente de voz.
Rastreamento, monitoramento e avaliação do agente de voz Rastreie, monitore e avalie conversas de voz.
Práticas recomendadas para agentes baseados em voz Aplique instruções, latência, reconhecimento, segurança, privacidade, transferência, testes e controles de lançamento.

Suporte ao modelo

O Serviço de Agente funciona com muitos modelos disponíveis no catálogo do Foundry. Para obter a lista completa, consulte o portal do Foundry.

Ferramentas e caixas de ferramentas

Os agentes atuam no mundo por meio de ferramentas. A Foundry oferece ferramentas internas, como pesquisa na Web, pesquisa de arquivos, interpretador de código e memória, ao mesmo tempo em que permite adicionar ferramentas personalizadas por meio de funções, especificações OpenAPI e servidores MCP. Para o conjunto completo, consulte a visão geral da caixa de ferramentas.

Uma caixa de ferramentas agrupa essas ferramentas em uma única unidade reutilizável. Você faz a curadoria das ferramentas uma vez, e o Foundry as expõe em um ponto de extremidade gerenciado compatível com MCP, que pode ser consumido por qualquer agente ou runtime, independentemente da estrutura. As caixas de ferramentas centralizam a autenticação, a governança e o controle de versão, para que você atualize as ferramentas em um único lugar em vez de religar todos os agentes. Crie uma nova versão, teste-a e promova-a para o padrão quando estiver pronto. Para saber mais, confira o que é a Caixa de Ferramentas na Foundry?.

Conectar-se e autenticar-se a servidores remotos MCP

O Foundry dá suporte a servidores MCP remotos que você pode adicionar ao seu agente, como o servidor MCP Azure DevOps. Conecte sua organização Azure DevOps para habilitar o acesso ao agente e configure um subconjunto de ferramentas disponíveis para controlar quais ações os agentes podem executar. Você também pode conectar servidores MCP personalizados hospedados no Azure Functions usando o ponto de extremidade de webhook do MCP do Functions (/runtime/webhooks/mcp) para expor ferramentas personalizadas aos seus agentes.

As opções de autenticação com suporte para servidores MCP e outras conexões de ferramenta incluem:

  • Acesso baseado em chave
  • Microsoft Entra (usando a identidade gerenciada do agente ou a identidade gerenciada do projeto)
  • Passagem de identidade OAuth (On-Behalf-Of)
  • Acesso não autenticado, quando apropriado

Essas opções de autenticação também se aplicam ao conectar servidores MCP remotos, com credenciais e escopos gerenciados na configuração da ferramenta.

Ciclo de vida de desenvolvimento

O Serviço de Agente dá suporte ao fluxo de trabalho completo de compilação-teste-implantação-monitoramento:

  1. Criar: defina um agente de prompt no portal ou com o SDK ou escreva um agente hospedado que chame a API de Respostas.
  2. Testar: converse com seu agente no playground de agentes ou execute localmente. As integrações de servidor MCP, incluindo servidores MCP personalizados hospedados em Azure Functions, podem ser exercidas diretamente no playground para validar a conectividade, as permissões e o comportamento da ferramenta antes da publicação.
  3. Rastreamento: inspecione cada chamada de modelo, invocação de ferramenta e decisão com rastreamento de agentes.
  4. Avaliar: execute avaliações para medir a qualidade e capturar regressões.
  5. Otimizar: aprimore automaticamente as instruções do agente hospedado usando o otimizador do agente.
  6. Publicar: Promova seu agente a um recurso gerenciado com um endpoint estável.
  7. Monitorar: acompanhe o desempenho e a confiabilidade com métricas de serviço e painéis.

Para obter um passo a passo detalhado, consulte o ciclo de vida de desenvolvimento do Agente.

Funcionalidades da empresa

O Serviço de Agente fornece infraestrutura de nível empresarial para cada agente que você implantar:

  • Identidade do agente: cada agente pode ter uma identidade de Microsoft Entra dedicada, permitindo acesso seguro e com escopo a recursos e APIs sem compartilhar credenciais. As identidades de agentes podem autenticar-se em servidores MCP externos, incluindo aqueles hospedados no Azure Functions, e a passagem OAuth On-Behalf-Of (OBO) é suportada quando configurada.
  • Rede privada: Execute agentes em sua rede virtual do Azure para garantir isolamento total da rede e conformidade com os requisitos de residência de dados. A rede privada está disponível para agentes de prompt. Os agentes hospedados oferecem suporte ao Bring-Your-Own Rede Virtual do Azure (BYO VNet), onde cada sessão ocorre em um "sandbox" isolado de VM conectado à sua VNet.
  • Controle de acesso baseado em funções: permissões granulares por meio do Microsoft Entra e do Azure RBAC. Controlar quem pode criar, invocar e gerenciar agentes.
  • Segurança de conteúdo: filtros de conteúdo integrados ajudam a mitigar os riscos de injeção de prompt (incluindo injeção entre prompts) e a evitar saídas inseguras.

Para obter instruções de configuração de ambiente, consulte Configurar seu ambiente.

Publicação e compartilhamento

O Serviço de Agente fornece controle de versão e publicação internos para que seus agentes possam passar do desenvolvimento para a produção com confiança.

  • Controle de versão: à medida que você itera em seu agente, são capturados instantâneos automáticos das versões. Reverta para qualquer versão anterior ou compare as alterações entre as versões.
  • Publicação: promova um agente para um recurso gerenciado com um ponto de extremidade estável. Os agentes publicados herdam a identidade da empresa e os controles de acesso configurados para seu projeto e podem ser invocados programaticamente.
  • Distribuição: Compartilhe agentes publicados por meio de Microsoft Copilot e Teams e do Entra Agent Registry, levando seus agentes para onde seus usuários já trabalham. O serviço Foundry Agent oferece suporte aos protocolos OpenResponses e Activity para publicação no Microsoft 365, a um protocolo de invocações para integração flexível de endpoints com aplicativos e serviços personalizados e ao A2A protocol para comunicação entre agentes. O A2A v1.0 está disponível em geral e a v0.3 permanece em versão prévia.

Segurança, privacidade e conformidade

O Serviço de Agente foi projetado para cargas de trabalho corporativas em que você precisa de controles fortes sobre identidade, rede, manipulação de dados e segurança.

  • Controles de segurança: use proteções integradas para ajudar a minimizar saídas não seguras e mitigar os riscos de injeção de solicitação, incluindo ataques de injeção de solicitação cruzada (XPIA).
  • Isolamento de rede e controles de residência de dados: use redes virtuais e traga seus próprios recursos para atender às suas necessidades.
  • Traga seus próprios recursos: use seus próprios recursos do Azure (por exemplo, armazenamento, Pesquisa de IA do Azure  e Azure Cosmos DB para estado de conversa) para atender às necessidades operacionais e de conformidade. Consulte Usar seus próprios recursos.
  • Diretrizes de IA Responsável: para obter um conjunto mais amplo de recomendações e recursos de governança, consulte Responsible AI for Microsoft Foundry.