Observação
O acesso a essa página exige autorização. Você pode tentar entrar ou alterar diretórios.
O acesso a essa página exige autorização. Você pode tentar alterar os diretórios.
O Foundry Agent Service é uma plataforma gerenciada para criar, implantar e dimensionar agentes de IA. Desenvolva com qualquer framework, qualquer modelo compatível do catálogo de modelos do Foundry e um único ponto de entrada para inferência de modelos e ferramentas.
A foundry atende a você em qualquer lugar do espectro de código declarativo a completo: defina um agente de prompt ou um agente de prompt baseado em voz e deixe o Foundry executá-lo, empacote seu próprio código como um agente hospedado ou chame a API de Respostas de um agente que você já executou em outro lugar. Escolha como criar aborda cada opção.
Serviço de Agente: Visão Geral
| Componente | O que ele faz |
|---|---|
| Ambiente de execução do agente | Hospeda e dimensiona agentes de prompt e agentes hospedados. Gerencia conversas, invocações de ferramentas e ciclo de vida do agente. |
| Caixas de ferramentas | Faça a curadoria de um conjunto de ferramentas uma vez, como: pesquisa na Web, pesquisa de arquivos, interpretador de código, servidores MCP e funções personalizadas. Em seguida, compartilhe-os entre agentes por meio de um único ponto de extremidade MCP gerenciado com autenticação centralizada, governança e controle de versão. |
| Modelos | Funciona com muitos modelos do catálogo de modelos do Foundry, como GPT-4o, Llama e DeepSeek. Troque modelos sem alterar o código do agente. |
| Observabilidade | Rastreamento de ponta a ponta, métricas, avaliações e integração do Application Insights. Veja cada decisão que seu agente toma e meça sua qualidade. |
| Otimização | O otimizador de agente (versão preliminar) avalia o comportamento do agente e gera automaticamente melhores instruções, habilidades, descrições de ferramentas e seleções de modelo para agentes de prompt e agentes hospedados. |
| Identidade &segurança | Microsoft Entra Identity, RBAC, filtros de conteúdo e isolamento de rede virtual. Confiança de nível empresarial incorporada. |
| Publicação | Gerencie versões de agentes, crie endpoints estáveis e compartilhe-os por meio do Microsoft Teams, do Microsoft Copilot e do Entra Agent Registry. |
Escolher como criar
Dica
Criando seu primeiro agente? Comece com um agente de prompt usando o portal do Foundry ou o início rápido para criar um agente de prompt com código.
O Foundry oferece várias maneiras de criar, desde uma única chamada a um modelo até um agente totalmente conteinerizado. Escolha seu caminho com base no que você está tentando fazer:
- Quer o mínimo de trabalho para gerenciar textos?Comece com um agente de prompts. Configurar instruções, um modelo e ferramentas; A Foundry a executa sem código ou infraestrutura.
- Quer uma experiência de voz gerenciada em tempo real?Crie um agente de prompt baseado em voz. Configure a experiência de voz e conecte-a por meio do Voice Live sem hospedar o código de orquestração por conta própria.
- Quer controle total no Foundry?Implantar um agente hospedado. Traga seu próprio código e estrutura em um contêiner; o Foundry o executa com um ponto de extremidade gerenciado, escalabilidade e gerenciamento de identidade.
- Já executou o código do agente em outro lugar?Chame a API de Respostas diretamente para usar modelos e ferramentas do Foundry, sem nenhum recurso de agente para gerenciar.
Agentes de prompt, agentes de prompt baseados em voz e agentes hospedados são os tipos de agente abordados nesta visão geral. A próxima seção divide o valor de cada um para que você possa escolher com confiança.
Tipos de agente
O Serviço de Agente oferece três tipos de agente. Sua escolha define o quanto você cria em comparação com o quanto o Foundry gerencia:
- Agentes de prompt: o caminho mais rápido. Defina instruções, um modelo e ferramentas e o Foundry executa o agente para você sem código ou infraestrutura para gerenciar.
- Agentes de prompt por comando de voz: agentes por voz gerenciados em tempo real. Configure o modelo, as instruções, o áudio e as ferramentas e conecte-se ao agente por meio do Voice Live.
- Agentes hospedados: o máximo de controle. Traga seu próprio código e framework, e Foundry o executa em um contêiner com endpoint gerenciado, escalabilidade e identidade.
Agentes de prompt
Você define os agentes de prompt inteiramente por meio da configuração, incluindo instruções, seleção de modelo e ferramentas. Crie-os no portal do Foundry para um início rápido ou defina-os programaticamente com os SDKs ou a API REST para integrar com seus fluxos de trabalho de CI/CD. De qualquer forma, o Foundry executa o agente para você. Não há nenhum código de aplicativo a ser mantido e nenhum contêiner ou pacote para otimizar, dimensionar ou monitorar a segurança.
Dois caminhos para começar:
- Portal-first: crie um agente interativamente no portal do Foundry, teste-o no playground e depois chame-o a partir do código do aplicativo.
- Code-first: defina o agente usando o SDK ou a API REST no pipeline de implantação, habilitando o controle de versão, a revisão de código e a distribuição automatizada.
Melhor para: introdução rápida, ferramentas internas, agentes de produção que não precisam de lógica de orquestração personalizada e equipes que desejam um runtime gerenciado sem sobrecarga de infraestrutura.
Agentes de prompt baseados em voz
Agentes de prompt por comando de voz são agentes gerenciados para conversas faladas em tempo real. Configure um modelo, instruções, configurações de áudio, saudação opcional e ferramentas na definição do agente. O Foundry Agent Service gerencia o ciclo de vida do agente e usa o Voice Live para reconhecimento de fala, tomada de turnos, interação de modelo e síntese de fala.
Os agentes de prompt por voz oferecem suporte a modelos gerenciados e, quando compatível, à implantação do seu próprio modelo. Você se conecta ao agente em um WebSocket em tempo real em vez de enviar solicitações de texto individuais. Para obter a configuração e os idiomas de cliente com suporte, consulte Início Rápido: Criar um agente de prompt baseado em voz. Para obter as arquiteturas de voz, os recursos e os limites de visualização atuais, consulte Como os agentes baseados em voz funcionam.
Melhor para: experiências de voz voltadas para o cliente, cenários de call center e aplicativos que precisam de interação de áudio de baixa latência sem implementar o serviço de orquestração de voz por conta própria.
Agentes hospedados
Hosted agents são agentes baseados em código que você cria com Agent FrameworkLangGraph, o SDK OpenAI Agents, o SDK do agente Anthropic, o SDK GitHub Copilot, ou seu próprio código. Envie seu agente como uma imagem de contêiner ou um arquivo .zip do código-fonte (o Foundry cria a imagem para você quando você traz um arquivo .zip) e o Foundry a executa com um ponto de extremidade gerenciado, dimensionamento automático, uma identidade de Microsoft Entra dedicada, persistência de estado no nível da sessão e observabilidade de ponta a ponta.
Nos bastidores, o código do agente chama o endpoint do seu projeto Foundry para inferência de modelos e orquestração de ferramentas, dando acesso aos modelos do Foundry disponíveis no catálogo e a um conjunto unificado de ferramentas da plataforma: ferramentas padrão, como busca de arquivos, interpretador de código e pesquisa na web, além de ferramentas adicionais como SharePoint, WorkIQ e Fabric IQ.
Melhor para: agentes que fazem chamadas ao seu próprio código personalizado; secundariamente, lógica de orquestração personalizada, sistemas multiagente e protocolos personalizados (webhooks, voz, AG-UI) nos quais você deseja ter controle total sobre a lógica do agente, enquanto o Foundry cuida da hospedagem, do dimensionamento e da identidade.
Comparar tipos de agente
| Agentes de prompt | Agentes de prompt baseados em voz | Agentes hospedados | |
|---|---|---|---|
| Superfície de criação | Portal, SDK ou REST | Definição do agente por meio do portal, SDK ou REST | Agent Framework, LangGraph, OpenAI Agents SDK, Anthropic Agent SDK, GitHub Copilot SDK, código personalizado |
| Modelos Foundry + ferramentas da plataforma | Sim | Sim, por meio do Voice Live e das ferramentas de agente configuradas | Sim (via a API Responses no endpoint do projeto Foundry) |
| Suporte a habilidades | Sim | Sim | Sim |
| Código de runtime a ser mantido | Nenhum | Nenhum para a orquestração de voz gerenciada | Sim, sua lógica de agente |
| Computação a ser gerenciada | Nenhum, totalmente gerenciado | Nenhum, totalmente gerenciado | Computação de contêiner, gerenciada pela Foundry |
| Endpoint gerenciado | Sim | Sim, WebSocket em tempo real | Sim |
| Autoscale | Automático, gerenciado pela Foundry; escala de acordo com o volume de solicitações | Gerenciado por Foundry e Voice Live | Automático, gerenciado pela Foundry; dimensiona instâncias de contêiner por sessão e volume de solicitação |
| Identidade do agente (Entra) | Sim | Sim | Automático, dedicado para cada agente |
| Modelo de custo | Inferência por chamada + uso de ferramenta | Uso do Voice Live e de modelos; consulte os preços do serviço | Inferência por chamada + uso de ferramentas + computação em contêineres |
| Melhor para | Início rápido, agentes de produção sem orquestração personalizada | Interações faladas em tempo real sem hospedar código de orquestração de voz | Agentes que chamam código personalizado; em segundo lugar, lógica de orquestração personalizada |
Usar a API de Respostas para agentes efêmeros
Ao chamar a API de Respostas diretamente do seu próprio código, você cria um agente efêmero: a definição do agente (instruções, ferramentas e modelo) reside no código do aplicativo, em vez de como um recurso persistente na Foundry. Cada chamada monta o agente em seu processo e o executa na API de Respostas, portanto, não há nenhum agente para criar, atualizar ou excluir no Foundry.
Use esse padrão quando desejar:
- Lógica do agente enviada com seu aplicativo. As versões das definições ficam junto com o restante do seu código, por meio do controle de versão e da revisão de código, em vez de mantê-las como um recurso separado do Foundry que alguém precisa manter sincronizado com o aplicativo.
- Recursos do Foundry sem a sobrecarga do recurso. Você ainda obtém modelos de catálogo, ferramentas de plataforma, dados com escopo de projeto, autenticação On-Behalf-Of, além de governança e observabilidade em nível de projeto. Tudo via ponto de extremidade de projeto no Foundry.
Confira o início rápido: use a API de Respostas para obter informações.
Como os agentes baseados em voz funcionam
Agentes de prompt por comando de voz conduzem conversas faladas em tempo real. Configure o agente no portal do Foundry ou por meio do SDK, teste-o com um microfone e disponibilize-o por meio de uma experiência do navegador ou de um canal de número de telefone. A Foundry gerencia o ciclo de vida do agente e a orquestração de voz, para que você não hospede essa infraestrutura por conta própria.
Importante
Os agentes baseados em voz e alguns recursos relacionados de monitoramento, avaliação, avatar, WebRTC e telefonia estão em versão prévia. Os recursos de visualização são fornecidos sem um contrato de nível de serviço e não são recomendados para cargas de trabalho de produção até que você examine seus requisitos de suporte, segurança, conformidade e disponibilidade.
Os agentes baseados em voz dão suporte a duas arquiteturas de modelo.
Conversão nativa de fala para fala
Caller audio
-> realtime speech model
-> spoken response
Essa arquitetura é otimizada para uma conversa natural de baixa latência. O modelo em tempo real lida diretamente com entrada e saída faladas. As configurações com suporte e as famílias de voz dependem do modelo selecionado.
Modelo de texto em cascata
Caller audio
-> speech recognition
-> text model
-> speech synthesis
-> spoken response
Essa arquitetura oferece mais opções de modelos de texto e de vozes do Azure. Ele também fornece controle explícito sobre transcrição, listas de frases, detecção de turnos e respostas provisórias, mas cada estágio contribui para a latência de ponta a ponta.
Recursos principais
Um agente de voz criado pelo portal típico usa:
- Um recurso e um projeto da Foundry.
- Um agente de prompt por voz versionado.
- Um modelo do Voice Live totalmente gerenciado ou um modelo qualificado implantado pelo cliente.
- Capacidades do Azure Speech no Foundry Tools para transcrição ou síntese, conforme exigido pela arquitetura selecionada.
- Application Insights para rastreamentos, monitoramento e dados de avaliação.
- Serviços de Comunicação do Azure e Grade de Eventos do Azure para extensibilidade de chamadas de entrada do Teams Phone, ou uma conexão de projeto Twilio para canais de números de telefone da Twilio.
Você não precisa implantar um modelo de áudio separado ao usar um modelo do Voice Live totalmente gerenciado. A disponibilidade e o comportamento do modelo são carregados dinamicamente para seu recurso e região.
Limites de suporte no portal atual
| Capability | Comportamento atual baseado em voz |
|---|---|
| Teste de navegador | Compatível com o ambiente de testes de agentes. |
| Visualizar aplicativo Web | Disponível quando o endpoint do agente oferece suporte ao protocolo Responses. |
| Telefones | Extensibilidade do Teams Phone e Twilio. |
| SIP direto | Atualmente, não é oferecido como um fluxo de cliente suportado. |
| Publicação do aplicativo Microsoft Teams e Microsoft 365 Copilot | O cartão padrão do agente de texto não é exibido atualmente no layout dos Canais por voz. Não descreva isso como o caminho de integração telefônica. |
| Avatar | Saída visual do navegador pelo WebRTC; os chamadores de telefone recebem somente áudio. |
| Monitorização | Cartões de resumo específicos por voz, detalhamento de tokens e gráficos de latência de conexão exigem o recurso Application Insights. |
| Rastreamento | Os rastreamentos de voz usam uma única visualização orientada a rastreamento porque não têm uma API de Responses response_id. |
| Avaliação | Há suporte para a avaliação de conversas completas a partir de conversas existentes. Atualmente, não há suporte para avaliações de turno único e de conversa simulada para agentes de voz. |
| Criação de conjunto de dados a partir de rastreamentos | A ação de rastreamento de página não está disponível no momento para agentes de voz. |
Disponibilidade e preços
A disponibilidade depende da região de recursos do Foundry, do modelo selecionado, da voz selecionada, da assinatura e dos recursos de visualização habilitados. Verifique o portal antes de contar com um modelo específico.
Os possíveis encargos incluem entrada e saída de modelos de IA generativa, reconhecimento e síntese de fala, treinamento e hospedagem de voz personalizada, uso de avatar, ingestão e retenção no Application Insights, chamadas e números de telefone do Serviços de Comunicação do Azure, serviços do Microsoft Teams e de telefonia, e ferramentas conectadas e serviços de dados. Para obter detalhes de custo, consulte Preços para agentes baseados em voz.
Documentação do agente por voz
| Artigo | Use para |
|---|---|
| Criar um agente de prompt baseado em voz | Crie um agente de voz gerenciado, conecte-se a uma sessão ativa e conclua um turno de fala. |
| Configurar um agente de voz | Escolha um modelo e configure transcrição, idiomas, vozes, avatares, detecção de turnos, aprimoramento de áudio, respostas provisórias e ferramentas. |
| Integrar um canal de telefonia | Integre a extensibilidade do Teams Phone ou o Twilio a um agente de voz. |
| Rastreamento, monitoramento e avaliação do agente de voz | Rastreie, monitore e avalie conversas de voz. |
| Práticas recomendadas para agentes baseados em voz | Aplique instruções, latência, reconhecimento, segurança, privacidade, transferência, testes e controles de lançamento. |
Suporte ao modelo
O Serviço de Agente funciona com muitos modelos disponíveis no catálogo do Foundry. Para obter a lista completa, consulte o portal do Foundry.
Ferramentas e caixas de ferramentas
Os agentes atuam no mundo por meio de ferramentas. A Foundry oferece ferramentas internas, como pesquisa na Web, pesquisa de arquivos, interpretador de código e memória, ao mesmo tempo em que permite adicionar ferramentas personalizadas por meio de funções, especificações OpenAPI e servidores MCP. Para o conjunto completo, consulte a visão geral da caixa de ferramentas.
Uma caixa de ferramentas agrupa essas ferramentas em uma única unidade reutilizável. Você faz a curadoria das ferramentas uma vez, e o Foundry as expõe em um ponto de extremidade gerenciado compatível com MCP, que pode ser consumido por qualquer agente ou runtime, independentemente da estrutura. As caixas de ferramentas centralizam a autenticação, a governança e o controle de versão, para que você atualize as ferramentas em um único lugar em vez de religar todos os agentes. Crie uma nova versão, teste-a e promova-a para o padrão quando estiver pronto. Para saber mais, confira o que é a Caixa de Ferramentas na Foundry?.
Conectar-se e autenticar-se a servidores remotos MCP
O Foundry dá suporte a servidores MCP remotos que você pode adicionar ao seu agente, como o servidor MCP Azure DevOps. Conecte sua organização Azure DevOps para habilitar o acesso ao agente e configure um subconjunto de ferramentas disponíveis para controlar quais ações os agentes podem executar. Você também pode conectar servidores MCP personalizados hospedados no Azure Functions usando o ponto de extremidade de webhook do MCP do Functions (/runtime/webhooks/mcp) para expor ferramentas personalizadas aos seus agentes.
As opções de autenticação com suporte para servidores MCP e outras conexões de ferramenta incluem:
- Acesso baseado em chave
- Microsoft Entra (usando a identidade gerenciada do agente ou a identidade gerenciada do projeto)
- Passagem de identidade OAuth (On-Behalf-Of)
- Acesso não autenticado, quando apropriado
Essas opções de autenticação também se aplicam ao conectar servidores MCP remotos, com credenciais e escopos gerenciados na configuração da ferramenta.
Ciclo de vida de desenvolvimento
O Serviço de Agente dá suporte ao fluxo de trabalho completo de compilação-teste-implantação-monitoramento:
- Criar: defina um agente de prompt no portal ou com o SDK ou escreva um agente hospedado que chame a API de Respostas.
- Testar: converse com seu agente no playground de agentes ou execute localmente. As integrações de servidor MCP, incluindo servidores MCP personalizados hospedados em Azure Functions, podem ser exercidas diretamente no playground para validar a conectividade, as permissões e o comportamento da ferramenta antes da publicação.
- Rastreamento: inspecione cada chamada de modelo, invocação de ferramenta e decisão com rastreamento de agentes.
- Avaliar: execute avaliações para medir a qualidade e capturar regressões.
- Otimizar: aprimore automaticamente as instruções do agente hospedado usando o otimizador do agente.
- Publicar: Promova seu agente a um recurso gerenciado com um endpoint estável.
- Monitorar: acompanhe o desempenho e a confiabilidade com métricas de serviço e painéis.
Para obter um passo a passo detalhado, consulte o ciclo de vida de desenvolvimento do Agente.
Funcionalidades da empresa
O Serviço de Agente fornece infraestrutura de nível empresarial para cada agente que você implantar:
- Identidade do agente: cada agente pode ter uma identidade de Microsoft Entra dedicada, permitindo acesso seguro e com escopo a recursos e APIs sem compartilhar credenciais. As identidades de agentes podem autenticar-se em servidores MCP externos, incluindo aqueles hospedados no Azure Functions, e a passagem OAuth On-Behalf-Of (OBO) é suportada quando configurada.
- Rede privada: Execute agentes em sua rede virtual do Azure para garantir isolamento total da rede e conformidade com os requisitos de residência de dados. A rede privada está disponível para agentes de prompt. Os agentes hospedados oferecem suporte ao Bring-Your-Own Rede Virtual do Azure (BYO VNet), onde cada sessão ocorre em um "sandbox" isolado de VM conectado à sua VNet.
- Controle de acesso baseado em funções: permissões granulares por meio do Microsoft Entra e do Azure RBAC. Controlar quem pode criar, invocar e gerenciar agentes.
- Segurança de conteúdo: filtros de conteúdo integrados ajudam a mitigar os riscos de injeção de prompt (incluindo injeção entre prompts) e a evitar saídas inseguras.
Para obter instruções de configuração de ambiente, consulte Configurar seu ambiente.
Publicação e compartilhamento
O Serviço de Agente fornece controle de versão e publicação internos para que seus agentes possam passar do desenvolvimento para a produção com confiança.
- Controle de versão: à medida que você itera em seu agente, são capturados instantâneos automáticos das versões. Reverta para qualquer versão anterior ou compare as alterações entre as versões.
- Publicação: promova um agente para um recurso gerenciado com um ponto de extremidade estável. Os agentes publicados herdam a identidade da empresa e os controles de acesso configurados para seu projeto e podem ser invocados programaticamente.
- Distribuição: Compartilhe agentes publicados por meio de Microsoft Copilot e Teams e do Entra Agent Registry, levando seus agentes para onde seus usuários já trabalham. O serviço Foundry Agent oferece suporte aos protocolos OpenResponses e Activity para publicação no Microsoft 365, a um protocolo de invocações para integração flexível de endpoints com aplicativos e serviços personalizados e ao A2A protocol para comunicação entre agentes. O A2A v1.0 está disponível em geral e a v0.3 permanece em versão prévia.
Segurança, privacidade e conformidade
O Serviço de Agente foi projetado para cargas de trabalho corporativas em que você precisa de controles fortes sobre identidade, rede, manipulação de dados e segurança.
- Controles de segurança: use proteções integradas para ajudar a minimizar saídas não seguras e mitigar os riscos de injeção de solicitação, incluindo ataques de injeção de solicitação cruzada (XPIA).
- Isolamento de rede e controles de residência de dados: use redes virtuais e traga seus próprios recursos para atender às suas necessidades.
- Traga seus próprios recursos: use seus próprios recursos do Azure (por exemplo, armazenamento, Pesquisa de IA do Azure e Azure Cosmos DB para estado de conversa) para atender às necessidades operacionais e de conformidade. Consulte Usar seus próprios recursos.
- Diretrizes de IA Responsável: para obter um conjunto mais amplo de recomendações e recursos de governança, consulte Responsible AI for Microsoft Foundry.
Conteúdo relacionado
- Configurar seu ambiente
- Ciclo de vida de desenvolvimento do agente
- Implantar seu primeiro agente hospedado
- Visão geral da Caixa de Ferramentas do Foundry
- Implantar seu primeiro agente hospedado
- Criar um agente de prompt baseado em voz
- Práticas recomendadas para agentes baseados em voz
- Catálogo de ferramentas
- Cotas, limites e suporte regional
- Para obter ajuda ou se conectar com a comunidade, participe do Microsoft AI Discord.