Servidor MCP do Azure SRE Agent

Seu Agente SRE cria um contexto profundo sobre seus serviços ao longo do tempo: padrões de incidente, detalhes da arquitetura, experiência operacional. Com o Servidor MCP do Agente SRE, esse conhecimento está disponível diretamente em seu IDE, terminal ou assistente de IA, seja você trabalhando com GitHub Copilot CLI, Claude Code, VS Code ou outro cliente compatível com MCP.

Durante a codificação, depuração ou resposta a incidentes, faça uma pergunta ao seu agente, inicie uma investigação ou configure um conector sem alternar as ferramentas. Seu ambiente de desenvolvimento e a inteligência operacional do agente se conectam por meio da mesma interface de linguagem natural que você já usa.

Como funciona

O fluxo a seguir mostra como um cliente MCP chega ao Agente SRE por meio do Azure MCP Server:

  1. Você cria um recurso do Agente SRE no Azure. O recurso é um recurso Microsoft.App/agents e inclui um ponto de extremidade do agente.
  2. Você instala o Azure MCP Server em um cliente ou host MCP.
  3. O cliente MCP inicia Azure servidor MCP localmente ou se conecta a um servidor hospedado.
  4. Azure servidor MCP autentica usando a identidade Azure disponível no host.
  5. O cliente solicita ao Azure MCP Server que descubra os recursos do SRE Agent.
  6. O Servidor MCP do Azure resolve o endpoint do Agente SRE por meio do Azure Resource Graph.
  7. O Azure MCP Server encaminha solicitações de threads e tarefas para o ponto de extremidade selecionado do SRE Agent.

Conectar-se ao servidor MCP do Agente SRE

As ferramentas do Agente SRE fazem parte do Azure MCP Server, que implementa o protocolo de contexto Model (MCP). Você instala o servidor MCP Azure em seu cliente MCP e as ferramentas do Agente SRE ficam disponíveis junto com outras ferramentas de Azure. O servidor é executado localmente via npx e cuida da autenticação, da resolução de endpoints e das chamadas de API em seu nome.

Duas camadas de API lidam com operações diferentes:

Camada O que processa Authentication
Plano de controle (ARM) Recursos do agente, conectores Função de leitor por meio de Azure Resource Manager
Plano de dados Threads, memórias, tarefas, habilidades, incidentes Função de administrador do Agente SRE por meio do ponto de extremidade do agente (*.azuresre.ai)

O servidor resolve automaticamente os pontos de extremidade do agente por meio do Azure Resource Graph. Você fornece uma assinatura e um nome de agente, e o servidor localiza o ponto de extremidade.

As ferramentas aparecem com o prefixo sreagent_ no seu cliente MCP (por exemplo, sreagent_agents_list, sreagent_threads_create).

Authentication

O Servidor MCP do Azure usa o contexto de autenticação do Azure disponível no host. Os métodos de autenticação com suporte incluem login via CLI do Azure, login do Azure no VS Code, login via Azure PowerShell, credenciais de ambiente e identidade gerenciada.

O servidor MCP não concede novas permissões. As operações do Agente SRE são executadas dentro das permissões de Azure existentes do chamador e do acesso ao Agente SRE. Se o chamador não tiver permissão para listar recursos, abrir um thread ou alterar a configuração do agente, a operação falhará com um erro de autorização.

Importante

O mecanismo alternativo de autenticação interativa é desabilitado quando o Servidor MCP do Azure é executado no modo servidor. Entre antes de iniciar o servidor ou configure uma credencial nãointerativa, como identidade gerenciada ou credenciais de ambiente.

Defina AZURE_TOKEN_CREDENTIALS para fixar o tipo de credencial quando várias fontes de credencial estiverem disponíveis.

Permissions

Duas funções do Azure RBAC no recurso Microsoft.App/agents:

Função Scope O que ele possibilita
Leitor Plano de controle (ARM) Listar e obter agentes, conectores
Administrador do Agente SRE Plano de dados Threads, memórias, tarefas agendadas, habilidades, ganchos, prompts, incidentes, fluxos de trabalho

Clientes com suporte

Cliente Método de instalação
VS Code com GitHub Copilot Instale a extensão do servidor MCP Azure, entre no Azure
CLI do GitHub Copilot Usar /mcp add ou configurar manualmente ~/.copilot/mcp.json
Cursor Adicionar à configuração do MCP
Código Claude Adicionar à configuração do MCP do usuário ou do projeto
Claude Desktop Instalar o pacote do MCPB ou configurar o comando do servidor local
Outros clientes MCP Configurar usando npx, , dotnet, uvxDocker ou outros métodos com suporte

Fluxo de trabalho de conexão

Use esse fluxo de trabalho de alto nível para conectar um cliente MCP ao Agente SRE:

  1. Provisionar o Agente SRE: Crie o recurso do Agente SRE usando o portal Azure, ARM ou Bicep. Esta etapa cria o recurso Microsoft.App/agents e seu ponto de extremidade de agente.

  2. Instale o Servidor MCP do Azure: Use um método compatível, como a extensão do VS Code, npx, dotnet, uvx, Docker, MCPB ou um instalador específico do cliente.

  3. Registre o Servidor MCP do Azure no seu cliente MCP: Escolha um modo de exposição de ferramentas. O modo padrão agrupa as ferramentas por namespace.

  4. Autentique-se no Azure: Faça login no host ou forneça uma identidade gerenciada ou uma credencial de ambiente.

  5. Localizar agentes: Peça ao cliente MCP para listar os recursos do SRE Agent em uma assinatura.

  6. Inicie uma investigação: Peça ao cliente para criar um thread ou executar uma investigação em um agente selecionado.

  7. Gerencie o agente: Use as ferramentas de gerenciamento para configurar habilidades, conectores, ganchos, subagentes, tarefas agendadas, prompts e integrações de resposta a incidentes.

Operações disponíveis e prompts de exemplo

Principais áreas de funcionalidade, cada uma acessível por meio de prompts de linguagem natural:

Area Operations Prompt de exemplo
Gerenciar agentes Listar, obter detalhes, criar e excluir sub-agentes "Listar meus agentes SRE na assinatura X"
Configurar conectores Criar conectores do Kusto e do MCP, testar e excluir "Criar um conector do Kusto chamado prod-logs no agente Y"
Executar investigações Criar threads, enviar mensagens, investigação autônoma "Investigar por que a API de produção tem latência elevada"
Agendar trabalho Criar, pausar, retomar e excluir tarefas agendadas "Pausar a tarefa agendada noturna no agente Y"
Gerenciar incidentes Listar incidentes ativos, configurar PagerDuty e ServiceNow "Listar incidentes ativos no agente Y"
Conhecimento e comandos Pesquisar e carregar memórias, gerenciar prompts comuns Pesquisar em memórias por 'falhas de implantação'
Criar fluxos de trabalho Gerar, validar, aplicar fluxos de trabalho YAML "Gerar um fluxo de trabalho para reversão automatizada"

Depois de se conectar e autenticar, você também pode começar com prompts de linguagem natural, como:

List my SRE Agent resources in subscription <SUBSCRIPTION_ID>.
Create an SRE Agent thread for <agent-name> and investigate why the production API has elevated latency.
Continue the investigation thread and check whether recent deployments or PagerDuty incidents are related.

Investigação autônoma

O investigate comando executa um loop de investigação de várias etapas. Seu agente explica o problema, solicita dados, cria hipóteses e faz o acompanhamento automaticamente.

  • Limites padrão: 20 iterações, tempo limite de 10 minutos (configurável via --max-iterations e --timeout-seconds)
  • Modo padrão: Pausa nos portões de aprovação para confirmação humana
  • Modo de aprovação automática (investigate_yolo): continua por todos os portões de forma autônoma

Warning

O comando investigate_yolo aprova automaticamente todas as portas de aprovação, incluindo ações que modificam sua infraestrutura (exclusão de pod, aplicativo YAML do Kubernetes, dimensionamento, alterações de estado de incidente). Não há restrição de somente leitura. O agente pode invocar qualquer ferramenta que sua identidade gerenciada permitir. Não use esse comando em produção, a menos que você aceite uma modificação de infraestrutura totalmente autônoma.

O que você pode fazer

Use o servidor MCP do Agente SRE para os seguintes cenários:

  • Encontre agentes rapidamente: Liste os recursos disponíveis do Agente SRE por assinatura e veja o nome, o grupo de recursos, o local, o estado de provisionamento e o ponto de extremidade do plano de dados de cada agente.

  • Investigue a partir do seu ambiente de desenvolvimento: Inicie uma investigação de incidentes a partir do Copilot CLI, do Claude Code ou de outro cliente com suporte a MCP.

  • Continue as investigações: Envie mensagens de acompanhamento para um thread do Agente SRE existente sem sair do cliente MCP.

  • Automatize configurações comuns: Configure habilidades do agente, conectores, gatilhos, subagentes, tarefas agendadas, prompts e integrações de resposta a incidentes quando tiver permissão de escrita.

  • Use os limites de segurança Azure existentes: mantenha as operações restritas pelas permissões RBAC e SRE Agent Azure do chamador.

Limitações

  • Crie o recurso do Agente SRE antes que o Servidor MCP do Azure possa descobri-lo ou executar operações nele.

  • O Servidor MCP do Azure não eleva permissões. Verifique se você tem as permissões necessárias para a operação solicitada.

  • A configuração do cliente difere entre hosts MCP. Valide o formato de configuração do cliente antes de publicar um guia de instalação em toda a equipe.

Servidor MCP do Agente SRE em comparação com conectores MCP

Essas duas opções usam o mesmo protocolo, mas funcionam em direções opostas:

Característica Direction Caso de uso
Servidor MCP do Agente SRE (este artigo) Seu IDE ou CLI faz chamadas para o Agente SRE Gerenciar e operar agentes do seu ambiente de desenvolvimento
Conectores MCP O Agente SRE faz chamadas para servidores MCP externos Estender seu agente com ferramentas Datadog, GitHub e Splunk

Guardrails de segurança

Proteção Description
Confirmação destrutiva As operações de exclusão exigem --confirm true. Sem desmontagens acidentais.
Portões de aprovação As operações de gravação exigem aprovação humana no modo padrão. No modo de aprovação automática (investigate_yolo), todos os portões são ignorados.
Redação secreta Padrões comuns de credenciais, incluindo tokens de portador, chaves de API e senhas, são removidos das respostas antes de chegarem ao cliente.
Sanitização de erros Os corpos de erro de origem têm as credenciais removidas e são truncados.
Fixação de ponto de extremidade As chamadas de plano de dados são restritas a domínios SRE de Azure permitidos (somente HTTPS).
Validação de host de terceiros ServiceNow restrito a .service-now.com; subdomínios PagerDuty validados.
Segredos do conector MCP Os valores de ambiente devem usar a sintaxe ${env:NAME}. Segredos literais são rejeitados.