Poznámka:
Přístup k této stránce vyžaduje autorizaci. Můžete se zkusit přihlásit nebo změnit adresáře.
Přístup k této stránce vyžaduje autorizaci. Můžete zkusit změnit adresáře.
Během incidentů často najdete kontext rozptýlený napříč upozorněními, dashboardy, tikety a repozitáři. Azure SRE Agent se připojuje k vašim Azure zdrojům, nástrojům pro pozorování, platformám pro incidenty a repozitářům zdrojového kódu, abyste mohli problémy zkoumat s více operačním kontextem na jednom místě. Použijte ho ke sběru signálů, porovnání aktuálních problémů s předchozími vyšetřováními a spuštění řízené automatizace v rámci konfigurovaných oprávnění, režimů spuštění a politik.
Co můžete dělat
Azure SRE Agent pomáhá vašemu týmu vyšetřovat incidenty a reagovat rychleji. Shromažďuje kontext, identifikuje pravděpodobné příčiny a navrhuje nebo při konfiguraci provádí zmírňující opatření.
Například během incidentu souvisejícího s pamětí může SRE Agent:
- Zjistěte trend využití paměti: Pomocí dotazu v Application Insights identifikujte trend využití paměti, který začal 40 minut před upozorněním
- Propojení nasazení: Spojte trend s událostí nasazení v repozitáři GitHub o dvě hodiny dříve
- Navrhněte zmírňující opatření: Identifikujte konkrétní commit a navrhněte restart dotčeného podu nebo úpravu prahu pro škálování podle paměti (Horizontal Pod Autoscaler, HPA)
- Předvyplňte tiket incidentu: Vytvořte ServiceNow, PagerDuty nebo ticket incident-channel s předvyplněným plným shrnutím vyšetřování
Tyto nakonfigurované pracovní postupy informují příslušné osoby, zatímco SRE Agent pracuje na navrhovaném řešení škody. V režimu Review administrátor SRE Agenta prohlíží souhrn s připojeným kontextem runbooku a schvaluje akce, které vyžadují schválení. Šetření probíhá v jednom vlákně, což omezuje nutnost přepínat mezi nástroji. Zda agent automaticky aplikuje zmírnění škody, nebo čeká na schválení, závisí na vašem nastaveném režimu spuštění.
Tento vzorec platí napříč nakonfigurovanými službami a integracemi Azure, včetně výpočetního, úložného, síťového, datového a souvisejících monitorovacích a správcovských služeb. Rozšiřte jej o povolené operace Azure CLI pomocí dovedností, schválených runbooků nebo vlastních agentů. Použijte agentové háky k přidání kontrolních bodů správy, které mohou povolit nebo blokovat akce.
Práce agenta následuje tři vzory:
Automatizujte incidenty: Ve stavu pohotovosti agent dotazuje vaše monitorovací nástroje, koreluje signály napříč systémy, identifikuje pravděpodobnou příčinu a navrhuje zmírňující opatření.
Automatizujte plánované pracovní postupy: Plánujte proaktivní zdravotní kontroly, compliance sweepy a rutinní provozní úkoly. Výsledky se zobrazí na připojené platformě incidentů nebo v kanálu oznámení.
Zkoumejte a radějte: Ptejte se na otázky v přirozeném jazyce o vašem prostředí, například "co se změnilo za poslední hodinu?" nebo "proč je tato služba degradovaná?", a získejte realistické, zdrojově citované odpovědi.
Jak to funguje
SRE Agent kombinuje znalosti produktů specifické pro Azure s přizpůsobením, které ovládáte sami. Ve výchozím nastavení může dotazovat a jednat na Azure zdrojích v rámci přidělených oprávnění, s vestavěným chováním pro běžné provozní úkoly.
Agent funguje prostřednictvím pěti rozšiřujících bodů, které si můžete přizpůsobit:
Dovednosti: Diskrétní schopnosti, včetně runbooků marketplace a skriptů Azure CLI, které rozšiřují provozní dosah agenta bez nutnosti vlastního kódu.
Vlastní agenti: Speciálně vytvoření agenti pro specifické provozní domény. Několik specializovaných agentů se dodává připravených k použití a vlastního si můžete vytvořit v nástroji pro vytváření agentů. Viz Vlastní agenti.
nástroje Python: Vlastní logika, transformace dat a integrace rozhraní API pro scénáře, které vyžadují kód, nikoli konfiguraci.
MCP servery: Připojte se k předkonfigurovaným partnerským konektorům pro platformy pozorovatelnosti jako Datadog, Splunk, New Relic, Dynatrace a Elasticsearch, nebo připojte jakýkoli vlastní nástroj prostřednictvím standardu Model Context Protocol. Viz konektory a nástroje MCP.
Agentní háky: Automatizace spouštěné událostmi, které běží v definovaných bodech životního cyklu agenta, například po spuštění nástroje nebo při jeho zastavení. Pomocí hooků můžete vynucovat zásady, generovat telemetrii nebo integrovat s externími pracovními postupy schvalování. Viz Agent Hooks.
Každé navržené volání nástroje prochází před spuštěním mechanismy správy, takže váš tým určuje hranice i pro plně automatizované pracovní postupy. Další informace najdete v tématu Zabezpečení a zásady správného řízení.
Integrations
Azure SRE Agent se připojuje k nástrojům, které váš tým již používá:
Monitorování a pozorovatelnost:
- Azure Monitor (metriky, protokoly, výstrahy, sešity)
- Application Insights
- Analýza protokolů
Řízení incidentů:
- Upozornění služby Azure Monitor
- PagerDuty
- ServiceNow
Správa zdrojového kódu a CI/CD:
- GitHub (úložiště, problémy)
- Azure DevOps (repozitáře, pracovní položky)
Zdroje dat:
- Clustery pro Azure Data Explorer (Kusto)
- Servery Protokolu kontextu modelu (MCP)
Komunikace a oznámení:
- Microsoft Teams
- Outlook
V závislosti na vaší konfiguraci nabízí Azure SRE Agent také spravované konektory, samostatný systém propojení, který může propojit vašeho agenta se SaaS službami jako Google Drive, SharePoint, Notion a Confluence.
Zabezpečení a zásady správného řízení
Bezpečnostní a platformní týmy mohou aplikovat vrstvené kontroly napříč sítí, identitou, autorizací a organizační správou:
Izolace sítě: Integrace s VNet směruje provoz pracovního prostoru agentů přes vaši virtuální síť. Platí pravidla vaší skupiny síťové bezpečnosti (NSG), zatímco vaše soukromé DNS řeší požadavky. Když správně nakonfigurujete síťové směrování, DNS a oprávnění, můžete dosáhnout na privátní koncové body, interní API a uzamčené zdroje stejně jako na jakýkoli jiný zdroj ve vaší virtuální síti (VNet).
Identita a RBAC: Agent se autentizuje pomocí spravované identity a pracuje pod Azure role-based access control (RBAC). Pro zdrojový kód umožňuje podpora GitHub Enterprise agentovi autentizovat se jako řízená identita služby prostřednictvím modelu Bring Your Own GitHub App Application.
Řízení přístupu na úrovni nástrojů: U každého nástroje, který agent používá, nastavte možnost povolit, vyžádat potvrzení nebo zakázat. Administrátoři nastavují globální mantiny, vedoucí týmů přizpůsobují každého vlastního agenta a uživatelé schvalují nástroje ve své konverzaci. Dostupné možnosti, výchozí nastavení a přednost závisí na rozsahu a platné politice. Podrobnosti viz zásady přístupu k nástrojům.
Infrastruktura jako kód: Nasazujte agenta, jeho síťovou konfiguraci, identitu a politiky nástrojů pomocí šablon Bicep (Azure jazyk infrastructure-as-code) a Azure CLI přes stejné CI/CD pipeline, které používáte pro všechny ostatní Azure zdroje.
Řízené rozdělení dovedností: Týmy platformy mohou publikovat schválené dovednosti do soukromého GitHub repozitáře pomocí Private Plugins Marketplace. Agenti napříč nájemcem instalují schválené dovednosti ze stejného spravovaného katalogu.
Opětovné použití operačního kontextu
Azure SRE Agent uchovává kontext z předchozích šetření a využívá generování background insight a session insights k rozpoznání opakujících se vzorů nebo souvisejícího kontextu. Zachovaný kontext může zahrnovat příčiny, kroky k řešení, preference a provozní vzorce. Opětovné použití může omezit opakované shromažďování kontextu, snížit závislost na nezdokumentovaných individuálních znalostech a poskytnout pohotovostním inženýrům konzistentnější počáteční informace.
Tip
Příklad týmu: Nový inženýr nastoupí do pohotovosti. Agent už zná vzorce nasazení, minulé incidenty a týmové postupy, takže od prvního dne začíná s větším kontextem.
Příklad sólo: Jdeš na dovolenou. Zachycený operační kontext agenta je dostupný tomu, kdo ho zastupuje, takže nezačínají od nuly.
| Stage | Co se stane |
|---|---|
| Počáteční nastavení | Připojte své nástroje a používejte vestavěné znalosti Azure během vyšetřování. |
| Po opakovaných vyšetřováních | Zachovaný kontext může zahrnovat topologii prostředí, opakující se poruchy a preference eskalace. |
| Jak se sdílený kontext hromadí | Členové týmu mohou znovu použít předchozí příčiny a kroky řešení s menší závislostí na nezdokumentovaných individuálních znalostech. |
Začínáme
Vyberte si cestu, která odpovídá vašemu cíli: naplánovat úkol, vyřešit incident nebo vytvořit zakázkového agenta.
Pomocí plánovaných úloh můžete automatizovat běžnou provozní práci (kontroly stavu, vyčištění a úklidy dodržování předpisů) bez psaní kódu infrastruktury.
Vyberte kartu Naplánovat úkoly .
Zadejte podrobnosti úkolu.
Definujte plán pro spuštění úlohy.
Vytvořte vlastní pokyny agenta pro úlohu.
Vyberte Vytvořit naplánovaný úkol.
Výsledky plánované úlohy vidíte ve své platformě pro propojené incidenty nebo v kanálu oznámení.
Související obsah
Použijte tyto zdroje k plánování nasazení, správy, fakturace a onboardingu týmu:
| zdroj | Co najdete |
|---|---|
| Ceny a fakturace | Cenové řízení založené na využití měřené v jednotkách Azure Agent (AAU), plus plánování kapacity |
| Přehled zabezpečení | Manipulace s daty, ochrana soukromí a izolace provádění |
| Vytvoření a nastavení | Nasazte agenta a udělte mu přístup k vybraným zdrojům Azure. |
| Nastavení týmu a role,uživatelské role a oprávnění | Jak role ovlivňují, kdo může agenta chatovat, schvalovat a spravovat, a také jak ho informovat o vašem týmu, službách a postupech |