Poznámka:
Přístup k této stránce vyžaduje autorizaci. Můžete se zkusit přihlásit nebo změnit adresáře.
Přístup k této stránce vyžaduje autorizaci. Můžete zkusit změnit adresáře.
Váš agent vyšetřuje na základě kontextu, který mu dáte. Pokud jste během úvodního nastavení přeskočili zdroje dat nebo pokud šetření přineslo méně výsledků, než jste očekávali, tento článek vám pomůže rozhodnout se, co připojit dál a co každé připojení přináší. Tento článek katalogizuje zdroje dostupné vašemu agentovi, zatímco propojovací články pokrývají postup pro každý z nich.
Začněte s nejmenší užitečnou množinou
Pro realistické odpovědi o vašich systémech stačí repozitář kódu a jeden zdroj logů. Každý jiný zdroj prohloubí to, co agent vidí, a zdroje můžete přidávat v libovolném pořadí kdykoliv, takže není potřeba dokončovat nastavení najednou.
Kód, logy, Azure zdroje a znalostní soubory se hromadí. Můžete kdykoli přidat další úložiště, poskytovatele telemetrie nebo rozsah, a můžete odstranit to, co už nechcete. Incidenty fungují odlišně. Aktivní může být v daném okamžiku pouze jedna platforma pro incidenty a připojení nové platformy odpojí tu současnou.
Co každý zdroj odpovídá
Každý zdroj dat umožňuje agentovi odpovědět na jiný typ otázky během vyšetřování.
| Source | Co to umožňuje agentovi odpovědět | Co potřebujete k jeho připojení |
|---|---|---|
| Kód (doporučený ) | Proč k selhání dochází. Agent čte zdrojové soubory, sleduje chyby na konkrétní řádky a identifikuje nedávné změny. | Přístup k GitHub, Azure DevOps nebo GitLab repozitáři, plus autentizační metodě, kterou poskytovatel podporuje. |
| Logs (doporučeno) | Co se stalo při produkci. Agent se ptá na vaši telemetrii a koreluje záznamy s kódem a závislostmi. | Oprávnění ke čtení ke zdroji telemetrie udělené identitě nebo přihlašovacím údajům, které konektor používá. |
| Prostředky Azure | Jak vypadá vaše prostředí právě teď. Agent kontroluje konfiguraci zdrojů, zdraví a metriky. | Přiřazení role Vlastník nebo Správce uživatelského přístupu ke každé skupině správy, odběru nebo skupině zdrojů, kterou přidáte. |
| Incidenty | Kdy začít pracovat, aniž by se vás někdo zeptal. Agent přijímá upozornění z vaší platformy pro incidenty a vyšetřuje ty, které odpovídají vašim plánům reakce. Jedna platforma je aktivní v daném okamžiku. | Azure Monitor se připojuje bez přihlašovacích údajů a upozornění z vašich spravovaných skupin zdrojů proudí k agentovi. PagerDuty a ServiceNow potřebují API přihlašovací údaje od správce platformy incidentů. |
| Znalostní soubory | Jak chce váš tým práci udělat. Agent se řídí vašimi provozními postupy, eskalačními postupy a poznámkami k architektuře. | Soubor v podporovaném formátu. Viz Nahrávat znalostní dokumenty. |
Poskytovatelé logů se liší v tom, jak autentizují. Azure Data Explorer, Log Analytics Workspace a Application Insights používají spravovanou identitu agenta. Datadog, Dynatrace, Elasticsearch, New Relic, Splunk a Hawkeye používají služební přihlašovací údaje, které poskytnete. Poskytovatelé, které navštěvujete, se mohou lišit podle nájemce a konfigurace, takže použijte vyhledávací pole, pokud nenajdete toho, koho hledáte. Informace o polích, která jednotliví poskytovatelé vyžadují, najdete v části Připojení zdroje telemetrie.
Vyberte si, co spojíte dál
Vyberte si situaci, která odpovídá tomu, co vašemu agentovi chybí.
- Agent říká, že o vaší aplikaci nic neví. Nejprve připojte Code jako první. Má to největší vliv na kvalitu vyšetřování a agent začne prozkoumávat repozitář hned, jakmile uložíte připojení.
- Agent vysvětlí váš kód, ale nemůže říct, co se stalo v produkci. Pak Spojte logy. Vyberte poskytovatele, na kterého se váš tým během incidentu již obrací.
- Vaše otázky se týkají zdraví zdrojů, konfigurace nebo škálování. Přidejte Azure zdroje, které jsou přiřazeny ke skupině zdrojů, která obsahuje pracovní zátěž, kterou nejvíce zkoumáte.
- Chcete, aby agent pracoval dřív, než někdo otevře chat. Připojte platformu pro řešení incidentů, ze které váš tým již dostává výstrahy, a poté vytvořte plán reakce, který odpovídá omezené sadě upozornění. Protože může být aktivní pouze jedna platforma najednou, vyberte si tu, která přináší vaše produkční upozornění. Viz Platformy pro incidenty.
- Odpovědi jsou technicky správné, ale ignorují fungování vašeho týmu. Přidejte znalostní soubory , aby agent následoval vaše postupy místo obecné sekvence.
Azure zdroje a incidenty jsou dvě spojení, která nejčastěji zahrnují někoho jiného. Obojí mění, na co může agent dosáhnout nebo kdy jedná, a oba potřebují přístup, který by jeden inženýr nemusel mít.
Požadavky
| Requirement | Details |
|---|---|
| Agent | Nejprve ho vytvořte pomocí Vytvořit a nastavit. |
| Role na agentovi | SRE Agent Standard User pokrývá přidávání kódových repozitářů a nahrávání znalostních dokumentů. SRE Agent Administrator se věnuje správě konektorů a přidávání či odebírání Azure resource scopes. SRE Agent Author se zabývá konfigurací řízení incidentů a tvorbou plánů reakce. Viz Uživatelské role a oprávnění. |
| Role Azure pro obory prostředků | Aktivní přiřazení role Vlastník nebo Správce uživatelského přístupu ke každému rozsahu, který přidáte, přímo nebo dědičně. Portál jej používá k přiřazení rolí k spravované identitě agenta. |
| Přístup ke každému zdroji | Přístup ke kódu v repozitáři, přístup pro čtení ke zdroji telemetrie pro protokoly a přihlašovací údaje k platformě PagerDuty nebo ServiceNow. |
| Upozornění nebo incidenty, které chcete dostávat | Azure Monitor přeposílá pouze upozornění, která generují vaše stávající pravidla upozornění, proto si ověřte, že pravidla existují, než očekáváte incidentní aktivitu. PagerDuty a ServiceNow předávají incidenty, které vytvářejí jejich vlastní integrace. |
Otevření instalační stránky
Na kartě Přehled v centru Operations Hub stavový panel uvádí zdroje, které jste dosud nenakonfigurovali. Vyberte Dokončit nastavení pro otevření stránky nastavení, která má dvě záložky.
| Tab | Zdroje dat |
|---|---|
| Rychlý start | Kód, logy, Azure zdroje, incidenty |
| Úplné nastavení | Všechno v Quickstartu, plus soubory znalostí |
Každý zdroj se objevuje jako karta. Připojená karta zobrazuje symbol zaškrtnutí a souhrnné informace, například počet připojených repozitářů nebo poskytovatelů protokolů, spolu s případnými chybami, jimž je třeba věnovat pozornost.
Stránka také zobrazuje ukazatel průběhu připojení. Ukazatel sleduje, kolik typů zdrojů je připojeno, nikoli to, jak moc tyto zdroje přispívají k vyšetřování, a může započítávat i typy, které vaše stránka nastavení nenabízí. V důsledku toho nemusí dosáhnout plného stavu ani po připojení všeho, co vidíte. Ber to spíš jako hrubý ukazatel než jako cíl. Kvalita vyšetřování vzniká propojením zdrojů, na kterých vaše práce závisí.
Návod
Pokud vám agent řekne, že o vaší aplikaci nic neví a nedokáže odpovědět na otázky o ní, nejdřív připojte Code.
Připojte zdroj
Vyberte tlačítko na kartě pro zdroj, který chcete, a pak následujte průvodce pro daného poskytovatele. Pro kompletní postupy viz:
Potvrďte, že spojení funguje
Nejdřív zkontrolujte kartu. Úspěšné připojení zobrazuje symbol zaškrtnutí a počet připojených položek. Nahrané znalostní soubory ukazují status Indexed , jakmile je agent dokončí zpracování. Pro přehled zdrojů znalostí viz Spojte znalosti.
Pak potvrďte, že agent má přístup ke zdroji, tak, že se ho zeptáte na něco, na co může odpovědět jen tento zdroj.
| Source | Zeptejte se agenta |
|---|---|
| Code | "Co toto úložiště dělá a jaké služby obsahuje?" |
| Logs | "Zkontrolujte, jestli nejsou v posledních 24 hodinách nějaké chyby." |
| Prostředky Azure | "Zkontrolujte stav zdrojů ve skupině <resource-group-name>zdrojů." |
| Znalostní soubory | Co náš runbook říká o řešení chyb HTTP 500? |
Uzemněná odpověď ukazuje kartičku s nástroji pro zdroj, který agent dotazoval, spolu s výsledkem, který agent vrátil. Obecná odpověď bez karty s nástroji nebo taková, která hlásí chybějící přístup, znamená, že spojení potřebuje znovu prozkoumat. U dotazů protokolu, které selžou kvůli chybě oprávnění, udělte identitě konektoru oprávnění ke čtení cílového prostředku a zkuste to znovu.
Co se změní, když přidáte více kontextu
Připojení platformy pro incidenty mění způsob, jakým agent začíná pracovat. Do té doby agent odpovídá lidem. Následně také přijímá incidenty z vaší platformy a vyšetřuje ty, které odpovídají vašim plánům reakce, na úrovni autonomie, kterou každý plán nastavuje. Pro nastavení tohoto chování viz Automate incident response.
Připojení zdroje se samo o sobě neúčtuje. Azure SRE Agent měří zpracování, které váš agent provádí jako aktivní využití toku, což zahrnuje chaty, incidenty, plánované úkoly a spouštěče. Více propojeného kontextu obvykle znamená více tohoto zpracování, zvlášť když platforma pro incidenty začne vyšetřovat bez vás. Bohatší kontext může vyšetřování také zkrátit, protože agent věnuje méně úsilí tomu, aby obešel to, co nevidí. Viz Ceny a fakturace a Vyhodnoťte Azure SRE Agent.
Návrat k týmovému onboardingu
Vaše vlákno o zaškolení týmu zůstává ve vašem seznamu oblíbených v postranním panelu. Vyberte si ho, abyste pokračovali v konverzaci vždy, když máte něco nového, co chcete agentovi říct, například službu, kterou váš tým využil, nebo změněný postup.
Můžete se také zeptat agenta, co nastavit dál. Dává doporučení podle toho, co jste připojili a co ještě chybí. Viz Zaškolení týmu.