Notatka
Dostęp do tej strony wymaga autoryzacji. Może spróbować zalogować się lub zmienić katalogi.
Dostęp do tej strony wymaga autoryzacji. Możesz spróbować zmienić katalogi.
Podczas incydentów często znajdujesz kontekst rozrzucony na alertach, pulpitach, zgłoszeniach i repozytoriach. Azure SRE Agent łączy się z zasobami Azure, narzędziami obserwacji, platformami incydentów i repozytoriami kodu źródłowego, dzięki czemu możesz badać problemy z większym kontekstem operacyjnym w jednym miejscu. Używaj go do zbierania sygnałów, porównywania bieżących problemów z wcześniejszymi dochodzeniami oraz uruchamiania zarządzanej automatyzacji w ramach skonfigurowanych uprawnień, trybów działania i polityk.
Co możesz zrobić
Azure SRE Agent pomaga zespołowi badać incydenty i szybciej reagować. Zbiera kontekst, identyfikuje prawdopodobne przyczyny i sugeruje lub, gdy jest skonfigurowany, wykonuje środki łagodzące.
Na przykład podczas incydentu związanego z pamięcią SRE Agent może:
- Wykrywanie trendów pamięci: Zapytaj Application Insights w celu zidentyfikowania trendu pamięci, który rozpoczął się 40 minut przed alertem
- Koreluj wdrożenia: Połącz trend z wydarzeniem wdrożenia repozytorium GitHub sprzed dwóch godzin
- Zaproponuj działania zaradcze: Zidentyfikuj konkretny commit i zaproponuj ponowne uruchomienie podu, którego dotyczy problem, lub dostosowanie progu skalowania pamięci (Horizontal Pod Autoscaler, HPA)
- Wstępnie wypełnij zgłoszenia incydentu: Stwórz zgłoszenia ServiceNow, PagerDuty lub zgłoszenia do kanału zdarzenia z pełnym podsumowaniem dochodzenia
Te skonfigurowane przepływy pracy powiadamiają odpowiednie osoby, gdy agent SRE pracuje nad proponowanymi działaniami zaradczymi. W trybie przeglądu administrator agenta SRE przegląda podsumowanie z dołączonym kontekstem podręcznika procedur i zatwierdza działania wymagające zatwierdzenia. Śledztwo pozostaje w jednym wątku, ograniczając konieczność przełączania się między narzędziami. To, czy agent automatycznie stosuje środek łagodzący, czy czeka na zatwierdzenie, zależy od skonfigurowanego trybu działania.
Ten wzorzec dotyczy wszystkich skonfigurowanych usług i integracji Azure, w tym systemów obliczeniowych, pamięci masowej, sieci, danych oraz powiązanych usług monitorowania i zarządzania. Rozszerz ją o dozwolone operacje interfejsu wiersza polecenia platformy Azure za pomocą umiejętności, zatwierdzonych elementów runbook lub niestandardowych agentów. Używaj haków agentów , aby dodać punkty kontrolne zarządzania, które mogą zezwalać lub blokować działania.
Praca agenta przebiega według trzech wzorców:
Automatyzacja incydentów: Po wystąpieniu alertu agent odpytuje narzędzia do monitorowania, koreluje sygnały z różnych systemów, identyfikuje prawdopodobną przyczynę źródłową i proponuje działania zaradcze.
Zautomatyzuj zaplanowane przepływy pracy: Zaplanuj proaktywne kontrole stanu, przeglądy zgodności oraz rutynowe zadania operacyjne. Wyniki są wyświetlane na połączonej platformie zdarzeń lub w kanale powiadomień.
Zbadaj i doradź: Zadawaj pytania w języku naturalnym dotyczące swojego otoczenia, takie jak "co się zmieniło w ostatniej godzinie?" lub "dlaczego ta usługa jest pogorszyona?", i otrzymuj odpowiedzi oparte na źródłach.
Jak to działa
SRE Agent łączy specyficzną wiedzę o produktach Azure z personalizacją, którą kontrolujesz. Domyślnie może zapytywać i działać na zasobach Azure w ramach przypisanych uprawnień, z wbudowanym zachowaniem dla typowych zadań operacyjnych.
Agent działa przez pięć punktów rozszerzenia, które możesz dostosować:
Umiejętności: odrębne możliwości, w tym elementy Runbook usługi Marketplace i skrypty Azure CLI, które rozszerzają możliwości operacyjne agenta bez konieczności tworzenia kodu niestandardowego.
Agenci niestandardowi: Agenci tworzeni specjalnie dla konkretnych domen operacyjnych. Kilku wyspecjalizowanych agentów jest dostępnych od razu do użycia, a własnego możesz stworzyć w kreatorze agentów. Zobacz Agenci niestandardowi.
Python narzędzia: niestandardowa logika, przekształcenia danych i integracje interfejsu API dla scenariuszy wymagających kodu, a nie konfiguracji.
Serwery MCP: Połącz się z gotowymi złączami partnerskimi dla platform obserwacji takich jak Datadog, Splunk, New Relic, Dynatrace i Elasticsearch, lub podłącz dowolne narzędzie niestandardowe za pomocą standardu Model Context Protocol. Zobacz złącza i narzędzia MCP.
Haki agentów: automatyzacje wyzwalane przez zdarzenia, które uruchamiają się w określonych punktach cyklu życia agenta, na przykład po uruchomieniu narzędzia lub gdy agent się zatrzyma. Użyj hooków, aby wymuszać zasady, wysyłać dane telemetryczne lub integrować się z zewnętrznymi przepływami zatwierdzania. Zobacz Agent hooks.
Każde proponowane wywołanie narzędzia przechodzi przez kontrolę zarządzania zanim się uruchomi, więc Twój zespół wyznacza granice nawet dla w pełni zautomatyzowanych przepływów pracy. Aby uzyskać więcej informacji, zobacz Zabezpieczenia i ład.
Integrations
Azure SRE Agent łączy się z narzędziami, których Twój zespół już używa:
Monitorowanie i obserwowanie:
- Azure Monitor (metryki, dzienniki, alerty, skoroszyty)
- Application Insights
- Analiza dzienników
Zarządzanie zdarzeniami:
- Alerty usługi Azure Monitor
- PagerDuty
- ServiceNow
Kontrola źródła i ciągła integracja/ciągłe wdrażanie:
- GitHub (repozytoria, problemy)
- Azure DevOps (repozytoria, elementy robocze)
Źródła danych:
- Klastry Azure Data Explorer (Kusto)
- Serwery protokołu MCP (Model Context Protocol)
Komunikacja i powiadomienia:
- Microsoft Teams
- Program Outlook
W zależności od konfiguracji, Azure SRE Agent oferuje także zarządzane konektory, osobny system łączący, który może łączyć Twojego agenta z usługami SaaS, takimi jak Google Drive, SharePoint, Notion i Confluence.
Zabezpieczenia i nadzór
Zespoły ds. bezpieczeństwa i platformy mogą stosować warstwowe kontrole w sieci, tożsamości, autoryzacji oraz zarządzaniu organizacyjnym:
Izolacja sieci: Integracja z VNet kieruje ruch przestrzeni roboczej agenta przez Twoją wirtualną sieć. Zasady Twojej grupy bezpieczeństwa sieciowego (NSG) obowiązują, gdy prywatny DNS rozwiązuje żądania. Gdy poprawnie skonfigurujesz routing sieciowy, DNS i uprawnienia, możesz dotrzeć do prywatnych punktów końcowych, wewnętrznych API i zablokowanych zasobów jak każdy inny zasób w Twojej wirtualnej sieci (VNet).
Tożsamość i RBAC: Agent uwierzytelnia się za pomocą zarządzanej tożsamości i działa w ramach kontroli dostępu opartej na rolach Azure (RBAC). Jeśli chodzi o kod źródłowy, wsparcie GitHub Enterprise pozwala agentowi uwierzytelniać się jako uregulowana tożsamość usługi poprzez model aplikacji Bring Your Own GitHub.
Kontrola dostępu na poziomie narzędzi: Ustaw każde narzędzie , którego używa agent, aby zezwalało, prosiło lub odmawiało. Administratorzy ustalają globalne bariery, liderzy zespołów dostosowują każdego agenta na zamówienie, a użytkownicy zatwierdzają narzędzia w swojej rozmowie. Dostępne opcje, domyślne i precedencje zależą od zakresu i obowiązującej polityki. Szczegóły można znaleźć w zasadach dostępu do narzędzi.
Infrastruktura jako kod: Wdroż agenta, jego konfigurację sieci, tożsamość oraz polityki narzędzi za pomocą szablonów Bicep (język infrastruktury jako kodu Azure) oraz Azure CLI przez te same potoki CI/CD, które używasz dla wszystkich innych zasobów Azure.
Kontrolowana dystrybucja umiejętności: Zespoły platformowe mogą publikować zatwierdzone umiejętności do prywatnego repozytorium GitHub za pomocą Private Plugins Marketplace. Agenci w całej dzierżawie instalują zatwierdzone funkcje z tego samego zarządzanego katalogu.
Ponowne wykorzystanie kontekstu operacyjnego
Azure SRE Agent zachowuje kontekst z wcześniejszych analiz oraz wykorzystuje generowanie analiz w tle i analizy sesji do rozpoznawania powtarzających się wzorców lub powiązanych kontekstów. Zachowany kontekst może obejmować przyczyny źródłowe, kroki rozwiązujące, preferencje oraz wzorce operacyjne. Ponowne wykorzystanie może ograniczyć powtarzające się zbieranie kontekstu, zmniejszyć zależność od nieudokumentowanej wiedzy indywidualnej oraz zapewnić inżynierom na wezwanie bardziej spójne informacje początkowe.
Wskazówka
Przykład zespołu: Nowy inżynier dołącza do dyżuru. Agent zna już wzorce wdrożeń, przeszłe incydenty i procedury zespołowe, więc zaczyna od pierwszego dnia z większym kontekstem.
Przykład solo: Idziesz na wakacje. Zarejestrowany kontekst operacyjny agenta jest dostępny dla każdej osoby, która go zastępuje, dzięki czemu nie musi zaczynać od zera.
| Etapie | Co się stanie |
|---|---|
| Początkowe przygotowanie | Połącz swoje narzędzia i korzystaj z wbudowanej wiedzy Azure podczas dochodzenia. |
| Po wielokrotnych dochodzeniach | Zachowany kontekst może obejmować topologię środowiska, powtarzające się wzorce awarii oraz preferencje eskalacji. |
| W miarę jak wspólny kontekst się kumuluje | Członkowie zespołu mogą ponownie wykorzystać wcześniejsze przyczyny i kroki rozwiązywania z mniejszym uzależnieniem od nieudokumentowanej wiedzy indywidualnej. |
Wprowadzenie
Wybierz ścieżkę odpowiadającą twojemu celowi: zaplanuj zadanie, załatw incydent lub zbuduj własnego agenta.
Użyj zaplanowanych zadań, aby zautomatyzować rutynowe prace operacyjne (kontrole stanu, czyszczenie i przeglądy zgodności) bez konieczności pisania kodu infrastruktury.
Wybierz kartę Planowanie zadań .
Wprowadź szczegóły zadania.
Zdefiniuj harmonogram uruchamiania zadania.
Utwórz niestandardowe instrukcje agenta dla zadania.
Wybierz pozycję Utwórz zaplanowane zadanie.
Wyniki zaplanowanego zadania widzisz na platformie powiązanych incydentów lub kanale powiadomień.
Treści powiązane
Wykorzystaj te zasoby do planowania wdrożenia, zarządzania, rozliczeń i wdrożenia zespołu:
| Resource | Co znajdziesz |
|---|---|
| Cennik i rozliczenia | Cenowanie oparte na użytkowaniu mierzone w jednostkach agentów Azure (AAU), plus planowanie pojemności |
| Omówienie zabezpieczeń | Obsługa danych, prywatność i izolacja wykonania |
| Tworzenie i konfigurowanie | Wdroż agenta i przyznaj mu dostęp do wybranych zasobów Azure. |
| Konfiguracja zespołu i role oraz role użytkownika i uprawnienia | Jak role decydują, kto może czatować, zatwierdzać i zarządzać agentem, a także jak uczyć agenta o Twoim zespole, usługach i procedurach |