Informacje o ćwiczeniach dotyczących awarii strefy dostępności w Menedżerze odporności infrastruktury (wersja zapoznawcza)

Infrastructure Resiliency Manager umożliwia ocenę odporności zasobów grupy usług poprzez symulowanie awarii stref dla poszczególnych zasobów. Możesz ocenić wydajność rozwiązań odporności między strefami dla aplikacji i zidentyfikować zasoby, które wymagają ulepszeń odporności w celu zapewnienia ciągłości aplikacji.

Szablony testu awarii strefy dostępności udostępniają awarie zalecane przez platformę Azure dla obsługiwanych typów zasobów i umożliwiają ich nadpisanie przy użyciu logiki niestandardowej za pomocą elementów Runbook platformy Azure. Po wstrzyknięciu błędów można wykonać przejście w tryb failover i ponowne włączenie ochrony zasobów skonfigurowanych przy użyciu aktywnych-pasywnych rozwiązań przy użyciu zintegrowanych planów odzyskiwania. Możesz również zmierzyć przestoje aplikacji podczas przestojów. Możesz również monitorować grupę usług i stan zasobów w czasie rzeczywistym podczas wykonywania ćwiczenia dzięki zintegrowanym metrykom.

Kluczowe składniki przechodzenia do szczegółów strefy dostępności

W poniższej tabeli wymieniono główne elementy używane podczas ćwiczeń związanych z awarią strefy dostępności:

Component  Opis 
Grupa usług Logiczna grupa zasobów Azure reprezentujących aplikację lub obciążenie. 
Przechodzenie do szczegółów strefy Szablon, który symuluje awarię strefy dostępności w zasobach grupy usług w celu oceny odporności między strefami.
Wstrzykiwanie błędów Proces wprowadzania kontrolowanych błędów w celu symulowania awarii stref. 
Plan odzyskiwania Zdefiniowana sekwencja operacji przełączenia awaryjnego i ponownej ochrony w celu odzyskania zasobów po wstrzyknięciu awarii. 
Projektant błędów Interfejs służy do przeglądania i edytowania błędów przypisanych do każdego zasobu w widoku szczegółowym.
Monitorowanie kondycji Zintegrowany widok metryk do śledzenia stanu zasobów w czasie rzeczywistym podczas wykonywania ćwiczenia.

Cykl życia realizacji drążenia

Poniższa sekwencja przedstawia każdy etap cyklu życia analizy szczegółowej oraz działania wykonywane na każdym etapie:

  1. Wstrzykiwanie błędów: zastosuj kontrolowane błędy do zasobów w wybranej strefie dostępności.

  2. Przełączenie awaryjne: Wyzwól przełączenie awaryjne dla zasobów skonfigurowanych przy użyciu rozwiązań typu aktywny-pasywny za pomocą skojarzonego planu odzyskiwania po awarii.

  3. Ponowne zabezpieczenie: Włącz replikację dla zasobów po przełączeniu awaryjnym, aby przywrócić nadmiarowość.

  4. Przełączenie awaryjne (powrotne): Przełącz zasoby z powrotem ze strefy docelowej do strefy źródłowej. 

  5. Ponowne włączenie ochrony (w kierunku odwrotnym): Ponownie włącz replikację w pierwotnym kierunku, aby przywrócić konfigurację wyjściową.

Następne kroki