À propos des exercices de panne de zone de disponibilité dans le Gestionnaire de résilience de l’infrastructure (version préliminaire)

Le Gestionnaire de résilience d’infrastructure vous permet d’évaluer la résilience des ressources du groupe de services en simulant des pannes de zone sur des ressources individuelles. Vous pouvez évaluer les performances des solutions de résilience interzone pour vos applications et identifier les ressources qui nécessitent des améliorations de résilience pour prendre en charge la continuité des applications.

Les modèles d’exercice de panne de zone de disponibilité fournissent des défaillances recommandées par Azure pour les types de ressources pris en charge et vous permettent de les remplacer par une logique personnalisée à l’aide d’Azure Runbooks. Après l’injection d’erreurs, vous pouvez effectuer un basculement et une reprotection pour les ressources configurées avec des solutions actives passives à l’aide des plans de récupération intégrés. Vous pouvez également mesurer le temps d’arrêt de l’application pendant les pannes. Vous pouvez également surveiller le Groupe de services et l’état de santé des ressources en temps réel pendant l’exécution du drill grâce à des métriques intégrées.

Composants clés pour l’exercice de panne de la zone de disponibilité

Le tableau suivant répertorie les principaux composants que vous utilisez dans les exercices de panne de zone de disponibilité :

Composant  Description 
Groupe de services Groupe logique de ressources Azure qui représentent une application ou une charge de travail. 
Exercice de panne de zone Modèle qui simule une panne de zone de disponibilité sur les ressources du groupe de services pour évaluer la résilience interzone.
Injection d’erreurs Processus d’introduction de défaillances contrôlées pour simuler des pannes de zone. 
Plan de récupération Une séquence définie d’opérations de basculement et de reprotection pour restaurer les ressources après l’injection d’erreurs. 
Concepteur de défauts L’interface sert à examiner et à modifier les défauts appliqués à chaque ressource dans l’exercice.
Surveillance de l’état Vue intégrée des métriques pour suivre l’état de santé des ressources en temps réel pendant l’exécution de l’exercice.

Cycle de vie d’exécution de l’exemple

La séquence suivante présente chaque étape du cycle de vie du forage, ainsi que les actions effectuées à chaque étape :

  1. Injection d’erreurs : appliquez des erreurs contrôlées aux ressources de la zone de disponibilité sélectionnée.

  2. Basculement : déclenchez un basculement pour les ressources configurées avec des solutions actives et passives à l’aide du plan de récupération associé.

  3. Reprotection : activez la réplication pour les ressources basculées pour rétablir la redondance.

  4. Basculement (retour) : basculez les ressources de la zone cible vers la zone source. 

  5. Reprotection (sens inverse) : réactiver la réplication dans le sens d’origine pour restaurer la configuration de référence.

Étapes suivantes