Magas rendelkezésre állású (HA) állapotmonitorozás Azure Database for PostgreSQL rugalmas kiszolgálóhoz

Azure Database for PostgreSQL rugalmas kiszolgáló magas rendelkezésre állású (HA) állapotmonitorozási funkciót tartalmaz, amely Azure Resource Health Check (RHC) keretrendszerét használja. Ez a szolgáltatás folyamatos betekintést nyújt a HA-kompatibilis példányok állapotába, és értesíti Önt azokról az eseményekről, amelyek hatással lehetnek a kapcsolatra és a rendelkezésre állásra. A következő szakaszok ismertetik az egyes állapotokat és a kapcsolódó forgatókönyveket, amelyek segítenek a HA stabilitásának hibaelhárításában és fenntartásában.

Egészségi állapotok

A szolgáltatás különböző belső jeleken keresztül figyeli az egyes HA-állapotokat, amelyek meghatározott feltételeket képviselnek. Az alábbi lista a lehetséges HA-állapotokat, valamint a Azure Database for PostgreSQL rugalmas kiszolgálót érintő vizuális mutatókat és forgatókönyveket ismerteti.

Kész – A HA kifogástalan állapotú

A Kész állapot azt jelzi, hogy a HA-kompatibilis kiszolgáló normálisan működik a feladatátvételi készültséget befolyásoló problémák nélkül. Az összes szükséges konfiguráció érintetlen, és nincsenek jelentős hibafeltételek.

Képernyőkép a HA kész állapotáról.

Csökkent – Hálózati biztonsági csoport (NSG) vagy virtuális hálózati berendezés blokkolja a kapcsolatokat

A csökkentett állapot akkor jelenhet meg, ha az NSG-szabályok vagy egy virtuális berendezés blokkolja a magas rendelkezésre álláshoz szükséges alapvető kapcsolatokat. Ez a konfigurációs probléma megakadályozza a teljes HA-funkcionalitást. Javítsa ki a problémát az NSG beállításainak módosításával.

Képernyőkép a leromlott HA-állapotról az NSG által blokkolt kapcsolatok miatt.

Korlátozott – Csak olvasható állapot

Ha a rugalmas PostgreSQL-kiszolgáló írásvédett állapotba lép, a csökkentett állapot ezt a korlátozást tükrözi. A teljes funkcionalitás helyreállításához ehhez az állapothoz általában további erőforrások biztosítására vagy a csak olvasható beállításhoz vezető körülmények kezelésére van szükség.

Képernyőkép a csak olvasható állapot miatti „HA Degraded” állapot megjelenítéséről.

Csökkentett – Magas rendelkezésre állás csökkentett állapotban

Ez az állapot akkor jelenik meg, ha a magas rendelkezésre állású (HA) szolgáltatás teljesítménycsökkenést tapasztal, esetleg átmeneti problémák vagy rendszerszintű feltételek miatt. Az újrapróbálkozási logika implementálása segíthet enyhíteni ezeknek az ideiglenes csatlakozási zavaroknak a hatásait. A csökkentett állapot nem jelenti azt, hogy a kiszolgáló nem érhető el. Ehelyett azt jelzi, hogy a teljes HA-konfiguráció és az állapotellenőrzések még nem teljesen készültek el. Ennek ellenére előfordulhat, hogy a kiszolgáló továbbra is működőképes és elérhető.

Az adatbázis rendelkezésre állásának pontos monitorozásához használja a metrikát az is_db_aliveadatbázis rendelkezésre állási metrikáinak részeként. Ez a metrika megbízhatóan jelzi az adatbázis rendelkezésre állását, és segít megkülönböztetni az ideiglenes hiányos HA-beállításokat és a tényleges állásidőt.

Képernyőkép, amelyen a teljesítményproblémák miatt csökkent HA-állapot látható.

Csökkentett teljesítményű – Tervezett feladatátvétel kezdeményezése

A kiszolgáló számára kezdeményezett tervezett feladatátvételi esemény során megjelenik a csökkentett állapot, amely azt jelzi, hogy a HA feladatátvételi folyamatok aktívak. Ez a folyamat általában rövid és szabályozott, és a szolgáltatás hamarosan folytatódik.

A tervezett feladatátvétel miatti degradált HA-állapotot mutató képernyőkép.

Csökkentett – Nem tervezett feladatátvételt kezdeményeztek

Nem tervezett feladatátvétel esetén ez az állapot egy olyan aktív feladatátvételi eseményt jelez, amelyet váratlan körülmények váltanak ki. Ez a forgatókönyv rövid kapcsolati megszakításokat vonhat maga után, amíg a kiszolgáló nem hajtja végre a feladatátvételi eljárásokat.

Képernyőkép a HA nem tervezett feladatátvétel miatti csökkentett állapotáról.

Leromlott állapot – Frissítés miatti feladatátvétel kezdeményezve

A rendszerfrissítések során előfordulhat, hogy a HA-kiszolgáló frissítési feladatátvételen megy keresztül a szükséges frissítések alkalmazásához. Ebben az állapotban a kiszolgáló ideiglenesen korlátozhatja az új kapcsolatokat. Újrapróbálkozási logika implementálása az átmeneti problémák hatékony kezeléséhez.

Képernyőkép, amely a frissítés miatti feladatátvétel következtében romlott HA-állapotot mutatja.

Erőforrásállapot-riasztások konfigurálása

Állítson be Resource Health riasztásokat, hogy valós idejű értesítéseket kapjon a HA-kompatibilis PostgreSQL-példány állapotában bekövetkező változásokról. Ezeket a riasztásokat a Azure portálon vagy egy ARM-sablon használatával konfigurálhatja. Így a portál aktív figyelése nélkül is értesülhet a HA állapotfrissítéséről.

A Resource Health-riasztások portálon keresztüli konfigurálásához szükséges lépések

  1. Nyissa meg a Azure portált, és válassza ki rugalmas PostgreSQL-kiszolgálóját.
  2. A bal oldali menü Figyelés szakaszában válassza a Riasztások lehetőséget.
  3. Válassza az Új riasztási szabály lehetőséget, és konfigurálja a riasztási logikát Resource Health jelek alapján.
  4. Állítsa be a műveletcsoportot az értesítés módjának (e-mail, SMS stb.) megadásához.
  5. Tekintse át és hozza létre a riasztási szabályt.

A Resource Health-riasztások ARM-sablonnal történő létrehozásának lépései

  1. Töltse le az ARM-sablont a Resource Health Alerts ARM-sablon útmutatójából.
  2. Testre szabhatja a sablont a megadott kiszolgálóadatokkal és riasztási beállításokkal.
  3. Az ARM-sablon üzembe helyezése Azure CLI vagy Azure PowerShell használatával.
  4. Ellenőrizze az üzembe helyezést, és győződjön meg arról, hogy a riasztások aktívak.

A riasztások beállításával kapcsolatos további információkért tekintse meg az alábbi útmutatókat:

A HA állapotmonitorozásával alapvető ismereteket szerezhet a PostgreSQL-kiszolgáló HA teljesítményéről, így proaktív módon kezelheti az üzemidőt és a rendelkezésre állást.