Referenční informace k systémové tabulce replikace

Important

Spravované zotavení po havárii je omezeno. Požádat o přístup prostřednictvím týmu účtu Azure Databricks. Azure Databricks umožní spravované zotavení po havárii pro váš účet poté, co budete schváleni.

Tato stránka obsahuje referenční informace pro states tabulku v systémovém replication schématu, která sleduje stav replikace Azure Databricks spravované zotavení po havárii (DR). Každý řádek je událost stavu pro skupinu převzetí služeb při selhání, která se pravidelně vydává a kdykoli se skupina převzetí služeb při selhání změní. Tato tabulka slouží k monitorování aktuálního a historického stavu replikace skupin převzetí služeb při selhání, včetně prodlevy replikace a všech chyb blokujících replikaci alespoň jednoho prostředku.

Cesta k tabulce: system.replication.states

Jak číst stav replikace

Stavové události jsou vysílány v pravidelných intervalech. Každá událost hlásí agregovaný stav skupiny pro failover, aktuální zpoždění a případné chyby, které blokují replikaci alespoň jednoho assetu. Neuvádí, které jednotlivé objekty byly úspěšně replikovány.

Pokud replication_lag_ms není null, vše, co není pokryto chybou v dané události, bylo replikováno až do tohoto zpoždění. Ostatní objekty v rozsahu pokračují v replikaci a zůstávají aktuální vůči zpoždění, i když errors pole není prázdné. Během INITIAL_REPLICATION, než jsou všechna aktiva v rozsahu jednou replikována, replication_lag_ms může být : nulludálost může stále uvádět chyby blokování, ale ještě neměří úplnost.

Typy aktiv, které spravovaná DR vůbec nepodporuje, se v tabulce neobjevují ani jako úspěch, ani jako chyba. Jejich absence neznamená, že se replikovaly. Viz Omezení. In-scope asset, která používají nepodporovanou funkci, jako jsou řádkové filtry, sloupcové masky nebo řízení přístupu založené na atributech (ABAC), se v tabulce objevují jako selhání.

Pro ověření, že konkrétní objekt existuje v sekundárním prostoru, zkontrolujte objekt tam. Protože sekundární katalogy v rámci rozsahu jsou pouze pro čtení, Azure Databricks doporučuje samostatný monitorovací pracovní prostor pouze pro čtení v sekundární oblasti. Viz Nastavit replikaci.

Referenční dokumentace schématu tabulek stavů

Tabulka states používá následující schéma:

Název sloupce Datový typ Description Example
event_id řetězec Jedinečný identifikátor události stavu. ca886134-876c-4671-a38b-332edf48c602
event_time časové razítko Časové razítko, kdy byla událost vygenerován. 2024-01-05T00:00:00.000+00:00
account_id řetězec ID účtu, do kterého skupina převzetí služeb při selhání patří. ca886134-876c-4671-a38b-332edf48c602
failover_group_name řetězec Plně kvalifikovaný název skupiny převzetí služeb při selhání accounts/account1/failover-group/group1
replication_state řetězec Stav replikace při vygenerování události Možné hodnoty jsou INITIAL_REPLICATION, , ACTIVE, CREATED, UPDATEDDELETEDFAILOVER_STARTED, , FAILOVER_FINISHEDa .FAILOVER_ABORTED ACTIVE
errors pole Když replication_state je nebo INITIAL_REPLICATION , ACTIVEagregovaný seznam chyb, které blokují replikaci alespoň jednoho aktiva, včetně počtu aktiv, která každá chyba ovlivní. Viz referenční informace k chybám. Zobrazit referenční informace k chybám
replication_lag_ms long Milisekundy od poslední úspěšné replikace všech prostředků v oboru při vygenerování události. Hodnota null označuje, že alespoň jeden prostředek se nikdy nereplikoval ze zdroje do repliky. Rostoucí hodnota znamená, že zotavení po havárii nemůže replikovat alespoň jeden prostředek v oboru, ale změny jiných prostředků v oboru se budou dál replikovat. 2323
effective_primary_region řetězec Primární oblast skupiny převzetí služeb při selhání v době, kdy byla událost generována. us-west-2
managed_assets struktura Prostředky spravované skupinou převzetí služeb při selhání při vygenerované události. Viz referenční informace ke spravovaným prostředkům. Viz referenční informace ke spravovaným prostředkům

Referenční informace k chybám

Sloupec errors obsahuje pole chyb, které blokují replikaci. Každý prvek pole je struktura s následujícími poli:

Název pole Datový typ Description
error struktura Podrobnosti o chybě Obsahuje error_class (řetězec), název třídy chyby; parameters (mapa), parametry klíč-hodnota s podrobnostmi o chybě; a message (řetězec), chybovou zprávu, která je čitelná pro člověka.
affected_assets_counts pole Jedna položka na ovlivněný typ prostředku. Každá položka obsahuje asset_type (řetězec), typ ovlivněného prostředku a failing_count (dlouhý), počet prostředků tohoto typu, které má chyba vliv.

Referenční informace ke spravovaným prostředkům

Sloupec managed_assets je struktura, která popisuje prostředky spravované skupinou převzetí služeb při selhání při vygenerování události. Obsahuje následující pole:

Název pole Datový typ Description
metastore_ids pole ID metastore spravovaných skupinou pro failover.
workspace_sets pole Pracovní prostor se nastavuje ve správě skupiny převzetí služeb při selhání. Každá položka obsahuje name (řetězec) a workspace_ids (pole).
catalogs pole Katalogy spravované skupinou převzetí služeb při selhání. Každá položka obsahuje name (řetězec).

Důležité informace při čtení tabulky

Při analýze states tabulky si poznamenejte následující skutečnosti:

  • Naplnění dat může trvat až 3 hodiny po výskytu události.
  • Tabulka obsahuje události pro všechny skupiny převzetí služeb při selhání v účtu Azure Databricks.

Příkladové dotazy

Následující dotaz vrátí nejnovější stav replikace pro danou skupinu převzetí služeb při selhání, včetně aktuální replication_state, prodlevy replikace a všech blokujících chyb:

SELECT
  event_time,
  replication_state,
  replication_lag_ms,
  errors
FROM system.replication.states
WHERE failover_group_name = :failover_group_name
ORDER BY event_time DESC
LIMIT 1

Následující dotaz vrátí distribuci prodlevy replikace pro danou skupinu převzetí služeb při selhání:

SELECT histogram_numeric(replication_lag_ms, 20) AS replication_lag_distribution
FROM system.replication.states
WHERE failover_group_name = :failover_group_name