Poznámka:
Přístup k této stránce vyžaduje autorizaci. Můžete se zkusit přihlásit nebo změnit adresáře.
Přístup k této stránce vyžaduje autorizaci. Můžete zkusit změnit adresáře.
Important
Spravované zotavení po havárii je omezeno. Požádat o přístup prostřednictvím týmu účtu Azure Databricks. Azure Databricks umožní spravované zotavení po havárii pro váš účet poté, co budete schváleni.
Tato stránka obsahuje referenční informace pro states tabulku v systémovém replication schématu, která sleduje stav replikace Azure Databricks spravované zotavení po havárii (DR). Každý řádek je událost stavu pro skupinu převzetí služeb při selhání, která se pravidelně vydává a kdykoli se skupina převzetí služeb při selhání změní. Tato tabulka slouží k monitorování aktuálního a historického stavu replikace skupin převzetí služeb při selhání, včetně prodlevy replikace a všech chyb blokujících replikaci alespoň jednoho prostředku.
Cesta k tabulce: system.replication.states
Jak číst stav replikace
Stavové události jsou vysílány v pravidelných intervalech. Každá událost hlásí agregovaný stav skupiny pro failover, aktuální zpoždění a případné chyby, které blokují replikaci alespoň jednoho assetu. Neuvádí, které jednotlivé objekty byly úspěšně replikovány.
Pokud replication_lag_ms není null, vše, co není pokryto chybou v dané události, bylo replikováno až do tohoto zpoždění. Ostatní objekty v rozsahu pokračují v replikaci a zůstávají aktuální vůči zpoždění, i když errors pole není prázdné. Během INITIAL_REPLICATION, než jsou všechna aktiva v rozsahu jednou replikována, replication_lag_ms může být : nulludálost může stále uvádět chyby blokování, ale ještě neměří úplnost.
Typy aktiv, které spravovaná DR vůbec nepodporuje, se v tabulce neobjevují ani jako úspěch, ani jako chyba. Jejich absence neznamená, že se replikovaly. Viz Omezení. In-scope asset, která používají nepodporovanou funkci, jako jsou řádkové filtry, sloupcové masky nebo řízení přístupu založené na atributech (ABAC), se v tabulce objevují jako selhání.
Pro ověření, že konkrétní objekt existuje v sekundárním prostoru, zkontrolujte objekt tam. Protože sekundární katalogy v rámci rozsahu jsou pouze pro čtení, Azure Databricks doporučuje samostatný monitorovací pracovní prostor pouze pro čtení v sekundární oblasti. Viz Nastavit replikaci.
Referenční dokumentace schématu tabulek stavů
Tabulka states používá následující schéma:
| Název sloupce | Datový typ | Description | Example |
|---|---|---|---|
event_id |
řetězec | Jedinečný identifikátor události stavu. | ca886134-876c-4671-a38b-332edf48c602 |
event_time |
časové razítko | Časové razítko, kdy byla událost vygenerován. | 2024-01-05T00:00:00.000+00:00 |
account_id |
řetězec | ID účtu, do kterého skupina převzetí služeb při selhání patří. | ca886134-876c-4671-a38b-332edf48c602 |
failover_group_name |
řetězec | Plně kvalifikovaný název skupiny převzetí služeb při selhání | accounts/account1/failover-group/group1 |
replication_state |
řetězec | Stav replikace při vygenerování události Možné hodnoty jsou INITIAL_REPLICATION, , ACTIVE, CREATED, UPDATEDDELETEDFAILOVER_STARTED, , FAILOVER_FINISHEDa .FAILOVER_ABORTED |
ACTIVE |
errors |
pole | Když replication_state je nebo INITIAL_REPLICATION , ACTIVEagregovaný seznam chyb, které blokují replikaci alespoň jednoho aktiva, včetně počtu aktiv, která každá chyba ovlivní. Viz referenční informace k chybám. |
Zobrazit referenční informace k chybám |
replication_lag_ms |
long | Milisekundy od poslední úspěšné replikace všech prostředků v oboru při vygenerování události. Hodnota null označuje, že alespoň jeden prostředek se nikdy nereplikoval ze zdroje do repliky. Rostoucí hodnota znamená, že zotavení po havárii nemůže replikovat alespoň jeden prostředek v oboru, ale změny jiných prostředků v oboru se budou dál replikovat. |
2323 |
effective_primary_region |
řetězec | Primární oblast skupiny převzetí služeb při selhání v době, kdy byla událost generována. | us-west-2 |
managed_assets |
struktura | Prostředky spravované skupinou převzetí služeb při selhání při vygenerované události. Viz referenční informace ke spravovaným prostředkům. | Viz referenční informace ke spravovaným prostředkům |
Referenční informace k chybám
Sloupec errors obsahuje pole chyb, které blokují replikaci. Každý prvek pole je struktura s následujícími poli:
| Název pole | Datový typ | Description |
|---|---|---|
error |
struktura | Podrobnosti o chybě Obsahuje error_class (řetězec), název třídy chyby; parameters (mapa), parametry klíč-hodnota s podrobnostmi o chybě; a message (řetězec), chybovou zprávu, která je čitelná pro člověka. |
affected_assets_counts |
pole | Jedna položka na ovlivněný typ prostředku. Každá položka obsahuje asset_type (řetězec), typ ovlivněného prostředku a failing_count (dlouhý), počet prostředků tohoto typu, které má chyba vliv. |
Referenční informace ke spravovaným prostředkům
Sloupec managed_assets je struktura, která popisuje prostředky spravované skupinou převzetí služeb při selhání při vygenerování události. Obsahuje následující pole:
| Název pole | Datový typ | Description |
|---|---|---|
metastore_ids |
pole | ID metastore spravovaných skupinou pro failover. |
workspace_sets |
pole | Pracovní prostor se nastavuje ve správě skupiny převzetí služeb při selhání. Každá položka obsahuje name (řetězec) a workspace_ids (pole). |
catalogs |
pole | Katalogy spravované skupinou převzetí služeb při selhání. Každá položka obsahuje name (řetězec). |
Důležité informace při čtení tabulky
Při analýze states tabulky si poznamenejte následující skutečnosti:
- Naplnění dat může trvat až 3 hodiny po výskytu události.
- Tabulka obsahuje události pro všechny skupiny převzetí služeb při selhání v účtu Azure Databricks.
Příkladové dotazy
Následující dotaz vrátí nejnovější stav replikace pro danou skupinu převzetí služeb při selhání, včetně aktuální replication_state, prodlevy replikace a všech blokujících chyb:
SELECT
event_time,
replication_state,
replication_lag_ms,
errors
FROM system.replication.states
WHERE failover_group_name = :failover_group_name
ORDER BY event_time DESC
LIMIT 1
Následující dotaz vrátí distribuci prodlevy replikace pro danou skupinu převzetí služeb při selhání:
SELECT histogram_numeric(replication_lag_ms, 20) AS replication_lag_distribution
FROM system.replication.states
WHERE failover_group_name = :failover_group_name