Informazioni di riferimento sulla tabella di sistema di replica

Importante

Il DR gestito è soggetto a restrizioni di accesso. Richiedi l'accesso tramite il team dell'account di Azure Databricks. Azure Databricks abilita il ripristino di emergenza gestito per il tuo account dopo che la tua richiesta è stata approvata.

Questa pagina fornisce un riferimento per la tabella nello schema di sistema, che tiene traccia dello stato di replica di Azure Databricks ripristino di emergenza gestito.This page provides a reference for the states table in the replication system schema, which track the replication status of Azure Databricks managed disaster recovery (DR). Ogni riga è un evento di stato per un gruppo di failover, generato periodicamente e ogni volta che il gruppo di failover cambia. Usare questa tabella per monitorare lo stato di replica corrente e cronologico dei gruppi di failover, inclusi il ritardo di replica e gli eventuali errori che bloccano la replica di almeno un asset.

Percorso tabella: system.replication.states

Come leggere lo stato di replicazione

Gli eventi di stato vengono emessi a intervalli regolari. Ogni evento riporta lo stato aggregato del gruppo di failover, il ritardo corrente e eventuali errori che bloccano la replica di almeno un asset. Non elenca quali singoli oggetti sono stati replicati con successo.

Quando replication_lag_ms non nullè , tutto ciò che non è coperto da un errore in quell'evento è stato replicato fino a quel lag. Altri asset in-scope continuano a replicarsi e rimangono aggiornati fino al lag, anche quando l'array errors non è vuoto. Durante INITIAL_REPLICATION, prima che tutti gli asset in ambito siano stati replicati una volta, replication_lag_ms può essere null: l'evento può ancora elencare errori di blocco, ma non misura ancora la completezza.

I tipi di asset che DR gestito non supporta affatto non compaiono nella tabella, né come successo né come errore. La loro assenza non significa che si siano replicati. Vedere Limitazioni. Gli asset in-scope che utilizzano una funzione non supportata, come filtri a righe, maschere di colonna o controllo di accesso basato su attributi (ABAC), appaiono nella tabella come fallimenti.

Per confermare che una risorsa specifica esista nel secondario, ispeziona l'oggetto lì. Poiché i cataloghi secondari in-scope sono di sola lettura, Azure Databricks raccomanda un workspace separato per monitor in sola lettura nella regione secondaria. Vedi Imposta replicazione.

Informazioni di riferimento sullo schema della tabella Stati

La states tabella usa lo schema seguente:

Nome della colonna Tipo di dati Descrizione Example
event_id string Identificatore univoco per l'evento di stato. ca886134-876c-4671-a38b-332edf48c602
event_time Marca temporale Timestamp di quando è stato generato l'evento. 2024-01-05T00:00:00.000+00:00
account_id string ID dell'account a cui appartiene il gruppo di failover. ca886134-876c-4671-a38b-332edf48c602
failover_group_name string Nome completo del gruppo di failover. accounts/account1/failover-group/group1
replication_state string Stato della replica quando è stato generato l'evento. I valori possibili sono INITIAL_REPLICATION, ACTIVE, CREATED, UPDATEDDELETED, FAILOVER_STARTED, FAILOVER_FINISHED, e FAILOVER_ABORTED. ACTIVE
errors array Quando replication_state è INITIAL_REPLICATION o ACTIVE, un elenco aggregato degli errori che bloccano la replica di almeno un asset, inclusa quanta risorsa ciascun errore influenza. Vedere Informazioni di riferimento sugli errori. Vedere Informazioni di riferimento sugli errori
replication_lag_ms long Millisecondi dall'ultima replica riuscita di tutti gli asset nell'ambito quando l'evento è stato generato. Un null valore indica che almeno un asset non è mai stato replicato dall'origine alla replica. Un valore crescente indica che il ripristino di emergenza non è in grado di replicare almeno un asset nell'ambito, ma le modifiche ad altri asset nell'ambito continuano a essere replicate. 2323
effective_primary_region string Area primaria del gruppo di failover al momento dell'emissione dell'evento. us-west-2
managed_assets struct Asset gestiti dal gruppo di failover quando l'evento è stato generato. Vedere Informazioni di riferimento sulle risorse gestite. Vedere Informazioni di riferimento sulle risorse gestite

Informazioni di riferimento sugli errori

La errors colonna contiene una matrice degli errori che bloccano la replica. Ogni elemento della matrice è uno struct con i campi seguenti:

Nome campo Tipo di dati Descrizione
error struct Dettagli sull'errore. Contiene error_class (stringa), un nome di classe per l'errore; parameters (mappa), parametri chiave-valore con dettagli sull'errore e message (stringa), un messaggio di errore leggibile.
affected_assets_counts array Una voce per ogni tipo di asset interessato. Ogni voce contiene asset_type (stringa), il tipo dell'asset interessato e failing_count (long), il numero di asset di quel tipo che influisce sull'errore.

Informazioni di riferimento sulle risorse gestite

La managed_assets colonna è uno struct che descrive gli asset gestiti dal gruppo di failover quando l'evento è stato generato. Include i seguenti campi:

Nome campo Tipo di dati Descrizione
metastore_ids array Gli ID dei metastore gestiti dal gruppo di failover.
workspace_sets array L'area di lavoro imposta i set gestiti dal gruppo di failover. Ogni voce contiene name (stringa) e workspace_ids (matrice).
catalogs array Cataloghi gestiti dal gruppo di failover. Ogni voce contiene name (stringa).

Considerazioni durante la lettura della tabella

Quando si analizza la states tabella, tenere presente quanto segue:

  • Il popolamento dei dati può richiedere fino a 3 ore dopo che si verifica un evento.
  • La tabella contiene eventi per tutti i gruppi di failover nell'account Azure Databricks.

Interrogazioni di esempio

La query seguente restituisce lo stato di replica più recente per un determinato gruppo di failover, incluso il relativo intervallo di replica corrente replication_statee gli eventuali errori di blocco:

SELECT
  event_time,
  replication_state,
  replication_lag_ms,
  errors
FROM system.replication.states
WHERE failover_group_name = :failover_group_name
ORDER BY event_time DESC
LIMIT 1

La query seguente restituisce la distribuzione del ritardo di replica per un determinato gruppo di failover:

SELECT histogram_numeric(replication_lag_ms, 20) AS replication_lag_distribution
FROM system.replication.states
WHERE failover_group_name = :failover_group_name