Referência da tabela do sistema de replicação

Importante

A recuperação de desastres gerenciada é restrita. Solicite acesso por meio de sua equipe de conta Azure Databricks. Azure Databricks habilita a recuperação de desastre gerenciada em sua conta depois que você é aceito.

Esta página fornece uma referência para a states tabela no esquema do replication sistema, que rastreia o status de replicação de Azure Databricks recuperação de desastre gerenciada (DR). Cada linha é um evento de status para um grupo de failover, emitido periodicamente e sempre que o grupo de failover é alterado. Use esta tabela para monitorar o status de replicação atual e histórico de seus grupos de failover, incluindo o atraso de replicação e quaisquer erros que estejam bloqueando a replicação de pelo menos um ativo.

Caminho da tabela: system.replication.states

Como ler o status de replicação

Eventos de status são emitidos em intervalos regulares. Cada evento relata o estado agregado do grupo de failover, o atraso atual e quaisquer erros que estejam bloqueando a replicação de pelo menos um ativo. Ele não lista quais objetos individuais foram replicados com sucesso.

Quando replication_lag_ms não nullé , tudo que não é coberto por um erro nesse evento foi replicado até esse lag. Outros ativos dentro do escopo continuam a se replicar e permanecem atualizados até o lag, mesmo quando o errors array não está vazio. Durante INITIAL_REPLICATION, antes que todos os ativos dentro do escopo tenham sido replicados uma vez, replication_lag_ms pode ser null: o evento ainda pode listar erros de bloqueio, mas ainda não mede a completude.

Tipos de ativos que o DR gerenciado não suporta não aparecem na tabela, nem como sucesso, nem como erro. A ausência deles não significa que eles se replicaram. Confira Limitações. Ativos dentro do escopo que utilizam um recurso não suportado, como filtros de linha, máscaras de coluna ou controle de acesso baseado em atributos (ABAC), aparecem na tabela como falhas.

Para confirmar que existe um ativo específico no secundário, inspecione o objeto ali. Como os catálogos secundários dentro do escopo são somente leitura, o Azure Databricks recomenda um espaço de trabalho separado para monitores somente leitura na região secundária. Veja Configurar replicação.

Referência de esquema de tabela de estados

A states tabela usa o seguinte esquema:

Nome da coluna Tipo de dados Descrição Example
event_id cadeia Identificador exclusivo para o evento de status. ca886134-876c-4671-a38b-332edf48c602
event_time carimbo de data/hora Carimbo de data/hora de quando o evento foi emitido. 2024-01-05T00:00:00.000+00:00
account_id cadeia ID da conta à qual o grupo de failover pertence. ca886134-876c-4671-a38b-332edf48c602
failover_group_name cadeia Nome totalmente qualificado do grupo de failover. accounts/account1/failover-group/group1
replication_state cadeia Estado da replicação quando o evento foi emitido. Os valores possíveis sãoINITIAL_REPLICATION, , ACTIVE, CREATED, UPDATED, DELETED, FAILOVER_STARTED, e FAILOVER_FINISHEDFAILOVER_ABORTED. ACTIVE
errors matriz Quando replication_state é INITIAL_REPLICATION ou ACTIVE, uma lista agregada dos erros que bloqueiam a replicação de pelo menos um ativo, incluindo quantos ativos cada erro afeta. Consulte a referência de Erros. Consulte a referência de erros
replication_lag_ms long Milissegundos desde a última replicação bem-sucedida de todos os ativos no escopo quando o evento foi emitido. Um null valor indica que pelo menos um ativo nunca foi replicado da origem para a réplica. Um valor crescente significa que a DR não consegue replicar pelo menos um ativo no escopo, mas as alterações em outros ativos no escopo continuam a ser replicadas. 2323
effective_primary_region cadeia A região primária do grupo de failover no momento em que o evento foi emitido. us-west-2
managed_assets struct Os ativos gerenciados pelo grupo de failover quando o evento foi emitido. Consulte a referência de ativos gerenciados. Consulte a referência de ativos gerenciados

Referência de erros

A errors coluna contém uma matriz dos erros que estão bloqueando a replicação. Cada elemento da matriz é um struct com os seguintes campos:

Nome do campo Tipo de dados Descrição
error struct Detalhes sobre o erro. Contém error_class (cadeia de caracteres), um nome de classe para o erro; parameters (mapa), parâmetros chave-valor com detalhes sobre o erro; e message (cadeia de caracteres), uma mensagem de erro legível por humanos.
affected_assets_counts matriz Uma entrada por tipo de ativo afetado. Cada entrada contém asset_type (cadeia de caracteres), o tipo do ativo afetado e failing_count (longo), o número de ativos desse tipo que o erro afeta.

Referência de ativos gerenciados

A managed_assets coluna é um struct que descreve os ativos gerenciados pelo grupo de failover quando o evento foi emitido. Ela contém os seguintes campos:

Nome do campo Tipo de dados Descrição
metastore_ids matriz Os IDs dos metastores gerenciados pelo grupo de failover.
workspace_sets matriz Os conjuntos de workspaces gerenciados pelo grupo de failover. Cada entrada contém name (cadeia de caracteres) e workspace_ids (matriz).
catalogs matriz Os catálogos gerenciados pelo grupo de failover. Cada entrada contém name (cadeia de caracteres).

Considerações ao ler a tabela

Anote o seguinte ao analisar a states tabela:

  • Os dados podem levar até 3 horas para serem preenchidos após a ocorrência de um evento.
  • A tabela contém eventos para todos os grupos de failover na conta Azure Databricks.

Consultas de exemplo

A consulta a seguir retorna o status de replicação mais recente para um determinado grupo de failover, incluindo seu atual replication_state, retardo de replicação e quaisquer erros de bloqueio:

SELECT
  event_time,
  replication_state,
  replication_lag_ms,
  errors
FROM system.replication.states
WHERE failover_group_name = :failover_group_name
ORDER BY event_time DESC
LIMIT 1

A consulta a seguir retorna a distribuição do atraso de replicação para um determinado grupo de failover:

SELECT histogram_numeric(replication_lag_ms, 20) AS replication_lag_distribution
FROM system.replication.states
WHERE failover_group_name = :failover_group_name