Observação
O acesso a essa página exige autorização. Você pode tentar entrar ou alterar diretórios.
O acesso a essa página exige autorização. Você pode tentar alterar os diretórios.
Importante
A recuperação de desastres gerenciada é restrita. Solicite acesso por meio de sua equipe de conta Azure Databricks. Azure Databricks habilita a recuperação de desastre gerenciada em sua conta depois que você é aceito.
Esta página fornece uma referência para a states tabela no esquema do replication sistema, que rastreia o status de replicação de Azure Databricks recuperação de desastre gerenciada (DR). Cada linha é um evento de status para um grupo de failover, emitido periodicamente e sempre que o grupo de failover é alterado. Use esta tabela para monitorar o status de replicação atual e histórico de seus grupos de failover, incluindo o atraso de replicação e quaisquer erros que estejam bloqueando a replicação de pelo menos um ativo.
Caminho da tabela: system.replication.states
Como ler o status de replicação
Eventos de status são emitidos em intervalos regulares. Cada evento relata o estado agregado do grupo de failover, o atraso atual e quaisquer erros que estejam bloqueando a replicação de pelo menos um ativo. Ele não lista quais objetos individuais foram replicados com sucesso.
Quando replication_lag_ms não nullé , tudo que não é coberto por um erro nesse evento foi replicado até esse lag. Outros ativos dentro do escopo continuam a se replicar e permanecem atualizados até o lag, mesmo quando o errors array não está vazio. Durante INITIAL_REPLICATION, antes que todos os ativos dentro do escopo tenham sido replicados uma vez, replication_lag_ms pode ser null: o evento ainda pode listar erros de bloqueio, mas ainda não mede a completude.
Tipos de ativos que o DR gerenciado não suporta não aparecem na tabela, nem como sucesso, nem como erro. A ausência deles não significa que eles se replicaram. Confira Limitações. Ativos dentro do escopo que utilizam um recurso não suportado, como filtros de linha, máscaras de coluna ou controle de acesso baseado em atributos (ABAC), aparecem na tabela como falhas.
Para confirmar que existe um ativo específico no secundário, inspecione o objeto ali. Como os catálogos secundários dentro do escopo são somente leitura, o Azure Databricks recomenda um espaço de trabalho separado para monitores somente leitura na região secundária. Veja Configurar replicação.
Referência de esquema de tabela de estados
A states tabela usa o seguinte esquema:
| Nome da coluna | Tipo de dados | Descrição | Example |
|---|---|---|---|
event_id |
cadeia | Identificador exclusivo para o evento de status. | ca886134-876c-4671-a38b-332edf48c602 |
event_time |
carimbo de data/hora | Carimbo de data/hora de quando o evento foi emitido. | 2024-01-05T00:00:00.000+00:00 |
account_id |
cadeia | ID da conta à qual o grupo de failover pertence. | ca886134-876c-4671-a38b-332edf48c602 |
failover_group_name |
cadeia | Nome totalmente qualificado do grupo de failover. | accounts/account1/failover-group/group1 |
replication_state |
cadeia | Estado da replicação quando o evento foi emitido. Os valores possíveis sãoINITIAL_REPLICATION, , ACTIVE, CREATED, UPDATED, DELETED, FAILOVER_STARTED, e FAILOVER_FINISHEDFAILOVER_ABORTED. |
ACTIVE |
errors |
matriz | Quando replication_state é INITIAL_REPLICATION ou ACTIVE, uma lista agregada dos erros que bloqueiam a replicação de pelo menos um ativo, incluindo quantos ativos cada erro afeta. Consulte a referência de Erros. |
Consulte a referência de erros |
replication_lag_ms |
long | Milissegundos desde a última replicação bem-sucedida de todos os ativos no escopo quando o evento foi emitido. Um null valor indica que pelo menos um ativo nunca foi replicado da origem para a réplica. Um valor crescente significa que a DR não consegue replicar pelo menos um ativo no escopo, mas as alterações em outros ativos no escopo continuam a ser replicadas. |
2323 |
effective_primary_region |
cadeia | A região primária do grupo de failover no momento em que o evento foi emitido. | us-west-2 |
managed_assets |
struct | Os ativos gerenciados pelo grupo de failover quando o evento foi emitido. Consulte a referência de ativos gerenciados. | Consulte a referência de ativos gerenciados |
Referência de erros
A errors coluna contém uma matriz dos erros que estão bloqueando a replicação. Cada elemento da matriz é um struct com os seguintes campos:
| Nome do campo | Tipo de dados | Descrição |
|---|---|---|
error |
struct | Detalhes sobre o erro. Contém error_class (cadeia de caracteres), um nome de classe para o erro; parameters (mapa), parâmetros chave-valor com detalhes sobre o erro; e message (cadeia de caracteres), uma mensagem de erro legível por humanos. |
affected_assets_counts |
matriz | Uma entrada por tipo de ativo afetado. Cada entrada contém asset_type (cadeia de caracteres), o tipo do ativo afetado e failing_count (longo), o número de ativos desse tipo que o erro afeta. |
Referência de ativos gerenciados
A managed_assets coluna é um struct que descreve os ativos gerenciados pelo grupo de failover quando o evento foi emitido. Ela contém os seguintes campos:
| Nome do campo | Tipo de dados | Descrição |
|---|---|---|
metastore_ids |
matriz | Os IDs dos metastores gerenciados pelo grupo de failover. |
workspace_sets |
matriz | Os conjuntos de workspaces gerenciados pelo grupo de failover. Cada entrada contém name (cadeia de caracteres) e workspace_ids (matriz). |
catalogs |
matriz | Os catálogos gerenciados pelo grupo de failover. Cada entrada contém name (cadeia de caracteres). |
Considerações ao ler a tabela
Anote o seguinte ao analisar a states tabela:
- Os dados podem levar até 3 horas para serem preenchidos após a ocorrência de um evento.
- A tabela contém eventos para todos os grupos de failover na conta Azure Databricks.
Consultas de exemplo
A consulta a seguir retorna o status de replicação mais recente para um determinado grupo de failover, incluindo seu atual replication_state, retardo de replicação e quaisquer erros de bloqueio:
SELECT
event_time,
replication_state,
replication_lag_ms,
errors
FROM system.replication.states
WHERE failover_group_name = :failover_group_name
ORDER BY event_time DESC
LIMIT 1
A consulta a seguir retorna a distribuição do atraso de replicação para um determinado grupo de failover:
SELECT histogram_numeric(replication_lag_ms, 20) AS replication_lag_distribution
FROM system.replication.states
WHERE failover_group_name = :failover_group_name