Referencia de tabla del sistema de replicación

Importante

La recuperación ante desastres administrada es de acceso restringido. Solicita acceso a través del equipo de cuenta de Azure Databricks. Azure Databricks habilita la recuperación ante desastres administrada en su cuenta una vez que se haya aprobado su solicitud.

En esta página se proporciona una referencia para la states tabla del esquema del replication sistema, que realiza un seguimiento del estado de replicación de Azure Databricks recuperación ante desastres administrada (DR). Cada fila es un evento de estado para un grupo de conmutación por error, emitido periódicamente y cada vez que cambia el grupo de conmutación por error. Use esta tabla para supervisar el estado de replicación actual e histórico de los grupos de conmutación por error, incluido el retraso de replicación y los errores que bloquean la replicación de al menos un recurso.

Ruta de acceso de tabla: system.replication.states

Cómo leer el estado de replicación

Los eventos de estado se emiten a intervalos regulares. Cada evento informa del estado agregado del grupo de conmutación por fallo, el retardo actual y cualquier error que bloquee la replicación de al menos un activo. No indica qué objetos individuales se replicaron con éxito.

Cuando replication_lag_ms no nulles , todo lo que no está cubierto por un error en ese evento se ha replicado hasta ese retardo. Otros activos dentro del alcance continúan replicándose y permaneciendo actualizados al lag, incluso cuando el errors array no está vacío. Durante INITIAL_REPLICATION, antes de que todos los activos dentro del alcance hayan sido replicados una vez, replication_lag_ms puede ser null: el evento aún puede listar errores de bloqueo, pero aún no mide la completitud.

Los tipos de activos que DR gestionado no soporta en absoluto no aparecen en la tabla, ni como éxito ni como error. Su ausencia no significa que se hayan replicado. Consulte Limitaciones. Los activos dentro del alcance que utilizan una característica no soportada, como filtros de fila, máscaras de columna o control de acceso basado en atributos (ABAC), aparecen en la tabla como fallos.

Para confirmar que existe un activo específico en el secundario, inspecciona el objeto allí. Como los catálogos secundarios dentro del alcance son de solo lectura, Azure Databricks recomienda un espacio de trabajo separado para monitores de solo lectura en la región secundaria. Consulta Configurar replicación.

Referencia de esquema de tabla de estados

La states tabla usa el esquema siguiente:

Nombre de la columna Tipo de dato Description Example
event_id string Identificador único del evento de estado. ca886134-876c-4671-a38b-332edf48c602
event_time timestamp Marca de tiempo de cuándo se emitió el evento. 2024-01-05T00:00:00.000+00:00
account_id string Identificador de la cuenta a la que pertenece el grupo de conmutación por error. ca886134-876c-4671-a38b-332edf48c602
failover_group_name string Nombre completo del grupo de conmutación por error. accounts/account1/failover-group/group1
replication_state string Estado de la replicación cuando se emitió el evento. Los valores posibles son INITIAL_REPLICATION, ACTIVE, CREATED, UPDATEDDELETED, , FAILOVER_STARTED, FAILOVER_FINISHEDy FAILOVER_ABORTED. ACTIVE
errors array Cuando replication_state es INITIAL_REPLICATION o ACTIVE, una lista agregada de los errores que bloquean la replicación de al menos un activo, incluyendo cuántos activos afecta cada error. Consulte Referencia de errores. Consulte Referencia de errores.
replication_lag_ms long Milisegundos desde la última replicación correcta de todos los recursos dentro del ámbito cuando se emitió el evento. Un null valor indica que al menos un recurso nunca se ha replicado desde el origen a la réplica. Un valor creciente significa que la recuperación ante desastres no puede replicar al menos un recurso dentro del ámbito, pero los cambios en otros recursos dentro del ámbito se siguen replicando. 2323
effective_primary_region string Región primaria del grupo de conmutación por error en el momento en que se emitió el evento. us-west-2
managed_assets estructura Los recursos administrados por el grupo de conmutación por error cuando se emitió el evento. Consulte Referencia de recursos administrados. Consulte Referencia de recursos administrados.

Referencia de errores

La errors columna contiene una matriz de los errores que bloquean la replicación. Cada elemento de la matriz es una estructura con los siguientes campos:

Nombre del campo Tipo de dato Description
error estructura Detalles sobre el error. Contiene error_class (cadena), un nombre de clase para el error; parameters (asignación), parámetros clave-valor con detalles sobre el error y message (cadena), un mensaje de error legible.
affected_assets_counts array Una entrada por tipo de recurso afectado. Cada entrada contiene asset_type (cadena), el tipo del recurso afectado y failing_count (long), el número de recursos de ese tipo que afecta el error.

Referencia de recursos administrados

La managed_assets columna es una estructura que describe los recursos administrados por el grupo de conmutación por error cuando se emitió el evento. Contiene los siguientes campos:

Nombre del campo Tipo de dato Description
metastore_ids array Los IDs de los metaalmacenes gestionados por el grupo de conmutación por error.
workspace_sets array El área de trabajo establece los conjuntos administrados por el grupo de conmutación por error. Cada entrada contiene name (cadena) y workspace_ids (matriz).
catalogs array Catálogos administrados por el grupo de conmutación por error. Cada entrada contiene name (cadena).

Consideraciones al leer la tabla

Tome nota de lo siguiente al analizar la states tabla:

  • Los datos pueden tardar hasta 3 horas en rellenarse después de que se produzca un evento.
  • La tabla contiene eventos para todos los grupos de conmutación por error de la cuenta de Azure Databricks.

Consultas de ejemplo

La consulta siguiente devuelve el estado de replicación más reciente de un grupo de conmutación por error determinado, incluido su retraso de replicación actual replication_statey los errores de bloqueo:

SELECT
  event_time,
  replication_state,
  replication_lag_ms,
  errors
FROM system.replication.states
WHERE failover_group_name = :failover_group_name
ORDER BY event_time DESC
LIMIT 1

La consulta siguiente devuelve la distribución del retraso de replicación para un grupo de conmutación por error determinado:

SELECT histogram_numeric(replication_lag_ms, 20) AS replication_lag_distribution
FROM system.replication.states
WHERE failover_group_name = :failover_group_name