Справочник по системной таблице репликации

Внимание

Эта функция доступна в закрытой предварительной версии. Чтобы попробовать, свяжитесь с вашим контактом в Azure Databricks.

Эта страница содержит ссылку на states таблицу в replication системной схеме, которая отслеживает состояние репликации Azure Databricks управляемого аварийного восстановления (DR). Каждая строка — это событие состояния для группы отработки отказа, которое периодически создается и всякий раз при изменении группы отработки отказа. Эта таблица используется для отслеживания текущего и исторического состояния репликации групп отработки отказа, включая задержку репликации и любые ошибки, которые блокируют репликацию по крайней мере одного ресурса.

Путь к таблице: system.replication.states

Справочник по схеме таблицы состояний

В таблице используется следующая states схема:

Название столбца Тип данных Description Example
event_id string Уникальный идентификатор события состояния. ca886134-876c-4671-a38b-332edf48c602
event_time timestamp Метка времени создания события. 2024-01-05T00:00:00.000+00:00
account_id string Идентификатор учетной записи, к которой принадлежит группа отработки отказа. ca886134-876c-4671-a38b-332edf48c602
failover_group_name string Полное имя группы отработки отказа. accounts/account1/failover-group/group1
replication_state string Состояние репликации при создании события. Возможные значения: INITIALIZING, REPLICATING, CREATEDUPDATEDDELETEDFAILOVER_STARTED, FAILOVER_FINISHEDи .FAILOVER_ABORTED REPLICATING
errors массив Если replication_state это REPLICATINGтак, агрегированный список ошибок, блокирующих репликацию по крайней мере одного ресурса, включая количество активов, влияющих на каждую ошибку. В противном случае ошибки, которые привели к сбою операции. См . справочник по ошибкам. См . справочник по ошибкам
replication_lag_ms long Миллисекунда с момента последней успешной репликации всех активов в области, когда событие было создано. Значение null указывает, что хотя бы один ресурс никогда не реплицировался из источника в реплику. Растущее значение означает, что аварийное восстановление не может реплицировать по крайней мере один ресурс в области, но изменения других ресурсов в области продолжают реплицироваться. 2323
effective_primary_region string Основной регион группы отработки отказа во время отправки события. us-west-2
managed_assets struct Ресурсы, управляемые группой отработки отказа при создании события. См. справочник по управляемым ресурсам. См . справочник по управляемым ресурсам

Справочник по ошибкам

Столбец errors содержит массив ошибок, блокирующих репликацию. Каждый элемент массива представляет собой структуру со следующими полями:

Имя поля Тип данных Description
error struct Сведения об ошибке. error_class Содержит (string), имя класса для ошибки; parameters (карта), параметры ключа-значение с подробными сведениями об ошибке и message (строка) сообщение об ошибке, доступное для чтения человеком.
affected_assets_counts массив Одна запись для каждого затронутого типа ресурса. Каждая запись содержит asset_type (строку), тип затронутого ресурса и failing_count (long), количество активов этого типа, влияющих на ошибку.

Справочник по управляемым ресурсам

Столбец managed_assets представляет собой структуру, описывающую ресурсы, управляемые группой отработки отказа при создании события. Он содержит следующие поля:

Имя поля Тип данных Description
metastores массив Хранилища метаданных, управляемые группой отработки отказа.
workspace_sets массив Рабочая область задает управление группой отработки отказа. Каждая запись содержит name (string) и workspace_ids (массив).
catalogs массив Каталоги, управляемые группой отработки отказа. Каждая запись содержит name (строку).

Рекомендации при чтении таблицы

Обратите внимание на следующее при анализе states таблицы:

  • Данные могут занять до 3 часов после возникновения события.
  • Таблица содержит события для всех групп отработки отказа в учетной записи Azure Databricks.

Примеры запросов

Следующий запрос возвращает последнее состояние репликации для данной группы отработки отказа, включая текущую replication_state, задержку репликации и любые ошибки блокировки:

SELECT
  event_time,
  replication_state,
  replication_lag_ms,
  errors
FROM system.replication.states
WHERE failover_group_name = :failover_group_name
ORDER BY event_time DESC
LIMIT 1

Следующий запрос возвращает распределение задержки репликации для определенной группы отработки отказа:

SELECT histogram_numeric(replication_lag_ms, 20) AS replication_lag_distribution
FROM system.replication.states
WHERE failover_group_name = :failover_group_name