Справочник по системной таблице репликации

Внимание

Управляемое аварийное восстановление имеет ограниченный доступ. Запросите доступ через вашу команду по работе с учетной записью Azure Databricks. Azure Databricks активирует управляемое аварийное восстановление для вашей учетной записи после одобрения.

Эта страница содержит ссылку на states таблицу в replication системной схеме, которая отслеживает состояние репликации Azure Databricks управляемого аварийного восстановления (DR). Каждая строка — это событие состояния для группы отработки отказа, которое периодически создается и всякий раз при изменении группы отработки отказа. Эта таблица используется для отслеживания текущего и исторического состояния репликации групп отработки отказа, включая задержку репликации и любые ошибки, которые блокируют репликацию по крайней мере одного ресурса.

Путь к таблице: system.replication.states

Как прочитать статус репликации

События статуса излучаются с регулярным интервалом. Каждое событие сообщает о совокупном состоянии группы отказа, текущей задержке и ошибках, блокирующих репликацию хотя бы одного актива. В ней не указано, какие отдельные объекты были успешно воспроизведены.

Когда replication_lag_ms нет null, всё, что не покрывается ошибкой в этом событии, было воспроизведено до этой задержки. Другие ассеты в области продолжают реплицироваться и остаются актуальными для задержки, даже когда errors массив не пуст. Во INITIAL_REPLICATIONвремя , до того как все элементы в области не будут воспроизведены один раз, replication_lag_ms может быть null: событие всё ещё может указывать ошибки блокировки, но пока не измеряет полноту.

Типы активов, которые управляемый DR вообще не поддерживает, не отображаются в таблице ни как успешные, ни как ошибки. Их отсутствие не означает, что они размножались. См. Ограничения. Внутри объёма, использующие неподдерживаемые функции, такие как фильтры строк, маски столбцов или контроль доступа на основе атрибутов (ABAC), отображаются в таблице как неудачи.

Чтобы убедиться, что определённый актив существует во вторичной части, осмотрите объект там. Поскольку вторичные каталоги внутри области являются только для чтения, Azure Databricks рекомендует создать отдельное рабочее пространство монитора только для чтения во вторичном регионе. См. Настройка репликации.

Справочник по схеме таблицы состояний

В таблице используется следующая states схема:

Название столбца Тип данных Description Example
event_id string Уникальный идентификатор события состояния. ca886134-876c-4671-a38b-332edf48c602
event_time timestamp Метка времени создания события. 2024-01-05T00:00:00.000+00:00
account_id string Идентификатор учетной записи, к которой принадлежит группа отработки отказа. ca886134-876c-4671-a38b-332edf48c602
failover_group_name string Полное имя группы отработки отказа. accounts/account1/failover-group/group1
replication_state string Состояние репликации при создании события. Возможные значения: INITIAL_REPLICATION, ACTIVE, CREATEDUPDATEDDELETEDFAILOVER_STARTED, FAILOVER_FINISHEDи .FAILOVER_ABORTED ACTIVE
errors массив Когда replication_stateINITIAL_REPLICATION это или ACTIVE, агрегированный список ошибок, блокирующих репликацию хотя бы одного актива, включая количество активов, затронутых каждой ошибкой. См . справочник по ошибкам. См . справочник по ошибкам
replication_lag_ms long Миллисекунда с момента последней успешной репликации всех активов в области, когда событие было создано. Значение null указывает, что хотя бы один ресурс никогда не реплицировался из источника в реплику. Растущее значение означает, что аварийное восстановление не может реплицировать по крайней мере один ресурс в области, но изменения других ресурсов в области продолжают реплицироваться. 2323
effective_primary_region string Основной регион группы отработки отказа во время отправки события. us-west-2
managed_assets struct Ресурсы, управляемые группой отработки отказа при создании события. См. справочник по управляемым ресурсам. См . справочник по управляемым ресурсам

Справочник по ошибкам

Столбец errors содержит массив ошибок, блокирующих репликацию. Каждый элемент массива представляет собой структуру со следующими полями:

Имя поля Тип данных Description
error struct Сведения об ошибке. error_class Содержит (string), имя класса для ошибки; parameters (карта), параметры ключа-значение с подробными сведениями об ошибке и message (строка) сообщение об ошибке, доступное для чтения человеком.
affected_assets_counts массив Одна запись для каждого затронутого типа ресурса. Каждая запись содержит asset_type (строку), тип затронутого ресурса и failing_count (long), количество активов этого типа, влияющих на ошибку.

Справочник по управляемым ресурсам

Столбец managed_assets представляет собой структуру, описывающую ресурсы, управляемые группой отработки отказа при создании события. Он содержит следующие поля:

Имя поля Тип данных Description
metastore_ids массив ID метахранилищ, управляемых группой резервирования.
workspace_sets массив Рабочая область задает управление группой отработки отказа. Каждая запись содержит name (string) и workspace_ids (массив).
catalogs массив Каталоги, управляемые группой отработки отказа. Каждая запись содержит name (строку).

Рекомендации при чтении таблицы

Обратите внимание на следующее при анализе states таблицы:

  • Данные могут занять до 3 часов после возникновения события.
  • Таблица содержит события для всех групп отработки отказа в учетной записи Azure Databricks.

Примеры запросов

Следующий запрос возвращает последнее состояние репликации для данной группы отработки отказа, включая текущую replication_state, задержку репликации и любые ошибки блокировки:

SELECT
  event_time,
  replication_state,
  replication_lag_ms,
  errors
FROM system.replication.states
WHERE failover_group_name = :failover_group_name
ORDER BY event_time DESC
LIMIT 1

Следующий запрос возвращает распределение задержки репликации для определенной группы отработки отказа:

SELECT histogram_numeric(replication_lag_ms, 20) AS replication_lag_distribution
FROM system.replication.states
WHERE failover_group_name = :failover_group_name