Примечание.
Для доступа к этой странице требуется авторизация. Вы можете попробовать войти или изменить каталоги.
Для доступа к этой странице требуется авторизация. Вы можете попробовать изменить каталоги.
Внимание
Управляемое аварийное восстановление имеет ограниченный доступ. Запросите доступ через вашу команду по работе с учетной записью Azure Databricks. Azure Databricks активирует управляемое аварийное восстановление для вашей учетной записи после одобрения.
Эта страница содержит ссылку на states таблицу в replication системной схеме, которая отслеживает состояние репликации Azure Databricks управляемого аварийного восстановления (DR). Каждая строка — это событие состояния для группы отработки отказа, которое периодически создается и всякий раз при изменении группы отработки отказа. Эта таблица используется для отслеживания текущего и исторического состояния репликации групп отработки отказа, включая задержку репликации и любые ошибки, которые блокируют репликацию по крайней мере одного ресурса.
Путь к таблице: system.replication.states
Как прочитать статус репликации
События статуса излучаются с регулярным интервалом. Каждое событие сообщает о совокупном состоянии группы отказа, текущей задержке и ошибках, блокирующих репликацию хотя бы одного актива. В ней не указано, какие отдельные объекты были успешно воспроизведены.
Когда replication_lag_ms нет null, всё, что не покрывается ошибкой в этом событии, было воспроизведено до этой задержки. Другие ассеты в области продолжают реплицироваться и остаются актуальными для задержки, даже когда errors массив не пуст. Во INITIAL_REPLICATIONвремя , до того как все элементы в области не будут воспроизведены один раз, replication_lag_ms может быть null: событие всё ещё может указывать ошибки блокировки, но пока не измеряет полноту.
Типы активов, которые управляемый DR вообще не поддерживает, не отображаются в таблице ни как успешные, ни как ошибки. Их отсутствие не означает, что они размножались. См. Ограничения. Внутри объёма, использующие неподдерживаемые функции, такие как фильтры строк, маски столбцов или контроль доступа на основе атрибутов (ABAC), отображаются в таблице как неудачи.
Чтобы убедиться, что определённый актив существует во вторичной части, осмотрите объект там. Поскольку вторичные каталоги внутри области являются только для чтения, Azure Databricks рекомендует создать отдельное рабочее пространство монитора только для чтения во вторичном регионе. См. Настройка репликации.
Справочник по схеме таблицы состояний
В таблице используется следующая states схема:
| Название столбца | Тип данных | Description | Example |
|---|---|---|---|
event_id |
string | Уникальный идентификатор события состояния. | ca886134-876c-4671-a38b-332edf48c602 |
event_time |
timestamp | Метка времени создания события. | 2024-01-05T00:00:00.000+00:00 |
account_id |
string | Идентификатор учетной записи, к которой принадлежит группа отработки отказа. | ca886134-876c-4671-a38b-332edf48c602 |
failover_group_name |
string | Полное имя группы отработки отказа. | accounts/account1/failover-group/group1 |
replication_state |
string | Состояние репликации при создании события. Возможные значения: INITIAL_REPLICATION, ACTIVE, CREATEDUPDATEDDELETEDFAILOVER_STARTED, FAILOVER_FINISHEDи .FAILOVER_ABORTED |
ACTIVE |
errors |
массив | Когда replication_state — INITIAL_REPLICATION это или ACTIVE, агрегированный список ошибок, блокирующих репликацию хотя бы одного актива, включая количество активов, затронутых каждой ошибкой. См . справочник по ошибкам. |
См . справочник по ошибкам |
replication_lag_ms |
long | Миллисекунда с момента последней успешной репликации всех активов в области, когда событие было создано. Значение null указывает, что хотя бы один ресурс никогда не реплицировался из источника в реплику. Растущее значение означает, что аварийное восстановление не может реплицировать по крайней мере один ресурс в области, но изменения других ресурсов в области продолжают реплицироваться. |
2323 |
effective_primary_region |
string | Основной регион группы отработки отказа во время отправки события. | us-west-2 |
managed_assets |
struct | Ресурсы, управляемые группой отработки отказа при создании события. См. справочник по управляемым ресурсам. | См . справочник по управляемым ресурсам |
Справочник по ошибкам
Столбец errors содержит массив ошибок, блокирующих репликацию. Каждый элемент массива представляет собой структуру со следующими полями:
| Имя поля | Тип данных | Description |
|---|---|---|
error |
struct | Сведения об ошибке.
error_class Содержит (string), имя класса для ошибки; parameters (карта), параметры ключа-значение с подробными сведениями об ошибке и message (строка) сообщение об ошибке, доступное для чтения человеком. |
affected_assets_counts |
массив | Одна запись для каждого затронутого типа ресурса. Каждая запись содержит asset_type (строку), тип затронутого ресурса и failing_count (long), количество активов этого типа, влияющих на ошибку. |
Справочник по управляемым ресурсам
Столбец managed_assets представляет собой структуру, описывающую ресурсы, управляемые группой отработки отказа при создании события. Он содержит следующие поля:
| Имя поля | Тип данных | Description |
|---|---|---|
metastore_ids |
массив | ID метахранилищ, управляемых группой резервирования. |
workspace_sets |
массив | Рабочая область задает управление группой отработки отказа. Каждая запись содержит name (string) и workspace_ids (массив). |
catalogs |
массив | Каталоги, управляемые группой отработки отказа. Каждая запись содержит name (строку). |
Рекомендации при чтении таблицы
Обратите внимание на следующее при анализе states таблицы:
- Данные могут занять до 3 часов после возникновения события.
- Таблица содержит события для всех групп отработки отказа в учетной записи Azure Databricks.
Примеры запросов
Следующий запрос возвращает последнее состояние репликации для данной группы отработки отказа, включая текущую replication_state, задержку репликации и любые ошибки блокировки:
SELECT
event_time,
replication_state,
replication_lag_ms,
errors
FROM system.replication.states
WHERE failover_group_name = :failover_group_name
ORDER BY event_time DESC
LIMIT 1
Следующий запрос возвращает распределение задержки репликации для определенной группы отработки отказа:
SELECT histogram_numeric(replication_lag_ms, 20) AS replication_lag_distribution
FROM system.replication.states
WHERE failover_group_name = :failover_group_name