Dokumentacja tabeli systemu replikacji

Ważna

Zarządzane odzyskiwanie po awarii jest objęte ograniczeniem dostępu. Złóż wniosek o dostęp za pośrednictwem zespołu obsługującego Twoje konto Azure Databricks. Azure Databricks umożliwia zarządzane odzyskiwanie po awarii dla Twojego konta po zaakceptowaniu Twojego zgłoszenia.

Ta strona zawiera odwołanie do tabeli w states schemacie systemowym, która śledzi stan replikacji Azure Databricks replication. Każdy wiersz jest zdarzeniem stanu dla grupy trybu failover, emitowane okresowo i za każdym razem, gdy grupa trybu failover ulegnie zmianie. Ta tabela służy do monitorowania bieżącego i historycznego stanu replikacji grup trybu failover, w tym opóźnienia replikacji i błędów blokujących replikację co najmniej jednego zasobu.

Ścieżka tabeli: system.replication.states

Jak odczytywać status replikacji

Zdarzenia statusowe są emitowane w regularnych odstępach czasu. Każde zdarzenie raportuje stan agregatu grupy failover, aktualne opóźnienie oraz wszelkie błędy blokujące replikację co najmniej jednego zasobu. Nie podaje się, które poszczególne obiekty zostały pomyślnie zreplikowane.

Gdy replication_lag_ms nie nulljest , wszystko, co nie jest objęte błędem w tym zdarzeniu, zostało powtórzone do tego opóźnienia. Inne zasoby w zakresie nadal replikują się i pozostają aktualne z opóźnieniem, nawet gdy tablica errors nie jest pusta. Podczas INITIAL_REPLICATION, zanim wszystkie zasoby w zakresie zostaną raz zreplikowane, replication_lag_ms może być : nullzdarzenie nadal może wykazywać błędy blokujące, ale nie mierzy jeszcze zupełności.

Typy aktywów, które zarządzane DR w ogóle nie obsługują, nie pojawiają się w tabeli ani jako sukces, ani jako błąd. Ich brak nie oznacza, że się replikowali. Zobacz Ograniczenia. Zasoby w zakresie, które wykorzystują nieobsługiwaną funkcję, takie jak filtry wierszowe, maski kolumnowe czy kontrola dostępu oparta na atrybutach (ABAC), pojawiają się w tabeli jako niepowodzenia.

Aby potwierdzić, że w drugorzędnym znajduje się konkretny obiekt, sprawdź go tam. Ponieważ wtórne katalogi w zakresie są tylko do odczytu, Azure Databricks zaleca osobny monitor workspace tylko do odczytu w regionie drugorzędnym. Zobacz Ustaw replikację.

Dokumentacja schematu tabeli Stanów

Tabela states używa następującego schematu:

Nazwa kolumny Typ danych Description Example
event_id ciąg Unikatowy identyfikator zdarzenia stanu. ca886134-876c-4671-a38b-332edf48c602
event_time sygnatura czasowa Sygnatura czasowa emisji zdarzenia. 2024-01-05T00:00:00.000+00:00
account_id ciąg Identyfikator konta, do którego należy grupa trybu failover. ca886134-876c-4671-a38b-332edf48c602
failover_group_name ciąg W pełni kwalifikowana nazwa grupy trybu failover. accounts/account1/failover-group/group1
replication_state ciąg Stan replikacji, gdy zdarzenie zostało wyemitowane. Możliwe wartości to INITIAL_REPLICATION, , ACTIVE, CREATEDUPDATEDDELETEDFAILOVER_STARTED, FAILOVER_FINISHEDi .FAILOVER_ABORTED ACTIVE
errors macierz Gdy replication_state jest lub INITIAL_REPLICATIONACTIVE, to zagregowana lista błędów blokujących replikację co najmniej jednego zasobu, w tym ile aktywów dotyczy każdy błąd. Zobacz Informacje o błędach. Zobacz informacje o błędach
replication_lag_ms long Milisekundy od ostatniej pomyślnej replikacji wszystkich zasobów w zakresie, gdy zdarzenie zostało wyemitowane. Wartość null wskazuje, że co najmniej jeden zasób nigdy nie został zreplikowany ze źródła do repliki. Rosnąca wartość oznacza, że odzyskiwanie po awarii nie może replikować co najmniej jednego zasobu w zakresie, ale zmiany w innych zasobach w zakresie są nadal replikowane. 2323
effective_primary_region ciąg Region podstawowy grupy trybu failover w momencie emisji zdarzenia. us-west-2
managed_assets struktura Zasoby zarządzane przez grupę trybu failover, gdy zdarzenie zostało wyemitowane. Zobacz Dokumentacja zasobów zarządzanych. Zobacz Dokumentacja zarządzanych zasobów

Odwołanie do błędów

Kolumna errors zawiera tablicę błędów blokujących replikację. Każdy element tablicy jest strukturą z następującymi polami:

Nazwa pola Typ danych Description
error struktura Szczegółowe informacje o błędzie. Zawiera error_class (ciąg), nazwę klasy dla błędu; parameters (mapa), parametry klucz-wartość ze szczegółami dotyczącymi błędu i message (ciąg), czytelny dla człowieka komunikat o błędzie.
affected_assets_counts macierz Jeden wpis na typ zasobu, którego dotyczy problem. Każdy wpis zawiera asset_type (ciąg), typ objętego zasobu i failing_count (długi) liczbę zasobów tego typu, na które ma wpływ błąd.

Dokumentacja zasobów zarządzanych

Kolumna managed_assets to struktura opisując zasoby zarządzane przez grupę trybu failover, gdy zdarzenie zostało wyemitowane. Zawiera następujące pola:

Nazwa pola Typ danych Description
metastore_ids macierz ID metastore'ów zarządzanych przez grupę failover.
workspace_sets macierz Zestawy obszarów roboczych zarządzane przez grupę trybu failover. Każdy wpis zawiera name (ciąg) i workspace_ids (tablicę).
catalogs macierz Wykazy zarządzane przez grupę trybu failover. Każdy wpis zawiera name (ciąg).

Zagadnienia dotyczące odczytywania tabeli

Podczas analizowania states tabeli zanotuj następujące kwestie:

  • Po wystąpieniu zdarzenia dane mogą potrwać do 3 godzin.
  • Tabela zawiera zdarzenia dla wszystkich grup trybu failover na koncie Azure Databricks.

Przykłady zapytań

Następujące zapytanie zwraca najnowszy stan replikacji dla danej grupy trybu failover, w tym bieżące replication_state, opóźnienie replikacji i wszelkie błędy blokujące:

SELECT
  event_time,
  replication_state,
  replication_lag_ms,
  errors
FROM system.replication.states
WHERE failover_group_name = :failover_group_name
ORDER BY event_time DESC
LIMIT 1

Następujące zapytanie zwraca rozkład opóźnienia replikacji dla danej grupy trybu failover:

SELECT histogram_numeric(replication_lag_ms, 20) AS replication_lag_distribution
FROM system.replication.states
WHERE failover_group_name = :failover_group_name