Notatka
Dostęp do tej strony wymaga autoryzacji. Może spróbować zalogować się lub zmienić katalogi.
Dostęp do tej strony wymaga autoryzacji. Możesz spróbować zmienić katalogi.
Ważna
Zarządzane odzyskiwanie po awarii jest objęte ograniczeniem dostępu. Złóż wniosek o dostęp za pośrednictwem zespołu obsługującego Twoje konto Azure Databricks. Azure Databricks umożliwia zarządzane odzyskiwanie po awarii dla Twojego konta po zaakceptowaniu Twojego zgłoszenia.
Ta strona zawiera odwołanie do tabeli w states schemacie systemowym, która śledzi stan replikacji Azure Databricks replication. Każdy wiersz jest zdarzeniem stanu dla grupy trybu failover, emitowane okresowo i za każdym razem, gdy grupa trybu failover ulegnie zmianie. Ta tabela służy do monitorowania bieżącego i historycznego stanu replikacji grup trybu failover, w tym opóźnienia replikacji i błędów blokujących replikację co najmniej jednego zasobu.
Ścieżka tabeli: system.replication.states
Jak odczytywać status replikacji
Zdarzenia statusowe są emitowane w regularnych odstępach czasu. Każde zdarzenie raportuje stan agregatu grupy failover, aktualne opóźnienie oraz wszelkie błędy blokujące replikację co najmniej jednego zasobu. Nie podaje się, które poszczególne obiekty zostały pomyślnie zreplikowane.
Gdy replication_lag_ms nie nulljest , wszystko, co nie jest objęte błędem w tym zdarzeniu, zostało powtórzone do tego opóźnienia. Inne zasoby w zakresie nadal replikują się i pozostają aktualne z opóźnieniem, nawet gdy tablica errors nie jest pusta. Podczas INITIAL_REPLICATION, zanim wszystkie zasoby w zakresie zostaną raz zreplikowane, replication_lag_ms może być : nullzdarzenie nadal może wykazywać błędy blokujące, ale nie mierzy jeszcze zupełności.
Typy aktywów, które zarządzane DR w ogóle nie obsługują, nie pojawiają się w tabeli ani jako sukces, ani jako błąd. Ich brak nie oznacza, że się replikowali. Zobacz Ograniczenia. Zasoby w zakresie, które wykorzystują nieobsługiwaną funkcję, takie jak filtry wierszowe, maski kolumnowe czy kontrola dostępu oparta na atrybutach (ABAC), pojawiają się w tabeli jako niepowodzenia.
Aby potwierdzić, że w drugorzędnym znajduje się konkretny obiekt, sprawdź go tam. Ponieważ wtórne katalogi w zakresie są tylko do odczytu, Azure Databricks zaleca osobny monitor workspace tylko do odczytu w regionie drugorzędnym. Zobacz Ustaw replikację.
Dokumentacja schematu tabeli Stanów
Tabela states używa następującego schematu:
| Nazwa kolumny | Typ danych | Description | Example |
|---|---|---|---|
event_id |
ciąg | Unikatowy identyfikator zdarzenia stanu. | ca886134-876c-4671-a38b-332edf48c602 |
event_time |
sygnatura czasowa | Sygnatura czasowa emisji zdarzenia. | 2024-01-05T00:00:00.000+00:00 |
account_id |
ciąg | Identyfikator konta, do którego należy grupa trybu failover. | ca886134-876c-4671-a38b-332edf48c602 |
failover_group_name |
ciąg | W pełni kwalifikowana nazwa grupy trybu failover. | accounts/account1/failover-group/group1 |
replication_state |
ciąg | Stan replikacji, gdy zdarzenie zostało wyemitowane. Możliwe wartości to INITIAL_REPLICATION, , ACTIVE, CREATEDUPDATEDDELETEDFAILOVER_STARTED, FAILOVER_FINISHEDi .FAILOVER_ABORTED |
ACTIVE |
errors |
macierz | Gdy replication_state jest lub INITIAL_REPLICATIONACTIVE, to zagregowana lista błędów blokujących replikację co najmniej jednego zasobu, w tym ile aktywów dotyczy każdy błąd. Zobacz Informacje o błędach. |
Zobacz informacje o błędach |
replication_lag_ms |
long | Milisekundy od ostatniej pomyślnej replikacji wszystkich zasobów w zakresie, gdy zdarzenie zostało wyemitowane. Wartość null wskazuje, że co najmniej jeden zasób nigdy nie został zreplikowany ze źródła do repliki. Rosnąca wartość oznacza, że odzyskiwanie po awarii nie może replikować co najmniej jednego zasobu w zakresie, ale zmiany w innych zasobach w zakresie są nadal replikowane. |
2323 |
effective_primary_region |
ciąg | Region podstawowy grupy trybu failover w momencie emisji zdarzenia. | us-west-2 |
managed_assets |
struktura | Zasoby zarządzane przez grupę trybu failover, gdy zdarzenie zostało wyemitowane. Zobacz Dokumentacja zasobów zarządzanych. | Zobacz Dokumentacja zarządzanych zasobów |
Odwołanie do błędów
Kolumna errors zawiera tablicę błędów blokujących replikację. Każdy element tablicy jest strukturą z następującymi polami:
| Nazwa pola | Typ danych | Description |
|---|---|---|
error |
struktura | Szczegółowe informacje o błędzie. Zawiera error_class (ciąg), nazwę klasy dla błędu; parameters (mapa), parametry klucz-wartość ze szczegółami dotyczącymi błędu i message (ciąg), czytelny dla człowieka komunikat o błędzie. |
affected_assets_counts |
macierz | Jeden wpis na typ zasobu, którego dotyczy problem. Każdy wpis zawiera asset_type (ciąg), typ objętego zasobu i failing_count (długi) liczbę zasobów tego typu, na które ma wpływ błąd. |
Dokumentacja zasobów zarządzanych
Kolumna managed_assets to struktura opisując zasoby zarządzane przez grupę trybu failover, gdy zdarzenie zostało wyemitowane. Zawiera następujące pola:
| Nazwa pola | Typ danych | Description |
|---|---|---|
metastore_ids |
macierz | ID metastore'ów zarządzanych przez grupę failover. |
workspace_sets |
macierz | Zestawy obszarów roboczych zarządzane przez grupę trybu failover. Każdy wpis zawiera name (ciąg) i workspace_ids (tablicę). |
catalogs |
macierz | Wykazy zarządzane przez grupę trybu failover. Każdy wpis zawiera name (ciąg). |
Zagadnienia dotyczące odczytywania tabeli
Podczas analizowania states tabeli zanotuj następujące kwestie:
- Po wystąpieniu zdarzenia dane mogą potrwać do 3 godzin.
- Tabela zawiera zdarzenia dla wszystkich grup trybu failover na koncie Azure Databricks.
Przykłady zapytań
Następujące zapytanie zwraca najnowszy stan replikacji dla danej grupy trybu failover, w tym bieżące replication_state, opóźnienie replikacji i wszelkie błędy blokujące:
SELECT
event_time,
replication_state,
replication_lag_ms,
errors
FROM system.replication.states
WHERE failover_group_name = :failover_group_name
ORDER BY event_time DESC
LIMIT 1
Następujące zapytanie zwraca rozkład opóźnienia replikacji dla danej grupy trybu failover:
SELECT histogram_numeric(replication_lag_ms, 20) AS replication_lag_distribution
FROM system.replication.states
WHERE failover_group_name = :failover_group_name