Referensi tabel sistem replikasi

Important

DR yang dikelola dibatasi aksesnya. Ajukan permohonan akses melalui tim akun Azure Databricks Anda. Azure Databricks mengaktifkan DR terkelola di akun Anda setelah Anda diterima.

Halaman ini menyediakan referensi untuk states tabel dalam replication skema sistem, yang melacak status replikasi Azure Databricks pemulihan bencana terkelola (DR). Setiap baris adalah peristiwa status untuk grup failover, dipancarkan secara berkala dan setiap kali grup failover berubah. Gunakan tabel ini untuk memantau status replikasi saat ini dan historis grup failover Anda, termasuk lag replikasi dan kesalahan apa pun yang memblokir replikasi setidaknya satu aset.

Jalur tabel: system.replication.states

Cara membaca status replikasi

Peristiwa status dipancarkan secara berkala. Setiap event melaporkan status agregat grup failover, lag saat ini, dan kesalahan yang menghambat replikasi setidaknya satu aset. Aplikasi ini tidak mencantumkan objek individu mana yang berhasil direplikasi.

Ketika replication_lag_ms tidak , nullsemua yang tidak tercakup oleh kesalahan dalam peristiwa tersebut telah direplikasi hingga lag tersebut. Aset lain yang berada dalam lingkup terus mereplikasi dan tetap terkini terhadap lag, bahkan ketika errors array tidak kosong. Selama INITIAL_REPLICATION, sebelum semua aset dalam cakupan direplikasi sekali, replication_lag_ms dapat berupa null: peristiwa masih dapat menampilkan kesalahan pemblokiran, tetapi belum mengukur kelengkapan.

Tipe aset yang sama sekali tidak didukung oleh managed DR tidak muncul di tabel, baik sebagai keberhasilan maupun sebagai kesalahan. Ketiadaan mereka tidak berarti mereka berulang. Lihat Batasan. Aset dalam cakupan yang menggunakan fitur yang tidak didukung, seperti filter baris, masker kolom, atau kontrol akses berbasis atribut (ABAC), muncul dalam tabel sebagai kegagalan.

Untuk memastikan bahwa aset tertentu ada di sekunder, periksa objek di sana. Karena katalog sekunder dalam cakupan bersifat hanya-baca, Azure Databricks merekomendasikan workspace monitor hanya-baca terpisah di wilayah sekunder. Lihat Atur replikasi.

Referensi skema tabel status

Tabel states menggunakan skema berikut:

Nama kolom Jenis data Deskripsi Example
event_id string Pengidentifikasi unik untuk peristiwa status. ca886134-876c-4671-a38b-332edf48c602
event_time stempel waktu Tanda waktu saat peristiwa dipancarkan. 2024-01-05T00:00:00.000+00:00
account_id string ID akun tempat grup failover berada. ca886134-876c-4671-a38b-332edf48c602
failover_group_name string Nama grup failover yang sepenuhnya memenuhi syarat. accounts/account1/failover-group/group1
replication_state string Status replikasi saat peristiwa dipancarkan. Nilai yang mungkin adalah INITIAL_REPLICATION, , ACTIVECREATED, UPDATED, DELETED, FAILOVER_STARTED, FAILOVER_FINISHED, dan FAILOVER_ABORTED. ACTIVE
errors array Kapan replication_state adalah INITIAL_REPLICATION atau ACTIVE, daftar agregat kesalahan yang menghambat replikasi setidaknya satu aset, termasuk berapa banyak aset yang terpengaruh oleh setiap kesalahan. Lihat Referensi kesalahan. Lihat Referensi kesalahan
replication_lag_ms long Milidetik sejak replikasi terakhir yang berhasil dari semua aset dalam cakupan saat peristiwa dipancarkan. Nilai null menunjukkan bahwa setidaknya satu aset belum pernah direplikasi dari sumber ke replika. Nilai naik berarti DR tidak dapat mereplikasi setidaknya satu aset dalam cakupan, tetapi perubahan pada aset dalam cakupan lainnya terus direplikasi. 2323
effective_primary_region string Wilayah utama grup failover pada saat peristiwa dipancarkan. us-west-2
managed_assets struktur Aset yang dikelola oleh grup failover saat peristiwa dipancarkan. Lihat Referensi aset terkelola. Lihat Referensi aset terkelola

Referensi kesalahan

Kolom errors berisi array kesalahan yang memblokir replikasi. Setiap elemen array adalah struct dengan bidang berikut:

Nama bidang Jenis data Deskripsi
error struktur Detail tentang kesalahan. Berisi error_class (string), nama kelas untuk kesalahan; parameters (peta), parameter nilai kunci dengan detail tentang kesalahan; dan message (string), pesan kesalahan yang dapat dibaca manusia.
affected_assets_counts array Satu entri per jenis aset yang terpengaruh. Setiap entri berisi asset_type (string), jenis aset yang terpengaruh, dan failing_count (panjang), jumlah aset jenis tersebut yang dipengaruhi kesalahan.

Referensi aset terkelola

Kolom managed_assets adalah struct yang menjelaskan aset yang dikelola oleh grup failover saat peristiwa dipancarkan. Ini berisi bidang berikut:

Nama bidang Jenis data Deskripsi
metastore_ids array ID metastore yang dikelola oleh grup failover.
workspace_sets array Kumpulan ruang kerja dikelola oleh grup failover. Setiap entri berisi name (string) dan workspace_ids (array).
catalogs array Katalog yang dikelola oleh grup failover. Setiap entri berisi name (string).

Pertimbangan saat membaca tabel

Perhatikan hal berikut ini saat Anda menganalisis states tabel:

  • Data dapat memakan waktu hingga 3 jam untuk diisi setelah peristiwa terjadi.
  • Tabel berisi peristiwa untuk semua grup failover di akun Azure Databricks.

Contoh pertanyaan

Kueri berikut mengembalikan status replikasi terbaru untuk grup failover tertentu, termasuk lag replikasi saat ini replication_state, dan kesalahan pemblokiran apa pun:

SELECT
  event_time,
  replication_state,
  replication_lag_ms,
  errors
FROM system.replication.states
WHERE failover_group_name = :failover_group_name
ORDER BY event_time DESC
LIMIT 1

Kueri berikut mengembalikan distribusi lag replikasi untuk grup failover tertentu:

SELECT histogram_numeric(replication_lag_ms, 20) AS replication_lag_distribution
FROM system.replication.states
WHERE failover_group_name = :failover_group_name