Not
Bu sayfaya erişim yetkilendirme gerektiriyor. Oturum açmayı veya dizinleri değiştirmeyi deneyebilirsiniz.
Bu sayfaya erişim yetkilendirme gerektiriyor. Dizinleri değiştirmeyi deneyebilirsiniz.
Şunun için geçerlidir:
Databricks SQL
Databricks Runtime 18 LTS ve üzeri
Note
Databricks Runtime 18, Databricks Runtime 18.0, 18.1 ve 18.2'den daha yenidir. Daha önce daha sonra numaralandırılmış sürüm olarak gönderilecek özellikler artık databricks Runtime 18'e tarihli güncelleştirmeler olarak gönderilir. Ayrıntılar için bkz. Birleşik sürüm notları hakkında.
Tablo düzeyi istatistikler ve isteğe bağlı olarak sütun başına istatistikler de dahil olmak üzere JSON belgesi olarak tablo için iyileştirici istatistiklerini döndürür.
Databricks, SHOW STATISTICS iyileştirici istatistiklerinin program aracılığıyla okunmasını önerir. Yalnızca şema, depolama, özellikler, bölümler ve EXTENDED... içindeki diğer meta verilerDESCRIBE TABLE olmadan istatistikleri döndürür. JSON OLARAK. Kullan ANALYZE TABLE ... Bu komutun raporladığı istatistikleri toplamak için İşlem İSTATİSTİkLerİ (veya tahmine dayalı iyileştirme).
Gerekli izinler
Unity Kataloğu tablosunda çalıştırmak SHOW STATISTICS için şunları yapmanız gerekir:
-
USE CATALOGöğesini seçin. -
USE SCHEMAüst şemada. -
SELECTveya tablonun sahipliği.
Syntax
SHOW STATISTICS [ { FROM | IN } ] table_name
[ FOR COLUMNS column_name [, ...] | FOR ALL COLUMNS ]
AS JSON
FROM ve IN anahtar sözcükleri isteğe bağlıdır ve birbirinin yerine kullanılabilir.
Parameters
-
İstatistikleri rapor etmek için tabloyu tanımlar. Ad bir zamansal belirtim veya seçenek belirtimi içermemelidir.
Tablo bulunamazsa Azure Databricks bir TABLE_OR_VIEW_NOT_FOUND hatası oluşturur.
Görünümler (geçici veya kalıcı) desteklenmez. Görünümde çağrılırken
SHOW STATISTICSEXPECT_TABLE_NOT_VIEW.NO_ALTERNATIVE oluşturulur. Meta verileri görüntülemek için kullanınDESCRIBE EXTENDED. FOR COLUMNScolumn_name [, ...]
Her adlandırılmış sütun için öğesine
statistics.column_statisticsbir girdi ekler.Tabloda adlandırılmış sütun yoksa, komut COLUMN_NOT_FOUND oluşturur.
HERKES İçİn COLUMNS
Tablonun atomik türdeki her üst düzey sütunu için öğesine bir girdi
statistics.column_statisticsekler.İyileştirici karmaşık türlerle ilgili istatistikleri toplamadığından veri türü STRUCT, ARRAY veya MAP olan sütunlar dışlanır. İç içe alanlar numaralandırılmaz.
JSON OLARAK
Required. Sonuç, tek bir JSON biçimli
STRINGolarak döndürülür.
JSON biçimli çıkış
Döndürülen JSON belgesi aşağıdaki şemayı kullanır:
{
"table_name": "<table_name>",
"catalog_name": "<catalog_name>",
"namespace": ["<schema_name>"],
"schema_name": "<schema_name>",
"statistics": {
"size_in_bytes": <bytes>,
"num_rows": <count>,
"collection_source": "<collection_source>",
"created_at": "<created_at_timestamp>",
"column_statistics": {
"<column_name>": {
"min": "<min_value>",
"max": "<max_value>",
"distinct_count": <count>,
"num_nulls": <count>,
"avg_len": <bytes>,
"max_len": <bytes>,
"has_histogram": <boolean>,
"has_mcv": <boolean>,
"has_kll_sketch": <boolean>
}
}
}
}
statistics.size_in_bytes
İyileştirici tarafından bilinen, tablo verilerinin bayt cinsinden toplam boyutu. Tablo düzeyinde istatistik olmadığında atlanır.
statistics.num_rows
İyileştirici tarafından bilinen satır sayısı.
nulltoplanmazsa.statistics.collection_source
Tablo düzeyinde istatistiklerin nasıl üretildiği. Bunlardan biri:
-
El ile Analiz — tarafından
ANALYZE TABLE ... COMPUTE STATISTICStoplanır. - Otomatik İstatistikler : Yazma sırasında otomatik olarak toplanır.
- Tahmine Dayalı Analiz — tahmine dayalı iyileştirme tarafından toplanır.
- Bilinmiyor — tanınmayan bir kaynak tarafından toplanır.
-
null— tablo düzeyinde istatistik yoktur.
-
El ile Analiz — tarafından
statistics.created_at
Tablo düzeyinde istatistikler toplandığında ISO 8601 UTC zaman damgası olarak (örneğin,
2026-05-29T08:14:24.845Z).nulltoplanmazsa.statistics.column_statistics
Yalnızca veya
FOR COLUMNSbelirtildiğindeFOR ALL COLUMNSdahil edilir. İstenen her sütunu sütun başına istatistikleriyle eşler.Aşağıdaki alanlar toplanmadığında her zaman bulunur
null:- min, max — JSON dizeleri olarak işlenen minimum ve maksimum değerler.
-
distinct_count — ayrı değerlerin sayısı (
NDV). -
num_nulls — değer sayısı
NULL. - avg_len, max_len — bayt cinsinden ortalama ve maksimum değer uzunluğu.
-
has_histogram —
truesütun için bir equi-height histogramı varsa.
Aşağıdaki alanlar yalnızca ilgili taslak koleksiyonu etkinleştirildiğinde görünür ve aksi takdirde atlanır:
-
has_mcv —
truesütun için en yaygın değerler listesi kullanılabiliyorsa. -
has_kll_sketch :
trueSütun için bir KLL taslağı varsa.
Examples
-- Set up a table and collect column statistics.
> CREATE TABLE customer(cust_id INT, name STRING, state STRING) USING parquet;
> INSERT INTO customer VALUES (100, 'Mike', 'AR'), (200, 'Jane', 'CA');
> ANALYZE TABLE customer COMPUTE STATISTICS FOR ALL COLUMNS;
-- Table-level statistics only.
> SHOW STATISTICS FROM customer AS JSON;
{"table_name":"customer","catalog_name":"spark_catalog",
"namespace":["default"],"schema_name":"default",
"statistics":{"size_in_bytes":864,"num_rows":2,
"collection_source":"Manual Analyze",
"created_at":"2026-05-29T08:14:24.845Z"}}
-- Per-column statistics for a list of columns.
> SHOW STATISTICS FROM customer FOR COLUMNS cust_id, name AS JSON;
{"table_name":"customer","catalog_name":"spark_catalog",
"namespace":["default"],"schema_name":"default",
"statistics":{"size_in_bytes":864,"num_rows":2,
"collection_source":"Manual Analyze",
"created_at":"2026-05-29T08:14:24.845Z",
"column_statistics":{
"cust_id":{"min":"100","max":"200","distinct_count":2,"num_nulls":0,
"avg_len":4,"max_len":4,"has_histogram":false,"has_mcv":false},
"name": {"min":"Jane","max":"Mike","distinct_count":2,"num_nulls":0,
"avg_len":4,"max_len":4,"has_histogram":false,"has_mcv":false}}}}
-- All atomic top-level columns. STRUCT, ARRAY, and MAP columns are skipped.
> SHOW STATISTICS FROM customer FOR ALL COLUMNS AS JSON;