İSTATISTIKLERI GÖSTER

Şunun için geçerlidir:evet olarak işaretlendi Databricks SQL denetimi evet olarak işaretlendi Databricks Runtime 18 LTS ve üzeri

Note

Databricks Runtime 18, Databricks Runtime 18.0, 18.1 ve 18.2'den daha yenidir. Daha önce daha sonra numaralandırılmış sürüm olarak gönderilecek özellikler artık databricks Runtime 18'e tarihli güncelleştirmeler olarak gönderilir. Ayrıntılar için bkz. Birleşik sürüm notları hakkında.

Tablo düzeyi istatistikler ve isteğe bağlı olarak sütun başına istatistikler de dahil olmak üzere JSON belgesi olarak tablo için iyileştirici istatistiklerini döndürür.

Databricks, SHOW STATISTICS iyileştirici istatistiklerinin program aracılığıyla okunmasını önerir. Yalnızca şema, depolama, özellikler, bölümler ve EXTENDED... içindeki diğer meta verilerDESCRIBE TABLE olmadan istatistikleri döndürür. JSON OLARAK. Kullan ANALYZE TABLE ... Bu komutun raporladığı istatistikleri toplamak için İşlem İSTATİSTİkLerİ (veya tahmine dayalı iyileştirme).

Gerekli izinler

Unity Kataloğu tablosunda çalıştırmak SHOW STATISTICS için şunları yapmanız gerekir:

  • USE CATALOG öğesini seçin.
  • USE SCHEMA üst şemada.
  • SELECT veya tablonun sahipliği.

Syntax

SHOW STATISTICS [ { FROM | IN } ] table_name
    [ FOR COLUMNS column_name [, ...] | FOR ALL COLUMNS ]
    AS JSON

FROM ve IN anahtar sözcükleri isteğe bağlıdır ve birbirinin yerine kullanılabilir.

Parameters

  • table_name

    İstatistikleri rapor etmek için tabloyu tanımlar. Ad bir zamansal belirtim veya seçenek belirtimi içermemelidir.

    Tablo bulunamazsa Azure Databricks bir TABLE_OR_VIEW_NOT_FOUND hatası oluşturur.

    Görünümler (geçici veya kalıcı) desteklenmez. Görünümde çağrılırken SHOW STATISTICSEXPECT_TABLE_NOT_VIEW.NO_ALTERNATIVE oluşturulur. Meta verileri görüntülemek için kullanın DESCRIBE EXTENDED .

  • FOR COLUMNScolumn_name [, ...]

    Her adlandırılmış sütun için öğesine statistics.column_statistics bir girdi ekler.

    Tabloda adlandırılmış sütun yoksa, komut COLUMN_NOT_FOUND oluşturur.

  • HERKES İçİn COLUMNS

    Tablonun atomik türdeki her üst düzey sütunu için öğesine bir girdi statistics.column_statistics ekler.

    İyileştirici karmaşık türlerle ilgili istatistikleri toplamadığından veri türü STRUCT, ARRAY veya MAP olan sütunlar dışlanır. İç içe alanlar numaralandırılmaz.

  • JSON OLARAK

    Required. Sonuç, tek bir JSON biçimli STRINGolarak döndürülür.

JSON biçimli çıkış

Döndürülen JSON belgesi aşağıdaki şemayı kullanır:

{
  "table_name": "<table_name>",
  "catalog_name": "<catalog_name>",
  "namespace": ["<schema_name>"],
  "schema_name": "<schema_name>",
  "statistics": {
    "size_in_bytes": <bytes>,
    "num_rows": <count>,
    "collection_source": "<collection_source>",
    "created_at": "<created_at_timestamp>",
    "column_statistics": {
      "<column_name>": {
        "min": "<min_value>",
        "max": "<max_value>",
        "distinct_count": <count>,
        "num_nulls": <count>,
        "avg_len": <bytes>,
        "max_len": <bytes>,
        "has_histogram": <boolean>,
        "has_mcv": <boolean>,
        "has_kll_sketch": <boolean>
      }
    }
  }
}
  • statistics.size_in_bytes

    İyileştirici tarafından bilinen, tablo verilerinin bayt cinsinden toplam boyutu. Tablo düzeyinde istatistik olmadığında atlanır.

  • statistics.num_rows

    İyileştirici tarafından bilinen satır sayısı. null toplanmazsa.

  • statistics.collection_source

    Tablo düzeyinde istatistiklerin nasıl üretildiği. Bunlardan biri:

    • El ile Analiz — tarafından ANALYZE TABLE ... COMPUTE STATISTICStoplanır.
    • Otomatik İstatistikler : Yazma sırasında otomatik olarak toplanır.
    • Tahmine Dayalı Analiztahmine dayalı iyileştirme tarafından toplanır.
    • Bilinmiyor — tanınmayan bir kaynak tarafından toplanır.
    • null — tablo düzeyinde istatistik yoktur.
  • statistics.created_at

    Tablo düzeyinde istatistikler toplandığında ISO 8601 UTC zaman damgası olarak (örneğin, 2026-05-29T08:14:24.845Z). null toplanmazsa.

  • statistics.column_statistics

    Yalnızca veya FOR COLUMNS belirtildiğinde FOR ALL COLUMNS dahil edilir. İstenen her sütunu sütun başına istatistikleriyle eşler.

    Aşağıdaki alanlar toplanmadığında her zaman bulunur null :

    • min, max — JSON dizeleri olarak işlenen minimum ve maksimum değerler.
    • distinct_count — ayrı değerlerin sayısı (NDV).
    • num_nulls — değer sayısı NULL .
    • avg_len, max_len — bayt cinsinden ortalama ve maksimum değer uzunluğu.
    • has_histogramtrue sütun için bir equi-height histogramı varsa.

    Aşağıdaki alanlar yalnızca ilgili taslak koleksiyonu etkinleştirildiğinde görünür ve aksi takdirde atlanır:

    • has_mcvtrue sütun için en yaygın değerler listesi kullanılabiliyorsa.
    • has_kll_sketch : true Sütun için bir KLL taslağı varsa.

Examples

-- Set up a table and collect column statistics.
> CREATE TABLE customer(cust_id INT, name STRING, state STRING) USING parquet;
> INSERT INTO customer VALUES (100, 'Mike', 'AR'), (200, 'Jane', 'CA');
> ANALYZE TABLE customer COMPUTE STATISTICS FOR ALL COLUMNS;

-- Table-level statistics only.
> SHOW STATISTICS FROM customer AS JSON;
 {"table_name":"customer","catalog_name":"spark_catalog",
  "namespace":["default"],"schema_name":"default",
  "statistics":{"size_in_bytes":864,"num_rows":2,
                "collection_source":"Manual Analyze",
                "created_at":"2026-05-29T08:14:24.845Z"}}

-- Per-column statistics for a list of columns.
> SHOW STATISTICS FROM customer FOR COLUMNS cust_id, name AS JSON;
 {"table_name":"customer","catalog_name":"spark_catalog",
  "namespace":["default"],"schema_name":"default",
  "statistics":{"size_in_bytes":864,"num_rows":2,
                "collection_source":"Manual Analyze",
                "created_at":"2026-05-29T08:14:24.845Z",
                "column_statistics":{
                  "cust_id":{"min":"100","max":"200","distinct_count":2,"num_nulls":0,
                             "avg_len":4,"max_len":4,"has_histogram":false,"has_mcv":false},
                  "name":   {"min":"Jane","max":"Mike","distinct_count":2,"num_nulls":0,
                             "avg_len":4,"max_len":4,"has_histogram":false,"has_mcv":false}}}}

-- All atomic top-level columns. STRUCT, ARRAY, and MAP columns are skipped.
> SHOW STATISTICS FROM customer FOR ALL COLUMNS AS JSON;