Dystrybucje (DMX)

Dotyczy: usług SQL Server Analysis Services

W Microsoft SQL Server Analysis Services możesz zdefiniować zawartość kolumn w strukturze wydobycia, aby wpłynąć na to, jak algorytmy przetwarzają dane w tych kolumnach podczas tworzenia modeli wydobycia. W przypadku niektórych algorytmów warto zdefiniować rozkład wszystkich kolumn ciągłych przed przetworzeniem modelu, jeśli kolumny są znane ze wspólnych rozkładów wartości. Jeśli nie zdefiniujesz rozkładów, wynikowe modele wyszukiwania mogą generować mniej dokładne przewidywania, niż jeśli rozkłady zostały zdefiniowane, ponieważ algorytmy będą miały mniej informacji, z których można interpretować dane.

Algorytmy eksploracji danych Microsoft obsługują następujące typy dystrybucji:

NORMAL
Wartości dla kolumny ciągłej tworzą histogram o rozkładzie normalnym Gaussa.

Dziennik — normalny
Wartości dla kolumny ciągłej tworzą histogram, gdzie logarytm wartości jest normalnie rozkładany.

MUNDUR
Wartości kolumny ciągłej tworzą płaską krzywą, w której wszystkie wartości są równie prawdopodobne.

Więcej informacji o algorytmach eksploracji danych Microsoft można znaleźć w artykule Data Mining Algorithms (Analysis Services - Data Mining). Dostawcy algorytmów zewnętrznych mogą wspierać dodatkowe typy dystrybucji. Aby określić, jakie typy rozkładów obsługuje algorytm, użyj zestawu wierszy SUPPORTED_DISTRIBUTION_FLAGS schematu.

Więcej informacji o typach dystrybucji można znaleźć w artykule Rozkłady kolumn (eksploracja danych).