Poznámka:
Přístup k této stránce vyžaduje autorizaci. Můžete se zkusit přihlásit nebo změnit adresáře.
Přístup k této stránce vyžaduje autorizaci. Můžete zkusit změnit adresáře.
platí pro: Analytické služby SQL Serveru
Vytváří nový těžební model založený na existující těžební struktuře. Když použijete příkaz ALTER MINING STRUCTURE k vytvoření nového těžebního modelu, struktura už musí existovat. Naopak, když použijete příkaz CREATE MINING MODEL (DMX), vytvoříte model a zároveň automaticky generujete jeho základní těžební strukturu.
Syntax
ALTER MINING STRUCTURE <structure>
ADD MINING MODEL <model>
(
<column definition list>
[(<nested column definition list>) [WITH FILTER (<nested filter criteria>)]]
)
USING <algorithm> [(<parameter list>)]
[WITH DRILLTHROUGH]
[,FILTER(<filter criteria>)]
Arguments
struktura
Název těžební stavby, ke které bude těžební model přidán.
model
Unikátní název pro těžební model.
Seznam definic sloupců
Seznam definic sloupců oddělený čárkou.
Seznam definic vnořených sloupců
Pokud je to relevantní, seznam sloupců oddělený čárkami z vnořené tabulky.
Kritéria vnořených filtrů
Filtrační výraz, který se aplikuje na sloupce v vnořené tabulce.
algoritmus
Název algoritmu pro těžbu dat, jak jej definuje poskytovatel.
Note
Seznam algoritmů podporovaných současným poskytovatelem lze získat pomocí DMSCHEMA_MINING_SERVICES Rowset. Pro zobrazení algoritmů podporovaných v aktuální instanci Analysis Services viz Vlastnosti dolování dat.
Seznam parametrů
Optional. Seznam parametrů definovaných poskytovatelem algoritmu oddělený čárkami.
Kritéria filtru
Filtrační výraz, který se aplikuje na sloupce v tabulce případů.
Remarks
Pokud těžební struktura obsahuje složené klíče, těžební model musí zahrnovat všechny sloupce klíčů, které jsou ve struktuře definovány.
Pokud model nevyžaduje předvídatelný sloupec, například modely vytvořené pomocí algoritmů Microsoft Clustering a Microsoft Sequence Clustering, nemusíte do tvrzení zahrnout definici sloupce. Všechny atributy ve výsledném modelu budou považovány za vstupy.
V klauzuli WITH, která platí pro tabulku případů, můžete specifikovat možnosti jak pro filtrování, tak pro drillthrough:
Přidejte klíčové slovo FILTER a podmínku filtru. Filtr se vztahuje na případy v těžebním modelu.
Přidejte klíčové slovo DRILLTHROUGH , aby uživatelé těžebního modelu mohli prohledat výsledky modelu až po data případu. V Data Mining Extensions (DMX) lze drillthrough povolit pouze při vytvoření modelu.
Pro použití jak filtrování případů, tak drillthrough, spojujete klíčová slova do jedné klauzule WITH pomocí syntaxe zobrazené v následujícím příkladu:
WITH DRILLTHROUGH, FILTER(Gender = 'Male')
Seznam definic sloupců
Strukturu modelu definujete tím, že specifikujete seznam definic sloupců, který obsahuje následující informace pro každý sloupec:
Název (povinný)
Alias (volitelné)
Modelování vlajek
Požadavek na predikci, který algoritmu indikuje, zda sloupec obsahuje předvídatelnou hodnotu, označenou klauzulí PREDICT nebo PREDICT_ONLY
Pro definici sloupce použijte následující syntaxi pro definování jednoho sloupce:
<structure column name> [AS <model column name>] [<modeling flags>] [<prediction>]
Název sloupku a alias
Název sloupce, který použijete v seznamu definic sloupců, musí být název sloupce, jak se používá v těžební struktuře. Nicméně můžete volitelně definovat alias, který reprezentuje sloupec struktury v těžebním modelu. Můžete také vytvořit více definic sloupců pro stejný sloupec a každému sloupci přiřadit jiný alias a použití predikce. Ve výchozím nastavení se používá název sloupce struktury, pokud nedefinujete alias. Pro více informací viz Vytvořit alias pro sloupec modelu.
Pro vnořené sloupce tabulky určujete název vnořené tabulky, datový typ jako TABLE, a poté poskytnete seznam vnořených sloupců pro zahrnutí do modelu, uzavřený v závorkách.
Filtrační výraz, který se aplikuje na vnořenou tabulku, můžete definovat připojením výrazu kritéria filtru za definicí sloupce vnořené tabulky.
Značky modelování
Analysis Services podporuje následující modelovací příznaky pro použití v těžbě modelových sloupců:
Note
Vlajka modelování NOT_NULL se vztahuje na sloupec těžební konstrukce. Další informace naleznete v tématu CREATE MINING STRUCTURE (DMX).
| Term | Definition |
|---|---|
| REGRESOR | Označuje, že algoritmus může použít zadaný sloupec ve vzorci regrese regresních algoritmů. |
| MODEL_EXISTENCE_ONLY | Označuje, že hodnoty sloupce atributu jsou méně důležité než samotná přítomnost atributu. |
Můžete definovat více modelovacích příznaků pro sloupec. Pro více informací o používání modelovacích příznaků viz Modeling Flags (DMX).
Predikční klauzule
Predikční klauzule popisuje, jak se predikční sloupec používá. Následující tabulka uvádí možné klauzule.
| Clause | Description |
|---|---|
| PŘEDPOVÍDAT | Tento sloupec může model předpovědět a jeho hodnoty lze použít jako vstup k předpovědi hodnoty ostatních předvídatelných sloupců. |
| PREDICT_ONLY | Tento sloupec lze předpovědět modelem, ale jeho hodnoty nelze použít ve vstupních případech k předpovědi hodnoty ostatních předvídatelných sloupců. |
Výrazy kritérií filtru
Můžete definovat filtr, který omezuje případy používané v těžebním modelu. Filtr lze aplikovat buď na sloupce v tabulce případů, nebo na řádky v vnořené tabulce, případně na obě.
Výrazy kritérií filtru jsou zjednodušené DMX predikáty, podobné klauzuli WHERE. Filtrační výrazy jsou omezeny na formule využívající základní matematické operátory, skaláry a názvy sloupců. Výjimkou je operátor EXISTS; vyhodnocuje se jako pravda, pokud je alespoň jeden řádek vrácen pro poddotaz. Predikáty lze kombinovat pomocí běžných logických operátorů: AND, OR a NOT.
Pro více informací o filtrech používaných v těžebních modelech viz Filtry pro těžební modely (Analytické služby - Data Mining).
Note
Sloupce ve filtru musí být sloupy těžební struktury. Nemůžete vytvořit filtr na sloupci modelu nebo na vyaliasovaném sloupci.
Pro více informací o DMX operátorech a syntaxi viz Sloupce modelů těžby.
Seznam definic parametrů
Výkon a funkčnost modelu můžete upravit přidáním parametrů algoritmu do seznamu parametrů. Parametry, které můžete použít, závisí na algoritmu, který specifikujete v klauzuli UŽÍVÁNÍ. Pro seznam parametrů spojených s každým algoritmem viz Data Mining Algorithms (Analysis Services - Data Mining).
Syntaxe seznamu parametrů je následující:
[<parameter> = <value>, <parameter> = <value>,...]
Příklad 1: Přidat model ke struktuře
Následující příklad přidává model těžby Naivního Bayesa do struktury těžby New Mailing a omezuje maximální počet stavů atributů na 50.
ALTER MINING STRUCTURE [New Mailing]
ADD MINING MODEL [Naive Bayes]
(
CustomerKey,
Gender,
[Number Cars Owned],
[Bike Buyer] PREDICT
)
USING Microsoft_Naive_Bayes (MAXIMUM_STATES = 50)
Příklad 2: Přidat filtrovaný model ke struktuře
Následující příklad přidává těžební model Naive Bayes Women, do struktury dolování New Mailing . Nový model má stejnou základní strukturu jako těžební model, který byl přidán v příkladu 1; Tento model však omezuje případy z těžební struktury na ženy starší 50 let.
ALTER MINING STRUCTURE [New Mailing]
ADD MINING MODEL [Naive Bayes Women]
(
CustomerKey,
Gender,
[Number Cars Owned],
[Bike Buyer] PREDICT
)
USING Microsoft_Naive_Bayes
WITH FILTER([Gender] = 'F' AND [Age] >50)
Příklad 3: Přidejte filtrovaný model ke struktuře s vnořenou tabulkou
Následující příklad přidává těžební model k upravené verzi struktury těžby tržního košíku. Těžební struktura použitá v příkladu byla upravena tak, že přidá sloupec Region , který obsahuje atributy pro region zákazníka, a sloupec Skupina příjmů , který kategorizuje příjmy zákazníků pomocí hodnot Vysoký, Střední nebo Nízký.
Těžební struktura také obsahuje vnořenou tabulku, která uvádí položky, které zákazník zakoupil.
Protože těžební struktura obsahuje vnořenou tabulku, můžete definovat filtr na case table, vnořené tabulce nebo obojí. Tento příklad kombinuje filtr skříněk a vnořený řádkový filtr, aby omezil případy na bohaté evropské zákazníky, kteří si zakoupili některý z modelů silničních pneumatik.
ALTER MINING STRUCTURE [Market Basket with Region and Income]
ADD MINING MODEL [Decision Trees]
(
CustomerKey,
Region,
[Income Group],
[Product] PREDICT (Model)
WITH FILTER (EXISTS (SELECT * FROM [v Assoc Seq Line Items] WHERE
[Model] = 'HL Road Tire' OR
[Model] = 'LL Road Tire' OR
[Model] = 'ML Road Tire' )
)
) WITH FILTER ([Income Group] = 'High' AND [Region] = 'Europe')
USING Microsoft_Decision Trees
Viz také
Data Mining Extensions (DMX) Definice dat
Příkazy pro manipulaci s daty Data Minings Extensions (DMX)
Reference na příkaz Data Mining Extensions (DMX)