Bányászati struktúrák (Analysis Services – Adatbányászat)

A következőkre vonatkozik: SQL Server 2019 és korábbi Analysis Services Azure Analysis Services Fabric/Power BI Premium

Fontos

Az adatbányászat elavult az SQL Server 2017 Analysis Servicesben, és megszűnt az SQL Server 2022 Analysis Servicesben. Az elavult és megszűnt funkciók dokumentációja nem frissül. További információkért tekintse meg az Analysis Services visszamenőleges kompatibilitását.

A bányászati struktúra meghatározza azokat az adatokat, amelyekből a bányászati modellek épülnek: meghatározza a forrásadat-nézetet, az oszlopok számát és típusát, valamint egy választható partíciót a betanítási és tesztelési csoportokba. Egyetlen bányászati struktúra több olyan bányászati modellt is támogathat, amelyek ugyanazon a területen osztoznak. Az alábbi ábra az adatbányászati struktúra és az adatforrás és annak adatbányászati modelljei közötti kapcsolatot mutatja be.

Az adatok feldolgozása: forrás–struktúra–modell

A diagram bányászati struktúrája egy olyan adatforráson alapul, amely több táblát vagy nézetet tartalmaz, és a CustomerID mezőhöz csatlakozik. Az egyik tábla az ügyfelekkel kapcsolatos információkat tartalmazza, például a földrajzi régiót, az életkort, a jövedelmet és a nemet, míg a kapcsolódó beágyazott táblázat több sornyi további információt tartalmaz az egyes ügyfelekről, például az ügyfél által vásárolt termékekről. Az ábrán látható, hogy több modell is építhető egy bányászati struktúrára, és hogy a modellek a szerkezettől eltérő oszlopokat használhatnak.

1. modell az Ügyfélazonosító, Bevétel, Életkor és Régió adatokat használja, és a Régió alapján szűri az adatokat.

Model 2 a CustomerID, Jövedelem, Kor, Régió változókat használja, és az adatok szűrését a Kor alapján végzi.

3. modell A CustomerID, az Age, a Gender és a beágyazott táblázatot használja szűrő nélkül.

Mivel a modellek különböző oszlopokat használnak a bemenethez, és mivel két modell egy szűrő alkalmazásával korlátozza a modellben használt adatokat, előfordulhat, hogy a modellek nagyon eltérő eredményeket adnak, annak ellenére, hogy ugyanazokon az adatokon alapulnak. Vegye figyelembe, hogy a CustomerID oszlop minden modellben kötelező, mert ez az egyetlen elérhető oszlop, amely esetkulcsként használható.

Ez a szakasz az adatbányászati struktúrák alapvető architektúráját ismerteti: a bányászati struktúrák definiálását, az adatokkal való feltöltését és a modellek létrehozásának módját. A meglévő adatbányászati struktúrák kezelésével vagy exportálásával kapcsolatos további információkért lásd: Adatkezelési megoldások és objektumok kezelése.

Bányászati struktúra meghatározása

Az adatbányászati struktúra beállítása a következő lépéseket tartalmazza:

  • Adatforrás definiálása.

  • Válassza ki a szerkezetbe felvenni kívánt adatoszlopokat (nem minden oszlopot kell hozzáadni a modellhez), és definiáljon egy kulcsot.

  • Adjon meg egy kulcsot a struktúra számára, beleértve a legjobb táblához tartozó kulcsot is, ha van ilyen.

  • Adja meg, hogy a forrásadatokat el kell-e különíteni betanító és tesztkészletre. Ez a lépés nem kötelező.

  • A struktúra feldolgozása.

Ezeket a lépéseket részletesebben a következő szakaszok ismertetik.

Adatforrások bányászati struktúrákhoz

Bányászati struktúra definiálásakor olyan oszlopokat használ, amelyek egy meglévő adatforrásnézetben érhetők el. Az adatforrásnézet egy megosztott objektum, amely lehetővé teszi több adatforrás kombinálására és egyetlen forrásként való használatára. Az eredeti adatforrások nem láthatók az ügyfélalkalmazások számára, és az adatforrás nézet tulajdonságaival módosíthatja az adattípusokat, összesítéseket vagy aliasoszlopokat hozhat létre.

Ha több bányászati modellt is létrehoz ugyanabból a bányászati struktúrából, a modellek a szerkezettől eltérő oszlopokat használhatnak. Létrehozhat például egy struktúrát, majd külön döntési fát és fürtözési modelleket hozhat létre belőle, és mindegyik modell különböző oszlopokat használ, és különböző attribútumokat jelez előre.

Ezenkívül minden modell különböző módokon használhatja a struktúra oszlopait. Előfordulhat például, hogy az adatforrás nézete tartalmaz egy Bevétel oszlopot, amelyet különböző módokon helyezhet el a különböző modellekhez.

Az adatbányászati struktúra az adatforrás és a benne lévő oszlopok definícióját a forrásadatokhoz kötések formájában tárolja. Az adatforrás-kötésekről további információt az Adatforrások és kötések (SSAS többdimenziós) című témakörben talál. Vegye figyelembe azonban, hogy az adatbányászati struktúrát anélkül is létrehozhatja, hogy egy adott adatforráshoz köti a DMX CREATE MINING STRUCTURE (DMX) utasítással.

Bányászati struktúraoszlopok

A bányászati szerkezet építőelemei a bányaszerkezet oszlopai, amelyek az adatforrás által tartalmazott adatokat írják le. Ezek az oszlopok olyan információkat tartalmaznak, mint az adattípus, a tartalom típusa és az adatok elosztása. A bányászati struktúra nem tartalmaz információt arról, hogy az oszlopok hogyan használhatók egy adott bányászati modellhez, vagy hogy milyen típusú algoritmust használnak a modell létrehozásához; ez az információ magában a bányászati modellben van definiálva.

A bányászati struktúrák beágyazott táblákat is tartalmazhatnak. A beágyazott táblák egy-a-többhöz kapcsolatot jelölnek az eset entitása és a kapcsolódó attribútumok között. Ha például az ügyfelet leíró információk egy táblában találhatók, és az ügyfél vásárlásai egy másik táblában találhatók, beágyazott táblák használatával egyetlen esetbe egyesítheti az adatokat. Az ügyfélazonosító az entitás, a vásárlások pedig a kapcsolódó attribútumok. A beágyazott táblák használatáról további információt a Beágyazott táblák (Analysis Services – Adatbányászat) című témakörben talál.

Ha adatbányászati modellt szeretne létrehozni az SQL Server Data Toolsban, először létre kell hoznia egy adatbányászati struktúrát. Az Adatbányászat varázsló végigvezeti a bányászati struktúra létrehozásának, az adatok kiválasztásának és a bányászati modell hozzáadásának folyamatán.

Ha adatbányászati bővítmények (DMX) használatával hoz létre bányászati modellt, megadhatja a modellt és a benne lévő oszlopokat, a DMX pedig automatikusan létrehozza a szükséges bányászati struktúrát. További információ: CREATE MINING MODEL (DMX).

További információ: Mining Structure Columns.

Az adatok felosztása betanítási és tesztelési csoportokra

A bányászati struktúra adatainak meghatározásakor megadhatja azt is, hogy az adatok egy része betanításra, mások pedig tesztelésre szolgáljon. Ezért már nem szükséges különválasztani az adatokat az adatbányászati struktúra létrehozása előtt. Ehelyett a modell létrehozásakor megadhatja, hogy az adatok bizonyos százalékát ki lehessen tartani tesztelésre, a többit pedig betanításra, vagy megadhat bizonyos számú esetet, amelyeket tesztadatkészletként használ. A betanítási és tesztelési adatkészletekkel kapcsolatos információk gyorsítótárazva vannak a bányászati struktúrával, és ennek eredményeképpen ugyanaz a tesztkészlet használható az adott struktúrán alapuló összes modellhez.

További információ: Betanítási és tesztelési adatkészletek.

Részletezés engedélyezése

Akkor is hozzáadhat oszlopokat a bányászati struktúrához, ha nem tervezi használni az oszlopot egy adott bányászati modellben. Ez akkor hasznos, ha például a fürtözési modellben lévő ügyfelek e-mail-címét szeretné lekérni anélkül, hogy az elemzési folyamat során az e-mail címet használna. Ha figyelmen kívül szeretne hagyni egy oszlopot az elemzési és előrejelzési fázis során, vegye fel a szerkezetbe, de ne adjon meg használati értéket az oszlophoz, vagy állítsa a használati jelzőt Figyelmen kívül hagyás értékre. Az ilyen módon megjelölt adatok továbbra is használhatók a lekérdezésekben, ha a részletezés engedélyezve van a bányászati modellen, és ha rendelkezik a megfelelő engedélyekkel. Például áttekintheti az összes ügyfél elemzéséből származó klasztereket, majd egy részletező lekérdezéssel lekérheti az adott klaszter ügyfeleinek nevét és e-mail-címét, még akkor is, ha ezek az adatoszlopok nem szerepeltek a modell felépítéséhez.

További információ: Részletezési lekérdezések (adatbányászat).

Bányászati struktúrák feldolgozása

A bányászati struktúra csak metaadat-tároló, amíg fel nem dolgozzák. A bányászati struktúra feldolgozásakor az SQL Server Analysis Services létrehoz egy gyorsítótárat, amely az adatokra vonatkozó statisztikákat, a folyamatos attribútumok megkülönböztetésére vonatkozó információkat, valamint a bányászati modellek által később használt egyéb információkat tárolja. Maga a bányászati modell nem tárolja ezeket az összefoglaló információkat, hanem a bányászati struktúra feldolgozásakor gyorsítótárazott információkra hivatkozik. Ezért nem kell újra feldolgoznia a struktúrát minden alkalommal, amikor új modellt ad hozzá egy meglévő struktúrához; csak a modellt tudja feldolgozni.

Dönthet úgy, hogy a feldolgozás után elveti ezt a gyorsítótárat, ha a gyorsítótár nagyon nagy, vagy el szeretné távolítani a részletes adatokat. Ha nem szeretné, hogy az adatok gyorsítótárazva legyenek, módosíthatja a bányászati struktúra CacheMode tulajdonságát ClearAfterProcessing értékre. Ez megsemmisíti a gyorsítótárat a modellek feldolgozása után. Ha a CacheMode tulajdonságot ClearAfterProcessing értékre állítja, az letiltja az adatbányászati modell részletezését.

A gyorsítótár megsemmisítése után azonban nem fog tudni új modelleket hozzáadni a bányászati struktúrához. Ha új bányászati modellt ad hozzá a struktúrához, vagy módosítja a meglévő modellek tulajdonságait, először újra kell dolgoznia a bányászati struktúrát. További információ: Feldolgozási követelmények és szempontok (adatbányászat).

Bányászati struktúrák megtekintése

A megtekintők nem használhatják az adatok bányászati struktúrában való böngészését. Az SQL Server Data Toolsban azonban a Data Mining Designer Mining Structure lapján megtekintheti a struktúraoszlopokat és azok definícióit. További információ: Adatbányászati tervező.

Ha szeretné áttekinteni a bányászati struktúrában lévő adatokat, lekérdezéseket hozhat létre a Data Mining Extensions (DMX) használatával. Az utasítás SELECT * FROM <structure>.CASES például a bányászati struktúrában lévő összes adatot visszaadja. Az információk lekéréséhez a bányászati struktúrát fel kell dolgoznunk, és a feldolgozás eredményeit gyorsítótáraznunk kell.

Az utasítás SELECT * FROM <model>.CASES ugyanazokat az oszlopokat adja vissza, de csak az adott modellben lévő esetekre. További információ: SELECT FROM <struktúra>.CASES és SELECT FROM <modell>.CASES (DMX).

Adatbányászati modellek használata bányászati struktúrákkal

Az adatbányászati modell egy bányászati modellalgoritmust alkalmaz a bányászati struktúra által képviselt adatokra. A bányászati modell egy adott bányászati struktúrához tartozó objektum, és a modell örökli a bányászati szerkezet által meghatározott tulajdonságok összes értékét. A modell az összes oszlopot használhatja, amelyet a bányászati struktúra tartalmaz, vagy az oszlopok egy részhalmazát. Egy struktúraoszlop több másolatát is hozzáadhatja egy struktúrához. Egy struktúraoszlop több másolatát is hozzáadhatja egy modellhez, majd különböző neveket vagy aliasokat rendelhet a modell minden egyes struktúraoszlopához. A struktúraoszlopok aliasolásával kapcsolatos további információkért lásd: Alias létrehozása modelloszlophoz és bányászati modelltulajdonságokhoz.

Az adatbányászati modellek architektúrájáról további információt a Bányászati modellek (Analysis Services – Adatbányászat) című témakörben talál.

A megadott hivatkozások segítségével többet tudhat meg a bányászati struktúrák definiálásáról, kezeléséről és használatáról.

Tasks Links
Relációs bányászati struktúrákkal végzett munka Új relációs bányászati struktúra létrehozása

Beágyazott tábla hozzáadása bányászati struktúrához
OLAP-kockákon alapuló bányászati struktúrák használata Új OLAP-bányászati struktúra létrehozása
Oszlopokkal végzett munka egy bányászati struktúrában Oszlopok hozzáadása bányászati struktúrához

Oszlopok eltávolítása bányászati struktúrából
A bányászati struktúra tulajdonságainak és adatainak módosítása vagy lekérdezése Bányászati struktúra tulajdonságainak módosítása
A mögöttes adatforrások használata és a forrásadatok frissítése A bányászati struktúra adatforrásnézetének szerkesztése

Bányászati struktúra feldolgozása

Lásd még:

Adatbázis-objektumok (Analysis Services – Többdimenziós adatok)
Bányászati modellek (Analysis Services – Adatbányászat)