Transformace oken v mapování toku dat

VZTAHUJE SE NA: Azure Data Factory Azure Synapse Analytics

Toky dat jsou k dispozici v kanálech Azure Data Factory i v kanálech Azure Synapse Analytics. Tento článek se týká mapování toků dat. Pokud s transformacemi začínáte, přečtěte si úvodní článek Transformace dat pomocí mapování toků dat.

Tip

Pokud s integrací dat začínáte, začněte s pomocí Fabric Data Factory, nové generace Azure Data Factory. Transformace okna se v současné době nepodporuje v Toku dat Gen2. Seznam podporovaných transformací a jejich ekvivalentů najdete v průvodci tokem dat Gen2 pro mapování uživatelů toku dat.

Transformace oken je proces, kde definujete agregace sloupců na základě oken ve vašich datových proudech. V Tvůrci výrazů můžete definovat různé typy agregací, které jsou založené na datech nebo časových oknech (klauzule SQL OVER), například LEAD, LAG, NTILE, CUMEDIST a RANK. Ve výstupu se vygeneruje nové pole, které obsahuje tyto agregace. Můžete také zahrnout volitelná pole pro seskupení.

Snímek obrazovky s oknem vybraným z nabídky

Přes

Nastavte dělení dat sloupců pro transformaci okna. Ekvivalent SQL je Partition By v klauzuli Over v SQL. Pokud chcete vytvořit výpočet nebo vytvořit výraz, který se má použít pro dělení, můžete to udělat tak, že najedete myší na název sloupce a vyberete Vypočítaný sloupec.

Snímek obrazovky ukazuje nastavení oken se záložkou Přehled vybranou.

Seřadit

Další částí klauzule Over je nastavení Order By. Tato klauzule nastavuje řazení dat. Můžete také vytvořit výraz pro počítanou hodnotu v tomto poli sloupce pro řazení.

Na snímku obrazovky je zobrazeno nastavení oken s vybraným panelem Seřadit.

Rozsah podle kritérií

Dále nastavte rámeček okna jako nevázaný nebo ohraničený. Pokud chcete nastavit nevázaný rámeček okna, nastavte posuvník na Nevázaný na obou koncích. Pokud zvolíte nastavení mezi nevázaným a aktuálním řádkem, musíte nastavit počáteční a koncové hodnoty posunu. Obě hodnoty jsou kladná celá čísla. Z dat můžete použít buď relativní čísla, nebo hodnoty.

Posuvník okna má dvě hodnoty, které se mají nastavit: hodnoty před aktuálním řádkem a hodnoty za aktuálním řádkem. Posun mezi začátkem a koncem odpovídá dvěma selektorům na posuvníku.

Snímek obrazovky znázorňuje nastavení zobrazení oken s vybranou kartou 'Rozsah podle'.

Sloupce okenní

Nakonec pomocí Tvůrce výrazů definujte agregace, které chcete použít s datovými okny, jako jsou například RANK, COUNT, MIN, MAX, DENSE RANK, LEAD, LAG atd.

Úplný seznam agregačních a analytických funkcí, které můžete použít v jazyce výrazů Tok dat prostřednictvím Tvůrce výrazů, jsou uvedeny v transformačních výrazech Data v mapování data flow.

Pokud hledáte jednoduchou seskupovací agregaci, použijte agregační transformaci.