Poznámka
Na prístup k tejto stránke sa vyžaduje oprávnenie. Môžete sa skúsiť prihlásiť alebo zmeniť adresáre.
Na prístup k tejto stránke sa vyžaduje oprávnenie. Môžete skúsiť zmeniť adresáre.
Mirroring in Fabric poskytuje jednoduchý zážitok na vyhnutie sa zložitému ETL (Extract Transform Load) a integráciu existujúcich dát zo skladu Snowflake so zvyškom dát v Microsoft Fabric. Existujúce údaje Snowflake môžete priebežne replikovať priamo do OneLake od spoločnosti Fabric. Vo vnútri Fabric môžete odomknúť výkonnú obchodnú inteligenciu, umelú inteligenciu, dátové inžinierstvo, dátovú vedu a scenáre zdieľania údajov.
Pre návod na konfiguráciu vašej databázy Snowflake pre zrkadlenie v Fabric pozri Tutorial: Konfiguruj Microsoft Fabric zrkadlené databázy zo Snowflake.
Prečo používať zrkadlenie v tkanine?
Zrkadlenie vo funkcii Fabric vám nevyžaduje spájanie rôznych služieb od viacerých dodávateľov. Namiesto toho si môžete vychutnať vysoko integrovaný, komplexný a ľahko použiteľný produkt, ktorý je navrhnutý tak, aby zjednodušil vaše analytické potreby a bol vytvorený pre otvorenosť a spoluprácu medzi spoločnosťami Microsoft, Snowflake a 1000 technologickými riešeniami, ktoré dokážu čítať formát tabuľky Delta Lake s otvoreným zdrojovým kódom.
V akých analytických prostrediach sú zabudované?
Zrkadlené databázy sú položkou v dátových skladoch štruktúry, ktorá sa líši od koncového boduWarehouse a SQL analytics.
Zrkadlenie vytvorí tieto položky v pracovnom priestore služby Fabric:
- Zrkadlená položka databázy. To umožňuje následné scenáre, ako je dátové inžinierstvo, dátová veda a ďalšie. Zrkadlenie spôsobuje:
- Replikácia spravovaných tabuliek a pohľadových dát do OneLake a konverzia do Parquet vo formáte pripravenom na analytiku.
- Replikácia metadát Iceberg tabuliek do OneLake pomocou skratiek a konverzia do úložiska, ktoré obsahuje vaše Iceberg tabuľky. OneLake automaticky konvertuje tieto Iceberg tabuľky na tabuľky formátované Delta Lake pre použitie naprieč Fabric workloadmi.
- Koncový bod analýzy SQL
Dôležité
Podpora tabuliek Iceberg: Ak sa rozhodnete zrkadliť tabuľky Iceberg, musíte poskytnúť úložné pripojenie k podkladovému úložisku, ktoré obsahuje dáta tabuľky Iceberg. Len Iceberg tabuľky, ktoré sú dostupné cez rovnaké úložisko, môžu byť zrkadlené spolu. Ak chcete nájsť miesto úložiska pre tabuľku Iceberg, spustite funkciu systému SYSTEM$GET_ICEBERG_TABLE_INFORMATION v Snowflake. Viac informácií nájdete v Návod: Konfigurácia zrkadlených databáz Microsoft Fabric zo Snowflake.
Každá zrkadlená databáza má automaticky generovaný koncový bod analýzy SQL , ktorý poskytuje bohaté analytické prostredie nad rozdielovými tabuľkami vytvorenými procesom zrkadlenia. Používatelia majú prístup k známym príkazom T-SQL, ktoré môžu definovať a dotazovať sa na dátové objekty, ale nemôžu manipulovať s údajmi z koncového bodu analýzy SQL, pretože ide o kópiu iba na čítanie. V koncovom bode analýzy SQL môžete vykonať nasledujúce akcie:
- Preskúmajte tabuľky, ktoré odkazujú na údaje v tabuľkách Delta Lake od Snowflake.
- Nevytvárajte žiadne dotazy a zobrazenia kódu a vizuálne skúmajte údaje bez písania riadku kódu.
- Vyvíjajte SQL zobrazenia, vložené TVF (tabuľkové funkcie) a uložené procedúry na zapuzdrenie sémantiky a obchodnej logiky v T-SQL.
- Spravujte povolenia pre objekty.
- Dotazujte sa na údaje v iných skladoch a jazerách v rovnakom pracovnom priestore.
Okrem editora dotazov SQL existuje široký ekosystém nástrojov, ktoré dokážu dotazovať SQL analytics endpoint, vrátane SQL Server Management Studio (SSMS), MSSQL rozšírenie pre Visual Studio Code a dokonca aj GitHub Copilot.
Podporované typy objektov Snowflake
Nasledujúca tabuľka uvádza, ktoré typy objektov Snowflake sú podporované pre zrkadlenie:
| Typ objektu | Podporované | Poznámky |
|---|---|---|
| Spravované tabuľky | Áno | Plne podporovaná replikácia |
| Tabuľky ľadovcov | Áno | Vyžaduje úložisko pripojené k podkladovému úložisku Iceberg table. Iceberg tabuľky môžete zrkadliť len tak, aby ste sa dostali cez rovnaké úložisko. |
| Views | Áno | Podporované synchronizácie každých 12 hodín |
| Realizované zobrazenia | Áno | Podporované synchronizácie každých 12 hodín |
| Externé stoly | Nie | Nepodporované |
| Prechodné tabuľky | Nie | Nepodporované |
| Dočasné tabuľky | Nie | Nepodporované |
| Dynamické tabuľky | Nie | Nepodporované |
Bezpečnostné aspekty
Ak chcete povoliť zrkadlenie štruktúry, budete potrebovať používateľské povolenia pre databázu Snowflake, ktorá obsahuje nasledujúce povolenia:
CREATE STREAMSELECT tableSHOW tablesDESCRIBE tables
Viac informácií nájdete v dokumentácii Snowflake o Access Control Privileges for Streaming tables a Required Permissions for Streams.
Dôležité
Akákoľvek detailná bezpečnosť nastavená v zdrojovom sklade Snowflake musí byť prekonfigurovaná v zrkadlovej databáze v Microsoft Fabric. Pre viac informácií pozri SQL granulárne oprávnenia v Microsoft Fabric.
Podporované autentifikačné metódy
Nasledujúca tabuľka uvádza, ktoré autentifikačné metódy sú podporované pre zrkadlenie pre Snowflake:
| Metóda overovania | Podporované | Poznámky |
|---|---|---|
| Meno používateľa a heslo | Áno | Natívna autentifikácia Snowflake |
| Microsoft Entra ID (SSO) | Áno | Single sign-on cez Entra ID |
| Autentifikácia páru kľúčov | Áno | RSA pár kľúčov pre scenáre servisných účtov |
| Identita pracovného priestoru | Nie | Momentálne nie je podporované pre Snowflake |
Zrkadlenie Snowflake za firewallom
Skontrolujte požiadavky na sieť a získajte prístup k zdroju údajov Snowflake. Ak váš zdroj údajov Snowflake nie je verejne prístupný a nachádza sa v súkromnej sieti, vytvorte bránu údajov virtuálnej siete alebo nainštalujte lokálnu bránu údajov na zrkadlenie údajov. Azure Virtual Network alebo sieť brány musí byť pripojená k inštancii Snowflake cez súkromný endpoint, inak musí byť povolená pravidlom firewallu. Na začiatok si pozrite Návod: Konfigurujte Microsoft Fabric zrkadlené databázy zo Snowflake.
Private Link a identita pracovného priestoru:
- Private Link: Direct Private Link konektivita medzi pracovným priestorom Fabric a Snowflake zatiaľ nie je podporovaná. Medzitým používajte virtuálnu sieťovú dátovú bránu alebo lokálnu dátovú bránu pre súkromné pripojenie.
- Identita pracovného priestoru: Autentifikácia identity pracovného priestoru momentálne nie je podporovaná pre zrkadlenie Snowflake.
Úvahy o nákladoch zrkadlovej snehovej vločky
Výpočtové prostriedky v oblasti štruktúry, ktoré sa používajú na replikáciu údajov do služby Fabric OneLake, sú bezplatné. Náklady na ukladací priestor zrkadlenia sú bezplatné až do limitu založeného na kapacite. Pre viac informácií pozri Náklady zrkadlenia a Microsoft Fabric Ceny. Výpočtová kapacita na dotazovanie dát pomocou SQL, Power BI alebo Spark sa účtuje pravidelne.
Fabric neúčtuje poplatky za vstup do siete do OneLake for Mirroring.
Pri zrkadlení údajov existujú náklady na výpočty a cloudové dotazy Snowflake: výpočty virtuálneho skladu a výpočty cloudových služieb.
- Výpočtové poplatky za virtuálny sklad Snowflake:
- Výpočtové poplatky sa budú účtovať na strane Snowflake, ak dôjde k zmenám údajov, ktoré sa čítajú v Snowflake, a následne sa zrkadlia do Fabric.
- Žiadne dotazy na metaúdaje spustené na pozadí na kontrolu zmien údajov sa neúčtujú za žiadne výpočty Snowflake; dotazy, ktoré produkujú údaje, ako napríklad a
SELECT *, však prebudia sklad Snowflake a výpočty sa budú účtovať.
- Výpočtové poplatky za služby Snowflake:
- Hoci sa neúčtujú žiadne výpočtové poplatky za zákulisné úlohy, ako je vytváranie, dotazy na metaúdaje, riadenie prístupu, zobrazovanie zmien údajov a dokonca aj dotazy DDL, s týmito dotazmi sú spojené náklady na cloud.
- V závislosti od toho, aký typ edície Snowflake máte, vám budú účtované zodpovedajúce kredity za všetky náklady na cloudové služby.
Na nasledujúcej snímke obrazovky môžete vidieť výpočtové náklady virtuálneho skladu a výpočtové náklady na cloudové služby pre priradenú databázu Snowflake, ktorá sa zrkadlí do štruktúry. V tomto scenári väčšina nákladov na výpočet cloudových služieb (žltá) pochádza z dotazov na zmenu údajov na základe vyššie uvedených bodov. Výpočtové poplatky virtuálneho skladu (modré) pochádzajú výlučne zo zmien údajov, ktoré sa čítajú zo Snowflake a zrkadlia sa do Fabric.
Odporúčania na optimalizáciu nákladov
Aby ste minimalizovali náklady na výpočty Snowflake pri zrkadlení, zvážte nasledujúce osvedčené postupy:
- Znovu využite existujúci sklad. Namiesto vytvárania samostatného skladu na zrkadlenie nastavte zrkadlenie tak, aby používalo ten istý sklad, ktorý vaše aplikácie už používajú na aktualizáciu zdrojových tabuliek. Tento prístup zabraňuje zbytočnému prebúdzaniu skladu a automatickému pozastaveniu cyklov. Keď vaša aplikácia aktualizuje tabuľku, zrkadlový replikátor zachytí zmeny takmer okamžite, kým je sklad ešte aktívny, takže nemusíte budiť samostatný sklad. Niektoré organizácie môžu uprednostniť vyhradený sklad na obmedzenie rozpočtu. Táto preferencia je kompromisom medzi úsporou nákladov a detailnosťou rozpočtovania.
- Zrkadli len tie stoly, ktoré potrebuješ. Zrkadlenie celej databázy môže spôsobiť nečakane vysokú spotrebu Snowflake a nárasty kapacity Fabric. Začnite výberom iba tabuliek potrebných pre vaše analytické scenáre. Tabuľky môžete pridať neskôr podľa potreby.
- Sledujte nečakané presejanie. Reseed (úplné načítanie dát) spracuje celú tabuľku a prináša výpočtové náklady úmerné veľkosti tabuľky. Zmeny schémy – vrátane tých, ktoré vyvolávajú nástroje ako DBT – môžu spôsobiť kontinuálne opätovné seedovanie. Sledujte stránku Stav zrkadlenia kvôli tabuľkám, ktoré ukazujú opakované správanie pri počiatočnom kopírovaní, a prečítajte si sekciu Reseeding nižšie pre spúšťače a odporúčania na riešenie problémov.
- Majte na pamäti, že zrkadlenie prebieha nepretržite. Zrkadlenie momentálne nepodporuje plánovanie ani replikačné okná. Replikátor neustále vyhľadáva zmeny, čo generuje priebežné využitie výpočtov Snowflake. Naplánujte si svoje rozpočty na Snowflake podľa toho.
Ďalšie informácie o nákladoch na cloudové dotazy špecifické pre Snowflake nájdete v téme Dokumentácia k Snowflake: Vysvetlenie celkových nákladov.