Přehled migrace Azure Synapse Sparku na Fabric

Tento článek slouží jako výchozí bod pro migraci úloh Azure Synapse Spark do Microsoft Fabric. Pomůže vám rozhodnout, které pokyny použít, co je možné migrovat přímo a kde se stále vyžaduje ruční refaktoring nebo ověření.

Fabric Data Engineering podporuje lakehouse, notebook, prostředí, definice úlohy Spark a položky pipeline. Většina migrací Synapse Sparku zahrnuje určitou kombinaci migrace položek, změn přístupu k datům, migrace metadat, refaktoring kódu a ověřování po migraci.

Před migrací

Než začnete, ověřte, že Fabric data engineering je pro vaši úlohu správným cílem. Zkontrolujte modul runtime Sparku, model zabezpečení, model fondu, model prostředí a vzory přístupu k datům, na které závisí vaše aktuální implementace Synapse.

Začněte těmito články:

Pokud migrujete existující pracovní prostor Synapse, naplánujte vytvoření nebo použití existujícího pracovního prostoru Fabric jako cíle migrace. Tento článek se nezabývá úplným zřizováním pracovních prostorů ani migrací úloh mimo Spark.

Co můžete migrovat?

Migrace Synapse-to-Fabric obvykle zahrnuje několik pracovních proudů.

Oblast migrace Typický obor Primární pokyny
Plánování a hodnocení Inventarizace fondů Sparku, poznámkových bloků, definic úloh Sparku, databází lake, propojených služeb a blokování Fáze 1: Strategie migrace a plánování
Položky, refaktoring kódu, pooly, konfigurace a knihovny Poznámkové bloky, definice úloh Sparku, fondy Sparku, mapování jezerových databází, mssparkutils, propojené služby, cesty k souborům, rozhraní API katalogu, ověřování konektorů, prostředí, uživatelské fondy, vlastnosti Sparku, kompatibilita knihoven Fáze 2: Migrace úloh Sparku
Metadata Metastoru Hive a jezera Databáze, tabulky, oddíly, spravované a externí tabulky Fáze 3: Hive Metastore a migrace dat
Přístup k datům a kanály Klávesové zkratky OneLake, přístup k ADLS Gen2, aktivity kopírování, migrace pipeline Migrace dat a kanálů
Zabezpečení, ověřování a přechod Role, připojení, správa, ověření, plánování přechodu Fáze 4: Migrace zabezpečení a zásad správného řízení

Volba cesty migrace

Použijte cestu, která odpovídá vašemu cíli.

  • Potřebujete ucelený plán migrace. Začněte se 4fázovou řadou osvědčených postupů. Toto je nejlepší vstupní bod pro většinu produkčních migrací.
  • Chcete rychle přesunout podporované položky Sparku. Začněte s Spark Pomocník s migrací a poté pomocí článků o refaktoringu a ověřování zaplňte mezery.
  • Potřebujete pomoct jenom s jednou oblastí. Články specifické pro úlohy použijte pro poznámkové bloky, definice úloh Sparku, fondy, knihovny, metadata metastoru Hive nebo migraci dat nebo kanálu.

Pro většinu týmů je nejrychlejším způsobem, jak přistupovat k migraci Synapse Sparku:

  1. Recenze Srovnání Fabric a Azure Synapse Spark: Klíčové rozdíly.
  2. Přečtěte si Fáze 1: Strategie migrace a plánování
  3. Pokud je to možné, spusťte Spark Synapse a Fabric Spark Pomocník s migrací.
  4. Refaktorujte poznámkové bloky, sparkové úlohy, pooly a knihovny pomocí Fáze 2: Migrace úloh Sparku.
  5. Ověřte přístup k datům, metadata, zabezpečení a připravenost na přechod pomocí zbývajících článků s osvědčenými postupy.

Snímek obrazovky znázorňující scénáře migrace

Migrace ze Synapse Sparku na Fabric je obvykle proces kopírování a přizpůsobení, nikoli přímý místní přesun. Můžete rychle migrovat mnoho prostředků, ale přesto byste měli očekávat ověření běhového chování, nahrazení integrací specifických pro Synapse a sladění vzorců zabezpečení, metadat a provozu s Fabric.

Řada osvědčených postupů

Použijte řadu osvědčených postupů pro strukturovanou a ucelenou cestu migrace:

Články o migraci specifické pro jednotlivé úlohy

Pokud potřebujete cílené pokyny pro konkrétní úlohu migrace, použijte tyto články: