Poznámka:
Přístup k této stránce vyžaduje autorizaci. Můžete se zkusit přihlásit nebo změnit adresáře.
Přístup k této stránce vyžaduje autorizaci. Můžete zkusit změnit adresáře.
Důležité
Tato funkce je v beta verzi. Abyste ho mohli používat, musí správce pracovního prostoru zapnout agentic code converter na stránce Previews. Viz Manage Azure Databricks preview.
Agentický převodník kódu využívá Genie Code k převodu existujícího SQL z dialektů jako T-SQL, Snowflake, Redshift, Oracle, BigQuery a Teradata do kódu běžícího na Azure Databricks. Organizujete svou práci v migračním projektu a vyberete cílový framework pro výstup: SQL pro generování Databricks SQL dotazů, nebo Notebooky pro generování Databricks notebooků využívajících DataFrame API. Převodník analyzuje každý zdrojový skript, ověřuje převedený výstup a iterativně opravuje chyby před zápisem výsledků do složky workspace.
Převaděč kódu agenta je součástí nástrojů Databricks pro migraci úloh z existujících datových skladů a nástrojů ETL do Azure Databricks. Převede váš zdrojový kód SQL, zatímco v migračním projektu organizujete a sledujete svou práci.
Jak to funguje
Převod zahájíte vytvořením projektu migrace ve vašem pracovním prostoru. Projekt sleduje stav každého souboru a poskytuje jedno místo pro správu migrace.
Když spustíte převod, Genie Code vyvolá dovednost migrace a nasadí podagenty, které konvertují soubory souběžně. Každý subagent analyzuje zdrojový dialekt, vygeneruje ekvivalentní kód pro cílový rámec projektu (Databricks SQL nebo Databricks notebook), ověří výsledek a znovu zkouší sekce, které selžou. Převedené soubory se zapisují přímo do složky pracovního prostoru, kterou zadáte pro projekt.
Pomocí příkazu v konverzaci Genie Code můžete také převést jeden soubor nebo složku bez projektu /migrate .
Requirements
- Pracovní prostor s povolenou verzí Beta agentního převodníku kódu. Správce pracovního prostoru povolí funkci ze stránky Previews . Viz Manage Azure Databricks preview.
- Vaše stávající soubory SQL musí být ve vašem pracovním prostoru přístupné, buď nahrané jako soubory pracovního prostoru, nebo otevřené v editoru.
- Váš pracovní prostor musí splňovat požadavky genie Code. Viz Genie Code.
Podporované zdroje a omezení
Převaděč podporuje následující zdrojové dialekty:
- T-SQL
- Snowflake SQL
- Redshift SQL
- Oracle
- BigQuery
- Teradata
Když vytváříte migrační projekt, vyberte jeden z následujících cílových rámců:
- SQL: dotazy Databricks SQL v souladu s ANSI.
-
Notebooky: notebooky Databricks využívající rozhraní DataFrame API, přičemž
spark.sqlse používá pro logiku, kterou lze v SQL vyjádřit přehledněji.
Pro každý převod platí následující omezení:
- Dávka může obsahovat maximálně 300 souborů.
- Skript může obsahovat maximálně 1 000 řádků.
- Skripty BTEQ pro Teradata zatím nejsou podporovány.
Převod existujícího kódu SQL
Následující kroky popisují, jak převést existující SQL v projektu migrace.
Krok 1: Nahrání zdrojových souborů
Nahrajte existující soubory SQL (.sql) pomocí prohlížeče souborů pracovního prostoru nebo pomocí rozhraní příkazového řádku Databricks nahrajte adresář skriptů.
Krok 2: Vytvoření projektu migrace
Vytvořte projekt migrace z pracovního prostoru:
- Klikněte na
>Migrační projekt. - Zadejte název projektu.
- Pomocí selektorů rozevíracího seznamu vyberte dialekt Zdroje a cílovou architekturu. Pro Target framework vyberte SQL pro generování dotazů Databricks SQL nebo Notebooks pro generování notebooků Databricks.
- Zadejte cestu k souboru do cílové složky. Kliknutím na Procházet vyberte cíl ze seznamu dostupných složek pracovního prostoru.
- (Volitelné) Zadejte cestu k souboru rodokmenu , který popisuje rodokmen projektu. Kliknutím na Procházet vyberte soubor ze seznamu souborů v pracovním prostoru.
- Klikněte na Vytvořit.
Krok 3: Přidání souborů do projektu
V novém projektu:
- Klikněte na Přidat soubory>+ Přidat soubory.
- Vyberte zdrojovou složku nebo soubor z pracovního prostoru.
Projekt uvádí každý soubor s jeho typem souboru, počtem řádků a stavem převodu.
Krok 4: Kontrola složitosti kódu a rodokmenu (volitelné)
Pokud jste spustili Analyzátor Lakebridge, nahrajte do projektu výstup JSON a zkontrolujte složitost kódu a rodokmen. Kliknutím na zdrojový soubor otevřete hodnocení složitosti a kliknutím na Lineage otevřete graf závislostí, který zobrazuje vzájemně závislé soubory a tabulky, které musíte migrovat společně. Pokyny ke spuštění Analyzátoru najdete v průvodci analyzátorem Lakebridge.
Krok 5: Spuštění převodu
Vyberte soubory, které chcete převést, a klikněte na Spustit. Genie Code zahájí konverzaci, spustí migrační dovednost a nasadí subagenty, aby souběžně převedly soubory. Každý převedený soubor se v projektu zobrazí jako propojený soubor. Převaděč označí každý soubor se stavem:
- Zelená: Úspěšně převedeno
- Žlutá: Potřebuje zkontrolovat
- Červená: Převod se nezdařil.
- Šedá: Probíhá
Krok 6: Kontrola výsledků převodu
U projektů SQL kliknutím na převedený soubor otevřete v editoru SQL porovnání vedle sebe se zdrojovým kódem vedle navrhovaného kódu Databricks SQL. Přijměte všechny navrhované změny nebo zkontrolujte a přijměte jednotlivé úpravy. Pro projekty Notebooks klikněte na převedený soubor a otevřete vygenerovaný zápisník Databricks. V případě skriptů, které se nepodaří převést, upravte kód v editoru nebo požádejte Genie Code, aby znovu ověřil nebo zopakuje konkrétní oddíly. Jakmile budete spokojeni, spusťte převedený SQL nebo notebook, abyste potvrdili, že běží na Azure Databricks.
Vytvoření vlastní dovednosti (volitelné)
Vlastní dovednosti umožňují kódovat obchodní pravidla, která Genie Code použije automaticky při každém převodu. Můžete je použít ke zpracování proprietárních datových typů, vynucení upřednostňovaných cílových vzorů nebo k zachycení oprav, které provedete opakovaně. Dovednost migrace je dovednost Genie Code, takže ji můžete vytvořit a spravovat stejným způsobem jako jakoukoli jinou dovednost. Další podrobnosti najdete v článku Rozšíření kódu Genie pomocí dovedností agenta.
Dovednosti můžete vytvořit z nastavení Genie Code nebo z konverzace Genie Code. Použijte cestu nastavení pro složité dovednosti, které obsahují podrobné pokyny, příklady nebo podpůrné soubory. Použijte chatovací cestu pro rychlé dovednosti s jediným pravidlem.
Nastavení kódu Genie
Vytvořte dovednost jako soubor, abyste mohli vytvořit podrobné pokyny a verzi ve složce Git:
Na panelu Genie Code klikněte na
Nastavení a potom klikněte na
Otevřete složku dovedností.
Vytvořte složku pro svou dovednost v rámci cesty dovedností pracovního prostoru .
Workspace/.assistant/skills/Například:Workspace/.assistant/skills/sql-migration/.Ve složce skillu vytvořte soubor
SKILL.mds požadovanou hlavičkou a pravidly konverze. Příklady:--- name: sql-migration description: Conversion rules to apply when migrating legacy SQL to ANSI SQL. --- Always convert the custom type MYDATE to TIMESTAMP_NTZ.
Genie Code převezme dovednost při příštím spuštění převodu.
Chat Genie Code
Popište pravidlo převodu, které chcete kódovat, a potom požádejte Genie Code, aby ho uložil:
Tip
Always convert our custom type MYDATE to TIMESTAMP_NTZ. Save this as a custom migration skill.
Genie Code vytvoří a zaregistruje dovednost a použije ji pro budoucí převody v pracovním prostoru.
Zobrazit aktivní dovednosti:
Tip
Show me my migration skills
Odebrání dovednosti:
Tip
Delete the migration skill for [description]
Dovednosti pracovního prostoru se ukládají na úrovni pracovního prostoru a sdílejí se mezi všemi uživateli v pracovním prostoru.
Tipy pro testování
V rámci své agentické smyčky převaděč analyzuje každý zdrojový skript, ověřuje, že převedený výstup je syntakticky platný a sémanticky ekvivalentní zdroji, a iterativně opravuje části, které neprojdou ověřením, před zapsáním výsledků. Následující tipy vám pomůžou zkontrolovat a získat důvěru ve výstup:
- Dávkový převod: Převeďte malou dávku dvou až pěti souborů v jedné relaci, abyste ověřili, že převod více souborů funguje od začátku do konce.
- Ověření syntaxe: Po převodu spusťte výstup v editoru NEBO poznámkovém bloku SQL Databricks a ověřte, že se spustí bez chyb.
-
Hraniční případy: Zahrňte skript s konstruktory specifickými pro dialekt, jako jsou funkce oken T-SQL, Snowflake
QUALIFYnebo RedshiftLISTAGG, abyste viděli, jak převaděč zpracovává jiné než triviální vzory. - Sémantická správnost: Spusťte původní a převedené dotazy na ekvivalentní testovací data a porovnejte výsledky. Ověřte, že je výstup sémanticky správný, nejen syntakticky platný.