Notatka
Dostęp do tej strony wymaga autoryzacji. Może spróbować zalogować się lub zmienić katalogi.
Dostęp do tej strony wymaga autoryzacji. Możesz spróbować zmienić katalogi.
Ważna
Ta funkcja jest dostępna w wersji beta. Aby z niego korzystać, administrator obszaru roboczego musi włączyć agentowy konwerter kodu na stronie Podglądy. Zobacz Zarządzanie wersjami zapoznawczami usługi Azure Databricks.
Agentowy konwerter kodu wykorzystuje Genie Code do konwertowania istniejącego kodu SQL z dialektów, takich jak T-SQL, Snowflake, Redshift, Oracle, BigQuery i Teradata, na standard ANSI SQL, który działa w usłudze Azure Databricks. Pracujesz w projekcie migracji, w którym konwerter analizuje każdy skrypt źródłowy, weryfikuje przekonwertowane dane wyjściowe, a iteracyjne naprawia błędy przed zapisaniem wyników w folderze obszaru roboczego.
Agentowy konwerter kodu jest częścią zestawu narzędzi Databricks do migracji obciążeń roboczych z istniejących hurtowni danych i narzędzi ETL do platformy Azure Databricks. Konwertuje źródłowy kod SQL podczas organizowania i śledzenia pracy w projekcie migracji.
Jak to działa
Rozpoczniesz konwersję, tworząc projekt migracji w obszarze roboczym. Projekt śledzi stan każdego pliku i zapewnia jedno miejsce do zarządzania migracją.
Po uruchomieniu konwersji kod Genie wywołuje umiejętności migracji i wdraża subagenty, które konwertują pliki współbieżnie. Każdy podagent analizuje dialekt źródłowy, generuje odpowiednik ANSI SQL, weryfikuje wynik i ponawia próby sekcji, które kończą się niepowodzeniem. Przekonwertowane pliki są zapisywane bezpośrednio w folderze obszaru roboczego określonym dla projektu.
Można również przekonwertować pojedynczy plik lub folder bez projektu przy użyciu /migrate polecenia w konwersacji Genie Code.
Requirements
- Obszar roboczy z włączoną obsługą agentowego konwertera kodu Beta. Administrator obszaru roboczego włącza funkcję na stronie Podglądy . Zobacz Zarządzanie wersjami zapoznawczami usługi Azure Databricks.
- Istniejące pliki SQL muszą być dostępne w obszarze roboczym, przekazywane jako pliki obszaru roboczego lub otwierane w edytorze.
- Obszar roboczy musi spełniać wymagania dotyczące kodu Genie. Zobacz Kod Genie.
Obsługiwane źródła i ograniczenia
Konwerter obsługuje następujące dialekty źródłowe:
- T-SQL
- Snowflake SQL
- Redshift SQL
- Oracle
- BigQuery
- Teradata
Konwerter jest przeznaczony dla usługi ANSI SQL. Do każdej konwersji mają zastosowanie następujące limity:
- Partia może zawierać maksymalnie 300 plików.
- Skrypt może zawierać maksymalnie 1000 wierszy.
- Skrypty teradata BTEQ nie są jeszcze obsługiwane.
Konwertowanie istniejącego kodu SQL
W poniższych krokach opisano sposób konwertowania istniejącego programu SQL w projekcie migracji.
Krok 1. Przekazywanie plików źródłowych
Przekaż istniejące pliki SQL (.sql) przy użyciu przeglądarki plików obszaru roboczego lub użyj interfejsu wiersza polecenia usługi Databricks , aby zbiorczo przekazać katalog skryptów.
Krok 2. Tworzenie projektu migracji
Utwórz projekt migracji z obszaru roboczego:
- Kliknij
>Projekt migracji. - Wprowadź nazwę projektu.
- Selektory listy rozwijanej umożliwiają wybranie dialektu źródłowego i platformy Target.
- Wprowadź ścieżkę pliku do docelowego folderu Docelowego. Kliknij przycisk Przeglądaj , aby wybrać miejsce docelowe z listy dostępnych folderów obszaru roboczego.
- (Opcjonalnie) Wprowadź ścieżkę do pliku pochodzenia , który opisuje pochodzenie projektu. Kliknij przycisk Przeglądaj , aby wybrać plik z listy plików w obszarze roboczym.
- Kliknij pozycję Utwórz.
Krok 3. Dodawanie plików do projektu
W nowym projekcie:
- Kliknij pozycję Dodaj pliki>+ Dodaj pliki.
- Wybierz folder źródłowy lub plik z obszaru roboczego.
Projekt wyświetla listę każdego pliku z jego typem pliku, liczbą wierszy i stanem konwersji.
Krok 4. Przegląd złożoności i pochodzenia kodu (opcjonalnie)
Jeśli uruchomiono narzędzie Lakebridge Analyzer, przekaż dane wyjściowe JSON do projektu, aby przejrzeć złożoność kodu i pochodzenie kodu. Kliknij plik źródłowy, aby otworzyć ocenę złożoności, a następnie kliknij Lineage, aby otworzyć wykres zależności pokazujący pliki i tabele powiązane zależnościami, które należy migrować razem. Aby uzyskać instrukcje dotyczące uruchamiania analizatora, zobacz Przewodnik po analizatorze Lakebridge.
Krok 5. Uruchamianie konwersji
Wybierz pliki do przekonwertowania, a następnie kliknij przycisk Uruchom. Kod Genie otwiera konwersację, wywołuje umiejętności migracji i wdraża subagenty w celu jednoczesnego konwertowania plików. Każdy przekonwertowany plik jest wyświetlany jako połączony plik w projekcie. Konwerter oznacza każdy plik odpowiednim statusem:
- Zielony: pomyślnie przekonwertowano
- Żółty: wymaga przeglądu
- Czerwony: Konwersja nie powiodła się
- Szary: w toku
Krok 6. Przeglądanie wyników konwersji
Kliknij przekonwertowany plik, aby otworzyć w edytorze SQL widok różnic obok siebie, z kodem źródłowym obok proponowanego kodu Databricks SQL. Zaakceptuj wszystkie sugerowane zmiany lub przejrzyj i zaakceptuj poszczególne zmiany. W przypadku skryptów, które nie mogą dokonać konwersji, zmodyfikuj kod w edytorze lub poproś kod Genie o ponowne zweryfikowanie lub ponowienie próby określonych sekcji. Po spełnieniu tego celu uruchom przekonwertowany kod SQL w notesie lub edytorze SQL, aby upewnić się, że działa on na Azure Databricks.
Tworzenie niestandardowej umiejętności (opcjonalnie)
Niestandardowe umiejętności umożliwiają kodowanie reguł biznesowych, które Genie Code automatycznie stosuje podczas każdej konwersji. Służy do obsługi zastrzeżonych typów danych, wymuszania preferowanych wzorców docelowych lub przechwytywania poprawek, które są wykonywane wielokrotnie. Umiejętność migracji jest umiejętnością Genie Code, dzięki czemu możesz tworzyć i zarządzać nią w taki sam sposób, jak w przypadku każdej innej umiejętności. Aby uzyskać więcej informacji, zobacz Extend Genie Code with agent skills (Rozszerzanie kodu Genie za pomocą umiejętności agenta).
Możesz utworzyć umiejętności na podstawie ustawień kodu Genie lub konwersacji z kodem Genie. Użyj ścieżki ustawień, aby uzyskać złożone umiejętności, które zawierają szczegółowe instrukcje, przykłady lub pliki pomocnicze. Użyj trybu czatu w przypadku szybkich umiejętności opartych na jednej regule.
Ustawienia kodu Genie
Utwórz umiejętność w postaci pliku, aby móc opracowywać szczegółowe instrukcje i wersjonować ją w folderze Git:
W panelu Genie Code kliknij
Ustawienia, a następnie kliknij
Otwórz folder skills.
Utwórz folder dla swojej umiejętności w ścieżce umiejętności obszaru roboczego.
Workspace/.assistant/skills/Na przykładWorkspace/.assistant/skills/sql-migration/.W folderze umiejętności utwórz
SKILL.mdplik z wymaganym frontmatterem i regułami konwersji. Przykład:--- name: sql-migration description: Conversion rules to apply when migrating legacy SQL to ANSI SQL. --- Always convert the custom type MYDATE to TIMESTAMP_NTZ.
Genie Code uwzględnia tę umiejętność przy następnym uruchomieniu konwersji.
Czat z kodem Genie
Opisz regułę konwersji, którą chcesz zakodować, a następnie poproś kod Genie o zapisanie go:
Wskazówka
Always convert our custom type MYDATE to TIMESTAMP_NTZ. Save this as a custom migration skill.
Aplikacja Genie Code tworzy i rejestruje umiejętności i stosuje je w przypadku przyszłych konwersji w obszarze roboczym.
Aby wyświetlić aktywne umiejętności:
Wskazówka
Show me my migration skills
Aby usunąć umiejętność:
Wskazówka
Delete the migration skill for [description]
Umiejętności obszaru roboczego są przechowywane na poziomie obszaru roboczego i udostępniane wszystkim użytkownikom w obszarze roboczym.
Porady dotyczące testowania
W ramach pętli agenta konwerter analizuje każdy skrypt źródłowy, sprawdza, czy przekonwertowane dane wyjściowe są składniowo prawidłowe i semantycznie równoważne źródle, a iteracyjne naprawia sekcje, które kończą się niepowodzeniem przed zapisaniem wyników. Poniższe porady ułatwiają przeglądanie i uzyskiwanie zaufania do danych wyjściowych:
- Konwersja wsadowa: Przekonwertuj niewielką partię od dwóch do pięciu plików w jednej sesji, aby sprawdzić, czy konwersja wielu plików działa poprawnie od początku do końca.
- Walidacja składni: po konwersji uruchom dane wyjściowe w edytorze SQL usługi Databricks lub notesie, aby potwierdzić, że działa bez błędów.
-
Przypadki brzegowe: Dołącz skrypt z konstrukcjami specyficznymi dla dialektu, takimi jak funkcje okna w T-SQL, Snowflake
QUALIFYlub RedshiftLISTAGG, aby zobaczyć, jak konwerter radzi sobie z nietrywialnymi wzorcami. - Poprawność semantyczna: uruchom oryginalne i przekonwertowane zapytania względem równoważnych danych testowych i porównaj wyniki. Upewnij się, że dane wyjściowe są semantycznie poprawne, a nie tylko prawidłowe składniowo.