Unity Catalog in Azure Databricks spiegelen

Veel organisaties registreren tegenwoordig hun gegevens in Unity Catalog in Azure Databricks. Met een gespiegelde Unity-catalogus in Fabric kan de klant gegevens lezen die worden beheerd door Unity Catalog vanuit Fabric-workloads. Azure Databricks en Fabric zijn beter samen.

Voor een zelfstudie over het configureren van uw Azure Databricks-werkruimte voor het spiegelen van de Unity-catalogus in Fabric, raadpleegt u zelfstudie: Gespiegelde Databases van Microsoft Fabric configureren vanuit Azure Databricks.

Door Mirroring in Fabric te gebruiken, profiteert u van een sterk geïntegreerd, end-to-end en gebruiksvriendelijk product dat uw analysebehoeften vereenvoudigt en is ontworpen voor openheid en samenwerking tussen Microsoft Fabric en Azure Databricks.

Wanneer u Fabric gebruikt om gegevens te lezen die zijn geregistreerd in Unity Catalog, is er geen gegevensverplaatsing of gegevensreplicatie. Alleen de structuur van de Azure Databricks-catalogus wordt gespiegeld naar Fabric en de onderliggende catalogusdata worden benaderd via snelkoppelingen. Wijzigingen in de onderliggende gegevens worden mogelijk niet onmiddellijk weergegeven in Fabric. Propagatie kan variëren van enkele seconden tot enkele minuten, zoals beschreven in de documentatie over de prestaties van het SQL-analyse-eindpunt.

Welke analyse-ervaringen zijn ingebouwd

Gespiegelde catalogi zijn een item in Fabric Data Warehouse dat verschilt van het eindpunt voor warehouse- en SQL-analyse.

Wanneer u een Azure Databricks Unity Catalog spiegelt, maakt Fabric deze items:

Je kunt op verschillende manieren toegang krijgen tot je gespiegelde Azure Databricks Unity Catalog-gegevens:

  • Elk gespiegeld Azure Databricks-item heeft een automatisch gegenereerd SQL-analyse-eindpunt dat een uitgebreide analytische ervaring biedt die is gemaakt door het spiegelingsproces. Gebruik T-SQL-opdrachten om gegevensobjecten te definiëren en op te vragen vanuit het alleen-lezen SQL-analyse-eindpunt.
  • Gebruik Power BI met de Direct Lake-modus om rapporten te maken voor het Azure Databricks-item.

Synchronisatie van metagegevens

Wanneer je een nieuwe mirror aanmaakt vanuit Azure Databricks in Fabric, is de optie Automatisch toekomstige cataloguswijzigingen synchroniseren voor het geselecteerde schema standaard ingeschakeld. Als je automatische synchronisatie inschakelt, worden de volgende metadatawijzigingen doorgevoerd van je Azure Databricks-werkruimte naar Fabric:

  • Toevoeging van schema's aan een catalogus.
  • Het verwijderen van schema's uit een catalogus.
  • Toevoeging van tabellen aan een schema.
  • Het verwijderen van tabellen uit een schema.

Schema-/tabelselectie:

  • Standaard wordt de hele catalogus geselecteerd wanneer de gebruiker de catalogus toevoegt.
  • De gebruiker kan bepaalde tabellen in het schema uitsluiten.
  • Als u de selectie van een schema opheft, worden ook alle tabellen binnen dat schema gedeselecteerd.
  • Als de gebruiker teruggaat en het schema selecteert, worden alle tabellen in het schema opnieuw geselecteerd.
  • Hetzelfde selectiegedrag is van toepassing op schema's in een catalogus.

Er zijn andere filtratievoorwaarden die worden toegepast op catalogi/schema's/tabellen:

  • Gematerialiseerde weergaven en streamingtabellen worden niet weergegeven.
  • Externe tabellen die geen ondersteuning bieden voor Delta-indeling, worden niet weergegeven.