Merk
Tilgang til denne siden krever autorisasjon. Du kan prøve å logge på eller endre kataloger.
Tilgang til denne siden krever autorisasjon. Du kan prøve å endre kataloger.
I denne quickstarten bruker du tre Fabric-motorer for å samhandle med det samme innsjøhusbordet. Først spør du tabellen ved å bruke SQL-analyse-endepunktet. Deretter bygger du en Power BI-rapport i Direct Lake-modus over den samme tabellen. Til slutt leser du den samme tabellen fra en Spark-notatbok. Sammen viser disse stegene kjernen i OneLake: én kopi av data, flere motorer.
OneLake lagrer tabulære data i åpen Delta Parquet-format oppå Azure Data Lake Storage (ADLS) Gen2. Det delte fundamentet lar ulike Fabric-motorer jobbe med de samme dataene uten å måtte flytte eller formatere dem for hver opplevelse. Verktøy og tjenester som støtter ADLS Gen2, som Azure Databricks, Azure Synapse Analytics og tilpassede applikasjoner, kan også nå de samme dataene utenfor Fabric.
Forutsetninger
- En Fabric lisens. Eller meld deg på en gratis Fabric prøveperiode.
- Et Fabric-arbeidsområde med tildelt kapasitet.
- Et innsjøhus som inneholder
dim_productstabellen fra forrige quickstart, Quickstart: Få data inn i OneLake.
Søk i tabellen ved å bruke SQL analytics-endepunktet
Hver lakehouse får automatisk et SQL-analyseendepunkt. Endepunktet leser direkte fra Delta-tabellene i OneLake, så du kan kjøre T-SQL-spørringer mot lakehouse-dataene dine uten å kopiere dem til en separat SQL-lagring.
I Fabric-portalen åpner du arbeidsområdet som inneholder innsjøhuset ditt og velger innsjøhuset.
I øvre høyre hjørne av lakehouse, velg Analyser data med>SQL-analyseendepunkt fra nedtrekksmenyen for å bytte til SQL-analyseendepunktet for samme element.
I SQL-analyse-endepunktmenyen, velg Ny SQL-forespørsel.
I spørringseditoren, kjør følgende spørring mot tabellen
dim_products:Denne spørringen grupperer etter kategori og underkategori for å vise antall produkter og gjennomsnittspris.
SELECT category, subcategory, COUNT(*) AS products, ROUND(AVG(standard_price), 2) AS avg_price FROM ( SELECT product_id, category, subcategory, standard_price, ROW_NUMBER() OVER ( PARTITION BY product_id ORDER BY from_date DESC ) AS rn FROM dbo.dim_products ) latest WHERE rn = 1 GROUP BY category, subcategory ORDER BY avg_price DESC;Gå gjennom resultatene i spørringsutdatapanelet.
Du spurte tabellen uten å flytte eller duplisere den. SQL-analyseendepunktet leste de samme Delta-filene i OneLake som lakehouse bruker.
Bygg en Power BI-rapport i Direct Lake-modus
Direct Lake er en Power BI-lagringsmodus som leser Delta-tabeller fra OneLake, så en semantisk modell kan levere rapporter uten å importere eller duplisere dataene. Direct Lake har to moduser som begge leser data fra OneLake: Direct Lake på OneLake og Direct Lake på SQL. De skiller seg i hvordan den semantiske modellen oppdager tabeller og håndhever tillatelser. Fordi denne hurtigstarten starter fra SQL-analyse-endepunktet, oppretter flyten en Direct Lake på SQL semantisk modell.
I denne delen bygger du en semantisk modell og en enkel rapport over samme dim_products tabell.
Rapportvisningen viser gjennomsnittlig produktpris med category, med hver strek delt på subcategory.
Fra SQL-analyse-endepunktmenyen, velg Ny semantisk modell.
Skriv inn et navn for den semantiske modellen, som
dim_products_model. Velg tabellendim_products, og velg deretter Bekreft.Fra menyen for semantisk modell, velg Ny rapport.
I rapportforfattingsopplevelsen, utvid
dim_productstabellen i Data-panelet .I panelet Visualiseringer , velg Stablet kolonnediagram.
Dra
categorytil X-aksen.Dra
standard_pricetil Y-aksen, og sett deretter aggregeringen til Gjennomsnitt.Dra
subcategorytil Legend for å dele opp hver kategori i underkategorier.
På båndet velger du Fillagring> og lagre rapporten i arbeidsområdet ditt.
Rapporten leses fra den samme Delta-tabellen i OneLake som du nettopp spurte med T-SQL. Du opprettet ikke en andre kopi av dataene for å drive rapporten.
Les den samme tabellen fra en Spark-notatbok
Fabric-notatbøker gir deg en tredje motor over de samme dataene. Spark leser dim_products Delta-tabellen direkte fra OneLake, uten å gå gjennom SQL-analyse-endepunktet eller den semantiske modellen. Dette steget viser at en motor med en helt annen spørringsstabel fungerer fra de samme underliggende filene.
Gå tilbake til hytta ved innsjøen som inneholder
dim_products.I lakehouse-menyen, velg Analyser data med>notatbok>Ny notatbok. Notatboken åpner med at hytta ved innsjøen allerede er tilknyttet som standard hytte.
I den første kodecellen, lim inn følgende PySpark-kode:
Denne koden bruker
from_datesom en tidsdimensjon og oppsummerer antall produkter og gjennomsnittspris etter periode og kategori.from pyspark.sql import functions as F df = spark.read.table("dim_products") summary = ( df.groupBy("from_date", "category") .agg( F.count("*").alias("products"), F.round(F.avg("standard_price"), 2).alias("avg_price"), ) .orderBy(F.col("from_date"), F.col("avg_price").desc()) ) display(summary)Velg Kjør celle (eller trykk Shift+Enter) for å kjøre cellen. Resultatet viser hvordan gjennomsnittsprisene varierer mellom kategorier på ikrafttredelsesdatoer.
Spark leser Delta-filene direkte i OneLake. Ingen data kopieres inn i en Spark-spesifikk butikk, og tabellen du spurte i er den samme som støtter din semantiske modell. Du har nå én kopi av data i OneLake som tre motorer – SQL-analyseendepunktet, Power BI Direct Lake og Spark – bruker gjennom åpen lagring og et åpent tabellformat, uten å flytte eller omformatere dataene.
Fjerning av ressurser
Hvis du ikke planlegger å fortsette å bruke den semantiske modellen, rapporten og notatboken, slett dem fra arbeidsområdet ditt:
- I arbeidsområdet ditt, hold musepekeren over den semantiske modellen du har laget og velg menyen for flere alternativer (...), og velg deretter Slett.
- Gjenta for rapporten og notatboken i arbeidsområdet ditt.
Å slette rapporten, den semantiske modellen eller notatboken påvirker ikke det underliggende lakehouse og dim_products tabellen.