Remarque
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de vous connecter ou de modifier des répertoires.
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de modifier des répertoires.
Dans ce démarrage rapide, vous utilisez trois moteurs Fabric pour interagir avec la même table de la maison du lac. D’abord, vous interrogez la table en utilisant le point de terminaison SQL analytics. Ensuite, vous construisez un rapport Power BI en mode Direct Lake sur cette même table. Enfin, vous lisez la même table depuis un notebook Spark. Ensemble, ces étapes montrent le motif central de OneLake : une copie des données, plusieurs moteurs.
OneLake stocke les données tabulaires au format Delta Parquet ouvert au-dessus d’Azure Data Lake Storage (ADLS) Gen2. Cette base partagée permet à différents moteurs Fabric de travailler avec les mêmes données sans avoir à les déplacer ou à les reformater pour chaque expérience. Les outils et services qui prennent en charge ADLS Gen2, tels que Azure Databricks, Azure Synapse Analytics, et des applications personnalisées, peuvent également accéder aux mêmes données depuis l’extérieur de Fabric.
Prerequisites
- Une licence Fabric. Vous pouvez également vous inscrire à un essai gratuit Fabric.
- Un espace de travail Fabric avec une capacité attribuée.
- Une maison au lac contenant le
dim_productstableau du précédent démarrage rapide, Démarrage rapide : Intégrer les données dans OneLake.
Interrogez la table à l’aide du point de terminaison d’analytique SQL
Chaque lakehouse dispose automatiquement d’un point de terminaison d’analytique SQL. Le point de terminaison lit directement depuis les tables Delta dans OneLake, vous pouvez donc lancer des requêtes T-SQL sur vos données Lakehouse sans les copier dans un magasin SQL séparé.
Dans le portail Fabric, ouvrez l’espace de travail contenant votre maison lacustre et sélectionnez la maison du lac.
Dans le coin supérieur droit du lakehouse, sélectionnez Analyser les données avec>le point de terminaison d’analytique SQL dans la liste déroulante pour basculer vers le point de terminaison d’analytique SQL du même élément.
Dans le menu endpoint SQL analytics, sélectionnez Nouvelle requête SQL.
Dans l’éditeur de requêtes, exécutez la requête suivante sur la
dim_productstable :Cette requête regroupe par catégorie et sous-catégorie pour afficher le nombre de produits et le prix moyen.
SELECT category, subcategory, COUNT(*) AS products, ROUND(AVG(standard_price), 2) AS avg_price FROM ( SELECT product_id, category, subcategory, standard_price, ROW_NUMBER() OVER ( PARTITION BY product_id ORDER BY from_date DESC ) AS rn FROM dbo.dim_products ) latest WHERE rn = 1 GROUP BY category, subcategory ORDER BY avg_price DESC;Examinez les résultats dans le panneau de sortie de requête.
Vous interrogiez la table sans la déplacer ni la dupliquer. Le terminau d’analyse SQL lisait les mêmes fichiers Delta dans OneLake que le lakehouse.
Créer un rapport Power BI en mode Direct Lake
Direct Lake est un mode de stockage Power BI qui lit les tables Delta de OneLake, ce qui permet à un modèle sémantique de servir des rapports sans importer ni dupliquer les données. Direct Lake propose deux modes qui lisent tous deux les données de OneLake : Direct Lake sur OneLake et Direct Lake sur SQL. Ils diffèrent dans la manière dont le modèle sémantique découvre les tables et applique les permissions. Comme ce démarrage rapide part du point de terminaison SQL analytics, le flux crée un Direct Lake sur un modèle sémantique SQL .
Dans cette section, vous construisez un modèle sémantique et un rapport simple sur la même dim_products table.
La vue du rapport montre le prix moyen du produit par category, chaque barre étant divisée par subcategory.
Dans le menu endpoint SQL analytics, sélectionnez Nouveau modèle sémantique.
Entrez un nom pour le modèle sémantique, comme
dim_products_model. Sélectionnez ledim_productstableau, puis sélectionnez Confirmer.Dans le menu du modèle sémantique, sélectionnez Nouveau rapport.
Dans l’interface de création de rapports, développez la table
dim_productsdans le volet Données.Dans le panneau Visualisations , sélectionnez Graphique à colonnes empilés.
Faites glisser
categorysur l’axe X.Faites glisser
standard_pricevers l’axe Y, puis réglez l’agrégation sur Moyenne.Glissez
subcategoryjusqu’à Légende pour diviser chaque catégorie en sous-catégories.
Sur le ruban, sélectionnez Sauvegarder des fichiers> et enregistrez le rapport dans votre espace de travail.
Le rapport lit les données de la même table Delta dans OneLake que vous venez d’interroger avec T-SQL. Vous n’avez pas créé une seconde copie des données pour alimenter le rapport.
Lisez le même tableau depuis un carnet Spark
Les notebooks Fabric offrent un troisième moteur pour les mêmes données. Spark lit la dim_products table Delta directement depuis OneLake, sans passer par le point d’accès SQL Analytics ni le modèle sémantique. Cette étape montre qu’un moteur avec une pile de requêtes complètement différente fonctionne à partir des mêmes fichiers sous-jacents.
Retournez à la maison du lac qui contient
dim_products.Dans le menu du lakehouse, sélectionnez Analyser des données avec>Notebook>Nouveau notebook. Le carnet s’ouvre avec ta maison sur le lac déjà attachée comme maison par défaut.
Dans la première cellule de code, collez le code PySpark suivant :
Ce code utilise
from_datecomme dimension temporelle et résume le nombre de produits ainsi que le prix moyen par période et catégorie.from pyspark.sql import functions as F df = spark.read.table("dim_products") summary = ( df.groupBy("from_date", "category") .agg( F.count("*").alias("products"), F.round(F.avg("standard_price"), 2).alias("avg_price"), ) .orderBy(F.col("from_date"), F.col("avg_price").desc()) ) display(summary)Sélectionnez Exécuter la cellule (ou appuyez sur Majus+Entrée) pour exécuter la cellule. Le résultat montre comment les prix moyens diffèrent selon les catégories selon les dates d’effet.
Spark lit directement les fichiers Delta dans OneLake. Aucune donnée n’est copiée dans un stockage propre à Spark, et la table que vous avez interrogée est la même que celle qui sous-tend votre modèle sémantique. Vous disposez désormais d’une copie des données dans OneLake que trois moteurs — le point de terminaison d’analyse SQL, Power BI Direct Lake et Spark — utilisent via un stockage ouvert et un format de table ouverte, sans déplacer ni reformater les données.
Nettoyer les ressources
Si vous ne prévoyez pas de continuer à utiliser le modèle sémantique, le rapport et le carnet, supprimez-les de votre espace de travail :
- Dans votre espace de travail, survolez le modèle sémantique que vous avez créé et sélectionnez le menu plus d’options (...), puis sélectionnez Supprimer.
- Répétez pour le rapport et le carnet dans votre espace de travail.
La suppression du rapport, du modèle sémantique ou du notebook n’affecte pas le lakehouse et la table dim_products sous-jacents.