Remarque
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de vous connecter ou de modifier des répertoires.
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de modifier des répertoires.
Les articles suivants fournissent les meilleures pratiques pour l’ingénierie des données dans Azure Databricks.
- Optimiser les performances de jointure dans Azure Databricks
- Modélisation des données
- Configurer un magasin d’état RocksDB sur Azure Databricks
- Réalisation d’un point de contrôle d’état asynchrone pour des requêtes avec état
- Suivi de progression asynchrone
- Considérations relatives à la production pour Structured Streaming
- Exécuter plusieurs requêtes Structured Streaming sur le même cluster
- Nettoyer et valider des données avec traitement par lot ou de flux
- Observabilité dans Azure Databricks pour les jobs, les pipelines Lakeflow et Lakeflow Connect
- Architecture fan-in et fan-out dans les pipelines Lakeflow
- Meilleures pratiques pour les pipelines Lakeflow
Pour obtenir des liens vers d’autres articles sur les meilleures pratiques, notamment les meilleures pratiques en matière de développement et de flux de travail CI/CD, consultez La meilleure pratique.