Recomanacions per optimitzar el rendiment de les dades

S'aplica a aquesta Power Platform recomanació de la llista de verificació d'eficiència del rendiment ben arquitectada:

PE:08 Optimitzeu el rendiment de les dades. Optimitzeu els magatzems de dades per a l'ús previst i real en la càrrega de treball.

Aquesta guia descriu les recomanacions per optimitzar el rendiment de les dades. L'optimització del rendiment de les dades consisteix a refinar l'eficiència amb què la càrrega de treball processa i emmagatzema dades. Cada operació, transacció o càlcul de càrrega de treball normalment es basa en la recuperació, el processament i l'emmagatzematge ràpids i precisos de dades. Quan s'optimitza el rendiment de les dades, la càrrega de treball funciona sense problemes. El rendiment de les dades compromès crea un efecte dòmino d'eficiència de rendiment deficient. Si no s'optimitza el rendiment de les dades, es produeixen retards en la resposta, una major latència i una escalabilitat reduïda. Posa en perill l'eficiència de tota la càrrega de treball.

Definicions

Terme Definició
Magatzem de dades Un recurs que emmagatzema dades com ara una base de dades, un magatzem d'objectes o un recurs compartit de fitxers.
Índex Estructura de base de dades que proporciona accés ràpid als elements.
Processament analític en línia (OLAP) Una tecnologia que organitza grans bases de dades empresarials, admet anàlisis complexes i realitza consultes analítiques complexes sense afectar negativament els sistemes transaccionals.
Processament de transaccions en línia (OLTP) Una tecnologia que registra les interaccions empresarials a mesura que es produeixen en les operacions diàries d'una organització.
Partició El procés de dividir físicament les dades en magatzems de dades separats.
Ajust de consultes Un procés que optimitza la velocitat d'una consulta a la base de dades.

Estratègies clau de disseny

Per optimitzar l'ús de dades, assegureu-vos que els magatzems de dades estiguin optimitzats per a l'ús previst i per al seu ús real en una càrrega de treball. L'ús optimitzat de dades pot millorar el rendiment de les consultes, reduir el consum de recursos i millorar l'eficiència general del sistema. Penseu en les estratègies següents:

  • Dades de perfil. Entengueu les vostres dades i assegureu-vos que el vostre model de dades sigui adequat per a la vostra càrrega de treball. Considereu factors com ara la normalització de dades i les tècniques de partició. Per a una recuperació eficient de les dades, assegureu-vos de seleccionar els tipus de dades adequats i definir les relacions entre taules.

  • Optimitzeu el rendiment de les consultes. Analitzeu i optimitzeu les consultes que s'executen a la càrrega de treball. Utilitzeu tècniques com l'optimització de consultes i la memòria cau. Utilitzeu visualitzacions del servidor per filtrar prèviament les dades. Per identificar colls d'ampolla, utilitzeu eines de monitorització del rendiment i després feu les millores necessàries.

  • Superviseu i ajusteu regularment el sistema. Superviseu contínuament el rendiment de la vostra càrrega de treball i itereu en la configuració de l'emmagatzematge de dades i les optimitzacions de consultes. Basant-se en les millors pràctiques d'ajust del rendiment, analitzeu les mètriques del sistema, identifiqueu àrees de millora i implementeu canvis. A mesura que les dades creixen, és possible que hàgiu d'actualitzar les vostres consultes per mantenir el rendiment.

Dades del perfil

El perfil de dades implica examinar les dades d'una font i recopilar informació sobre elles. L'objectiu és entendre la qualitat, l'estructura i les característiques de les dades de càrrega de treball. Aquest procés permet identificar problemes com ara valors que falten, duplicats, formats inconsistents i altres anomalies.

Per a un perfil de dades eficaç, considereu les estratègies següents:

  • Entendre l'estructura de dades. Examineu l'estructura de les dades, incloses les taules, les columnes i les relacions. Determineu els tipus de dades, les longituds i les restriccions que s'apliquen a cada columna. L'avaluació de l'estructura de dades us ajuda a entendre com s'organitzen les dades i com es relacionen amb altres elements de dades.

  • Analitzeu el volum de dades. Avalueu el volum de dades per entendre la mida general i els patrons de creixement. Determineu el nombre de registres o documents i la mida de les taules o col·leccions individuals. Aquesta informació us ajuda a estimar els requisits d'emmagatzematge i identificar problemes d'escalabilitat.

  • Identifiqueu les relacions de dades. Exploreu les relacions entre els elements de dades. Entendre com es connecten les dades, de manera que pugueu determinar com els canvis en una taula o document poden afectar les dades relacionades.

  • Avaluar la qualitat de les dades. Avalueu la qualitat de les vostres dades examinant factors com ara la integritat, la precisió, la coherència i la singularitat. Identifiqueu anomalies de dades, valors que falten o registres duplicats que puguin afectar la integritat de les dades i el rendiment de les consultes. Aquest pas us ajuda a identificar àrees de neteja i millora de dades.

  • Captura la distribució de dades. Analitzeu la distribució de valors dins de cada columna per determinar patrons de dades. Identifiqueu valors freqüents i rars, valors atípics i esbiaixos de dades. Per optimitzar el rendiment de les consultes, analitzeu si les claus alternatives serien adequades per millorar el rendiment.

Supervisar el rendiment de les dades

La supervisió del rendiment de les dades és la pràctica de fer un seguiment constant de l'eficiència dels magatzems de dades. Implica recopilar i analitzar mètriques de rendiment específiques de les operacions de dades, utilitzant eines adaptades per a solucions de monitorització a nivell de sistema, específiques de bases de dades o de tercers. El monitoratge eficaç del rendiment de les dades us permet identificar i mitigar de manera proactiva els possibles colls d'ampolla, assegurant que els processos i les tasques relacionades amb les dades siguin eficients.

Per supervisar el rendiment de les dades, considereu les estratègies següents:

  • Recolliu mètriques específiques de dades. Recolliu mètriques clau relacionades directament amb el rendiment de les dades. Aquestes mètriques inclouen els temps de resposta de les consultes i el rendiment de dades.

  • Configureualertes de dades. Configureu alertes específiques per a les mètriques de dades. Utilitzeu llindars o anomalies predefinits en aquestes mètriques per activar alertes. Les alertes us permeten rebre notificacions quan les mètriques de rendiment superen els intervals acceptables o mostren un comportament anormal. Per exemple, si una consulta a la base de dades triga més del previst o si el rendiment de les dades disminueix significativament. Podeu configurar aquestes alertes mitjançant eines de supervisió especialitzades o scripts personalitzats.

  • Diagnostiqueu problemes de rendiment de dades. Reviseu periòdicament les mètriques de dades recollides per identificar possibles colls d'ampolla de rendiment o degradació en les operacions de dades. Les eines de visualització o taulers poden ser molt valuosos en aquest procés, ajudant a ressaltar tendències, colls d'ampolla i valors atípics en el rendiment de les dades. Un cop identificats, investigueu les causes fonamentals d'aquests problemes i planifiqueu els passos de correcció adequats.

Dades de partició

La partició implica dividir grans conjunts de dades o càrregues de treball de gran volum en subconjunts més petits i manejables. La partició millora l'eficiència del rendiment de les dades distribuint la càrrega de treball i millorant el processament paral·lel. També garanteix un accés més eficaç a les dades en funció de necessitats específiques i patrons de consulta. Podeu particionar les dades verticalment o horitzontalment (també anomenat fragmentació). Per exemple, si utilitzeu Dataverse taules elàstiques, considereu quina hauria de ser la clau de partició.

Estratègia Definició Exemple Casos d'ús
Partició vertical Dividiu una taula en taules més petites seleccionant columnes o camps específics per a cada partició. Cada partició representa un subconjunt de les dades completes. Si teniu una taula amb columnes A, B, C i D, podeu crear una taula amb columnes A i B i una altra amb columnes C i D. - Una taula conté moltes columnes, però les consultes no accedeixen a totes les columnes juntes.
- Algunes columnes són més grans que d'altres i separar-les pot augmentar el rendiment d'E/S.
- Les diferents parts de dades tenen patrons d'accés diversos.
Partició horitzontal Dividiu les dades en funció de files o intervals de valors (també coneguts com a fragmentació). Cada partició conté un subconjunt de files amb característiques similars. Si teniu una taula amb les files 1 a 1000, podeu crear una partició amb les files 1 a 500 i una altra amb les files 501 a 1000. - Un conjunt de dades és massa gran per a una sola ubicació o servidor.
- S'accedeix a les dades en funció d'intervals o filtres específics.
- Cal distribuir la càrrega de treball entre nodes físics o servidors per millorar el rendiment.

Per particionar les dades, tingueu en compte els passos següents:

  • Analitza dades i consultes. Analitzeu les dades i els patrons de consulta per identificar estratègies adequades de partició o fragmentació. Comprendre la naturalesa de les dades, els patrons d'accés i els requisits de distribució.

  • Determineu una clau. Trieu una clau de partició o partició per distribuir les dades entre particions o fragments. Seleccioneu acuradament la clau en funció de les característiques de les dades i els requisits de consulta.

  • Determineu la lògica. Determineu una lògica de partició o fragmentació en funció de la clau escollida. Penseu en dividir les dades en intervals, aplicar algorismes de hash o utilitzar altres tècniques de particionament.

Optimitzar les consultes

L'optimització de les consultes refina les consultes per reduir les dades que compleixen els requisits i les dades retornades. Aquests ajustos augmenten l'eficiència i la velocitat de recuperació de dades. Com a resultat, la base de dades té una càrrega de treball més lleugera, els recursos funcionen de manera més eficaç i els usuaris gaudeixen d'interaccions més fluides.

Per optimitzar les consultes de la base de dades, tingueu en compte les estratègies següents:

  • Reescriure les consultes. Revisar i analitzar consultes complexes per identificar oportunitats per reescriure-les. Penseu en reestructurar la lògica de consulta, eliminar operacions redundants o simplificar la sintaxi de la consulta.

  • Eviteu el problema de consulta N+1. Minimitzeu el nombre d'anades i tornades a la base de dades mitjançant l'ús d'unions i la recuperació per lots per recuperar dades relacionades de manera eficient.

  • Reordena les unions. Avalueu i considereu reorganitzar l'ordre d'unió per minimitzar el nombre de files en cada operació d'unió. L'ordre en què uniu les taules pot afectar el rendiment de la consulta.

  • Consultes de memòria cau. Emmagatzemeu els resultats de les consultes que s'executen amb freqüència per reutilitzar-los fàcilment. La memòria cau de consultes elimina la necessitat d'executar la mateixa consulta repetidament i redueix la sobrecàrrega de processament de consultes.

  • Monitoritzar i sintonitzar. Superviseu les mètriques de rendiment de les consultes, com ara el temps d'execució, la utilització de recursos i el rendiment de les consultes. Utilitzeu eines de creació de perfils de bases de dades i funcionalitats de supervisió per identificar consultes amb un rendiment baix. Utilitzeu aquesta informació per optimitzar el rendiment de les consultes.

Arxivar i depurar les dades

Arxivar i depurar són estratègies que racionalitza l'emmagatzematge de dades. L'arxiu trasllada les dades més antigues i a les quals s'accedeix amb menys freqüència a un emmagatzematge més rendible. La depuració de dades elimina permanentment les dades redundants. Tots dos mètodes contribueixen a l'eficiència del rendiment reduint el volum de dades, augmentant la velocitat d'accés a les dades i reduint els temps de còpia de seguretat i recuperació.

  • Reducció del volum de dades: menys dades significa temps de processament més ràpids, garantint respostes ràpides a les sol·licituds dels usuaris.
  • Augment de la velocitat d'accés a les dades: un conjunt de dades retallat permet fer consultes i recuperar dades més ràpides, optimitzant la capacitat de resposta del sistema.
  • Reducció dels temps de còpia de seguretat i recuperació: els conjunts de dades més petits acceleren els processos de còpia de seguretat i restauració, minimitzant el temps d'inactivitat i garantint un rendiment coherent.

L'arxiu i la purga són fonamentals per mantenir l'eficiència del rendiment màxim en sistemes basats en dades.

Optimitzar la càrrega d'emmagatzematge

Optimitzar la càrrega d'emmagatzematge significa racionalitzar les sol·licituds al sistema d'emmagatzematge. Ajuda a eliminar les sol·licituds innecessàries, millora la recuperació de dades i evita aclaparar el sistema d'emmagatzematge. L'optimització de la càrrega d'emmagatzematge garanteix que el sistema d'emmagatzematge segueix sent sensible a les sol·licituds legítimes i manté un rendiment màxim. Implementeu estratègies per reduir la càrrega de processament del magatzem de dades. Per optimitzar la càrrega magatzem de dades, tingueu en compte les estratègies següents.

Utilitzeu la memòria cau

L'emmagatzematge en memòria cau emmagatzema les dades a les quals s'accedeix habitualment en una àrea d'emmagatzematge d'accés ràpid, cosa que fa que la recuperació de dades sigui més ràpida que extreure-les de la font principal. Aquesta tècnica augmenta el rendiment de les dades reduint els temps d'accés i evitant les recuperacions repetitives de dades. L'emmagatzematge a la memòria cau millora les velocitats de lectura i els temps de l'usuari resposta, especialment per a les dades d'accés freqüent. Aquest mètode és més eficaç amb dades estàtiques o dades que rarament canvien.

Per garantir una eficiència òptima de la memòria cau, tingueu en compte factors com ara les polítiques de caducitat, les estratègies de desallotjament i la gestió de la mida de la memòria cau. Ajusteu la configuració, com ara el temps de vida (TTL), per obtenir un rendiment òptim. Per utilitzar una memòria cau per optimitzar la càrrega d'emmagatzematge, tingueu en compte les estratègies següents:

  • Emmagatzematge en memòria cau a la memòria: realitzeu l'emmagatzematge en memòria cau a la memòria per emmagatzemar les dades a les quals s'accedeix amb freqüència a la memòria per a una recuperació ràpida. Podeu utilitzar aquesta tècnica per a dades d'aplicacions que són costoses de calcular o recuperar d'una base de dades. L'emmagatzematge a la memòria cau és útil per a dades que llegiu amb freqüència però que no canvien amb freqüència. Per exemple, podeu utilitzar variables en fluxos de núvol o col·leccions en aplicacions de llenç per emmagatzemar dades a la memòria cau.

  • Emmagatzematge a la memòria cau de consultes a la base de dades: utilitzeu aquesta tècnica per emmagatzemar a la memòria cau els resultats de les consultes a la base de dades per evitar executar la mateixa consulta diverses vegades. La memòria cau de consultes a la base de dades és útil per a consultes de bases de dades complexes i que requereixen temps. Quan emmagatzemeu a la memòria cau els resultats d'una consulta, les sol·licituds posteriors per a la mateixa consulta es retornen ràpidament. Penseu també en utilitzar vistes del costat del servidor sempre que sigui possible per filtrar prèviament les dades per reduir les dades rellevants per a la vostra consulta.

  • Emmagatzematge en memòria cau a la xarxa de lliurament de contingut: utilitzeu aquesta tècnica per emmagatzemar contingut web a la memòria cau en servidors de xarxa distribuïts per reduir la latència i millorar l'entrega de contingut. La memòria cau a la xarxa de lliurament de contingut és eficaç per al contingut estàtic, com ara imatges, CSS arxius i JavaScript. Les xarxes de lliurament de contingut emmagatzemen còpies del contingut en diverses ubicacions del món, de manera que els usuaris puguin accedir al contingut des d'un servidor geogràficament proper.

Optimitzar les actualitzacions de dades

L'optimització de les actualitzacions de dades implica avaluar les actualitzacions de dades que es realitzen per garantir que funcionin. Les actualitzacions poden afectar el rendiment més que altres operacions perquè poden desencadenar treballs innecessaris i provocar conflictes de bloqueig.

Per avaluar com optimitzar les actualitzacions de dades, tingueu en compte:

  • Canvis de dades. Optimitzeu l'automatització per utilitzar imatges prèvies de les dades o filtres per minimitzar el treball quan no s'ha produït cap canvi real. Eviteu activar l'automatització de dades no modificades.

  • Automatització. Avalueu quan i com s'activen les actualitzacions en funció dels canvis de dades i optimitzeu els activadors per incloure un filtre. Per exemple, per activar l'automatització només quan es modifica un camp específic a font de dades. Avalueu les actualitzacions que desencadenen automatitzacions de manera incremental diverses vegades. En comptes d'això, considereu si podeu crear una operació personalitzada per gestionar tot el processament. Per exemple, si s'envia una comanda i la data d'enviament i el número de seguiment s'actualitzen per separat, es podrien actualitzar tots dos alhora en una operació personalitzada "ShipOrder".

  • Bloquejos. Avalueu les operacions d'actualització lentes que poden estar causant problemes a causa de diversos fluxos que actualitzen les mateixes dades en diferents seqüències. Aquesta ineficiència pot conduir a conflictes de bloqueig o fins i tot a possibles bloquejos, donant lloc a una reelaboració innecessària. Actualitzeu els diferents recursos en la mateixa seqüència per minimitzar la contenció.

  • Actualitzacions massives. Si executeu operacions en diverses files d'una taula, considereu l'ús operacions a granel.

Optimitzar el moviment i el processament de dades

Optimitzar el moviment i el processament de dades implica millorar l'eficiència i el rendiment de les operacions relacionades amb l'extracció, transformació, càrrega i processament de dades. Tingueu en compte els aspectes clau següents per optimitzar el moviment i el processament de dades:

  • Optimització d'extracció, transformació i càrrega (ETL). : Optimitzeu els processos ETL per minimitzar el temps de processament. Podeu agilitzar el procés d'extracció, implementar algorismes de transformació eficients i optimitzar el procés de càrrega. Quan feu que cada pas sigui eficient, optimitzeu el flux de treball global.

  • Processament paral·lel : Utilitzeu tècniques de processament paral·lel per millorar el rendiment. Quan distribuïu tasques de processament de dades entre diversos fils o nodes, podeu dividir i processar la càrrega de treball simultàniament, la qual cosa resulta en un processament ràpid.

  • Processament per lots : Agrupeu tasques similars per reduir les despeses generals causades per operacions repetides. Processa diverses tasques en un lot per reduir el temps de processament global.

Disseny per a la proximitat de dades

La proximitat de dades fa referència a la col·locació estratègica de les dades més a prop dels usuaris o serveis que hi accedeixen amb més freqüència. La reducció de la distància física o lògica entre les dades i els seus usuaris garanteix un accés més ràpid a les dades i una millor capacitat de resposta. Per optimitzar el disseny per a la proximitat, tingueu en compte aquestes estratègies:

  • Avaluar els patrons d'accés a les dades : avalueu els patrons d'accés de la vostra càrrega de treball i les dades d'accés freqüent. Aquesta anàlisi pot ajudar a determinar on col·locar les dades per obtenir el màxim benefici.

  • Trieu solucions que admetin la reubicació de dades: considereu solucions que ofereixin una reubicació dinàmica de dades basada en patrons d'accés canviants, garantint un posicionament òptim de les dades.

  • Trieu solucions que admetin la sincronització de dades: si doneu servei a una base d'usuaris distribuïda, trieu solucions que permetin la sincronització de dades entre les diferents regions, per assegurar-vos que les rèpliques de dades estiguin disponibles a prop dels usuaris.

Compensació: si les dades subjacents canvien amb freqüència, implementeu un mecanisme de validació de la memòria cau per assegurar-vos que les dades emmagatzemades a la memòria cau es mantinguin actualitzades.

Power Platform facilitació

Supervisar el rendiment de les dades: per supervisar el rendiment de les dades, considereu utilitzar Azure Monitor per recopilar i analitzar mètriques, registres i dades d'aplicacions d'infraestructura. Podeu integrar Monitor amb altres serveis com Application Insights. Application Insights proporciona monitorització del rendiment de l'aplicació i admet moltes plataformes.

Application Insights recull dades d'ús i rendiment. Podeu utilitzar el Log Analytics per correlacionar aquestes dades amb les dades de configuració i rendiment dels recursos Azure. Actualment, el Application Insights flux de dades for Dataverse proporciona dades de rendiment relacionades amb les trucades entrants de l'API, Dataverse les Dataverse trucades d'execució de complements i Dataverse les trucades SDK.

Optimitzar els patrons de dades de consulta a les aplicacions de llenç: Seguiu les instruccions i els suggeriments documentats. Vegeu Patrons de dades de consulta optimitzats a Power Apps.

Optimitzeu la personalització, l'ampliació o la integració Dataverse:Seguiu les pràctiques recomanades i les directrius documentades. Vegeu Pràctiques recomanades i orientacions per utilitzar-lo Microsoft Dataverse.

Optimitzar les consultes de la base de dades i el rendiment de l'índex: utilitzeu la característica d'informació sobre el rendiment de les consultes de Azure SQL Database per optimitzar consultes, taules i bases de dades. També podeu utilitzar aquesta característica per identificar i solucionar problemes de rendiment de les consultes.

Per a les bases de dades relacionals, seguiu les directrius de disseny d'índexs, les directrius SQL d'índex del servidor i les directrius Azure Cosmos DB d'índex. Utilitzeu SQL Base de dades per dur a terme l'ajust automàtic de les consultes per millorar-ne el rendiment.

Per a les bases de dades SQL, hauríeu de reorganitzar o reconstruir regularment els índexs. Identifiqueu les consultes lentes i ajusteu-les per millorar el rendiment. Molts motors de bases de dades tenen característiques d'ajust de consultes. Per obtenir més informació, consulteu les pràctiques recomanades per al rendiment deles consultes.

Azure Cosmos DB té una política d'indexació predeterminada que indexa totes les propietats de cada element i aplica índexs d'interval per a qualsevol cadena o número. Aquesta norma us proporciona un rendiment eficient de les consultes i no cal que administreu els índexs amb antelació.

Optimitzeu la càrrega d'emmagatzematge: molts serveis de bases de dades Azure admeten rèpliques de lectura. La disponibilitat i la configuració de les rèpliques de lectura varien en funció del servei de base de dades Azure. Consulteu la documentació oficial de cada servei per entendre els detalls i les opcions.

Llista de verificació d'eficiència de rendiment

Consulteu el conjunt complet de recomanacions.