Rekomendacijos, kaip reaguoti į tiesioginio pasirodymo problemas

Taikoma šiai Power Platform gerai suplanuoto našumo efektyvumo kontrolinio sąrašo rekomendacijai:

PE:09 Atsakykite į gyvo pasirodymo problemas. Suplanuokite, kaip spręsti našumo problemas, įtraukdami aiškias bendravimo ir atsakomybės linijas. Iškilus probleminei situacijai, naudokite tai, ką išmokote, kad nustatytumėte prevencines priemones ir įtrauktumėte jas į savo darbo krūvį. Įgyvendinkite metodus, kad galėtumėte greičiau grįžti prie įprastų operacijų, kai atsiranda panašių situacijų.

Šiame vadove aprašoma geriausia reagavimo į tiesioginio našumo problemas praktika. Tiesioginio pasirodymo problemos susijusios su realaus laiko iššūkiais ir kliūtimis, kurios gali trukdyti optimaliam darbo krūvio veikimui. Operatyvus šių problemų sprendimas ne tik palengvina neatidėliotiną našumo trikdžių aptikimą ir ištaisymą, bet ir užtikrina, kad darbo krūvis nuosekliai atitiktų veiklos rodiklius. Jei jų neišspręsite, gali kilti komplikacijų, įskaitant sulėtėjimą, gedimus ir sistemos nereagavimą, taip pat pablogėti vartotojo patirtis. Jie taip pat gali neleisti vartotojams efektyviai atlikti savo užduočių ir, savo ruožtu, sugadinti organizacijos reputaciją.

Apibrėžtys

Terminas Apibrėžtis
Duomenų koreliacija Žurnalų, metrikos ir įvykių iš įvairių darbo krūvio dalių suderinimas, kad būtų galima tiksliai nustatyti pagrindines priežastis.
Pagrindinės priežasties analizė Procesas, skirtas nustatyti pagrindinius veiksnius, kurie yra atsakingi už problemą.
Savęs gijimas Galimybė automatiškai taisyti problemas be žmogaus įsikišimo.
Saviprevencija Diegimas atsižvelgiant į darbo krūvį, kad būtų išvengta galimų problemų ir gedimų.

Pagrindinės projektavimo strategijos

Kai susiduriate su tiesioginio pasirodymo problema, turite būti pasirengę turėdami tinkamus duomenis ir planą, kaip reaguoti į problemą. Į šį planą turėtų būti įtrauktos aiškios komunikacijos ir atsakomybės linijos. Pagrindinis tikslas yra nustatyti, ar našumo problemos yra laikinos, ar izoliuotos, nustatyti pagrindinę našumo problemos priežastį ir įgyvendinti sprendimus, kurie palengvintų greitą grįžimą prie įprastų operacijų ir suteiktų įžvalgų apie incidentą. Prevencinių priemonių integravimas į jūsų darbo eigą yra pagrindinė strategija. Tikslas yra arba užkirsti kelią tai pačiai problemai pasikartoti, arba sumažinti jos poveikį našumui, jei jos neįmanoma išvengti.

Pasiruošimas problemoms

Idealus atsakas į tiesioginės svetainės našumo problemas yra tikslus ir greitas. Tikslumas ir greitis atliekant ištaisymą reikalauja paruošimo. Norint efektyviai reaguoti į tiesioginio našumo problemas, labai svarbu stebėti pagrindinę našumo metriką, nustatyti pagrindinę problemų priežastį ir įdiegti tinkamus sprendimus ar optimizavimą. Norint atlikti šiuos veiksmus, gali tekti analizuoti darbo krūvio žurnalus, atlikti našumo testavimą ir optimizuoti kodą arba konfigūracijas.

Toliau pateiktuose pavyzdžiuose apibūdinamos kelios svarbios pasirengimo sritys:

  • Turėkite tikslias architektūros diagramas. Jūsų architektūros diagramose turėtų būti visi komponentai ir parodyta, kaip jie sąveikauja. Vizualinis vaizdavimas gali padėti nustatyti kliūtis ir pavienius gedimo taškus, dėl kurių gali pablogėti našumas arba jų gali nebūti. Idealiu atveju jūs sugaunate ir pašalinate šias problemas, kol jos nesukelia problemų, tačiau turėdami naujausią diagramą galite tiksliai nustatyti problemas didelio streso momentais.

  • Patikrinkite prieigą prie duomenų. Stebėjimo procesų duomenys ir žurnalai yra labai svarbūs norint realiuoju laiku reaguoti į našumo problemas ir atlikti pagrindinių priežasčių analizę. Tačiau svarbu išlaikyti duomenų vientisumą ir konfidencialumą. Norint reaguoti į tiesioginės svetainės našumo problemas, dažnai reikia prieigos prie pagrindinių duomenų, kurie paprastai gali būti nepasiekiami. Turite užtikrinti, kad darbuotojai turėtų prieigą prie duomenų, kurių jiems reikia iškilus problemoms. Tačiau turėtumėte suteikti tik ribotą laiką, mažiausiai privilegijų turinčią prieigą ir turėtumėte apriboti šią prieigą įgaliotiems darbuotojams.

  • Nustatykite automatinius įspėjimus. Įspėjimai gali padėti nustatyti ir išspręsti problemas, kai tik jos atsiranda. Įspėjimai turėtų generuoti pranešimus, kai darbo krūvio našumas nukrypsta nuo našumo bazinių linijų. Laikui bėgant turėtumėte pakoreguoti įspėjimų konfigūracijas, kad išvengtumėte per daug ar per mažai pranešimų. Jūsų naudojami stebėjimo sprendimai turi surinkti pakankamai duomenų, kad būtų galima generuoti įspėjimus. Šie įspėjimai turėtų būti suderinti su tiksliniais veiklos rodikliais ir nustatytomis pradinėmis reikšmėmis. Turėtumėte vengti generuoti įspėjimus apie problemas, kurios nėra susijusios su jūsų tikslais. Įspėjimų pavyzdžiai apima atsakymo laiko pablogėjimą, API skambučių ar papildinių našumą Dataverse ir puslapio įkėlimus.

Sukurkite triage planą

Kuriant triage planą, reikia sukurti struktūrizuotą požiūrį, kaip nustatyti, išplėsti, analizuoti, nustatyti prioritetus ir pranešti apie tiesioginės svetainės našumo problemas. Triage planas yra strategija, kaip reaguoti į gyvo pasirodymo problemas. Juo užtikrinama, kad veiklos sutrikimų problemos būtų sprendžiamos greitai ir veiksmingai, nustatant aiškius vaidmenis ir procedūras. Dauguma našumo problemų nėra vertos avarinio atkūrimo protokolų, tačiau jos gali pakankamai paveikti darbo krūvio funkcionalumą, kad būtų reikalingas triažo planavimas. Gerai dokumentuotas triage planas užtikrina, kad visi komandos nariai būtų suderinti ir galėtų veikti greitai, sumažindami poveikį vartotojams ir darbo krūviams. Triage planas turėtų apimti šiuos komponentus:

  • Identifikavimas ir stebėjimas: įdiekite sistemą, skirtą našumo problemoms nustatyti ir stebėti realiuoju laiku. Turėtumėte turėti žmonių, galinčių priimti sprendimus ar eskaluoti problemas į aukštesnį lygį, kontaktinės informacijos sąrašą. Plane taip pat turėtų būti nustatyti vaidmenys ir atsakomybė. Ji turi dokumentuoti, kurios paskyros gauna prieigą prie saugomos informacijos ir kiek laiko.

  • Problemų sprendimo procesas: apibrėžkite aiškų problemų sprendimo procesą, kad užtikrintumėte, jog našumo problemos būtų laiku perduotos atitinkamoms komandoms ar asmenims. Proceso apibrėžimas turėtų apimti kontaktinę informaciją ir gaires, kaip eskaluoti problemas.

  • Pagrindinės priežasties analizė: sukurkite pagrindinės priežasties analizės atlikimo procesą, kad nustatytumėte pagrindinę kiekvienos našumo problemos priežastį. Procesas turėtų apimti žurnalų ir našumo metrikos analizę bei diagnostinių testų atlikimą, siekiant tiksliai nustatyti kiekvienos problemos šaltinį.

  • Prioritetų nustatymas: sukurkite prioritetų nustatymo sistemą, kad nustatytumėte našumo problemų rimtumą ir nustatytumėte jų prioritetus pagal jų poveikį darbo krūviui ir vartotojams.

  • Komunikacija: sukurkite komunikacijos planą, kad suinteresuotosios šalys būtų informuojamos apie veiksmingumo problemų būklę ir jų sprendimo eigą. Apsvarstykite reguliarius naujinimus, būsenos ataskaitas ir aiškius komunikacijos kanalus.

  • Dokumentacija: dokumentuokite triažo planą, įskaitant visus jo veiksmus, procesus ir geriausią praktiką. Šie dokumentai turėtų būti lengvai prieinami komandos nariams, kurie dalyvauja atsakant į našumo problemas.

Sukurti problemų nustatymo ir sprendimo metodus

Norint išspręsti tiesioginio pasirodymo problemas, reikia nustatyti ir pašalinti visus veiksnius, kurie gali sukelti našumo pablogėjimą ar neefektyvumą tiesioginiame darbo krūvyje. Duomenys, kuriuos renkate stebėdami, yra neįkainojami tiriant ir sprendžiant su našumu susijusius incidentus. Šie duomenys pateikia istorinį našumo metrikos įrašą. Kai turite stebėjimo duomenų, galite analizuoti pagrindines priežastis ir nustatyti prisidedančius veiksnius. Turėtumėte naudoti visus susijusius stebėjimo duomenis, kad suprastumėte ir išspręstumėte kiekvieną našumo problemą. Stebėkite, kiek trumpalaikių šuolių aptinkate, ir atitinkamai koreguokite slenksčius.

Naudokite pagrindinės priežasties analizę

Pagrindinės priežasties analizė reikalauja hipotezės testavimo. Peržiūrėję stebėjimo duomenis, turėtumėte išvardyti galimas našumo problemos priežastis ir jas išbandyti.

Norėdami atlikti tiesioginio našumo problemos pagrindinės priežasties analizę, atlikite šiuos veiksmus:

  • Surinkite informaciją. Surinkite kuo daugiau informacijos apie našumo problemą. Pavyzdžiui, klaidų pranešimai, žurnalai, našumo metrika ir visi kiti susiję duomenys. Taip pat įtraukite informacijos apie vartotojus, kurie pranešė apie problemą, pvz., jų įrenginį, tinklą ir vietovę.

  • Apibrėžkite problemą. Aiškiai apibrėžkite problemą nustatydami simptomus ir problemos poveikį darbo krūviui ar vartotojams.

  • Ištirkite galimas priežastis. Susiaurinkite analizės apimtį nustatydami konkretų darbo krūvio komponentą ar sritį, kurioje kyla našumo problema. Remdamiesi surinkta informacija, nustatykite galimas našumo problemos priežastis. Šis procesas gali apimti kodo, konfigūracijos nustatymų, infrastruktūros ar išorinių priklausomybių analizę.

  • Koreliuokite duomenis. Pasinerkite į surinktus duomenis, kad nustatytumėte modelius, anomalijas ar koreliacijas, kurios gali prisidėti prie našumo problemos. Duomenų koreliacija yra labai svarbi nustatant našumo problemas ir priežastis. Tai gali apimti žurnalų peržiūrą, našumo metrikos analizę ir bandymų atlikimą.

  • Patikrinkite hipotezes. Suformuluokite hipotezes pagal galimas priežastis, kurias nustatote. Atlikite testus, kad patvirtintumėte arba paneigtumėte savo hipotezes. Turėtumėte naudoti bandymo aplinką, kad pamatytumėte, ar galite pakartoti klaidą.

  • Įgyvendinkite sprendimus. Nustatę pagrindinę priežastį, sukurkite ir įdiekite sprendimus našumo problemai spręsti.

  • Stebėkite ir patvirtinkite. Įdiegę sprendimus, nuolat stebėkite darbo krūvį, kad įsitikintumėte, jog našumo problema išspręsta. Patvirtinkite sprendimų efektyvumą stebėdami našumo metriką ir naudotojų atsiliepimus.

Kompromisas: Pagrindinės priežasties analizės veiksmai, tokie kaip galimų priežasčių nustatymas, hipotezių testavimas ir analizės dokumentavimas, gali užtrukti. Norėdami susieti našumo problemas, taip pat turite rinkti ir saugoti duomenis. Reikalingas laikas ir infrastruktūra gali pridėti daug darbo operacijų komandoms ir išlaidas darbo krūviui.

Rizika: jei atliksite pagrindinės priežasties analizę be tinkamų apsauginių turėklų, kyla pavojus, kad atskleisite neskelbtiną informaciją, kai suteiksite prieigą prie žurnalų ir duomenų.

Įtraukite "Microsoft" palaikymą

Kreipkitės į "Microsoft" palaikymo tarnybą , kad padėtumėte išspręsti nuolatines efektyvumo problemas. "Microsoft" palaikymo tarnybos atstovai ne tik turi patirties, įrankių, išteklių ir patirties problemoms spręsti, bet ir gali žinoti apie visas dabartines visuotines našumo problemas ar gedimus, kurie gali turėti įtakos jūsų darbo krūviui. Jūsų palaikymo sutartis nustato teikiamo palaikymo lygį.

Dažnai geriausia dirbti lygiagrečiai su "Microsoft" palaikymu. Pavyzdžiui, apsvarstykite strategiją, pagal kurią kai kurie komandos nariai bendradarbiauja su "Microsoft" palaikymo tarnyba, o kiti toliau triuškina ir sprendžia našumo problemas.

Svarbu, kad palaikymo kontaktinė informacija būtų prieinama komandai. Atminkite, kad "Microsoft" palaikymo tarnybai taip pat gali prireikti prieigos prie duomenų, kad būtų galima efektyviai spręsti problemas.

Norėdami gauti daugiau informacijos, žiūrėkite Gauti palaikymą Power Platform.

Mokykitės iš išvadų

Išsprendę tiesioginės svetainės našumo problemą, turite peržiūrėti, kas nutiko. Tikslas yra mokytis iš našumo problemų, o ne tik nustatyti problemas. Geriausias būdas mokytis yra dokumentacija. Dokumentuokite kiekvieną problemą ir paaiškinkite, kaip ją išspręsti. Jei tiekėjas padėjo, bendradarbiaukite su tiekėju, kad patobulintumėte savo dokumentaciją, apmokytumėte komandą ir atitinkamai pakeistumėte darbo krūvį.

Dokumentuose turėtų būti nurodyta, kaip užkirsti kelią kiekvienai problemai pasikartoti. Kartu su dokumentacija galite kurti patobulintus įspėjimus, kurie padės anksti reaguoti į našumo problemos indikatorius.

Power Platform Palengvinimo

Power Platform ir "Azure" pateikia keletą įrankių, kurie padės atsakyti į tiesioginio veikimo problemas:

  • "Azure Monitor " yra išsamus stebėjimo sprendimas, teikiantis įžvalgų apie jūsų programų ir infrastruktūros našumą ir sveikatą. "Azure Monitor" siūlo tokias funkcijas kaip metrika, žurnalai, įspėjimai ir ataskaitų sritys, padedančios stebėti ir diagnozuoti našumo problemas. Power Platform programos ir automatizavimas gali būti integruoti su "Azure Monitor" naudojant Application Insights šią galimybę. Galima registruoti ir analizuoti standartinę telemetriją kartu su pasirinktiniais sekimo įvykiais.

  • Application Insights yra programų našumo valdymo (APM) paslauga, padedanti kūrėjams ir "DevOps" profesionalams stebėti tiesiogines programas. Jis automatiškai aptinka našumo anomalijas, renka programos lygio žurnalus ir įvykius bei teikia analizės įrankius problemoms diagnozuoti. Power Platform integruojasi su Application Insights.

  • "Log Analytics " yra paslauga, kuri renka ir analizuoja žurnalo duomenis iš įvairių šaltinių, įskaitant programas, virtualiąsias mašinas ir "Azure" išteklius. Kai naudojate "Log Analytics", galite teikti užklausas ir analizuoti žurnalo duomenis, kad gautumėte įžvalgų apie programų našumą ir veikimą. Apsvarstykite galimybę naudoti "Log Analytics", jei jūsų darbo krūvis naudoja "Azure" išteklius.

  • Sprendimų tikrintuvas atlieka išsamią statinę jūsų sprendimų analizę pagal geriausios praktikos taisyklių rinkinį ir nustato probleminius modelius. Išspręskite visas su našumu susijusias problemas prieš diegdami sprendimą gamyboje, kad išvengtumėte tiesioginės svetainės našumo problemų.

Našumo efektyvumo kontrolinis sąrašas

Žiūrėkite visą rekomendacijų rinkinį.