Kommentar
Åtkomst till den här sidan kräver auktorisering. Du kan prova att logga in eller ändra kataloger.
Åtkomst till den här sidan kräver auktorisering. Du kan prova att ändra kataloger.
I molnmiljöer är fel oundvikliga. Maskinvarufel, programvarufel, konfigurationsfel, trafiktoppar, avbrott i datacenter och till och med regionomfattande avbrott kan inträffa. Tillförlitlighet är möjligheten för en arbetsbelastning att fortsätta uppfylla företagets förväntningar, även under fel eller störningar. Med rätt arkitektur och åtgärder behöver fel inte leda till stilleståndstid.
Oplanerad stilleståndstid kan ha stor inverkan. Det medför ekonomiska kostnader och skadar kund- och användarförtroendet. Utöver dessa omedelbara effekter påverkar dålig tillförlitlighet efterlevnadsskyldighet och konkurrenspositionering. Dina team lägger mer tid på brandbekämpning och mindre tid på att leverera värde. Det kan till och med utlösa avtalsenliga påföljder på servicenivå.
Azure tillhandahåller elastisk infrastruktur och hanterade tjänster, men arbetsbelastningens tillförlitlighet beror på design- och driftsbeslut som du fattar: hur du utformar din arkitektur, konfigurerar tjänster, hanterar beroenden, automatiserar svar på problem och testar programvara och processer. Att utforma för tillförlitlighet tidigt hjälper dig att minimera fel och ser till att din arbetsbelastning försämras på förutsägbara och kontrollerade sätt som överensstämmer med affärsprioriteringar när de inträffar.
En tillförlitlig arbetsbelastning har två viktiga egenskaper:
- Det är motståndskraftigt, vilket innebär att det kan absorbera fel och ändringar i miljön samtidigt som den fortsätter att fungera på en acceptabel servicenivå.
- Det kan också återställas, vilket innebär att när störningar inträffar kan arbetsbelastningen återställa normala åtgärder inom definierade tids- och dataförlustgränser.
Du behöver båda egenskaperna för att uppfylla verkliga tillgänglighetsförväntningar och upprätthålla affärskontinuitet.
Tillförlitlighet i Azure fungerar i tre sammankopplade lager:
- Ditt program: Dina arkitekturval, metoder och processer, inklusive beroendehantering, runbooks, automatisering och testning
-
Tillförlitlighetsfunktioner, inklusive:
- Arbetsbelastningstjänster och konfiguration: Så här konfigurerar du de Azure tjänster som kör din arbetsbelastning och de tillförlitlighetsfunktioner som du konfigurerar inom dessa tjänster
- Azure plattformstjänster: Azure tjänster som specifikt stöder arbetsbelastningstillförlitlighet, till exempel belastningsutjämning, DNS, trafikroutning och övervakning
- Tillförlitlighetsgrunder: Azure inbyggda motståndskraft, till exempel tillgänglighetszoner, regioner och säkra distributionsmetoder
De här lagren fungerar tillsammans för att fastställa den övergripande arbetsbelastningens tillförlitlighet. Att förstå dem hjälper dig att skilja mellan vad Azure tillhandahåller som standard och vad du behöver för att utforma, konfigurera och använda.
Den här modellen hjälper dig att utnyttja vad Azure ger samtidigt som du tar ansvar för det som bara du kan utforma. Den här artikeln fokuserar på vad Azure tillhandahåller i dessa lager. Omfattande vägledning om arbetsbelastningens design- och driftskikt (design av motståndskraftiga lösningar och arkitekturmönster) finns i Azure Well-Architected Framework och särskilt tillförlitlighetspelare.
Delat ansvar för tillförlitlighet
Tillförlitlighet i Azure följer en modell för delat ansvar. Microsoft ger den motståndskraftiga plattformen via Azure. Du utformar den motståndskraftiga arbetsbelastningen.
Microsoft äger plattformsgrunderna och plattformens tillförlitlighetstjänster. Det här ägarskapet omfattar elastisk infrastruktur (fysisk redundans, felisolering och återställning), tillgänglighetszoner, regional distribution, säkra distributionsmetoder och tjänster på plattformsnivå som belastningsutjämning, trafikroutning och övervakning. Microsoft ansvarar för Azure plattforms tillförlitlighet och för tjänsternas tillförlitlighet enligt definitionen i varje tjänsts publicerade serviceavtal och dokumentation, till exempel deras tillförlitlighetsguide.
Du äger arbetsbelastningens design och åtgärder. Du ansvarar för att översätta Azure funktioner till tillförlitligt arbetsbelastningsbeteende genom arkitekturbeslut, konfigurationsalternativ, driftmetoder och testning.
Azure kan inte känna till dina tillgänglighetsmål, acceptabla kompromisser, affärskontext eller programspecifika krav. Det är bara du som kan definiera dessa krav och utforma dem i enlighet med detta. Azure tillhandahåller funktioner medan du väljer och konfigurerar dem. Du kan till exempel konfigurera redundansbeteende för tjänster som databaser, och du definierar hälsoavsökningar för lastbalanserare som korrekt representerar programmets hälsa så att trafikdirigeringsbesluten är korrekta, även vid fel.
Important
Plattformen tillhandahåller byggstenar, inte garantier från slutpunkt till slutpunkt. Dina design- och driftval avgör om dessa funktioner översätts till en tillförlitlig arbetsbelastning. En fullständig uppdelning av modellen för delat ansvar finns i Delat ansvar i molnet.
Serviceavtal definierar tillförlitlighetsåtaganden och förväntningar för Azure tjänster. Att förstå serviceavtal är viktigt när du utvärderar tjänster och utformar för specifika tillgänglighetsmål. Azure tjänster publicerar SLA-åtaganden som kan variera beroende på konfigurations- och redundansnivå. Andra tjänster som du använder från andra leverantörer kan också publicera serviceavtal. Omfattande vägledning om hur serviceavtal fungerar och relaterar till arbetsbelastningens tillgänglighetsförväntningar finns i Servicenivåavtal.
Elastiska grunder i Azure
Azure är utformat med flera motståndskraftslager inbyggda i själva plattformen. De här grunderna ger de grundläggande funktioner som tillförlitliga arbetsbelastningar bygger på:
Motståndskraft mot fysisk infrastruktur: Azure datacenter är utformade med redundant infrastruktur som ström, kylning och nätverksanslutning. Den Azure infrastrukturstyrenheten isolerar och hanterar maskinvarufel automatiskt. Den identifierar fel och samordnar arbetsbelastningsmigrering till felfri maskinvara utan kundintervention.
Regioner: Azure fungerar i över 70 regioner över hela världen. Den här geografiska distributionen gör det möjligt för arbetsbelastningar att hantera regionomfattande störningar och avbrott genom planerade redundansfunktioner, samtidigt som du följer dina krav på datahemvist. Mer information finns i översikten över Azure regioner.
Tillgänglighetszoner: Många Azure regioner omfattar fysiskt separata datacenter i samma region. Dessa tillgänglighetszoner är anslutna via höghastighetsnätverk med låg latens. Varje zon har oberoende ström, kylning och nätverk för att skydda mot fel på datacenternivå samtidigt som synkrona replikeringsfunktioner bibehålls för många Azure tjänster. Mer information finns i Vad är tillgänglighetszoner?
Säkra distributioner: Azure implementerar kontrollerade, förskjutna distributionsprocesser för plattformsuppdateringar och tjänständringar för att minimera risken för omfattande avbrott i tjänsten. Plattformen distribuerar uppdateringar gradvis, till exempel över feldomäner, tillgänglighetszoner och regioner, med automatiserade återställningsfunktioner när den upptäcker problem. Den här metoden säkerställer att plattformsändringar inte medför tillförlitlighetsrisker för kundernas arbetsbelastningar.
Azure tillhandahåller dessa grunderna på plattformsnivå automatiskt. De utgör det baslager där du skapar tillförlitliga arbetsbelastningar. Du måste dock fortfarande konfigurera dina tjänster korrekt och kombinera dessa funktioner på ett sätt som uppfyller dina specifika affärskrav.
Azure tjänster som stöder din tillförlitlighet
Azure tillhandahåller plattformsfunktioner som omvandlar tillförlitlighetsbegrepp till användbara byggstenar för din arkitektur. Dessa funktioner fungerar tillsammans för att aktivera motståndskraftiga arkitekturer, och många Azure tjänster innehåller inbyggda implementeringar av dessa mönster:
| Capability | Description |
|---|---|
|
|
Använder AI-drivna funktioner för att utvärdera och förbättra tillförlitligheten. De här funktionerna analyserar arbetsbelastningsmönster, identifierar potentiella risker och ger rekommendationer som hjälper team att gå från reaktiv felsökning till proaktiv tillförlitlighetshantering. Dessa funktioner visar tillförlitlighetssignaler och omvandlar dem till användbara rekommendationer som hjälper teamen att prioritera och förbättra tillförlitligheten över tid. Azure tillhandahåller flera AI-drivna tillförlitlighetstjänster, bland annat: - Azure återhämtningsfunktioner - Återhämtningsfunktioner i agenter (förhandsversion) i Azure Copilot - Azure SRE-agent Dessa tjänster analyserar arbetsbelastningsmönster och föreslår förbättringar för att optimera din tillförlitlighetsstatus över hela linjen. |
|
|
Möjliggör tillförlitlighet genom att dirigera trafik mellan redundanta instanser och hantera redundans automatiskt. Den här funktionen är viktig för att upprätthålla tjänstens tillgänglighet när enskilda komponenter misslyckas. Azure ger belastningsutjämning i flera lager, inklusive: - Azure Load Balancer för TCP/UDP-trafikdistribution i Layer-4 - Azure Application Gateway för Layer-7 HTTP-routning med programmedvetna hälsokontroller - Azure Front Door för global HTTP-belastningsutjämning med snabb redundans - Azure Traffic Manager för DNS-baserad global slutpunktsdistribution Om du behöver hjälp med att bestämma vilken lastbalanserare som ska användas för ditt scenario kan du läsa Mer information om alternativ för belastningsutjämning. |
|
|
Skyddar mot dataförlust och skada och möjliggör återställning när ett problem inträffar. Azure har flera funktioner för säkerhetskopiering och återställning, bland annat: - Azure Backup för centraliserad säkerhetskopiering med konfigurerbar kvarhållning för virtuella datorer, blobcontainrar, filer och vissa databaser – Inbyggda funktioner för säkerhetskopiering och återställning i många Azure tjänster, inklusive de flesta databastjänster - Bicep och annan infrastruktur som kodverktyg för konfigurationssäkerhetskopiering, driftskydd och snabb rekreation av miljön Granska varje Azure-tjänstens tillförlitlighetsguide för att förstå de säkerhetskopieringsmetoder som tjänsten stöder. |
|
|
Möjliggör återställning från regionala fel via datareplikering mellan regioner och automatiserade redundansfunktioner. Azure Site Recovery samordnar haveriberedskap för arbetsbelastningar på virtuella datorer med automatiserad replikering och redundanssekvensering. Många Azure tjänster tillhandahåller också inbyggda geo-replikeringsfunktioner, inklusive: - Azure Cosmos DB med intern datareplikering mellan regioner och redundansfunktioner - Azure API Management med interna redundansfunktioner mellan regioner Guider för tjänsttillförlitlighet beskriver alla geo-replikeringsalternativ som är tillgängliga för varje tjänst. |
|
|
Ger omfattande insyn i tillförlitlighetsstatus och möjliggör proaktivt svar på problem. Azure tillhandahåller flera observerbarhetstjänster, inklusive: - Azure Monitor och Application Insights för övervakning, aviseringar och beroendespårning i realtid - Hälsomodeller i Azure Monitor för att övervaka hälsotillståndet för en hel arbetsbelastning - Azure Service Health för anpassade aviseringar och vägledning för Azure tjänstproblem som kan påverka dina arbetsbelastningar Tillsammans hjälper dessa funktioner dig att förstå om du uppfyller tillförlitlighetskraven och svarar snabbt när problem uppstår. |
|
|
Hjälper till att kontrollera att arbetsbelastningar fungerar som förväntat under felförhållanden och hjälper till att säkerställa att din lösning uppfyller tillförlitlighetskraven innan problem påverkar användarna. Azure tillhandahåller tjänster för tillförlitlighetstestning, inklusive: - Azure Chaos Studio för kontrollerade felinmatningsexperiment för att validera självåterställningsbeteende och motståndskraft mot verkliga fel - Azure applikationstestning för prestanda- och funktionstestning för att förstå hur program beter sig, även under stress |
Aktivera tillförlitlighet i Azure tjänster
Plattformen tillhandahåller tillförlitlighetsfunktioner på tjänstnivå genom dussintals Azure tjänster, var och en med specifika styrkor och användningsfall. Varje tjänsts tillförlitlighetsguide innehåller information om hur tjänsten kan förbli tillgänglig under olika scenarier, till exempel:
- Tillfälliga fel, som är korta tillfälliga fel. Tjänstguiderna ger rekommendationer för bästa praxis för att minimera deras påverkan, till exempel att försöka igen och använda Microsoft tillhandahållna SDK:er.
- Fel i tillgänglighetszonen, så tjänsten kan automatiskt omdirigera begäranden för att upprätthålla hög tillgänglighet.
- Regionomfattande fel, så att tjänsten kan redundansväxla till en sekundär region och fortsätta att fungera under ett regionavbrott.
Information om hur du visar tillförlitlighetsguider för många Azure tjänster finns i Tillförlitlighetsguider per tjänst.
Utforma tillförlitliga arbetsbelastningar
Tillförlitligheten kommer från en kontinuerlig cykel med att definiera mål, utforma för fel och snabb återställning, testa antaganden och förbättra genom driftinlärning. Använd tillförlitlighetsguiderna för Azure Well-Architected Framework och tjänsten för att förstå vad varje tjänst tillhandahåller som standard och vad som kräver explicit konfiguration. En strukturerad metod för att implementera tillförlitlighet finns i mognadsmodellen för Azure Well-Architected Framework-tillförlitlighet.
När du utformar kan du koppla ihop grundläggande begrepp med tekniska begrepp. Grundläggande begrepp som affärskontinuitet och delat ansvar definierar vilka resultat du behöver uppnå. Tekniska begrepp som redundans, replikering, säkerhetskopiering, redundans och återställning efter fel definierar hur du implementerar dessa resultat i din arkitektur och dina åtgärder. Serviceavtal hjälper dig att förstå de garantier du får från dina tjänsteleverantörer.
Suveränitet och datahemvist
När du utformar tillförlitlighet ska du inkludera krav på suveränitet och datahemvist tidigt eftersom de påverkar valet av region, replikeringsstrategin och redundansvägarna. En elastisk arkitektur kan fortfarande misslyckas med efterlevnadskrav om redundans eller dataflytt överskrider begränsade gränser. Mer information finns i Tillförlitlighet och suveränitet.
Tillförlitlighet i Azure uppnås genom att kombinera elastiska plattformsgrunder med genomtänkt arbetsbelastningsdesign och drift. Genom att förstå vad Azure tillhandahåller och var du behöver fatta design- och konfigurationsbeslut kan du skapa system som fortsätter att uppfylla företagets förväntningar, även om det uppstår fel.