Kommentar
Åtkomst till den här sidan kräver auktorisering. Du kan prova att logga in eller ändra kataloger.
Åtkomst till den här sidan kräver auktorisering. Du kan prova att ändra kataloger.
Azure Automation är en tjänst som kör hanteringsuppgifter åt dig. Du definierar skript som kallas runbooks och som du vill köra och Azure Automation tillhandahåller infrastrukturen för att köra skripten. Den här artikeln fokuserar på processautomatisering, vilket är tjänstens kärnfunktion. Hybrid Runbook Workers, som körs på kundhanterad infrastruktur, omfattas inte av den här artikeln.
När du använder Azure är tillförlitlighet ett delat ansvar. Microsoft tillhandahåller en rad funktioner för att stödja återhämtning och återställning. Du ansvarar för att förstå hur dessa funktioner fungerar inom alla tjänster som du använder och välja de funktioner du behöver för att uppfylla dina affärsmål och drifttidsmål.
Den här artikeln beskriver hur du gör Azure Automation motståndskraftiga mot olika potentiella avbrott och problem, inklusive tillfälliga fel, avbrott i tillgänglighetszonen, regionstopp och serviceunderhåll. Den beskriver också alternativ för säkerhetskopiering och återställning samt viktig information om Azure Automation serviceavtal (SLA).
Rekommendationer för produktionsdistribution för tillförlitlighet
Följ dessa rekommendationer för produktionsarbetsbelastningar som använder processautomatisering:
Hantera tillfälliga fel som uppstår när dina runbooks interagerar med Azure tjänster och API:er genom att lägga till lämplig logik för återförsök i skripten.
Utforma dina runbooks så att de är motståndskraftiga mot avbrott. Använd kontrollpunkter för att upprätthålla förloppet mellan jobbomstarter och om du behöver lagra tillstånd använder du extern lagring.
Översikt över tillförlitlighetsarkitektur
I det här avsnittet beskrivs några av de viktiga aspekterna av hur tjänsten fungerar som är mest relevant ur ett tillförlitlighetsperspektiv. I avsnittet beskrivs den logiska arkitekturen, som innehåller några av de resurser och funktioner som du distribuerar och använder. Den diskuterar också den fysiska arkitekturen, som innehåller information om hur tjänsten fungerar under täcket.
Logisk arkitektur
När du distribuerar Azure Automation skapar du ett automationskonto, som är en logisk container för resurser som kör automatiseringen.
- Runbooks, som representerar det arbete som ska utföras. Textbaserade runbooks är skript skrivna i PowerShell eller Python. Grafiska runbooks skapas med hjälp av en grafisk redigerare.
- Resurser som runbooks delar, inklusive moduler, anslutningar, autentiseringsuppgifter, certifikat och variabler.
- Resurser som initierar körning av runbooks, inklusive scheman och övervakare.
Mer information om dessa resurser finns i Körning av runbooks i Azure Automation.
Den här artikeln beskriver tillförlitligheten och motståndskraften hos dessa funktioner, som är en del av processautomatisering i Azure Automation.
Fysisk arkitektur
Runbooks körs på datorinfrastruktur. Det finns två distributionsmodeller för processautomatisering:
Molnjobb (Microsoft-hanterade): Som standard körs runbooks på molninfrastruktur som tillhandahålls av Microsoft. Microsoft ansvarar för den här infrastrukturens höga tillgänglighet och hantering. När du skickar ett runbook-jobb allokerar Azure Automation ett molnjobb från dess pool med tillgängliga beräkningsresurser, kör runbooken och returnerar sedan resursen till poolen.
Jobb i molnet kan ibland avbrytas under körning. Utforma dina runbooks utifrån antagandet att ett jobb kan starta om i en annan infrastruktur och att alla data som skrivs till tillfällig lagring på den tidigare instansen inte längre är tillgängliga.
Hybrid Runbook Worker: Du kan också välja att konfigurera din egen datainfrastruktur (virtuella datorer i Azure, andra moln eller i den lokala miljön) för att köra runbooks. När du använder hybrid runbook-arbetare ansvarar du för att konfigurera dem så att de uppfyller dina tillförlitlighetskrav. Hybrid Runbook Worker omfattas inte av den här artikeln.
Motståndskraft mot tillfälliga fel
Tillfälliga fel är kortvariga, intermittenta fel i komponenter. De förekommer ofta i en distribuerad miljö som molnet, och de är en normal del av åtgärderna. Tillfälliga fel korrigerar sig själva efter en kort tidsperiod. Det är viktigt att dina program kan hantera tillfälliga fel, vanligtvis genom att försöka igen.
Alla molnbaserade program bör följa vägledningen för tillfälliga felhantering i Azure när de kommunicerar med molnbaserade API:er, databaser och andra komponenter. Mer information finns i Rekommendationer för hantering av tillfälliga fel.
Du ansvarar för att skriva runbooks som hanterar tillfälliga fel i de tjänster och API:er som de interagerar med. För textbaserade runbooks implementerar du omprövningslogik med hjälp av loopar och felhantering. Vägledning och exempel finns i Hantera tillfälliga fel i ett tidsberoende skript. För grafiska runbooks konfigurerar du återförsöksbeteende för aktiviteter i arbetsflödet. Mer information om konfigurationsdetaljer finns i Aktiviteten Försök igen i grafiska runbooks.
Infrastrukturunderhåll eller andra plattformshändelser kan avbryta runbook-jobb. Utforma dina körböcker för att hantera dessa avbrott:
Implementera kontrollpunkter. För PowerShell-arbetsflödesrunbooks använder du kontrollpunkter för att spara förlopp vid viktiga punkter i arbetsflödet. Om ett jobb avbryts och startas om kan det återupptas från den senaste kontrollpunkten i stället för att starta om. Mer information finns i Använda kontrollpunkter i ett arbetsflöde.
Förstå jobbgränser. Molnjobb har fairshare-gränser för hur länge de får köras. Mer information om begränsningar för jobbkörning och hur de tillämpas finns i Runbook-körning.
Lagra beständiga tillstånd externt. Jobb underhåller inte tillstånd mellan körningar. Om ett jobb avbryts och startar om på en annan instans kan allt som skrivs till tillfällig lagring under den första körningen gå förlorat. Om du behöver spara data mellan jobbkörningar lagrar du dem i extern lagring, till exempel Azure Blob Storage eller en databas.
Motståndskraft mot fel i tillgänglighetszonen
Tillgänglighetszoner är fysiskt separata grupper av datacenter i en Azure-region. När en zon misslyckas kan tjänsterna redundansväxla till en av de återstående zonerna.
I regioner som stöds är Automation-konton och molnjobb zonredundanta, vilket innebär att tjänsten sprider dina resurser över flera tillgänglighetszoner. Microsoft aktiverar automatiskt zonredundans och kräver ingen konfiguration.
Kravspecifikation
Regionstöd: När du distribuerar ett automationskonto till någon av följande regioner är det automatiskt zonredundant:
| Americas | Europe | Mellanöstern | Africa | Asia Pacific |
|---|---|---|---|---|
| Brazil South | France Central | Israel Centrala | Sydafrika Nord | Australia East |
| Canada Central | Tyskland Västcentral | Qatar Central | Central India | |
| Central US | Italy North | Norra Kina 3 | ||
| East US | North Europe | East Asia | ||
| USA, östra delen 2 | Norway East | Japan East | ||
| Södra centrala USA | Polen centrala | Korea Central | ||
| USGov Virginia | Sweden Central | Southeast Asia | ||
| Västra USA 2 | UK South | |||
| Västra USA 3 | West Europe |
Den aktuella listan över regioner som stöds finns i Stöd för tillgänglighetszoner för Azure Automation.
Cost
Det kostar inget extra för zonredundans. För processautomatisering baseras faktureringen på hur lång tid dina jobb och bevakare kör. Mer information finns i prissättning för Azure Automation.
Konfigurera stöd för tillgänglighetszoner
När du skapar ett automationskonto i en region som stöds är det automatiskt zonredundant. Du kan inte inaktivera zonredundans. Mer information finns i Stöd för tillgänglighetszoner för Azure Automation.
Beteende när alla zoner är felfria
I det här avsnittet beskrivs vad du kan förvänta dig när ditt automationskonto är zonredundant och alla tillgänglighetszoner i regionen är i drift.
Drift mellan zoner: Hanteringsåtgärder för Automation-konton och molnjobb fördelas automatiskt mellan tillgänglighetszoner i regionen. En begäran eller ett jobb kan hanteras av alla instanser i valfri tillgänglighetszon.
Datareplikering mellan zoner: Automation-kontokonfiguration, runbook-skript och andra resurser som du distribuerar till ditt automationskonto replikeras synkront över flera tillgänglighetszoner.
Beteende vid ett zonfel
Det här avsnittet beskriver vad du kan förvänta dig när ditt automationskonto är zonredundant och det uppstår ett avbrott i någon av tillgänglighetszonerna i regionen.
- Identifiering och respons: Azure Automation-plattformen ansvarar för att upptäcka ett fel i en tillgänglighetszon. Du behöver inte göra något för att påbörja en zone-failover.
- Anmälan: Microsoft meddelar dig inte automatiskt när en zon är nere. Du kan dock använda Azure Service Health för att förstå tjänstens övergripande hälsotillstånd, inklusive eventuella zonfel, och du kan konfigurera Service Health-aviseringar för att meddela dig om problem.
Aktiva begäranden: Alla jobb som körs i den felaktiga zonen kan avbrytas. Azure Automation startar automatiskt ett nytt jobb som körs med hjälp av infrastruktur i felfria zoner. Utforma dina runbooks så att de är motståndskraftiga mot tillfälliga fel och avbrott så att de kan startas om på ett säkert sätt.
Förväntad dataförlust: Jobbkörningar sparar inte tillstånd, så ett fel i en zon förväntas inte leda till dataförlust för pågående jobb. Om ett jobb behöver lagra data som det kan använda för att återställa från avbrott, till exempel kontrollpunkter, lagrar du informationen i en beständig molnlagringstjänst som Azure Storage eller en databas.
Automation-kontokonfiguration och runbook-data replikeras mellan zoner och förblir tillgängliga även när en zon inte är tillgänglig.
Förväntad stilleståndstid: Under ett zonavbrott kan ditt Automation-konto uppleva ett kort avbrott medan tjänsten identifierar felet och omdistribuerar arbetsbelastningen till felfria zoner.
Omfördelning: Tjänsten balanserar automatiskt om kapaciteten över återstående felfria zoner. Nya jobb, övervakare och scheman fortsätter att köras i infrastrukturen i friska zoner. Återställningen är inte beroende av att den felande zonen tas i drift igen.
Zonåterställning
När en felaktig zon tas i drift igen återintegrerar Azure Automation den automatiskt i zonrotationen. Ingen åtgärd krävs från din sida. Tjänsten övervakar zonens hälsa och distribuerar om arbetsbelastningen över alla zoner när normala åtgärder återupptas.
Test för zonfel
Azure Automation hanterar trafikdirigering, redundansväxling och zonåterställning för zonredundanta resurser. Du behöver inte initiera något och du behöver inte verifiera felprocesser i tillgänglighetszonen. Testa dina runbooks för att säkerställa att de är robusta vid avbrott.
Motståndskraft mot regionomfattande fel
Azure Automation är en tjänst med en region. Om regionen blir otillgänglig är ditt Automation-konto inte heller tillgängligt.
Anpassade lösningar för flera regioner för återhämtning
Du kan distribuera separata Automation-konton i flera regioner och växla mellan dem när det behövs. Du ansvarar för att distribuera kontona till varje region, konfigurera dem på rätt sätt, distribuera begäranden mellan kontona och hantera redundans om en region inte är tillgänglig. Detaljerad information om metoder som du kan överväga finns i Haveriberedskap för Azure Automation.
Säkerhetskopiering och återställning
För de flesta lösningar bör du inte enbart förlita dig på säkerhetskopior. Använd i stället de andra funktionerna som beskrivs i den här guiden för att stödja dina återhämtningskrav. Säkerhetskopior skyddar dock mot vissa risker som andra metoder inte gör. Mer information finns i Vad är redundans, replikering och säkerhetskopiering?.
Azure Automation tillhandahåller inte inbyggd säkerhetskopiering för din Automation-kontokonfiguration eller runbook-innehåll. Behåll dina egna kopior utanför tjänsten så att du kan distribuera om dem om det behövs.
Använd infrastruktur som kod (IaC) för konfiguration av automationskonto. Definiera automationskonton och relaterade resurser i Bicep filer, ARM-mallar eller Terraform. Lagra mallarna i källkontrollen och använd distributionspipelinen för att återskapa miljön i samma eller en annan region. Inkludera certifikat, variabler, scheman och referenser för autentiseringsuppgifter i dina artefakter och distributionsprocesser. Lagra hemligheter i tjänster som Azure Key Vault i stället för att bädda in värden direkt i runbook-kod.
Lagra runbook-skript i källkontrollen. Behåll källan för PowerShell och Python runbooks i ett källkontrollsystem som Git. Använd versionshantering, förgrening och granskning av pull requests för att säkerställa skriptkvalitet och möjliggöra återgång till tidigare verifierade fungerande versioner.
Säkerhetskopiera status från relevant datalager. Jobb bevarar inte sitt tillstånd. Om du behöver spara detaljerade jobbloggar eller andra data som dina runbooks genererar, kan du lagra dem i en annan Azure-lagrings- eller databastjänst och säkerhetskopiera dem därifrån.
Motståndskraft mot oavsiktlig borttagning
Om du av misstag tar bort ett Automation-konto kanske du kan återställa det inom en begränsad tidsperiod. Mer information finns i Återställa ett borttaget Automation-konto.
Motståndskraft mot serviceunderhåll
Microsoft tillämpar regelbundet tjänstuppdateringar och utför annat underhåll. Den Azure plattformen hanterar dessa aktiviteter automatiskt, vilket säkerställer att underhållet är sömlöst och transparent för dig. Ingen driftstopp förväntas under underhållshändelser om du inte har blivit informerad via Azure Service Health planerat underhåll.
Serviceavtal
Serviceavtal (SLA) för Azure-tjänster beskriver den förväntade tillgängligheten för varje tjänst och de villkor som din lösning måste uppfylla för att uppnå den tillgänglighetsförväntningen. Mer information finns i Serviceavtal för onlinetjänster.