Spolehlivost v Microsoft Fabric

Tento článek popisuje podporu spolehlivosti v Microsoft Fabric, včetně regionální odolnosti s dostupnostními zónami a obnovy napříč regiony a kontinuity podnikání. Podrobnější přehled spolehlivosti v Azure najdete v tématu Spolehlivost Azure.

Podpora zón dostupnosti

Zóny dostupnosti jsou fyzicky oddělené skupiny datacenter v rámci oblasti Azure. Když jedna zóna selže, mohou služby přejít na jednu ze zbývajících zón.

Výrobek Fabric používá zóny dostupnosti Azure k ochraně Fabric a položek a dat Power BI před selháním datacentra. Služba automaticky distribuuje Fabric zdroje mezi více zón bez nutnosti jakékoli zákaznické konfigurace.

  • Datové inženýrství podporuje zóny dostupnosti, pokud používáte OneLake. Pokud používáte jiné zdroje dat, jako je ADLS Gen2, musíte zajistit, aby bylo povolené zónově redundantní úložiště (ZRS).

Snížení intenzity zážitku

Během výpadku na úrovni zóny se nevyžaduje žádná akce zákazníka. Schopnosti fabricu se automaticky opravují a znovu vyrovnávají, aby těžily ze zdravé zóny. V některých případech může být nutné probíhající operace restartovat. Například spuštění Spark Jobs může selhat, pokud je primární uzel v zóně selhání. V takovém případě je potřeba nabídky znovu odeslat. Dotaz na datový sklad a koncový bod analytiky SQL může selhat, pokud je front-endový uzel v zóně selhání. V takovém případě je potřeba dotaz bezpečně restartovat.

Important

Microsoft se snaží poskytovat jednotnou a konzistentní podporu zón dostupnosti, avšak při selhání zóny dostupnosti mohou kapacity Fabric umístěné v regionech Azure s vyššími výkyvy poptávky zákazníků zažít větší než obvyklé latence.

Zotavení po havárii napříč oblastmi a provozní kontinuita

Zotavení po havárii (DR) označuje postupy, které organizace používají k zotavení z událostí s vysokým dopadem, jako jsou přírodní katastrofy nebo neúspěšná nasazení, která vedou k výpadkům a ztrátě dat. Bez ohledu na příčinu je nejlepším řešením havárie dobře definovaný a otestovaný plán zotavení po havárii a návrh aplikace, který zotavení po havárii aktivně podporuje. Než začnete vytvářet plán zotavení po havárii, přečtěte si téma Doporučení pro návrh strategie zotavení po havárii.

Pro DR používá Microsoft model sdílené odpovědnosti. V tomto modelu Microsoft zajišťuje, aby byly dostupné základní služby infrastruktury a platformy. Mnoho služeb Azure ale automaticky nereplikuje data ani neumožňuje automatický přechod z selhávající oblasti pro křížovou replikaci do jiné povolené oblasti. Za tyto služby zodpovídáte za nastavení plánu zotavení po havárii, který funguje pro vaši úlohu. Většina služeb, které běží v rámci nabídky platformy jako služby (PaaS) na Azure, poskytuje funkce a pokyny pro podporu disaster recovery (DR). Pomocí funkcí specifických pro službu můžete podporovat rychlé obnovení, což pomůže s vývojem vašeho DR plánu.

Tato část popisuje plán zotavení po havárii pro Fabric, který je navržený tak, aby vaší organizaci pomohl zajistit bezpečnost a dostupnost dat v případě, že dojde k neplánované regionální havárii. Tento plán se zabývá následujícími tématy:

  • Replikace mezi regiony: Fabric nabízí replikaci mezi regiony pro data uložená v OneLake. Na základě vašich požadavků se můžete do této funkce zapojit nebo se z ní odhlásit.

  • Přístup k datům po havárii: V regionálním scénáři havárie zaručuje Fabric přístup k datům s určitými omezeními. I když je vytváření nebo úpravy nových položek v případě selhání omezené, hlavní pozornost zůstává na tom, aby stávající data zůstala přístupná a nedotčená.

  • Pokyny pro obnovení: Fabric poskytuje strukturovanou sadu pokynů, které vás provedou procesem obnovení. Strukturované pokyny usnadňují přechod zpět na běžné operace.

Power BI, nyní součást platformy Fabric, má implementovaný pevný systém zotavení po havárii a nabízí následující funkce:

  • BCDR jako výchozí: Pokud je oblast paired s oblastí , která podporuje Power BI, funkce zotavení po havárii jsou ve výchozím nastavení zahrnuté. Tuto funkci nemusíte povolovat ani aktivovat samostatně.

  • Replikace mezi oblastmi: Power BI používá geograficky redundantní replikaci úložiště Azure a geograficky redundantní replikaci Azure SQL , aby se zajistilo, že instance zálohování existují v jiných oblastech a je možné je použít. To znamená, že data se duplikují napříč různými oblastmi, zvyšují jejich dostupnost a snižují rizika spojená s oblastmi výpadků.

  • Trvalé služby a přístup po havárii: I během rušivých událostí zůstanou položky Power BI přístupné v režimu jen pro čtení. Mezi položky patří sémantické modely, sestavy a řídicí panely, které zajišťují, aby firmy mohly pokračovat v analýze a rozhodovacích procesech bez významné překážky.

Další informace najdete v tématu Nejčastější dotazy k vysoké dostupnosti, převzetí služeb při selhání a zotavení po havárii v Power BI.

Important

Pro zákazníky postižené katastrofou a jejichž domovské regiony nemají Azure spárovaný region podporující Fabric, může být schopnost využívat kapacity Fabric ohrožena, i když jsou data v těchto kapacitách replikována. Toto omezení je spojeno s infrastrukturou domovského regionu, která je nezbytná pro provoz kapacit. Pokud chcete zobrazit seznam oblastí, které podporují Fabric, přejděte do Dostupnost regionu pro Fabric.

Funkcionalita domovské oblasti a kapacity

Pro efektivní plánování zotavení po havárii je důležité pochopit vztah mezi vaší domovskou oblastí a umístěními kapacity. Porozumění domovské oblasti a umístěním kapacity vám pomůže provádět strategické výběry oblastí kapacity a odpovídajících procesů replikace a obnovení.

Domovská oblast tenanta vaší organizace a úložiště dat je nastavená na umístění fakturační adresy prvního uživatele, který se zaregistruje. Další podrobnosti o nastavení tenantů najdete v Plánování implementace Power BI: Nastavení tenanta. Při vytváření nových kapacit je vaše úložiště dat ve výchozím nastavení nastavené na domovskou oblast. Pokud chcete změnit oblast ukládání dat na jinou oblast, musíte povolit Multi-Geo, což je funkce Fabric Premium.

Important

Volba jiné oblasti pro vaši kapacitu úplně nepřemístí všechna vaše data do této oblasti. Některé datové prvky zůstávají uložené v domovské oblasti. Pokud chcete zjistit, která data zůstávají v domovské oblasti a která data jsou uložená v oblasti s podporou Multi-Geo, přečtěte si téma Konfigurace podpory Multi-Geo pro Fabric Premium.

V případě domovského regionu, který nemá spárovaný region, mohou kapacity v jakémkoli regionu s podporou Multi-Geo čelit provozním problémům, pokud domovský region narazí na havárii, protože základní funkčnost služeb je navázaná na domovský region.

Pokud vyberete oblast s podporou multi-Geo v rámci EU, je zaručeno, že vaše data jsou uložená v rámci datové hranice EU.

Informace o tom, jak identifikovat domovskou oblast, najdete v tématu Vyhledání domovské oblasti Fabric.

Nastavení kapacity zotavení po havárii

Fabric poskytuje přepínač zotavení po havárii na stránce nastavení kapacity. Je k dispozici tam, kde regionální párování Azure odpovídají přítomnosti služby Fabric. Tady jsou specifika tohoto přepínače:

  • Přístup k rolím: Tento přepínač můžou používat jenom uživatelé s rolí správce kapacity nebo vyšší.

  • Členitost: Kapacita přepínače je úroveň členitosti. Je k dispozici pro kapacity Premium i Fabric.

  • Rozsah dat: Přepínač zotavení po havárii konkrétně řeší data OneLake, která zahrnují data Lakehouse a Warehouse. Switch neovlivňuje vaše data uložená mimo OneLake.

  • Kontinuita BCDR pro Power BI: Zatímco můžete zapínat a vypínat obnovu po havárii pro data OneLake, BCDR pro Power BI je vždy podporován, bez ohledu na to, zda je spínač zapnutý nebo vypnutý.

  • Frekvence: Jakmile změníte nastavení kapacity obnovy po havárii, musíte počkat 30 dní, než ji můžete znovu upravit. Čekací doba udržuje stabilitu a zabraňuje neustálému přepínání.

Snímek obrazovky s nastavením instance pro obnovení po havárii

Note

Po zapnutí nastavení kapacity obnovy po havárii nebo vytvoření nových pracovních prostorů v rámci kapacity může replikace dat chvíli trvat, než začne. Stav každého pracovního prostoru můžete zkontrolovat na stránce nastavení kapacity v části Pracovní prostory přiřazené této kapacitě. Ve sloupci Geografické replikace OneLake se zobrazuje stav povolení geografické replikace.

Replikace dat

Když zapnete nastavení kapacity zotavení po havárii, povolí se replikace mezi oblastmi jako schopnost zotavení po havárii pro data OneLake. Platforma Fabric se sladí s oblastmi Azure, aby vytvořila páry geografické redundance. Některé oblasti ale nemají párovou oblast Azure nebo párová oblast nepodporuje Fabric. Pro tyto oblasti není replikace dat dostupná. Další informace najdete v tématech Oblasti se zónami dostupnosti a bez párování regionů a Dostupnost regionů infrastruktury.

Note

Fabric sice nabízí řešení replikace dat ve OneLake, které podporuje zotavení po havárii, ale existují určitá omezení. Data databází a sad dotazů KQL se například ukládají externě do OneLake, což znamená, že je potřeba použít samostatný přístup pro zotavení po havárii. Podrobnosti o přístupu k obnově po havárii pro každou položku Fabric najdete ve zbývající části tohoto dokumentu.

Billing

Funkce zotavení po havárii v Fabric umožňuje geografickou replikaci vašich dat pro lepší zabezpečení a spolehlivost. Tato funkce využívá více úložišť a transakcí, které se účtují jako operace BCDR Storage a BCDR. Tyto náklady můžete monitorovat a spravovat v aplikaci Microsoft Fabric Capacity Metrics, kde se zobrazují jako samostatné řádkové položky.

Úplný přehled všech souvisejících nákladů na zotavení po havárii, které vám pomůžou s plánováním a rozpočtem, najdete v tématu Využití výpočetních prostředků a úložiště OneLake.

Nastavení zotavení po havárii

I když Fabric poskytuje funkce zotavení po havárii, které podporují odolnost dat, musíte během přerušení služby provést určité ruční kroky. Tato část podrobně popisuje akce, které byste měli provést při přípravě na potenciální přerušení.

Fáze 1: Příprava

  • Aktivujte nastavení kapacity zotavení po havárii: Pravidelně zkontrolujte a nastavte nastavení kapacity zotavení po havárii, abyste měli jistotu, že splňují vaše požadavky na ochranu a výkon.

  • Vytváření záloh dat: Kopírování důležitých dat uložených mimo OneLake do jiné oblasti způsobem, který odpovídá vašemu plánu zotavení po havárii.

Fáze 2: Záložní řešení při havárii

Když velká katastrofa způsobí, že primární region není možné obnovit, Microsoft Fabric spustí regionální failover. K portálu Fabric nebudete mít přístup, dokud nebude převzetí služeb při selhání dokončeno. Na stránce podpory Microsoft Fabric je zveřejněno upozornění.

Doba trvání převzetí služeb se může lišit, i když obvykle trvá méně než hodinu. Po dokončení přepnutí na záložní systém můžete očekávat následující:

  • Portál Fabricu: Můžete získat přístup k portálu a číst operace, jako je procházení existujících pracovních prostorů, toky úkolů v pracovních prostorech a položkách, fungují nepřetržitě. Všechny operace zápisu, jako je vytvoření nebo úprava pracovního prostoru, se pozastaví.

  • Power BI: Můžete provádět operace čtení, jako je zobrazení řídicích panelů a sestav. Aktualizace grafů či sestav, operace publikování sestav, úpravy řídicích panelů a sestav a další operace, které vyžadují změny metadat, nejsou podporovány.

  • Lakehouse/Warehouse: Tyto položky nemůžete otevřít, ale soubory můžete používat přes OneLake API nebo nástroje.

  • Definice Spark jobu: Definice pracovních pozic ve Sparku otevřít nemůžete, ale můžete přistupovat k souborům kódu přes OneLake API nebo nástroje. Veškerá metadata nebo konfigurace se po failoveru uloží.

  • Notebook: Notebooky nelze otevřít a obsah kódu se po katastrofě neukládá.

  • Model nebo experiment ML: Modely nebo experimenty ML nejde otevřít. Obsah kódu a metadata, jako jsou metriky běhů a konfigurace, se po katastrofě neukládají.

  • Dataflow Gen2/Pipeline/Eventstream: Tyto položky nejde otevřít, ale k ochraně dat můžete použít podporované cíle zotavení po havárii, jako jsou lakehouses nebo warehouses.

  • KQL databáze/dotazovací sada: Po failoveru nelze přistupovat k databázím a dotazovacím sadám KQL. K ochraně dat v databázích A sadách dotazů KQL se vyžadují další požadované kroky.

V případě katastrofy jsou Fabric portál a Power BI v režimu pouze pro čtení a ostatní položky Fabric nejsou dostupné. K jejich datům uloženým v OneLake se můžete dostat pomocí API nebo nástrojů třetích stran. Portál i Power BI si zachovají možnost provádět operace čtení i zápisu na tato data. Tato schopnost zajišťuje, že důležitá data zůstanou přístupná a upravitelná a zmírní potenciální přerušení obchodních operací.

K datům OneLake můžete přistupovat prostřednictvím několika kanálů:

Fáze 3: Plán obnovení

Ačkoli Fabric zajišťuje, že data zůstanou přístupná i po havárii, můžete také podniknout kroky k úplnému obnovení jejich služeb do stavu před incidentem. Tato část obsahuje podrobný průvodce, který vám pomůže procesem obnovení.

Kroky obnovení

  1. Po katastrofě vytvořte novou kapacitu Fabric v libovolném regionu. Vzhledem k vysoké poptávce během těchto událostí zvolte region mimo svou primární oblast, abyste zvýšili pravděpodobnost dostupnosti výpočetních služeb. Pro informace o vytvoření kapacity viz Buy Fabric capacity in Azure.

  2. Vytvořte pracovní prostory v nově vytvořené kapacitě. V případě potřeby použijte stejné názvy jako staré pracovní prostory.

  3. Vytvořte položky se stejnými názvy jako položky, které chcete obnovit. Tento krok je důležitý, pokud k obnovení lakehouse a skladů použijete vlastní skript.

  4. Obnovte položky. Pro každou položku postupujte podle příslušné části v pokynech pro zotavení po havárii specifické pro prostředí a obnovte položku.

Další kroky