本文介紹 Microsoft Fabric 中的可靠性支援,包括區域彈性與可用性區域的整合,以及跨區域的復原與業務持續性。 如需更多關於 Azure 可靠性的詳細概觀,請參閱 Azure 可靠性。
可用性區域支援
可用性區域 是 Azure 區域內物理上獨立的資料中心群組。 當某個區域發生故障時,服務可以切換至其他剩餘的區域。
Fabric 會使用 Azure 可用性區域來保護 Fabric 和 Power BI 專案和資料免於資料中心失敗。 該服務自動將 Fabric 資源分配到多個區域,無需客戶設定。
- 如果您使用 OneLake,數據工程支援可用區域。 如果您使用ADLS Gen2等其他數據源,則必須確定已啟用區域備援記憶體 (ZRS)。
區域縮減體驗
在全區域中斷期間,不需要客戶採取任何動作。 Fabric 能力會自動自我修復並重新平衡,以充分利用健康區域。 在某些情況下,進行中的操作可能需要重新啟動。 例如,若主節點位於失敗區域,執行 Spark Jobs 可能會失敗。 在這種情況下,你需要重新提交工作。 如果前端節點位於失敗區域,資料倉儲和 SQL 分析端點查詢可能會失敗。 在這種情況下,你需要安全地重新開始查詢。
Important
雖然 Microsoft 努力提供統一且一致的可用區域支援,但在某些可用區域失敗的情況下,位於客戶需求波動較大的 Azure 區域中的 Fabric 容量可能會經歷比平常更高的延遲。
跨區域災害復原和商務持續性
災害復原 (DR) 是指組織用來從高影響事件中復原的做法,例如自然災害或導致停機時間和數據遺失的失敗部署。 無論原因為何,解決災害的最佳辦法是定義完善且經過測試的 DR 方案,以及主動支援 DR 的應用程式設計。 開始建立災害復原計劃之前,請參閱 設計災害復原策略的建議。
在 DR 方面,Microsoft 採用 共同責任模型。 在此模型中,Microsoft可確保基準基礎結構和平臺服務可供使用。 然而,許多 Azure 服務並不會自動複製資料,也不會從失敗的區域回退到另一個已啟用的區域。 針對這些服務,您必須負責設定適用於您工作負載的災害復原計劃。 在 Azure 平臺即服務上執行的大部分服務 (PaaS) 供應專案都提供支援DR的功能和指引。 您可以使用 服務特定功能來支援快速復原 ,以協助開發DR方案。
本節描述 Fabric 的災害復原方案,其設計目的是協助組織在發生非計劃性區域災害時,讓資料保持安全且可供存取。 方案中會涵蓋下列主題:
跨區域複寫:Fabric 為儲存在 OneLake 中的資料提供跨區域複寫。 您可以根據需求加入或退出此功能。
災害後的資料存取:在區域性災害案例中,Fabric 會保證資料存取,但有特定限制。 雖然容錯移轉後會限制新項目的建立或修改,但主要焦點會維持在確保現有資料保持可供存取且完好無損。
復原指導:Fabric 提供一組結構化的指示,以引導您完成復原程序。 結構化指導可讓您更輕鬆地轉換回一般作業。
Power BI 現在是 Fabric 的一部分,已備妥穩固的災害復原系統,並提供下列功能:
預設啟用 BCDR:如果某個區域與支援 Power BI 的區域配對,則預設即包含災難復原功能。 您不需要個別選擇加入或啟用此功能。
跨區域複寫:Power BI 使用 Azure 儲存體異地備援複寫和 Azure SQL 異地備援複寫,以保證備份執行個體存在於其他區域,而且可供使用。 這表示資料會跨不同區域複寫,以強化其可用性,並降低與區域中斷相關的風險。
災害後的持續服務和存取:即使在干擾性事件期間,Power BI 項目仍可供在唯讀模式下存取。 這些項目包括語意模型、報表和儀表板,可確保企業可以繼續其分析和決策程序,而不會造成重大障礙。
欲了解更多資訊,請參閱 Power BI 高可用性、故障轉移及災難復原常見問題。
Important
對於受災難影響且其家庭區域沒有支援 Fabric 的 Azure 配對區域的客戶,即使該容量內的資料被複製,使用 Fabric 容量的能力仍可能受到影響。 此限制與本國地區基礎設施相關,而基礎設施對能力運作至關重要。 若要查看支援 Fabric 的區域清單,請移至 Fabric 區域可用性。
主區域和容量功能
若要有效地規劃災害復原,請務必了解主區域與容量位置之間的關聯性。 了解主區域和容量位置可協助您有策略地選取容量區域,以及對應的複寫和復原程序。
組織租戶和資料儲存的主區域會根據第一位使用者註冊時提供的帳單地址位置來設定。 如需租用戶設定的進一步詳細資料,請移至 Power BI 實作規劃:租用戶設定。 當您建立新的容量時,資料儲存體預設會設定為主要區域。 如果你想將資料儲存區域更改到另一個區域,你需要啟用 Multi-Geo,這是 Fabric Premium 的一項功能。
Important
為數據容量選擇其他區域並不會將所有資料完全遷移到該區域。 某些資料元素仍會儲存在主區域中。 若要查看哪些資料會留在主區域,以及哪些資料會儲存在已啟用 Multi-Geo 的區域,請參閱設定 Fabric Premium 的 Multi-Geo 支援。
若本區域沒有配對區域,任何多地理支援的區域容量在主區域發生災難時可能面臨運作問題,因為核心服務功能是綁定於本區域的。
如果您選取歐盟內已啟用 Multi-Geo 的區域,則您的資料保證會儲存在歐盟資料界限內。
若要了解如何識別主區域,請參閱尋找 Fabric 主區域。
災害復原容量設定
Fabric 會在容量設定頁面上提供災害復原開關。 Azure 的區域配對與 Fabric 的服務存在保持一致的地方便可使用。 以下是此開關的具體細節:
角色存取:只有具有容量管理員角色或更高階角色的使用者才能使用此開關。
細微性:此開關的細微性是容量層級。 其同時適用於 Premium 和 Fabric 容量。
資料範圍:災害復原切換特別適用於 OneLake 資料,其中包括 Lakehouse 和倉儲資料。 這個交換器不會影響你儲存在 OneLake 以外的資料。
Power BI 的 BCDR 持續性:雖然您可以開啟或關閉 OneLake 資料的災害復原,但無論此開關是啟用還是停用,Power BI 的 BCDR 一律受支援。
頻率:一旦你更改災難復原容量設定,必須等待30天才能再次更改。 等待期維持穩定,避免頻繁切換。
Note
啟用災難復原容量設定或在容量內建立新工作區後,資料複製可能需要一段時間才能開始。 你可以在容量設定頁面的 「分配給該容量的工作區」中查看每個工作空間的狀態。 OneLake 地理複製欄位顯示啟用地理複製的狀態。
資料複寫
當您開啟災害復原容量設定時,跨區域複寫會啟用為 OneLake 資料的災害復原功能。 Fabric 平台會根據 Azure 區域進行配置,以提供異地備援配對。 不過,某些區域沒有 Azure 配對區域,或配對區域不支援 Fabric。 針對這些區域,便無法使用資料複寫。 如需詳細資訊,請參閱具有可用性區域但沒有區域配對的區域和 Fabric 區域可用性。
Note
雖然 Fabric 在 OneLake 中提供資料複寫解決方案來支援災害復原,但有顯著的限制。 例如,KQL 資料庫和查詢集的資料會儲存在 OneLake 外部,這表示需要個別的災害復原方法。 如需每個 Fabric 項目的災害復原方法詳細資料,請參閱本文件的其餘部分。
Billing
Fabric 中的災害復原功能可讓您異地複寫資料,以提高安全性和可靠性。 此功能會耗用更多儲存體和交易,兩者分別會以 BCDR 儲存體和 BCDR 作業的形式計費。 您可以在 Microsoft Fabric 容量計量應用程式中監視和管理這些顯示為個別明細項目的成本。
如需所有相關災害復原成本的詳盡明細,以協助您據此進行規劃和編列預算,請參閱 OneLake 計算和儲存體耗用量。
設定災害復原
雖然 Fabric 提供災害復原功能來支援資料復原,但您必須遵循特定手動步驟,才能在中斷期間還原服務。 本節詳細說明為了針對潛在的中斷做好準備,您所應該採取的動作。
階段 1:準備
啟用災害復原容量設定:定期檢閱並設定災害復原容量設定,以確保其符合您的保護和效能需求。
建立資料備份:以符合災害復原方案的方式,將儲存在 OneLake 外部的重要資料複製到另一個區域。
階段 2:災害容錯移轉
當重大災難使主要區域無法恢復時,Microsoft Fabric 會啟動區域故障轉移。 在故障轉移完成前,你無法存取 Fabric 入口網站。 通知會發布在 Microsoft Fabric 支援頁面。
容錯移轉完成所需的時間可能不同,但通常不到一小時。 容錯移轉完成後,預期會有以下情況:
Fabric 入口網站:您可以存取入口網站,而且瀏覽現有工作區、工作區中的任務流程和項目等讀取作業會繼續運作。 所有寫入作業 (例如建立或修改工作區) 則會暫停。
Power BI:您可以執行讀取作業,例如顯示儀表板和報表。 不支援重新整理、報表發佈作業、儀表板和報表修改,以及其他需要變更中繼資料的作業。
Lakehouse/Warehouse:這些項目無法開啟,但可以透過 OneLake API 或工具存取檔案。
Spark 工作定義:你無法開啟 Spark 工作定義,但可以透過 OneLake API 或工具存取程式碼檔案。 任何元資料或設定都會在備援後被保存。
筆記本:你無法開啟筆記本,災難後程式碼內容也不會被保存。
ML 模型/實驗:您無法開啟 ML 模型或實驗。 程式碼內容和元資料(如執行指標和設定)在災難發生後不會被保存。
資料流程 Gen2/管線/Eventstream:您無法開啟這些項目,但可以使用受支援的災害復原目的地 (lakehouses 或倉儲) 來保護資料。
KQL 資料庫/查詢集:故障轉移後無法存取 KQL 資料庫和查詢集。 需要進行更多必要步驟才能保護 KQL 資料庫和查詢集中的資料。
在災難情境下,Fabric 入口網站和 Power BI 都處於唯讀模式,其他 Fabric 項目無法使用。 你可以透過 API 或第三方工具存取他們儲存在 OneLake 中的資料。 入口網站和 Power BI 都會保有對該資料執行讀寫作業的能力。 此能力可確保重要資料仍可供存取和可供修改,並降低業務營運的中斷可能性。
您可以透過多種管道存取 OneLake 資料:
OneLake ADLS Gen2 API:請參閱連線到 Microsoft OneLake
可連線到 OneLake 資料的工具範例:
Azure 儲存體總管:請參閱整合 OneLake 與 Azure 儲存體總管
OneLake 檔案總管:請參閱使用 OneLake 檔案總管來存取 Fabric 資料
在災害案例中,OneLake 目錄處於只讀模式:
探索索引標籤:您可以存取 [探索] 索引標籤來檢視所有專案和工作區,包括其元數據和相關詳細數據。
治理索引標籤:您可存取 [治理] 索引標籤,以檢視深入解析、建議的動作和治理工具 - 根據容錯轉移前的最近成功模型重新整理。
階段3:復原方案
雖然 Fabric 可確保資料在災害發生後仍可供存取,但您也可以採取行動,將其服務完全恢復到事件發生前的狀態。 本節提供逐步指南,以協助您完成復原程序。
復原步驟
在災害發生後,於任何區域中建立新的 Fabric 容量。 鑑於此類事件期間需求量大,選擇非主要地理區域的區域,以提高計算服務可用性的可能性。 有關建立容量的資訊,請參閱 Azure 中的購買 Fabric 容量。
在新建立的容量中建立工作區。 如有必要,請使用與舊工作區相同的名稱。
使用與您想要復原的項目相同的名稱建立項目。 如果您使用自訂指令碼來復原 Lakehouse 和倉儲,此步驟便很重要。
還原項目。 針對每個項目,請遵循體驗特定災害復原指導中的相關章節來還原項目。