Confiabilidade no Migrador de Armazenamento do Azure

Armazenamento do Azure Mover é um serviço totalmente gerenciado que migra arquivos e pastas para Armazenamento do Azure e mantém arquivos sincronizados entre contas de armazenamento. Use o Gerenciador de Armazenamento quando estiver movendo dados para Azure ou quando precisar manter os dados sincronizados entre diferentes locais dentro de Azure.

Quando você usa o Azure, a confiabilidade é uma responsabilidade compartilhada. A Microsoft fornece uma variedade de recursos para dar suporte à resiliência e recuperação. Você é responsável por entender como esses recursos funcionam em todos os serviços que você usa e selecionar os recursos necessários para atender aos seus objetivos de negócios e metas de tempo de atividade.

Este artigo descreve como Armazenamento do Azure Mover responde a uma variedade de possíveis interrupções e problemas, incluindo falhas transitórias, falhas na zona de disponibilidade e falhas em toda a região. Ele também descreve como proteger a configuração do Storage Mover.

Important

Este artigo aborda a confiabilidade do serviço Armazenamento do Azure Mover e apenas de seus recursos. A confiabilidade de uma migração de ponta a ponta depende de todos os componentes: o serviço do Storage Mover, todos os agentes do Storage Mover que você implantar, o ambiente de origem e a conectividade de rede e a conta de armazenamento de destino. Você é responsável pela confiabilidade de agentes, sistemas de origem e armazenamento de destino. Para obter mais informações sobre confiabilidade Armazenamento do Azure, consulte Confiabilidade em Armazenamento de Blobs do Azure e Confiabilidade no Arquivos do Azure.

Visão geral da arquitetura de confiabilidade

Esta seção descreve alguns dos aspectos importantes de como o serviço funciona que são mais relevantes do ponto de vista da confiabilidade. A seção apresenta a arquitetura lógica, que inclui alguns dos recursos e recursos que você implanta e usa. Também discute a arquitetura física, que fornece detalhes sobre como o serviço funciona nos bastidores.

Arquitetura lógica

Armazenamento do Azure Mover foi projetado para migrar e sincronizar dados entre locais de armazenamento, não para atender solicitações no caminho de runtime de uma carga de trabalho de produção. Ele tem uma hierarquia de recursos que define os componentes que você implanta e gerencia. O recurso de nível superior é chamado de storage mover. Em um mover de armazenamento, você define projetos que contêm definições de trabalho que descrevem o que migrar e para onde. Endpoints definem os locais de origem e destino para um trabalho de migração ou sincronização.

Para alguns cenários, como migrações de ambientes locais, você também implanta um ou mais agentes do Storage Mover. Um agente é um software que você executa em uma máquina que você controla, como uma máquina virtual ou uma máquina física. Alguns cenários não exigem um agente.

O serviço armazena metadados de configuração, incluindo projetos, endpoints, registros de agentes, definições de trabalho e histórico de execução de trabalhos. Esses metadados não incluem os dados migrados.

Arquitetura física

O serviço Armazenamento do Azure Mover é executado na infraestrutura gerenciada por Microsoft. Os agentes são executados no hardware que você gerencia. Você é responsável pela confiabilidade dos agentes, que está fora do escopo deste artigo.

Resiliência a falhas transitórias

Falhas transitórias são falhas curtas e intermitentes nos componentes. Elas ocorrem com frequência em um ambiente distribuído, como a nuvem, e são uma parte normal das operações. Falhas transitórias se corrigem após um curto período de tempo. É importante que seus aplicativos possam lidar com falhas transitórias, geralmente repetindo solicitações afetadas.

Todos os aplicativos hospedados na nuvem devem seguir as diretrizes transitórias de tratamento de falhas do Azure quando eles se comunicam com qualquer APIs, bancos de dados e outros componentes hospedados na nuvem. Para obter mais informações, consulte Recomendações para resolver falhas transitórias.

Se uma falha transitória afetar a comunicação entre um agente e o serviço Storage Mover, ou ocorrer ao se conectar a uma origem ou a um destino, o agente tentará novamente automaticamente. Para tarefas de Azure para Azure, o serviço também é resistente a muitas falhas transitórias. Quando a conectividade é restaurada, os trabalhos de migração em andamento são retomados.

Em alguns casos, falhas transitórias aparecem como erros no histórico de execuções de trabalho. Para obter uma descrição dos códigos de erro, incluindo erros transitórios, consulte códigos de status e tipos de erro do Armazenamento do Azure Mover. Para obter orientações sobre como resolver problemas persistentes de conectividade de rede, consulte Solucionar problemas de conectividade de rede do Armazenamento do Azure Mover.

Resiliência a falhas de zona de disponibilidade

As zonas de disponibilidade são grupos fisicamente separados de datacenters em uma região do Azure. Quando uma zona falha, os serviços podem fazer o failover de uma das zonas restantes.

Em regiões que oferecem suporte a zonas de disponibilidade, a plataforma distribui os metadados de configuração de um Storage Mover entre as zonas, na medida do possível, mas esse comportamento não é garantido. Se as migrações de armazenamento precisarem suportar a perda de uma zona, projete o processo de migração para tolerar a perda de um mover de armazenamento e examine a resiliência para falhas em toda a região.

Considere o efeito de uma falha de zona no contexto de como você usa o Storage Mover. O serviço orquestra a migração e a sincronização de dados e normalmente não está no caminho de execução da sua carga de trabalho de produção. Se um mover de armazenamento não estiver disponível durante uma falha de zona, um trabalho de migração ou sincronização geralmente será atrasado em vez de causar uma interrupção de produção e você poderá retomar ou repetir o trabalho após a recuperação do serviço. O Storage Mover também não oferece um acordo de nível de serviço (SLA) de disponibilidade, portanto seu projeto não deve presumir que o serviço esteja continuamente disponível. Se sua carga de trabalho depender da sincronização contínua, avalie se esse tipo de atraso é aceitável para seu cenário.

O diagrama a seguir mostra um mover de armazenamento com metadados de infraestrutura e configuração espalhados por três zonas:

Diagrama de um migrador de armazenamento com redundância de zona que se espalha por três zonas de disponibilidade.

Note

A confiabilidade de qualquer migração de dados também depende das contas de armazenamento e dos agentes que você usa. Por exemplo, se sua conta de armazenamento de destino usa LRS (armazenamento com redundância local), ela não é resiliente a uma falha de zona. Para tornar uma migração resiliente a uma falha de zona, use uma conta de armazenamento de destino com redundância de zona.

Requisitos

Suporte da região: A distribuição em regime de melhor esforço dos metadados de configuração entre zonas só pode ocorrer em uma região que ofereça suporte ao Storage Mover e às zonas de disponibilidade. Verifique a disponibilidade da região do Storage Mover e compare-a com a lista de regiões que dão suporte a zonas de disponibilidade. Mesmo nessas regiões, a resiliência de zona não é garantida.

Custo

O Storage Mover não oferece suporte a zonas de disponibilidade configuráveis, portanto, não há custos extras associados a zonas de disponibilidade. Para obter mais informações sobre como o Storage Mover é cobrado, consulte Entendendo a cobrança do Armazenamento do Azure Mover.

Configurar o suporte à zona de disponibilidade

O Storage Mover não oferece suporte a zonas de disponibilidade configuráveis, portanto, não há nada que você precise habilitar nem ao que aderir. Para obter mais informações sobre como criar um recurso do Storage Mover, consulte Planejamento de implantação para Armazenamento do Azure Mover.

Comportamento quando todas as zonas estão saudáveis

Esta seção descreve o que esperar quando um mover de armazenamento está em uma região que dá suporte a zonas de disponibilidade e todas as zonas estão operacionais.

  • Operação entre zonas: A infraestrutura em qualquer uma das zonas de disponibilidade na região pode atender a operações de gerenciamento e acesso a metadados. As conexões do agente podem alcançar o serviço por meio de qualquer zona.

  • Distribuição de dados entre zonas: O serviço visa replicar metadados de configuração de forma síncrona entre zonas de disponibilidade na região.

Comportamento durante uma falha de zona

Esta seção descreve o que esperar quando um mover de armazenamento está em uma região que dá suporte a zonas de disponibilidade e há uma interrupção em uma das zonas.

  • Detecção e resposta: A plataforma foi projetada para detectar a perda de uma zona de disponibilidade e redirecionar o tráfego para zonas íntegras, mas essa resposta é de melhor esforço e não é garantida.
  • Notificação: a Microsoft não notifica você automaticamente quando uma zona está inativa. No entanto, você pode usar Azure Resource Health para monitorar a integridade de um recurso individual e pode configurar alertas Resource Health para notificar você sobre problemas. Você também pode usar Integridade do Serviço do Azure para entender a integridade geral do serviço, incluindo quaisquer falhas de zona, e você pode configurar alertas Service Health para notificar você sobre problemas.
  • Solicitações ativas: As operações de gerenciamento em andamento que dependem da infraestrutura na zona afetada podem falhar e você precisa repeti-las. Trabalhos de migração de dados ativos executados em agentes podem continuar a ser executados, mas as operações de gerenciamento que dependem do serviço de metadados podem estar indisponíveis.

  • Perda de dados esperada: Os dados que um mover de armazenamento está migrando não são perdidos durante uma falha de zona.

    Como o Gerenciador de Armazenamento não garante que os metadados de configuração sejam distribuídos entre zonas, uma falha de zona pode tornar alguns dos metadados de configuração do mover de armazenamento temporariamente indisponíveis até que a zona se recupere.

  • Tempo de inatividade esperado: A plataforma tenta restaurar as operações usando outra zona, mas em algumas situações as operações podem ficar indisponíveis até que a zona afetada se recupere. Prepare sua carga de trabalho seguindo as diretrizes transitórias de tratamento de falhas.

  • Redistribuição: Se a plataforma redirecionar o tráfego para zonas de disponibilidade saudáveis, ela o fará na medida do possível.

Recuperação de zona

Quando uma zona de disponibilidade é recuperada, a plataforma visa restaurar a capacidade na zona recuperada e reequilibrar o tráfego entre zonas. Esse comportamento é de melhor esforço e não é garantido. Você não precisa tomar nenhuma ação para iniciar a recuperação de zona.

Testar falhas em zonas

Você não pode iniciar nem testar uma falha em uma zona de disponibilidade para um migrador de armazenamento. Como o Storage Mover não garante resiliência de zona, não presuma que o Storage Mover sobreviverá a uma falha de zona. Se o seu processo de migração precisar resistir à perda de uma zona, valide você mesmo a resiliência de ponta a ponta desse processo e consulte Resiliência a falhas em toda uma região para conhecer abordagens que permitem controlar o failover.

Resiliência a falhas em toda a região

Armazenamento do Azure Mover é um serviço de região única. Ao implantar um recurso Armazenamento do Azure Mover, selecione uma região para armazenar os metadados de configuração do recurso. Se a região do mover de armazenamento sofrer uma interrupção, as operações de gerenciamento realizadas pelo agente e que dependem do Azure poderão não ser concluídas. Além disso, as migrações de dados ativas para contas de armazenamento localizadas na região afetada podem falhar.

Se o seu mover de armazenamento estiver em uma região do Azure com uma região emparelhada, seus metadados de configuração serão replicados para a região emparelhada do Azure para fins de recuperação de desastres, e a Microsoft poderá acionar o failover para a região emparelhada durante um desastre que afete sua região primária.

Se o seu migrador de armazenamento estiver em uma região não emparelhada, a Microsoft não replicará os metadados de configuração, e não haverá failover integrado para outra região. No entanto, você pode implantar recursos separados em várias regiões. Nesse cenário, é sua responsabilidade gerenciar a replicação, a distribuição de tráfego e o failover. Se usar uma região não emparelhada ou se a replicação de metadados integrada não atender às suas necessidades, você poderá criar uma estratégia personalizada de failover de várias regiões.

Note

Você é responsável pela recuperação de desastre para suas fontes de dados (incluindo Azure e fontes de dados locais), destinos e agentes.

Failover gerenciado pela Microsoft para uma região emparelhada

Se o recurso do Storage Mover estiver em uma região emparelhada com outra região, Microsoft replicará os metadados de configuração do seu mover de armazenamento para a região emparelhada.

Diagrama de um storage mover replicando seus metadados para uma região emparelhada.

No caso de indisponibilidade de uma região, a Microsoft pode realizar um failover para a região emparelhada por meio dos metadados de configuração replicados. Esse processo é uma opção padrão e não requer nenhuma intervenção de você.

Diagrama de um migrador de armazenamento fazendo failover para uma região emparelhada.

O failover de recursos do Storage Mover pode ocorrer em um momento diferente de qualquer failover de outros serviços de Azure.

Important

É improvável que a Microsoft inicie o failover, exceto após um atraso significativo, e isso é feito em regime de melhor esforço. Se você precisar cumprir prazos específicos para a recuperação do Migrador de Armazenamento, ou se o comportamento padrão de replicação e failover não atender às suas necessidades, use soluções personalizadas de várias regiões para resiliência para planejar e iniciar seu próprio failover.

A replicação entre regiões se aplica somente aos metadados de configuração. Ele não se aplica aos dados de origem nem à conta de armazenamento de destino, que tem suas próprias opções de confiabilidade e replicação. Para obter mais informações, consulte Confiabilidade em Armazenamento de Blobs do Azure e Confiabilidade no Arquivos do Azure.

Requisitos

Suporte à região: a replicação entre regiões gerenciada por Microsoft está disponível apenas para recursos do Storage Mover que você implanta em uma região que tem uma região emparelhada. Para os recursos em regiões não emparelhadas, não há replicação entre regiões nem failover disponível. Para obter resiliência entre regiões em regiões não emparelhadas, use uma solução personalizada de várias regiões.

Custo

O Migrador de Armazenamento não cobra pela replicação entre regiões gerenciada pela Microsoft da configuração do seu Migrador de Armazenamento. No entanto, pode haver uma pequena cobrança pela replicação entre regiões. Para saber mais, confira Preços de largura de banda.

Configurar o suporte a várias regiões

A replicação entre regiões gerenciada pela Microsoft é habilitada automaticamente para recursos do Storage Mover em regiões emparelhadas. Você não configura ou aceita esse comportamento.

Comportamento quando todas as regiões estão saudáveis

Esta seção descreve o que esperar quando um migrador de armazenamento é configurado para failover e replicação entre regiões e a região primária está operacional.

  • Operação entre regiões: Seu recurso do Storage Mover na região primária processa todas as solicitações. A região emparelhada é usada somente em caso de failover iniciado pela Microsoft.

  • Replicação de dados entre regiões: A região primária replica a configuração de forma assíncrona para a região emparelhada. Como a replicação é assíncrona, as alterações recentes na configuração podem não ser refletidas na região emparelhada no momento de uma falha.

Comportamento durante uma falha de região

Esta seção descreve o que esperar quando um migrador de armazenamento é configurado para failover e replicação entre regiões e há uma interrupção na região primária.

  • Detecção e resposta: Microsoft detecta falhas na região e decide se deseja iniciar um failover. É improvável que a Microsoft inicie o failover, a menos que haja um atraso significativo, e o failover é realizado em regime de melhor esforço.
  • Notificação: a Microsoft não notifica você automaticamente quando uma região está inoperante. No entanto:

  • Solicitações ativas: As solicitações de gerenciamento ativo são descartadas e precisam ser repetidas após a conclusão do failover. Os trabalhos ativos de migração de dados executados em agentes poderão falhar se dependerem da região que está enfrentando a interrupção.

  • Perda de dados esperada: Como a replicação entre regiões é assíncrona, quaisquer alterações de metadados de configuração que não são replicadas para a região emparelhada no momento da interrupção podem ser perdidas.

  • Tempo de inatividade esperado: Um failover de região pode levar até 24 horas para ser concluído. Durante esse tempo, o migrador de armazenamento não estará disponível.

  • Redistribuição: após a conclusão do failover, o Migrador de Armazenamento começa a executar trabalhos na região emparelhada.

    No entanto, você precisa registrar novamente os agentes junto ao mecanismo de movimentação de armazenamento na região emparelhada.

Recuperação de região

Quando a região primária original é recuperada, a Microsoft coordena o failback. Você precisa registrar novamente os agentes junto ao migrador de armazenamento na região primária.

Teste de falhas na região

A plataforma Armazenamento do Azure Mover gerencia a replicação entre regiões, failover e recuperação de região. Como Microsoft gerencia totalmente esse recurso, você não pode iniciar ou testar um failover de região.

Soluções personalizadas de várias regiões para resiliência

Se você precisar controlar quando o failover ocorre, ou se estiver em uma região não emparelhada, mas ainda precisar que seu Storage Mover seja resiliente a falhas regionais, implante recursos independentes do Storage Mover em várias regiões do Azure. Você é responsável por todos os aspectos dessa abordagem, incluindo:

  • Criando e mantendo projetos, endpoints, agentes e definições de trabalho equivalentes em cada região.
  • Detectando falhas de região e decidindo quando fazer failover.
  • Redirecionando agentes e tarefas de migração para a região secundária.
  • Reconciliando o estado do trabalho e o histórico de execuções entre regiões.

Uma solução personalizada com várias regiões funciona tanto em regiões emparelhadas quanto em regiões não emparelhadas e oferece controle total sobre o processo de failover.

Para obter mais informações, consulte a recuperação de desastre iniciada pelo cliente para Armazenamento do Azure Mover.

Backup e restauração

Armazenamento do Azure Mover é um serviço de orquestração de migração e movimentação de dados. Ele não armazena os dados que você migra. O serviço armazena apenas metadados de configuração, como projetos, pontos de extremidade, definições de trabalho e histórico de execução de trabalho. Não há dados de migração para fazer backup.

Para proteger a configuração do Storage Mover, defina seus recursos usando a infraestrutura como código, como arquivos Bicep e armazene essas definições no controle do código-fonte. Se você precisar recriar um recurso, poderá reimplantá-lo de sua configuração armazenada.

Para a maioria das soluções, você não deve depender exclusivamente de backups. Em vez disso, use as outras funcionalidades descritas neste guia para dar suporte aos seus requisitos de resiliência. No entanto, os backups protegem contra alguns riscos que outras abordagens não protegem. Para obter mais informações, consulte O que são redundância, replicação e backup?.

Resiliência à manutenção do serviço

A Microsoft aplica regularmente as atualizações de serviço e executa outras manutenções. A plataforma Azure manipula essas atividades automaticamente, garantindo que a manutenção seja perfeita e transparente para você. Não se espera tempo de inatividade durante eventos de manutenção, a menos que você tenha sido avisado por meio de manutenção planejada do Integridade do Serviço do Azure.

Os agentes do Storage Mover são atualizados automaticamente.

Contrato de nível de serviço

O Storage Mover é um serviço de migração e não oferece um SLA (contrato de nível de serviço) de disponibilidade. No entanto, a documentação do Storage Mover descreve as metas de desempenho e escala esperadas. Essas metas são baseadas em migrações simuladas e não constituem garantia nem compromisso.