Falha em Disco Local No SQL Server 2016 Always On Availability Groups: O Failover é Acionado Automaticamente?

lucaspedro 0 Pontos de reputação
2025-07-24T15:21:28.3566667+00:00

Olá,

Estou configurando um ambiente de SQL Server 2016 com Always On Availability Groups em um cluster de Windows Server 2016. Recentemente, removi um disco local que continha alguns bancos de dados do grupo de disponibilidade, mas o failover não foi acionado automaticamente.

De acordo com a documentação, o failover é desencadeado principalmente por falhas no SQL Server ou em recursos de cluster. No entanto, não encontrei clareza se falhas em discos locais, que não estão em Cluster Shared Volumes (CSV), devem ou não acionar o failover automaticamente. Quando um disco que armazena bancos de dados falha, mas o serviço do SQL Server e o cluster permanecem estáveis, o failover deve ocorrer ou ele precisa ser realizado manualmente?

Alguém já passou por isso ou pode esclarecer se esse comportamento está correto? Alguma configuração adicional deve ser feita para forçar o failover quando ocorrerem falhas de disco em bancos de dados no Always On?

SQL Server | Outro
SQL Server | Outro

Recursos e tópicos adicionais do SQL Server não abordados em categorias específicas


Resposta recomendada pelo moderador

Dio Xavier 290.3K Pontos de reputação Moderador Voluntário
2025-07-24T23:23:19.9533333+00:00

Olá

Bem vindo à Comunidade Microsoft

Tudo bem, Lucas? Obrigado por compartilhar sua dúvida — ela é bastante pertinente ao cenário de alta disponibilidade com o Always On Availability Groups.

Tecnicamente, o comportamento que você observou está de acordo com o design do SQL Server Always On. O mecanismo de failover automático é acionado apenas quando há falhas críticas detectadas no SQL Server ou na instância do WSFC (Windows Server Failover Cluster) — por exemplo, perda da instância, parada do serviço SQL Server ou falha de quorum. A falha de disco local que não está em CSV e não interrompe o serviço ou o cluster não dispara failover automático, pois o WSFC não tem visibilidade direta sobre o estado dos discos locais de cada nó.

Pontos importantes:

  • Always On Availability Groups não monitora diretamente falhas de disco.
  • Se um disco local falhar, os bancos de dados nesse volume podem entrar em estado de "suspenso", mas a instância permanece online, impedindo o failover automático.
  • Monitoramento externo pode ser implementado (via scripts ou ferramentas como SCOM) para detectar falhas de I/O e disparar failover manual, caso necessário.

Health checks personalizados com sp_server_diagnostics podem ser utilizados para aumentar a sensibilidade a falhas, mas exigem configuração avançada.

Sugestão:

Se há necessidade de failover automático em falhas de disco, considere:

  • Migrar os dados para volumes compartilhados com maior visibilidade pelo cluster, como CSV ou Storage Spaces Direct.

Avaliar o uso de monitoração adicional para automatizar o failover com base em falhas de acesso aos arquivos de dados.

Documentação técnica recomendada:

Configure Failover Conditions for an Availability Group

Esta resposta foi útil?

0 comentários Sem comentários

0 respostas adicionais

Classificar por: Mais útil

Sua resposta

As respostas podem ser marcadas como ‘Aceitas’ pelo autor da pergunta e ‘Recomendadas’ pelos moderadores, o que ajuda os usuários a saber a resposta que resolveu o problema do autor.