Recursos e tópicos adicionais do SQL Server não abordados em categorias específicas
Olá
Bem vindo à Comunidade Microsoft
Tudo bem, Lucas? Obrigado por compartilhar sua dúvida — ela é bastante pertinente ao cenário de alta disponibilidade com o Always On Availability Groups.
Tecnicamente, o comportamento que você observou está de acordo com o design do SQL Server Always On. O mecanismo de failover automático é acionado apenas quando há falhas críticas detectadas no SQL Server ou na instância do WSFC (Windows Server Failover Cluster) — por exemplo, perda da instância, parada do serviço SQL Server ou falha de quorum. A falha de disco local que não está em CSV e não interrompe o serviço ou o cluster não dispara failover automático, pois o WSFC não tem visibilidade direta sobre o estado dos discos locais de cada nó.
Pontos importantes:
- Always On Availability Groups não monitora diretamente falhas de disco.
- Se um disco local falhar, os bancos de dados nesse volume podem entrar em estado de "suspenso", mas a instância permanece online, impedindo o failover automático.
- Monitoramento externo pode ser implementado (via scripts ou ferramentas como SCOM) para detectar falhas de I/O e disparar failover manual, caso necessário.
Health checks personalizados com sp_server_diagnostics podem ser utilizados para aumentar a sensibilidade a falhas, mas exigem configuração avançada.
Sugestão:
Se há necessidade de failover automático em falhas de disco, considere:
- Migrar os dados para volumes compartilhados com maior visibilidade pelo cluster, como CSV ou Storage Spaces Direct.
Avaliar o uso de monitoração adicional para automatizar o failover com base em falhas de acesso aos arquivos de dados.
Documentação técnica recomendada: