Introdução
E aí, pessoal! Vamos falar sobre um assunto que é crucial para qualquer empresa que trabalha com dados críticos: recuperação de desastres (DR). Para serviços financeiros, o jogo é ainda mais sério. Quando acontece uma queda regional, os clientes precisam de acesso ininterrupto aos dados, e os objetivos de tempo de recuperação (RTO) e ponto de recuperação (RPO) são medidos em minutos, não em horas.
A S&P Global Market Intelligence enfrentou exatamente esse desafio com a plataforma Capital IQ. E a solução deles foi genial: usar o Amazon FSx for NetApp ONTAP para criar um failover em modo somente leitura em menos de 15 minutos. Vamos ver como eles fizeram isso!
![]()
A Solução: SnapMirror + FlexClone
A estratégia da S&P Global tem duas frentes:
- Failover imediato para DR em modo somente leitura – usando snapshots ONTAP e tecnologia FlexClone para recuperação em menos de 15 minutos.
- Conversão de somente leitura para leitura-escrita – seguindo um design de geo-cluster com replicação SnapMirror.
Como o FlexClone Funciona
Os volumes FlexClone são criados a partir de snapshots SnapMirror existentes na região de DR. O processo é automatizado diariamente, identificando o snapshot mais recente e criando um clone que pode ser apresentado a uma instância SQL Server somente leitura. Aqui está um comando CLI típico:
# Cria um volume FlexClone a partir do snapshot SnapMirror mais recente
volume clone create \
-vserver dr-svm \
-flexclone ciq_data_readonly \
-parent-volume ciq_data_mirror \
-parent-snapshot snapmirror.latest \
-type RW
Esse comando cria um clone leitura-escrita (embora usado como somente leitura inicialmente) que compartilha blocos de dados com o volume pai, minimizando a sobrecarga de armazenamento.

Vantagens e Pontos de Atenção
Vantagens
- Recuperação em menos de 15 minutos: A criação do FlexClone leva menos de 2 minutos, tornando o failover uma simples troca de tráfego.
- Eficiência de armazenamento: Os clones compartilham blocos de dados, reduzindo custos de armazenamento na DR.
- Isolamento operacional: Os clones não interferem na replicação SnapMirror em andamento.
- Além dos desastres: As instâncias somente leitura também suportam disponibilidade durante lançamentos de código em produção.
Limitações e Cuidados
Apesar de poderoso, é importante considerar:
- RPO variável: O RPO real depende da atividade de produção. Durante altos volumes de transações, a perda de dados pode se aproximar de 15 minutos.
- Complexidade: Implementar um cluster WSFC geo-distribuído entre regiões exige bastante conhecimento técnico.
- Custo: Embora os custos de armazenamento sejam reduzidos, os custos de computação e rede para uma configuração multi-região podem ser altos.
Se você está começando com DR na AWS, vale a pena dar uma olhada na documentação oficial para entender os conceitos básicos.

Conclusão
A implementação da S&P Global mostra que é possível ter uma DR rápida sem abrir mão da eficiência de custos. Ao combinar replicação SnapMirror com tecnologia FlexClone, eles construíram uma solução mais rápida, enxuta e flexível que as abordagens tradicionais on-premises. Para organizações do setor financeiro que estão migrando para a nuvem, esse é um blueprint comprovado: replique o que funciona, modernize como funciona e mantenha o mesmo nível de proteção de dados.
Próximos Passos
- Aprofunde-se nos recursos de segurança e replicação do Amazon FSx for NetApp ONTAP.
- Explore como automatizar a criação de FlexClones usando AWS Lambda ou outras ferramentas de orquestração.
- Estude padrões de geo-cluster para SQL Server na AWS.
Para mais insights sobre arquitetura de nuvem e gestão de dados, confira nosso guia sobre programação GPU ou este tutorial sobre indexação Pandas.