O Problema: A 'Taxa de Rede' Multi-Cluster
Bora ser honesto: rodar vários clusters AKS é uma necessidade para muitas empresas. Compliance, disaster recovery, isolamento de falhas... os motivos são vários. Mas quando esses clusters precisam conversar entre si, a dor de cabeça começa. VPNs complexas, gateways, service discovery manual... É o que a Microsoft chama de "networking tax" (a taxa de rede).
E essa taxa está prestes a ser extinta! O Azure Kubernetes Fleet Manager anunciou o preview público da sua nova rede cross-cluster baseada em Cilium. Isso não é só mais um feature incremental, é uma mudança fundamental na forma como a gente pensa em arquiteturas multi-cluster na Azure.
O Fleet Manager já resolvia a propagação de workloads e a orquestração de updates. Mas a rede era o último obstáculo. Com essa novidade, a visão de um fleet unificado está ficando cada vez mais real. Olha só isso!

Como Funciona: Cilium + eBPF por baixo dos panos
A mágica acontece ao estender o modelo de rede do Kubernetes através das fronteiras dos clusters. E não é um protocolo proprietário, não! É construído sobre fundações open-source: Cilium para o dataplane e Kubefleet para a orquestração do fleet. Ambos são projetos da CNCF, garantindo transparência e alinhamento com o ecossistema.
No coração disso, o roteamento baseado em eBPF permite que os pods se comuniquem entre clusters com performance nativa. Nada de proxies ou gateways. Vamos ver os destaques:
- Conectividade Leste-Oeste Transparente: Pods se comunicam entre clusters como se estivessem no mesmo cluster.
- Descoberta de Serviço Global: Anotou o serviço com
service.cilium.io/global=truee ele automaticamente descobre os endpoints em todos os clusters membros. - Observabilidade Multi-Cluster: Métricas, logs e visibilidade de fluxo unificados para todo o fleet.
- Segurança Unificada: Aplique políticas de rede enterprise-grade em todos os clusters, não apenas em um.
Colocando a Mão na Massa
O setup é surpreendentemente simples. Primeiro, garanta que seus clusters tenham o Azure CNI powered by Cilium e o Advanced Container Networking Services (ACNS) habilitados. Depois:
- Adicione seus clusters a um Fleet.
- Associe os membros a um perfil de rede cross-cluster.
- Faça o deploy dos serviços com a anotação global.
# Exemplo: Criar um namespace e fazer deploy de um serviço global
kubectl create ns global-app
# Deploy da sua aplicação (simplificado)
kubectl apply -f - <<EOF
apiVersion: apps/v1
kind: Deployment
metadata:
name: app-deployment
namespace: global-app
spec:
replicas: 2
selector:
matchLabels:
app: my-app
template:
metadata:
labels:
app: my-app
spec:
containers:
- name: my-app
image: nginx:latest
EOF
# Expor como um Serviço Global
kubectl apply -f - <<EOF
apiVersion: v1
kind: Service
metadata:
name: my-global-service
namespace: global-app
annotations:
service.cilium.io/global: "true"
spec:
selector:
app: my-app
ports:
- port: 80
targetPort: 80
EOF
Depois de configurado, o Fleet Manager cuida de certificados e configurações de rede automaticamente. A dor de cabeça de configurar componentes Cilium multi-cluster manualmente acabou. Foco no aplicativo, não na infraestrutura!

Isso é o Futuro? (E Qual é o Porém?)
Essa é uma jogada e tanto da Microsoft. Mostra que eles veem o futuro do Kubernetes como inerentemente multi-cluster, e estão construindo a malha de rede para suportar isso. A resiliência estratégica fica clara: construir arquiteturas de "Shared Services" ou "Global Services" fica muito mais simples.
| Capacidade | Azure Fleet Manager (Novo) | VPN/Gateway Tradicional |
|---|---|---|
| Performance | Roteamento eBPF nativo | Adiciona latência com proxy |
| Descoberta de Serviço | Automática (Global Service) | Manual ou DNS externo |
| Políticas de Segurança | Unificadas entre clusters | Por cluster, complexas de gerenciar |
| Overhead Operacional | Zero-touch (gerenciado) | Alto (configuração e manutenção manual) |
As Limitações & Pontos de Atenção
É importante manter um olhar crítico sobre esse preview. A promessa é enorme, mas existem limitações:
- Pré-requisitos Obrigatórios: Você precisa estar rodando o Azure CNI powered by Cilium e o ACNS. Isso significa que não dá para usar com o kubenet padrão ou outros plugins de CNI.
- Foco na Azure: A integração é profunda com AKS e Fleet Manager. Se você tem um ambiente híbrido ou multi-cloud, essa funcionalidade não vai conectar seus clusters no GCP ou on-prem.
- Status de Preview: Como é um preview público, tenha cautela com workloads de produção. As funcionalidades podem mudar.
Próximos Passos para seus Estudos
Essa tecnologia é um ótimo exemplo da indústria se movendo em direção ao eBPF como padrão para rede de alta performance. Para sair na frente:
- Mergulhe no Cilium: Entender a arquitetura do Cilium é essencial para troubleshooting e para usar features avançadas.
- Explore o Advanced Container Networking Services: Conheça as funcionalidades de observabilidade e segurança que o ACNS oferece.
- Teste o Conceito de Serviço Global: Não fique só na leitura. Monte dois clusters e teste o failover você mesmo.
Para quem está construindo na Azure, isso é um divisor de águas. Remove um dos últimos argumentos contra uma arquitetura baseada em fleet. A pergunta não é mais "como escalar um cluster?", mas "como escalar todo o nosso fleet?".
Se você também está explorando como trazer resiliência similar para suas workloads de IA, dá uma olhada no nosso guia sobre NVIDIA DOCA In-Silicon Security para entender o blueprint de proteção para fábricas de IA.
![]()
Conclusão: A Fronteira do Cluster Não é Mais o Limite
A rede cross-cluster para o Fleet Manager é mais do que uma feature; é um habilitador estratégico. Ela efetivamente torna a fronteira do cluster transparente para as aplicações, permitindo que você construa sistemas verdadeiramente distribuídos e resilientes, sem a dor de cabeça operacional.
Para engenheiros de plataforma, essa é a ferramenta que vai permitir abstrair a complexidade da infraestrutura para os desenvolvedores. Para líderes de negócio, é um caminho para maior disponibilidade e expansão regional mais rápida.
O futuro do Kubernetes não é gerenciar um único cluster; é gerenciar um fleet. E com essa atualização, a rede finalmente está do seu lado. Vamos nessa!