Arquiteturas resilientes · tema 9 de 18
Balanceamento de carga e Auto Scaling
40 min · 2 vídeos · 14 cards · 1 drill
Por que cai
Aparece em metade dos cenários do Domínio 2 e reaparece nos de desempenho e custo. A prova cobra três decisões: qual balanceador (a pista está no protocolo e no tipo de roteamento), o que a verificação de integridade faz de fato, e a diferença entre repor capacidade e aumentar capacidade — que é o par Auto Scaling e política de escala.
Pré-teste · 1 de 2
responda antes de verUma aplicação precisa rotear /api para um conjunto de instâncias e /imagens para outro, no mesmo domínio. Qual balanceador atende?
Vídeo · português · 23 min
Em uma frase
O balanceador tira o alvo doente da rotação e distribui a carga; o Auto Scaling repõe o que morreu e ajusta a quantidade. Sem os dois, não há arquitetura resiliente na prova — e o par certo depende do protocolo e do tipo de variação da carga.
Os três balanceadores
| ALB | NLB | Gateway Load Balancer | |
|---|---|---|---|
| Camada | 7 (HTTP e HTTPS) | 4 (TCP, UDP, TLS) | 3 (GENEVE, porta 6081) |
| Roteia por | Caminho, host, cabeçalho, método, consulta | IP e porta | Não roteia: insere appliance no caminho |
| Endereço | Nome DNS (IP muda) | IP estático por zona, aceita Elastic IP | Endpoint na VPC |
| Alvos | Instância, IP, Lambda, outro ALB | Instância, IP, ALB | Appliances de rede |
| Pista no enunciado | Microsserviços, caminho, redirecionamento, autenticação | IP fixo, UDP, latência mínima, milhões de conexões, IP de origem preservado | Firewall de terceiro, inspeção transparente |
A decisão quase nunca é de gosto: o enunciado entrega a pista. "Rotear /api" só existe no ALB. "IP fixo para liberar no firewall do cliente" só existe no NLB. "Passar o tráfego por um appliance de inspeção" é o GWLB, que aparece pouco e com essa descrição exata.
Verificação de integridade: duas, e elas não são a mesma
verificação de integridade— Teste periódico que o balanceador faz em cada alvo. Ao falhar o limiar configurado, o alvo sai da rotação e deixa de receber tráfego.O ponto que a prova adora: o grupo de Auto Scaling tem a própria noção de saúde, e ela é configurável:
- Tipo EC2 (padrão): olha só o estado da instância e as checagens do hipervisor. Aplicação travada numa instância ligada continua "saudável".
- Tipo ELB: adota o resultado da verificação do balanceador. Aí sim, uma aplicação que devolve erro faz o grupo substituir a instância.
O sintoma clássico da questão: "o balanceador tirou a instância da rotação, mas ela nunca é substituída". A resposta é mudar o tipo de verificação para ELB.
Auto Scaling: repor e ajustar
grupo de Auto Scaling— Conjunto de instâncias criado a partir de um modelo de lançamento, com capacidade mínima, desejada e máxima, distribuído pelas sub-redes informadas.Ele faz duas coisas diferentes, e a prova separa:
- Repor: se uma instância falha, o grupo cria outra para voltar à capacidade desejada. Isso acontece mesmo sem nenhuma política de escala.
- Ajustar: mudar a capacidade desejada conforme a demanda. Isso é política de escala.
| Política | Como funciona | Quando é a resposta |
|---|---|---|
| Rastreamento de alvo | Mantém uma métrica num valor (CPU em 50%) | Carga variável e imprevisível; menor esforço |
| Por etapas | Degraus diferentes por faixa de alarme | Reação proporcional ao tamanho do desvio |
| Simples | Um ajuste por alarme, com cooldown | Legado; raramente a melhor resposta |
| Agendada | Muda a capacidade em horário definido | Pico conhecido: campanha, fechamento, horário comercial |
| Preditiva | Aprende o padrão histórico e antecipa | Padrão recorrente que você não quer agendar à mão |
Distribuir entre zonas
O grupo equilibra a capacidade entre as sub-redes que você informar, uma por zona. Depois de uma falha, ele reequilibra. É por isso que "adicionar sub-redes de uma segunda zona ao grupo de Auto Scaling" é uma resposta tão frequente: ela resolve falha de instância e de zona com uma mudança de configuração, sem arquitetura nova.
Os limites importam na leitura: a capacidade mínima é o piso que o grupo repõe; a máxima é o teto que protege a fatura quando algo dispara a escala — inclusive um ataque, o que liga este tema ao Shield Advanced.
Como responder o cenário
Leia o protocolo e o tipo de roteamento para escolher o balanceador. Leia o tipo de variação da carga para escolher a política. Confirme que a alternativa menciona mais de uma zona — sem isso, ela resolve metade do problema. E quando o sintoma for "a instância doente não é substituída", olhe o tipo de verificação de integridade do grupo antes de qualquer outra coisa.
Se quiser outro ângulo1 vídeo
Como cai na sabatina
“A aplicação precisa suportar picos imprevisíveis e sobreviver à falha de uma instância, com o MENOR custo. O que você desenha?”
Erros comuns
- Escolher NLB para roteamento por caminho ou por cabeçalho. NLB é camada 4: enxerga IP e porta, não URL. Roteamento por conteúdo é ALB.
- Escolher ALB quando o enunciado pede IP estático, latência ultrabaixa ou milhões de conexões por segundo. Isso é NLB, que ainda suporta protocolos além de HTTP.
- Achar que o balanceador dá alta disponibilidade sozinho. Ele distribui entre alvos saudáveis; se todos estão na mesma zona, a zona continua sendo o ponto único de falha.
- Confundir verificação de integridade do balanceador com a do Auto Scaling. A do balanceador tira o alvo da rotação; para o Auto Scaling substituir a instância, o grupo precisa usar o tipo de verificação ELB, não só EC2.
- Usar escala por agendamento para carga imprevisível, ou escala reativa para pico conhecido. Agendamento é para padrão previsível; rastreamento de alvo é para carga variável.
- Ignorar o período de estabilização (cooldown) e o aquecimento. Sem eles, o grupo escala em cascata reagindo a métricas de instâncias que ainda nem subiram.
Flashcards
Card 1 de 14
0 certos · 0 a reverDrill
Qual balanceador e qual política?
Para cada requisito, diga a escolha esperada na prova.
1.Rotear /checkout e /catalogo para conjuntos diferentes de instâncias.
2.Endereço IP fixo para os clientes liberarem no firewall deles.
3.Passar todo o tráfego por um firewall virtual de terceiro antes de chegar à aplicação.
4.Manter a CPU média do grupo perto de 50% com carga que varia sem padrão.
5.Toda segunda-feira às 9h o acesso triplica por duas horas.
6.Aplicação de jogos com UDP e latência crítica.
Quiz · 1 de 4
Uma empresa executa uma aplicação HTTP em instâncias EC2 e precisa que o tráfego de /api vá para um conjunto de instâncias e o restante para outro, com a aplicação continuando disponível se uma instância ou uma zona falhar. Qual solução atende?
Explique para um gerente
Explique em um minuto por que ter um balanceador na frente não adianta se todas as máquinas estão no mesmo lugar.
Se travar numa palavra técnica, é sinal de que ainda não entendeu essa parte.
Prefiro falar em voz alta
00:00
Toque para gravar, ou responda em voz alta sem gravar