Pular para o conteúdo

Tema

Arquiteturas resilientes · tema 9 de 18

Balanceamento de carga e Auto Scaling

40 min · 2 vídeos · 14 cards · 1 drill

Por que cai

Aparece em metade dos cenários do Domínio 2 e reaparece nos de desempenho e custo. A prova cobra três decisões: qual balanceador (a pista está no protocolo e no tipo de roteamento), o que a verificação de integridade faz de fato, e a diferença entre repor capacidade e aumentar capacidade — que é o par Auto Scaling e política de escala.

Pré-teste · 1 de 2

responda antes de ver

Uma aplicação precisa rotear /api para um conjunto de instâncias e /imagens para outro, no mesmo domínio. Qual balanceador atende?

Quanta certeza você tem?

Vídeo · português · 23 min

Feito para prova, em português, e cobre exatamente o par deste tema. Assista anotando os tipos de balanceador e em que camada cada um trabalha; é a pista que a questão dá no enunciado.

Em uma frase

O balanceador tira o alvo doente da rotação e distribui a carga; o Auto Scaling repõe o que morreu e ajusta a quantidade. Sem os dois, não há arquitetura resiliente na prova — e o par certo depende do protocolo e do tipo de variação da carga.

Os três balanceadores

ALBNLBGateway Load Balancer
Camada7 (HTTP e HTTPS)4 (TCP, UDP, TLS)3 (GENEVE, porta 6081)
Roteia porCaminho, host, cabeçalho, método, consultaIP e portaNão roteia: insere appliance no caminho
EndereçoNome DNS (IP muda)IP estático por zona, aceita Elastic IPEndpoint na VPC
AlvosInstância, IP, Lambda, outro ALBInstância, IP, ALBAppliances de rede
Pista no enunciadoMicrosserviços, caminho, redirecionamento, autenticaçãoIP fixo, UDP, latência mínima, milhões de conexões, IP de origem preservadoFirewall de terceiro, inspeção transparente

A decisão quase nunca é de gosto: o enunciado entrega a pista. "Rotear /api" só existe no ALB. "IP fixo para liberar no firewall do cliente" só existe no NLB. "Passar o tráfego por um appliance de inspeção" é o GWLB, que aparece pouco e com essa descrição exata.

Verificação de integridade: duas, e elas não são a mesma

verificação de integridadeTeste periódico que o balanceador faz em cada alvo. Ao falhar o limiar configurado, o alvo sai da rotação e deixa de receber tráfego.

O ponto que a prova adora: o grupo de Auto Scaling tem a própria noção de saúde, e ela é configurável:

  • Tipo EC2 (padrão): olha só o estado da instância e as checagens do hipervisor. Aplicação travada numa instância ligada continua "saudável".
  • Tipo ELB: adota o resultado da verificação do balanceador. Aí sim, uma aplicação que devolve erro faz o grupo substituir a instância.

O sintoma clássico da questão: "o balanceador tirou a instância da rotação, mas ela nunca é substituída". A resposta é mudar o tipo de verificação para ELB.

Auto Scaling: repor e ajustar

grupo de Auto ScalingConjunto de instâncias criado a partir de um modelo de lançamento, com capacidade mínima, desejada e máxima, distribuído pelas sub-redes informadas.

Ele faz duas coisas diferentes, e a prova separa:

  • Repor: se uma instância falha, o grupo cria outra para voltar à capacidade desejada. Isso acontece mesmo sem nenhuma política de escala.
  • Ajustar: mudar a capacidade desejada conforme a demanda. Isso é política de escala.
PolíticaComo funcionaQuando é a resposta
Rastreamento de alvoMantém uma métrica num valor (CPU em 50%)Carga variável e imprevisível; menor esforço
Por etapasDegraus diferentes por faixa de alarmeReação proporcional ao tamanho do desvio
SimplesUm ajuste por alarme, com cooldownLegado; raramente a melhor resposta
AgendadaMuda a capacidade em horário definidoPico conhecido: campanha, fechamento, horário comercial
PreditivaAprende o padrão histórico e antecipaPadrão recorrente que você não quer agendar à mão

Distribuir entre zonas

O grupo equilibra a capacidade entre as sub-redes que você informar, uma por zona. Depois de uma falha, ele reequilibra. É por isso que "adicionar sub-redes de uma segunda zona ao grupo de Auto Scaling" é uma resposta tão frequente: ela resolve falha de instância e de zona com uma mudança de configuração, sem arquitetura nova.

Os limites importam na leitura: a capacidade mínima é o piso que o grupo repõe; a máxima é o teto que protege a fatura quando algo dispara a escala — inclusive um ataque, o que liga este tema ao Shield Advanced.

Como responder o cenário

Leia o protocolo e o tipo de roteamento para escolher o balanceador. Leia o tipo de variação da carga para escolher a política. Confirme que a alternativa menciona mais de uma zona — sem isso, ela resolve metade do problema. E quando o sintoma for "a instância doente não é substituída", olhe o tipo de verificação de integridade do grupo antes de qualquer outra coisa.

Se quiser outro ângulo1 vídeo
Complementar e mais fundo, do mesmo autor: entra nas políticas de escala e nas verificações de integridade. Vale se o primeiro vídeo deixou dúvida sobre quando o grupo substitui uma instância.

Como cai na sabatina

A aplicação precisa suportar picos imprevisíveis e sobreviver à falha de uma instância, com o MENOR custo. O que você desenha?

Erros comuns

  • Escolher NLB para roteamento por caminho ou por cabeçalho. NLB é camada 4: enxerga IP e porta, não URL. Roteamento por conteúdo é ALB.
  • Escolher ALB quando o enunciado pede IP estático, latência ultrabaixa ou milhões de conexões por segundo. Isso é NLB, que ainda suporta protocolos além de HTTP.
  • Achar que o balanceador dá alta disponibilidade sozinho. Ele distribui entre alvos saudáveis; se todos estão na mesma zona, a zona continua sendo o ponto único de falha.
  • Confundir verificação de integridade do balanceador com a do Auto Scaling. A do balanceador tira o alvo da rotação; para o Auto Scaling substituir a instância, o grupo precisa usar o tipo de verificação ELB, não só EC2.
  • Usar escala por agendamento para carga imprevisível, ou escala reativa para pico conhecido. Agendamento é para padrão previsível; rastreamento de alvo é para carga variável.
  • Ignorar o período de estabilização (cooldown) e o aquecimento. Sem eles, o grupo escala em cascata reagindo a métricas de instâncias que ainda nem subiram.

Flashcards

Card 1 de 14

0 certos · 0 a rever

Drill

Qual balanceador e qual política?

Para cada requisito, diga a escolha esperada na prova.

  1. 1.Rotear /checkout e /catalogo para conjuntos diferentes de instâncias.

  2. 2.Endereço IP fixo para os clientes liberarem no firewall deles.

  3. 3.Passar todo o tráfego por um firewall virtual de terceiro antes de chegar à aplicação.

  4. 4.Manter a CPU média do grupo perto de 50% com carga que varia sem padrão.

  5. 5.Toda segunda-feira às 9h o acesso triplica por duas horas.

  6. 6.Aplicação de jogos com UDP e latência crítica.

Quiz · 1 de 4

Uma empresa executa uma aplicação HTTP em instâncias EC2 e precisa que o tráfego de /api vá para um conjunto de instâncias e o restante para outro, com a aplicação continuando disponível se uma instância ou uma zona falhar. Qual solução atende?

Explique para um gerente

Explique em um minuto por que ter um balanceador na frente não adianta se todas as máquinas estão no mesmo lugar.

Se travar numa palavra técnica, é sinal de que ainda não entendeu essa parte.

Prefiro falar em voz alta

00:00

Toque para gravar, ou responda em voz alta sem gravar

Para ir além3 artigos