Sobes.tech
Junior — Middle

Pode explicar o conceito de escalabilidade no Kubernetes e como é implementado?

sobes.tech IA

Resposta da IA

A escalabilidade no Kubernetes é o processo de aumentar ou diminuir a quantidade de pods (unidades de implantação de aplicações) para garantir o desempenho e a disponibilidade necessários.

Principais tipos de escalabilidade:

  • Escalabilidade manual: o administrador altera manualmente o número de réplicas usando o comando kubectl scale.
  • Escalabilidade automática (Horizontal Pod Autoscaler, HPA): o Kubernetes aumenta ou diminui automaticamente o número de pods com base em métricas (por exemplo, carga de CPU ou métricas personalizadas).

Exemplo de comando para escalabilidade manual:

kubectl scale deployment my-app --replicas=5

O HPA é configurado através de um manifesto, onde se indica a métrica alvo e o número mínimo/máximo de réplicas. O controlador do Kubernetes monitora as métricas e ajusta o número de pods.

Assim, a escalabilidade permite adaptar os recursos de forma flexível à carga, garantindo a estabilidade e eficiência da aplicação.