Junior — Middle
Pode explicar o conceito de escalabilidade no Kubernetes e como é implementado?
sobes.tech IA
Resposta da IA
A escalabilidade no Kubernetes é o processo de aumentar ou diminuir a quantidade de pods (unidades de implantação de aplicações) para garantir o desempenho e a disponibilidade necessários.
Principais tipos de escalabilidade:
- Escalabilidade manual: o administrador altera manualmente o número de réplicas usando o comando
kubectl scale. - Escalabilidade automática (Horizontal Pod Autoscaler, HPA): o Kubernetes aumenta ou diminui automaticamente o número de pods com base em métricas (por exemplo, carga de CPU ou métricas personalizadas).
Exemplo de comando para escalabilidade manual:
kubectl scale deployment my-app --replicas=5
O HPA é configurado através de um manifesto, onde se indica a métrica alvo e o número mínimo/máximo de réplicas. O controlador do Kubernetes monitora as métricas e ajusta o número de pods.
Assim, a escalabilidade permite adaptar os recursos de forma flexível à carga, garantindo a estabilidade e eficiência da aplicação.