Middle — Middle+
Kuidas hallata Kubernetes konteinerite arvu dünaamiliselt sõltuvalt süsteemi koormusest?
sobes.tech AI
Vastus AI-lt
Kuberneteses kasutatakse dünaamilise konteinerite (podide replikate) arvu juhtimiseks Horizontal Pod Autoscaler (HPA). HPA automaatselt skaleerib podide arvu Deployment, ReplicaSet või StatefulSet sees, lähtudes metrikatest nagu CPU kasutus, mälu või kohandatud metrikad.
Näide HPA konfiguratsioonist, mis skaleerib podide arvu CPU koormuse põhjal:
apiVersion: autoscaling/v2
kind: HorizontalPodAutoscaler
metadata:
name: näide-hpa
spec:
scaleTargetRef:
apiVersion: apps/v1
kind: Deployment
name: näide-deployment
minReplicas: 1
maxReplicas: 10
metrics:
- type: Resource
resource:
name: cpu
target:
type: Utilization
averageUtilization: 50
Siin hoiab HPA CPU keskmise kasutuse 50%, suurendades või vähendades podide arvu vahemikus 1 kuni 10.
Samuti saab kasutada Vertical Pod Autoscaler (VPA), et muuta podide ressursse, kuid replikate arvu skaleerimiseks on HPA parim valik.