HPA tự động tăng/giảm số replica của một Deployment/StatefulSet dựa trên tải quan sát được.
- Đọc metric (mặc định CPU/memory qua metrics-server; hoặc custom/external metric như request/giây).
- So với ngưỡng mục tiêu đã đặt (vd giữ CPU ~60%). Vượt → thêm pod; dưới → bớt pod, trong khoảng
min–maxreplica. - Là horizontal scaling (thêm pod), khác VPA (vertical — chỉnh CPU/RAM cho từng pod).
Điều kiện cần: pod phải khai báo resource requests để HPA tính % sử dụng. Có cơ chế ổn định (stabilization) để tránh giật (flapping).