Cả hai khai báo tài nguyên (CPU/memory) cho container nhưng có vai trò khác nhau:
- requests: lượng tài nguyên tối thiểu được đảm bảo. Scheduler dùng con số này để chọn node đủ chỗ đặt pod. Đây cũng là cơ sở HPA tính % sử dụng.
- limits: trần tối đa container được phép dùng. Vượt limit CPU → bị throttle (giảm tốc); vượt limit memory → container bị OOMKilled (kill vì hết bộ nhớ).
Kết hợp requests/limits quyết định QoS class của pod:
- Guaranteed (requests = limits cho mọi container),
- Burstable (có requests < limits),
- BestEffort (không đặt gì) — bị evict trước khi node thiếu tài nguyên.
Đặt requests quá thấp → node bị xếp quá nhiều pod và quá tải; quá cao → lãng phí. Đây là cân chỉnh quan trọng cho ổn định và chi phí.