Kubernetes Pod liên tục restart dù CPU và RAM chưa vượt limit
Playbook điều tra Kubernetes Pod restart khi CPU và RAM chưa vượt limit: exit code, previous logs, probes, OOM, node pressure, eviction, volume và rollout.

Kubernetes Pod liên tục restart dù CPU và RAM chưa vượt limit không có nghĩa hệ thống đang khỏe. Root cause có thể là application crash, probe thất bại, node pressure, eviction, volume lỗi, dependency timeout, config sai hoặc rollout liên tục.
Đừng tăng resource limit ngay. Trước tiên cần xác định container đã kết thúc như thế nào, ai đã kết thúc nó và Pod đang restart bên trong hay bị controller thay thế.
Nguyên tắc cốt lõi
Restart count chỉ là triệu chứng. Bằng chứng quan trọng nằm trong last termination state, previous logs, Pod events, node conditions và controller history.
Phân loại
Container restart hay Pod bị thay thế?
RESTARTS tăng với cùng Pod UID khác với Pod mới được tạo liên tục.






