22장. Rollout 실패 진단 10분
먼저 Deployment condition과 revision, ReplicaSet, pod event, image digest를 본다. Pending이면 scheduler·quota·node·PVC, ImagePull이면 registry·identity·digest, CrashLoop이면 exit·config·probe, Ready 0이면 endpoint·dependency로 경계를 나눈다.
kubectl -n fieldpass get deploy,rs,pod
kubectl -n fieldpass describe deploy fieldpass-api
kubectl -n fieldpass get events --sort-by=.lastTimestamp
kubectl -n fieldpass logs deploy/fieldpass-api --previous
명령 출력에 Secret이 없는지 확인한다. 원인을 고치기 전에 이전 digest와 rollout undo 가능성을 확인하고 사용자 오류 예산이 빠르게 소모되면 rollback한다. pod 하나를 수동 수정해 성공시키지 않고 manifest와 pipeline을 고친다.