do4i가 배포 후 정상 수렴하지 않거나 대표 기능이 비정상일 때 따르는 절차다. 먼저 서비스 공통 1차 대응 절차로 범위를 좁힌 뒤 아래 do4i 특화 확인으로 내려간다.
do4i / workload api Deployment, mysql StatefulSet / ingress api-ingress / host agents.do4i.com/api, admin.do4i.com/api.api 와 mysql 관계를 먼저 본다sudo kubectl get deploy,sts,pods,svc,ing -n do4i
api replica 부족 여부, mysql 정상 기동 여부, DB 연결로 readiness가 깨진 것은 아닌지. do4i는 앱과 DB가 같이 흔들릴 수 있어 api만 보면 안 된다.api 로그에서 시작 실패 원인을 본다sudo kubectl logs deploy/api -n do4i --tail=100
sudo kubectl describe ingress -n do4i api-ingress
sudo kubectl get svc -n do4i
agents.do4i.com/admin.do4i.com 기준과 맞는가, /api 연결, backend service/port.sudo kubectl logs statefulset/mysql -n do4i --tail=100
api 재시작 루프 없이 수렴, mysql 정상, ingress·service 연결 유지, 대표 /api 응답.api·mysql 동시 비정상 / DB 연결 실패 반복으로 api 재시작 / ingress 정상인데 대표 API 무응답 / 직전 배포가 원인 명확.온보딩 트랙 2부. 서비스 운영
이전: do4i 모니터링·알람·SRE · 다음: do4i 백업과 복구 · 전체 경로: 시작하기: 신입 온보딩