Health Probes
Health Probes 관련 장애 문제 12개를 모았습니다. 검수된 문제부터 풀어 보세요.
먼저 읽을 가이드
ConfigMap은 바뀌었는데 Pod가 이전 값을 계속 쓸 때ConfigMap 업데이트 이후 envFrom, subPath, volume projection, rollout trigger 차이로 값이 갱신되지 않는 상황Kubernetes3분 읽기CoreDNS는 Running인데 DNS 조회만 실패할 때CoreDNS Pod는 정상처럼 보이지만 kube-dns 경로, upstream, node-local-dns, policy에서 실패하는 상황Kubernetes3분 읽기CrashLoopBackOff가 뜰 때 가장 먼저 볼 것Pod가 반복 재시작하면서 이전 로그와 event에 실제 원인이 남는 상황Kubernetes5분 읽기
추천 문제
검수된 문제를 먼저, 그다음 시나리오가 자세한 문제를 보여 줍니다.
모든 문제 12개
K8S-1192새 노드에 배포하면 liveness probe가 기동 중인 앱을 계속 죽임주문 조회 서비스(JVM)에 인터넷에서 찾은 공개 예제의 probe 설정을 그대로 붙여 두었습니다.검수Kubernetes고급21분무료K8S-1220메모리를 올리자 pod 재시작은 멈췄는데 롤아웃이 계속 실패팀이 직접적인 크래시 원인은 고쳤는데, health 타이밍 계약을 갱신하지 않아 롤아웃을 끝내지 못합니다.Kubernetes고급18분ProK8S-1234현재 시작 예산에서 deployment 레플리카 하나가 영구히 Ready가 아니라 PodDisruptionBudget이 노드 점검을 막음drain이 멈춘 것처럼 보입니다 — disruption 예산이, 워크로드가 정상 상태에서 실제로는 만족한 적 없는 readiness 계산에 의존합니다.Kubernetes고급19분ProK8S-1204kubectl logs에 증상은 보이는데 원인은 안 보임현재 로그에는 probe나 wrapper 잡음만 있어 재시작 루프가 알 수 없어 보입니다. 정작 중요한 증거는 운영자가 보지 않은 직전 인스턴스에 있습니다.Kubernetes중급17분ProK8S-1244readiness probe 경로는 있는데 계속 실패서비스 메시나 인증 sidecar를 도입한 뒤, 앱 route는 살아 있는데 잘 되던 readiness probe가 실패하기 시작합니다.Kubernetes중급17분ProK8S-1249readiness route는 있는데 계속 실패서비스 메시나 인증 프록시, sidecar를 도입한 뒤, 실제 클라이언트에게는 앱 route가 잘 동작하는데도 readiness 확인이 실패하기 시작합니다.Kubernetes중급17분ProK8S-1254readiness route는 있는데 계속 실패서비스 메시나 인증 프록시를 도입한 뒤, 애플리케이션이 여전히 route를 서빙하는데도 잘 되던 readiness 확인이 실패하기 시작합니다.Kubernetes중급17분ProK8S-1218이 리비전에서는 실제로 돌지 않는 마이그레이션 작업 뒤에야 probe 경로가 서빙돼 readiness가 영영 false컨테이너 자체는 멀쩡한데 ready가 되지 않습니다 — probe가 기대하는 경로가 배포된 리비전에 없는 기동 단계나 job 경로에 속합니다.Kubernetes중급17분ProK8S-1207현재 로그만 읽어 CrashLoopBackOff 디버깅이 진짜 스택 트레이스를 놓침현재 로그에는 wrapper 잡음만 보이고 쓸모 있는 크래시 신호는 이전 컨테이너 인스턴스에 있습니다.Kubernetes중급17분ProK8S-1225probe 예산이 소진된 뒤에야 정상이 되는 sidecar에 엔드포인트가 의존해 startup probe가 계속 실패주 컨테이너는 멀쩡한데 기동이 성공하지 못합니다 — readiness 경로가 나중에 뜨는 다른 컨테이너나 sidecar에 의존합니다.Kubernetes중급18분ProK8S-1211느린 애플리케이션에는 더 긴 liveness 지연이 아니라 startup probe가 필요했는데 그대로 둬 readiness가 끝내 안정되지 않음길게 보면 컨테이너는 정상인데 트래픽이 안정되지 않습니다 — 기동을 제대로 분리하는 대신 readiness와 liveness를 느린 부팅에 맞춰 늘려놨습니다.Kubernetes중급18분ProK8S-1184Service에 정상 pod는 있는데 사용 가능한 endpoint가 0공개 답변은 selector부터 확인하라고 합니다. selector는 맞고, endpoint를 비워 두는 진짜 관문은 readiness입니다.Kubernetes중급20분Pro