Kubernetes Config and Rollouts
Kubernetes Config and Rollouts 관련 장애 문제 204개를 모았습니다. 검수된 문제부터 풀어 보세요.
먼저 읽을 가이드
추천 문제
모든 문제 204개
CICD-067메트릭 질의가 오래된 canary label을 써서 Argo Rollouts 분석이 끝내 승격하지 않음트래픽도 pod도 정상으로 보이는데 자동 승격이 일어나지 않습니다 — 분석 provider가 계속 옛 release label 집합의 메트릭을 평가합니다.CI/CD고급22분ProCICD-061Argo CD app-of-apps sync wave에서 플랫폼 업그레이드가 자식 의존성에 걸려 멈춤root 애플리케이션은 정상으로 보이는데 자식 앱 하나가 ready가 되지 않습니다 — sync 순서가 CRD가 실제로 쓸 수 있게 되기 전에 의존성이 끝났다고 가정합니다.CI/CD고급24분ProK8S-052서비스 메시 sidecar가 health 포트를 가로챈 뒤에만 readiness probe가 실패컨테이너는 원래 포트로는 제대로 응답하는데 probe가 실패합니다 — sidecar 경로나 리다이렉트된 포트가 probe 기대와 맞지 않습니다.Kubernetes고급24분ProK8S-054볼륨 attach는 성공하는데 pod가 끝내 마운트하지 못함Kubernetes고급27분ProK8S-035인증서 교체 후 validating webhook이 새 워크로드를 거부webhook 서비스에는 닿는데 admission이 실패합니다 — 설정의 CABundle이 서빙 인증서 체인과 더 이상 맞지 않습니다.Kubernetes고급27분ProK8S-060HPA와 PodDisruptionBudget이 겹쳐 레플리카가 적은 롤아웃이 교착오토스케일링과 disruption 통제가 각각은 합리적인데, 함께 놓이면 갱신 중 배포가 앞으로 나아가지 못하게 만듭니다.Kubernetes고급28분ProK8S-039StatefulSet 축소가 PVC 데이터를 남겨 다음 ordinal 재사용을 오염이후 확장이 ordinal을 재사용하며 옛 볼륨을 붙여, 애플리케이션이 새 배포 의도와 맞지 않는 오래된 상태로 시작합니다.Kubernetes고급28분ProK8S-094멈춘 Job 하나가 끝내 종료 상태에 도달하지 않아 CronJob concurrency 정책이 모든 실행을 건너뜀일정은 맞는데 새 작업이 시작되지 않습니다 — 이전 Job이 종료 상태가 아니어서 concurrency 가드를 영원히 막습니다.Kubernetes고급16분ProK8S-079finalizer가 사용 불가한 aggregated API에 의존해 네임스페이스 삭제가 멈춤대부분의 리소스는 사라졌는데 삭제가 끝내 완료되지 않습니다 — finalizer 하나가 클러스터에서 더는 도달할 수 없는 API 서비스를 호출해야 합니다.Kubernetes고급20분ProK8S-025네임스페이스 간 DNS 조회가 디버그 pod에서는 되고 앱 pod에서 안 됨빠른 디버그 셸에서는 이름이 해석되는데 워크로드 컨테이너는 실패합니다 — search 도메인과 런타임 이미지가 다릅니다.Kubernetes중급20분ProK8S-074zone 하나에 validating webhook의 endpoint가 없어 admission 지연이 급증webhook 서비스는 있는데 한 경로의 요청이 멈춥니다 — 뒤의 Deployment가 zone 커버리지를 잃어 API 서버가 원격 재시도에서 계속 타임아웃합니다.Kubernetes고급21분ProK8S-099API 서버 감사 로그에는 패치가 보이는데 컨트롤러 캐시가 그것을 끝내 보지 못함Kubernetes고급22분ProK8S-070front-proxy CA 번들이 어긋난 뒤 metrics-server가 aggregated API를 잃음pod는 돌고 있는데 오토스케일링과 kubectl top이 실패합니다 — aggregated API 신뢰 체인이 API 서버 front-proxy 설정과 더 이상 맞지 않습니다.Kubernetes고급23분ProK8S-051OrderedReady가 문제 pod 하나 뒤의 ordinal을 막아 StatefulSet 복구가 멈춤비정상인 ordinal은 하나뿐인데 복구 경로 전체가 멈춥니다 — PodManagementPolicy가 여전히 순서 있는 readiness를 강제합니다.Kubernetes중급20분ProK8S-031startupProbe를 정의한 적이 없어 느리게 시작하는 JVM pod가 루프정상 상태 서비스 기준으로는 liveness와 readiness probe가 합리적으로 보이는데, 애플리케이션이 예열 중 계속 재시작합니다 — 전용 시작 구간을 받지 못합니다.Kubernetes중급21분ProK8S-022롤링 업데이트 중 서비스 endpoint 수가 떨어짐pod는 하나씩 보면 정상인데 롤아웃 중 endpoint 풀이 너무 줄어 짧은 트래픽 공백이 생깁니다.Kubernetes중급23분ProK8S-1679PodDisruptionBudget이 있는데 drain 하나가 계속 막힘label 정리 후 레플리카는 정상으로 보이는데도 노드 drain이 계속 막힙니다.Kubernetes중급12분ProK8S-1689PodDisruptionBudget이 있는데 drain 하나가 계속 막힘롤아웃 label을 표준화한 뒤에도 노드 drain이 계속 막힙니다.Kubernetes중급9분ProK8S-1699PodDisruptionBudget이 있는데 drain 하나가 계속 막힘롤아웃 label을 정리한 뒤에도 노드 drain이 계속 막힙니다.Kubernetes중급9분ProK8S-1719PodDisruptionBudget이 있는데 drain 하나가 계속 막힘PodDisruptionBudget이 있는데도 drain이 계속 막힙니다.Kubernetes중급9분Pro