CKA
CKA 준비에 도움이 되는 장애 대응 문제 955개를 모았습니다.
먼저 읽을 가이드
추천 문제
모든 문제 955개
K8S-079finalizer가 사용 불가한 aggregated API에 의존해 네임스페이스 삭제가 멈춤대부분의 리소스는 사라졌는데 삭제가 끝내 완료되지 않습니다 — finalizer 하나가 클러스터에서 더는 도달할 수 없는 API 서비스를 호출해야 합니다.Kubernetes고급20분ProK8S-032PodDisruptionBudget이 레플리카가 적은 deployment의 점검 drain을 막음워크로드는 정상으로 보이는데 노드 drain 명령이 멈춰 있습니다 — 빡빡한 disruption budget과 replica 수 때문에 허용되는 eviction 경로가 없습니다.Kubernetes중급20분ProK8S-1213PVC는 bound인데 pod가 계속 롤아웃 창을 놓침stateful 워크로드가 PVC는 받는데 시작할 때마다 계속 멈춘 것처럼 보입니다.Kubernetes고급20분ProK8S-1231StatefulSet이 Pending에 머무름stateful 워크로드가 레플리카를 하나 더 늘리는데, 클러스터에 여유가 있는데도 새 pod가 끝내 스케줄되지 않습니다.Kubernetes고급20분ProK8S-025네임스페이스 간 DNS 조회가 디버그 pod에서는 되고 앱 pod에서 안 됨빠른 디버그 셸에서는 이름이 해석되는데 워크로드 컨테이너는 실패합니다 — search 도메인과 런타임 이미지가 다릅니다.Kubernetes중급20분ProK8S-1226확장 후에도 pod가 Pending에 머무름장애 중 stateful 워크로드를 확장했는데, 유휴로 보이는 노드가 여럿인데도 새 pod가 계속 Pending입니다.Kubernetes고급20분ProK8S-074zone 하나에 validating webhook의 endpoint가 없어 admission 지연이 급증webhook 서비스는 있는데 한 경로의 요청이 멈춥니다 — 뒤의 Deployment가 zone 커버리지를 잃어 API 서버가 원격 재시도에서 계속 타임아웃합니다.Kubernetes고급21분ProK8S-099API 서버 감사 로그에는 패치가 보이는데 컨트롤러 캐시가 그것을 끝내 보지 못함Kubernetes고급22분ProK8S-083HPA는 CPU로 스케일하는데 진짜 병목은 단일 스레드 큐 소비자의 파티션 할당오토스케일링이 도움이 되는 듯한데 처리량이 오르지 않습니다 — 워크로드의 shard나 파티션 소유권이 쓸모 있는 작업을 레플리카 하나에 묶어 둡니다.Kubernetes고급22분ProK8S-1203Ingress health는 좋아 보이는데 경로 하나가 계속 404커뮤니티 답변에서 복사한 rewrite 스니펫이 route 하나에는 됩니다. 상류 edge 계층도 경로를 예상 밖으로 변형해 다른 경로는 계속 404입니다.Kubernetes고급22분ProK8S-1210노드 변경 후 CoreDNS가 계속 degraded자체 관리 worker 풀을 새로 추가했는데, 관리형 풀은 정상으로 보이면서 CoreDNS가 계속 degraded입니다.Kubernetes중급22분ProK8S-070front-proxy CA 번들이 어긋난 뒤 metrics-server가 aggregated API를 잃음pod는 돌고 있는데 오토스케일링과 kubectl top이 실패합니다 — aggregated API 신뢰 체인이 API 서버 front-proxy 설정과 더 이상 맞지 않습니다.Kubernetes고급23분ProK8S-1183upgrade 헤더가 프록시 홉 하나에서 멈춰 Ingress NGINX가 WebSocket 경로에 400을 반환일반 HTTP 요청은 되는데 WebSocket 트래픽이 실패합니다 — ingress-nginx 앞의 프록시 계층 하나가 업그레이드 의미를 버립니다.Kubernetes중급24분ProK8S-061노드 drain 후 topology spread와 zone taint가 레플리카를 계속 pending으로 둠클러스터에 용량은 아직 있는데 워크로드가 복구되지 못합니다 — spread 규칙과 taint가 겹쳐 합법적인 배치 선택지를 전부 없앱니다.Kubernetes고급24분ProK8S-065시계 drift 후 kubelet 인증서 rotation이 실패해 노드 하나가 새 pod를 거부노드는 계속 보고하는데 admission과 관리 경로가 실패합니다 — 시간 오차가 회전 절차를 무효화하면서 kubelet 신뢰 갱신이 깨졌습니다.Kubernetes고급25분ProK8S-037노드 하나에 여유가 있는데도 TopologySpreadConstraints가 레플리카를 pending으로 둠클러스터에 CPU와 메모리 자체는 충분한데 zone 분산 요구와 maxSkew 때문에 남은 replica를 놓을 자리가 하나도 없습니다.Kubernetes고급26분ProK8S-056오래된 IPVS 항목이 남아 kube-proxy가 삭제된 백엔드로 계속 트래픽을 보냄endpoint는 제대로 바뀌었는데 일부 노드가 계속 죽은 백엔드로 라우팅합니다 — 오래된 로드밸런싱 상태가 기대대로 조정되지 않았습니다.Kubernetes고급26분ProK8S-1121topology spread 규칙은 균형 잡혀 보임 (Rollout Stuck)A topology spread rule looks balanced (Rollout Stuck) focuses on kubernetes-workload-reliability and asks the reader to isolate Rollout Stuck. 실무에서는 Rollout Stuck 증상만 보고 Pod 하나에 매달리지 말고 이벤트, 이전 로그, Service/Endpoint, 최근 배포 변경을 한 번에 묶어 보는 편이 오진을 줄입니다.Kubernetes고급31분ProK8S-1584cert-manager issuer 전환은 맞는데 order 하나가 계속 대기issuer를 전환한 뒤에도 cert-manager order 하나가 pending에 머무릅니다.Kubernetes중급8분ProK8S-1576CoreDNS rewrite 규칙이 바뀌었는데 서비스 하나가 계속 옛 suffix로 해석CoreDNS 재작성을 갱신한 뒤에도 서비스 하나가 계속 옛 suffix를 해석합니다.Kubernetes중급8분Pro