CKA
CKA 준비에 도움이 되는 장애 대응 문제 955개를 모았습니다.
먼저 읽을 가이드
추천 문제
모든 문제 955개
K8S-1295롤아웃이 zone 하나에서만 멈춤클러스터 drain이 깨끗이 시작되는데, 전체 용량은 충분한데도 워크로드 하나가 끝내 재스케줄되지 않습니다.Kubernetes고급18분ProK8S-112메트릭 APIService 인증서 drift로 scrape 절반이 깨져 HorizontalPodAutoscaler가 커스텀 메트릭을 간헐적으로만 봄어댑터에는 닿는데 컨트롤 플레인 구성 요소 사이의 TLS 검증이 산발적으로 실패해 오토스케일링이 무작위처럼 보입니다.Kubernetes고급18분ProK8S-1281배포가 성공할 때마다 pod가 재시작사설 엔드포인트나 의존성 주소가 바뀐 직후, 롤아웃이 일부 노드에서는 되고 다른 노드에서 실패합니다.Kubernetes고급18분ProK8S-091요청 body가 리버스 프록시 한도를 넘어 큰 Pod 스펙에서만 mutating webhook이 타임아웃작은 워크로드는 잘 받아들여지는데 큰 것이 실패합니다 — webhook 경로에 API 서버 요청보다 낮은 body 크기 설정을 가진 프록시가 있습니다.Kubernetes고급18분ProK8S-080이전 후에도 Ingress 컨트롤러 leader election lease가 옛 네임스페이스에 남음새 컨트롤러는 깔끔히 배포되는데 replica 하나만 reconcile합니다 — 선출 객체가 아직 이전 릴리스의 namespace 패턴을 가리킵니다.Kubernetes고급18분ProK8S-1287재부팅 후 StatefulSet은 복구되는데 멤버 하나가 계속 엉뚱한 볼륨을 붙임stateful 워크로드를 이전하거나 복원한 뒤 ordinal 하나가 반복해서 엉뚱한 영구 데이터로 부팅합니다.Kubernetes고급18분ProK8S-192route는 올바른 listener에 바인딩되는데 네임스페이스 간 백엔드 참조가 계속 인가되지 않음 (failover 리허설 중)객체 그래프는 연결돼 보이는데 보안 경계가 아직 종단 간 흐름을 막습니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Kubernetes고급19분ProK8S-1246Service에 endpoint가 있고 pod도 Ready인데 요청이 계속 실패새로 도입한 노드 부류의 pod는 정상인데, 옛 노드에서는 되는 같은 Service가 그 pod에 닿는 클라이언트에서만 타임아웃합니다.Kubernetes고급19분ProK8S-1251Service의 pod와 endpoint가 정상인데 요청이 계속 실패EKS 클러스터에 새 노드 그룹이 합류했는데, 완전히 Ready인데도 거기 배치된 pod만 Service 트래픽에서 실패하기 시작합니다.Kubernetes고급19분ProK8S-101StatefulSet ordinal 재시작이 PodDisruptionBudget과 충돌해 노드 점검 후 quorum이 끝내 다시 형성되지 않음레플리카 하나가 다른 하나의 복구를 기다리는데 축출 보호가 quorum 알고리즘에 필요한 재시작 순서를 막습니다.Kubernetes고급19분ProK8S-1248StatefulSet 볼륨은 성공적으로 다시 붙는데 기동이 계속 실패노드 이벤트 후 stateful 워크로드가 다른 노드에서 돌아오는데, 붙은 데이터 볼륨에 대해 즉시 권한 오류로 실패합니다.Kubernetes고급19분ProK8S-1229그 AMI 변형에 자격 증명 provider 바이너리가 없어 노드 그룹 하나에서만 이미지 pull이 실패같은 service account와 image pull secret이 다른 곳에서는 되는데 node group 하나가 계속 실패합니다 — 그쪽 이미지 자격 증명 helper 구성이 다릅니다.Kubernetes고급19분ProK8S-092네임스페이스 하나의 projected CA 번들이 뒤처져 그 팀 작업만 아웃바운드 TLS 검증에 실패클러스터 TLS 신뢰는 대체로 정상인데 네임스페이스 하나가 계속 더 오래된 CA 번들을 마운트해 그 작업이 새 상류 인증서 경로를 거부합니다.Kubernetes고급19분ProK8S-1256사설 EKS subnet의 pod가 ImagePullBackOff새 사설 노드 그룹이 EKS에 합류했는데, 이미지 참조와 노드 IAM role이 유효한데도 ECR에서 pull하는 워크로드만 실패하기 시작합니다.Kubernetes고급19분ProK8S-1243재스케줄 후 StatefulSet pod가 무한 재시작노드 이벤트 후 stateful 워크로드가 재스케줄되고, 이후 데이터 경로에서 권한 오류로 반복 실패합니다.Kubernetes고급19분ProK8S-1253재스케줄 후 StatefulSet 볼륨은 다시 붙는데 쓰기 접근이 계속 실패노드 장애 후 stateful 워크로드가 다른 노드에서 재시작하는데, 볼륨은 깔끔히 붙는데도 파일 권한에서 즉시 실패합니다.Kubernetes고급19분ProK8S-073재시도 폭주로 emptyDir 요청 로그가 부풀어 ephemeral-storage 축출이 시작노드에 CPU와 메모리는 남아 있는데 pod가 evict됩니다 — 재시도가 많은 요청 로깅이 emptyDir에 쌓이면서 로컬 임시 스토리지가 찹니다.Kubernetes고급19분ProK8S-1238ingress route는 유효해 보이는데 hostname 하나가 계속 404ingress 컨트롤러를 추가하거나 업그레이드한 뒤, Ingress 객체 자체는 그대로인데 hostname 하나가 엉뚱한 응답을 반환하기 시작합니다.Kubernetes고급20분ProK8S-084maxUnavailable이, 이미 사용 불가 멤버가 하나 있는 taint 걸린 노드 그룹과 충돌해 DaemonSet 갱신이 멈춤업데이트 전략은 보수적으로 보이는데 롤아웃 진행이 멈춥니다 — taint된 그룹의 현재 불가용 상태가 이미 허용된 업데이트 예산을 넘었습니다.Kubernetes고급20분ProK8S-1250노드 그룹은 Ready가 되는데 일부 워크로드가 계속 실패EKS 클러스터에 새 노드 그룹이 합류했는데 거기 배치된 pod만 시작이나 네트워킹에서 실패하기 시작합니다.Kubernetes고급20분Pro