자격증문제 955개· 검수 문제 24개

CKA

CKA 준비에 도움이 되는 장애 대응 문제 955개를 모았습니다.

모든 문제 955개

K8S-020secret rotation 이후 특정 Pod만 오래된 자격 증명을 계속 쓰는 문제시크릿은 교체됐지만 롤아웃 조건이 없어 일부 워크로드만 옛 값을 참조하는 상황입니다.Kubernetes중급23분ProK8S-007HPA가 붙어 있는데도 스케일이 오르지 않는 metrics 파이프라인 문제리소스 사용량은 높지만 autoscaler가 반응하지 않는 상황에서 metrics 흐름을 추적합니다.Kubernetes고급26분ProK8S-003Job이 끝나지 않는 배치 워크로드에서 backofflimit 해석하기배치 실패 재시도 정책과 컨테이너 종료 코드를 연결해 근본 원인을 찾는 고급형 문제입니다.Kubernetes고급27분ProK8S-010StatefulSet PVC가 Pending에 머물며 롤아웃이 멈추는 문제StorageClass, access mode, 용량 조건이 맞지 않아 상태 저장 워크로드가 올라오지 않는 문제입니다.Kubernetes고급28분ProK8S-1199kubectl port-forward는 되는데 ingress가 계속 실패팀이 kubectl port-forward로 앱을 확인하고 ingress는 문제없다고 가정합니다. 실제 실패는 edge hostname이나 경로 재작성 체인의 더 앞쪽에 있습니다.Kubernetes중급18분ProK8S-009Ingress 경로 재작성 규칙 불일치로 특정 API만 404가 나는 문제헬스체크는 통과하지만 실제 사용자 요청만 실패하는 경로 재작성 문제를 다룹니다.Kubernetes중급24분ProK8S-017Service mesh 사이드카가 붙은 뒤 readiness 시간이 급격히 늘어나는 문제애플리케이션 자체보다 프록시 초기화가 병목이 되어 시작 시간이 길어지는 상황입니다.Kubernetes중급24분ProCICD-110Argo CD ignoreDifferences가 서비스 계정 annotation의 drift를 가려, 동기화 때 워크로드가 클라우드 신원을 잃음Git과 클러스터는 동기화된 것처럼 보이는데 런타임 신원이 깨졌습니다 — diff 무시 규칙이 pod를 클라우드 role에 묶는 바로 그 annotation을 가렸습니다.CI/CD고급18분ProCICD-094Argo CD 동기화는 성공하는데 네임스페이스 label 정책이 네트워크 예외 label을 조용히 제거앱은 깨끗이 배포되는데 워크로드가 깨집니다 — 클러스터 정책이 앱이 네트워킹에 의존하는 네임스페이스 label을 다시 씁니다.CI/CD고급18분ProK8S-090노드 재부팅 폭풍 후 CSI node 플러그인은 정상인데 볼륨 마운트가 실패Kubernetes고급20분ProK8S-097CSI 스냅샷 복원은 끝났는데 파일시스템 UUID 충돌이 부트스트랩 스크립트를 혼란시킴스토리지는 다시 온라인인데 앱이 계속 실패합니다 — 복원된 파일시스템 신원이 시작 로직이 고유하다고 여기는 값과 충돌합니다.Kubernetes고급21분ProK8S-066projected 서비스 계정 토큰 audience 불일치로 외부 Vault 인증이 깨짐pod에 유효한 토큰은 있는데 외부 인증이 계속 실패합니다 — 검증기가 projected 토큰 요청이 만든 것과 다른 audience를 기대합니다.Kubernetes고급21분ProK8S-081readiness는 통과하는데 trust 번들 분리 후 Envoy sidecar가 컨트롤 플레인에 닿지 못함앱 컨테이너는 정상인데 트래픽이 계속 실패합니다 — 인증서 번들이 고르지 않게 바뀐 뒤 sidecar가 mesh 컨트롤 플레인에 대한 신뢰를 잃었습니다.Kubernetes고급21분ProK8S-086로컬 ephemeral-storage 요청이 모든 노드 템플릿을 넘어 Cluster Autoscaler가 pending pod를 무시pod가 pending에 머물고 오토스케일링도 반응하지 않습니다 — 요청한 로컬 스토리지 프로파일이 확장 그룹의 어떤 노드 형태에도 맞지 않습니다.Kubernetes고급21분ProK8S-068FailurePolicy Ignore 때문에 필수 보안 sidecar 없이 pod가 시작됨webhook 장애 중에도 클러스터는 계속 살아 있는데 나중에 운영 트래픽이 실패합니다 — 플랫폼이 전제하는 sidecar 계약 없이 워크로드가 떴습니다.Kubernetes고급22분ProK8S-087OIDC provider issuer URL이 교체돼 클러스터의 모든 projected 토큰 검증기가 새 토큰을 거부토큰 projection은 계속 되는데 컨슈머가 실패합니다 — 오래 살아 있는 검증기 아래에서 issuer 신뢰 경로와 JWKS 탐색 URL이 바뀌었습니다.Kubernetes고급22분ProK8S-076복제 복구 테스트 후 VolumeSnapshot 복원이 엉뚱한 PVC 계보에 바인딩됨스냅샷 데이터는 유효한데 이후 복원이 엉뚱한 기대 체인에 붙습니다 — 테스트 중에 스냅샷 내용과 클론 이름을 너무 대충 재사용했습니다.Kubernetes고급22분ProK8S-028장수 연결 pod에서 노드 drain이 멈춤점검은 제대로 시작되는데 축출이 끝나지 않습니다 — 연결 draining과 종료 훅이 너무 오래 걸립니다.Kubernetes중급22분ProK8S-062노드 상실 후 오래된 VolumeAttachment 객체가 PVC 재연결을 막음대체 노드는 준비됐는데 워크로드가 볼륨을 마운트하지 못합니다 — 스토리지 컨트롤 경로가 아직 옛 attach가 살아 있다고 믿습니다.Kubernetes고급23분ProCICD-071앱 경계를 너무 넓게 잡아 Argo CD prune이 공유 secret을 삭제동기화 자체는 성공하는데 정리 단계가 다른 워크로드가 아직 의존하는 namespace 범위 secret을 지웁니다 — 소유권 경계가 안전하게 표현되지 않았습니다.CI/CD고급23분Pro