Kubernetes Config and Rollouts
Kubernetes Config and Rollouts 관련 장애 문제 204개를 모았습니다. 검수된 문제부터 풀어 보세요.
먼저 읽을 가이드
추천 문제
모든 문제 204개
K8S-014liveness probe가 너무 공격적이라 정상 Pod도 계속 재시작하는 문제애플리케이션 부하가 높은 구간에서 liveness 기준이 지나치게 빡빡해지는 상황입니다.Kubernetes중급19분ProK8S-020secret rotation 이후 특정 Pod만 오래된 자격 증명을 계속 쓰는 문제시크릿은 교체됐지만 롤아웃 조건이 없어 일부 워크로드만 옛 값을 참조하는 상황입니다.Kubernetes중급23분ProK8S-003Job이 끝나지 않는 배치 워크로드에서 backofflimit 해석하기배치 실패 재시도 정책과 컨테이너 종료 코드를 연결해 근본 원인을 찾는 고급형 문제입니다.Kubernetes고급27분ProK8S-017Service mesh 사이드카가 붙은 뒤 readiness 시간이 급격히 늘어나는 문제애플리케이션 자체보다 프록시 초기화가 병목이 되어 시작 시간이 길어지는 상황입니다.Kubernetes중급24분ProCICD-094Argo CD 동기화는 성공하는데 네임스페이스 label 정책이 네트워크 예외 label을 조용히 제거앱은 깨끗이 배포되는데 워크로드가 깨집니다 — 클러스터 정책이 앱이 네트워킹에 의존하는 네임스페이스 label을 다시 씁니다.CI/CD고급18분ProK8S-066projected 서비스 계정 토큰 audience 불일치로 외부 Vault 인증이 깨짐pod에 유효한 토큰은 있는데 외부 인증이 계속 실패합니다 — 검증기가 projected 토큰 요청이 만든 것과 다른 audience를 기대합니다.Kubernetes고급21분ProK8S-081readiness는 통과하는데 trust 번들 분리 후 Envoy sidecar가 컨트롤 플레인에 닿지 못함앱 컨테이너는 정상인데 트래픽이 계속 실패합니다 — 인증서 번들이 고르지 않게 바뀐 뒤 sidecar가 mesh 컨트롤 플레인에 대한 신뢰를 잃었습니다.Kubernetes고급21분ProCICD-099이미지 서명은 CI에서 성공하는데 root 교체 후 admission 정책이 서명 발급자를 거부빌드는 서명된 이미지를 게시하는데 클러스터 admission이 실패합니다 — 검증기가 계속 옛 서명 root만 신뢰합니다.CI/CD고급21분ProK8S-068FailurePolicy Ignore 때문에 필수 보안 sidecar 없이 pod가 시작됨webhook 장애 중에도 클러스터는 계속 살아 있는데 나중에 운영 트래픽이 실패합니다 — 플랫폼이 전제하는 sidecar 계약 없이 워크로드가 떴습니다.Kubernetes고급22분ProK8S-087OIDC provider issuer URL이 교체돼 클러스터의 모든 projected 토큰 검증기가 새 토큰을 거부토큰 projection은 계속 되는데 컨슈머가 실패합니다 — 오래 살아 있는 검증기 아래에서 issuer 신뢰 경로와 JWKS 탐색 URL이 바뀌었습니다.Kubernetes고급22분ProK8S-028장수 연결 pod에서 노드 drain이 멈춤점검은 제대로 시작되는데 축출이 끝나지 않습니다 — 연결 draining과 종료 훅이 너무 오래 걸립니다.Kubernetes중급22분ProCICD-071앱 경계를 너무 넓게 잡아 Argo CD prune이 공유 secret을 삭제동기화 자체는 성공하는데 정리 단계가 다른 워크로드가 아직 의존하는 namespace 범위 secret을 지웁니다 — 소유권 경계가 안전하게 표현되지 않았습니다.CI/CD고급23분ProK8S-026PriorityClass가 핵심 작업은 살리는데 배치 큐를 굶김긴급 워크로드 정책이 문제 하나는 풀지만, 낮은 우선순위 큐가 영영 따라잡지 못하게 만들어 다른 문제를 조용히 만듭니다.Kubernetes고급27분ProK8S-096기본 워크로드는 계속 도는데 PodSecurity admission이 디버그 컨테이너 흐름을 차단앱은 계속 트래픽을 서빙하는데 긴급 디버깅이 실패합니다 — 현재 보안 프로파일이 ephemeral 컨테이너 경로를 거부합니다.Kubernetes고급17분ProK8S-091요청 body가 리버스 프록시 한도를 넘어 큰 Pod 스펙에서만 mutating webhook이 타임아웃작은 워크로드는 잘 받아들여지는데 큰 것이 실패합니다 — webhook 경로에 API 서버 요청보다 낮은 body 크기 설정을 가진 프록시가 있습니다.Kubernetes고급18분ProK8S-080이전 후에도 Ingress 컨트롤러 leader election lease가 옛 네임스페이스에 남음새 컨트롤러는 깔끔히 배포되는데 replica 하나만 reconcile합니다 — 선출 객체가 아직 이전 릴리스의 namespace 패턴을 가리킵니다.Kubernetes고급18분ProK8S-092네임스페이스 하나의 projected CA 번들이 뒤처져 그 팀 작업만 아웃바운드 TLS 검증에 실패클러스터 TLS 신뢰는 대체로 정상인데 네임스페이스 하나가 계속 더 오래된 CA 번들을 마운트해 그 작업이 새 상류 인증서 경로를 거부합니다.Kubernetes고급19분ProK8S-073재시도 폭주로 emptyDir 요청 로그가 부풀어 ephemeral-storage 축출이 시작노드에 CPU와 메모리는 남아 있는데 pod가 evict됩니다 — 재시도가 많은 요청 로깅이 emptyDir에 쌓이면서 로컬 임시 스토리지가 찹니다.Kubernetes고급19분ProK8S-084maxUnavailable이, 이미 사용 불가 멤버가 하나 있는 taint 걸린 노드 그룹과 충돌해 DaemonSet 갱신이 멈춤업데이트 전략은 보수적으로 보이는데 롤아웃 진행이 멈춥니다 — taint된 그룹의 현재 불가용 상태가 이미 허용된 업데이트 예산을 넘었습니다.Kubernetes고급20분ProCICD-088커스텀 리소스 버전은 업그레이드됐는데 Lua health 스크립트가 그대로라 Argo CD health check가 계속 degraded리소스는 실제로 잘 도는데 GitOps 컨트롤러가 승격을 계속 막습니다 — 커스텀 헬스 로직이 옛 API 형태만 이해합니다.CI/CD고급20분Pro