Stateful Workload Ops
Stateful Workload Ops 관련 장애 문제 3개를 모았습니다. 검수된 문제부터 풀어 보세요.
먼저 읽을 가이드
ConfigMap은 바뀌었는데 Pod가 이전 값을 계속 쓸 때ConfigMap 업데이트 이후 envFrom, subPath, volume projection, rollout trigger 차이로 값이 갱신되지 않는 상황Kubernetes3분 읽기CoreDNS는 Running인데 DNS 조회만 실패할 때CoreDNS Pod는 정상처럼 보이지만 kube-dns 경로, upstream, node-local-dns, policy에서 실패하는 상황Kubernetes3분 읽기CrashLoopBackOff가 뜰 때 가장 먼저 볼 것Pod가 반복 재시작하면서 이전 로그와 event에 실제 원인이 남는 상황Kubernetes5분 읽기
추천 문제
검수된 문제를 먼저, 그다음 시나리오가 자세한 문제를 보여 줍니다.
모든 문제 3개
K8S-1198로컬 캐시를 지속 상태로 착각해 stateful 워크로드가 재스케줄 전까지는 정상으로 보임pod는 원래 노드에서는 잘 도는데 재스케줄 후 복구가 실패합니다 — 핵심 상태가 운영자가 영속적이라고 믿었던 로컬 캐시 경로에만 있었습니다.Kubernetes고급25분ProK8S-1195노드 하나를 drain하자, 사실 이식성이 없던 local-path 워크로드가 조용히 깨짐점검 drain이 일상적으로 보이는데 워크로드 하나가 크게 실패합니다 — 노드 간 이식성이 확보된 적 없는 로컬 스토리지 동작에 의존했습니다.Kubernetes고급24분ProK8S-1187차트 정리가 명시적 storage class를 제거한 뒤 PVC가 Pending에 머무름StatefulSet이 이전에는 됐는데, 차트 리팩터가 storageClassName을 제거해 클러스터 기본값이 더는 호환 볼륨을 프로비저닝하지 않습니다.Kubernetes고급26분Pro