Rollout Stuck
‘Rollout Stuck’ 증상으로 나타나는 장애 문제 384개를 모았습니다.
먼저 읽을 가이드
추천 문제
모든 문제 384개
CICD-053OCI Helm 차트 게시는 성공하는데 클러스터가 계속 직전 차트를 pull레지스트리는 새 chart artifact를 받는데 배포 job이 계속 이전 digest로 해석합니다 — chart 참조와 버전 올림이 함께 갱신되지 않았습니다.CI/CD중급20분ProK8S-032PodDisruptionBudget이 레플리카가 적은 deployment의 점검 drain을 막음워크로드는 정상으로 보이는데 노드 drain 명령이 멈춰 있습니다 — 빡빡한 disruption budget과 replica 수 때문에 허용되는 eviction 경로가 없습니다.Kubernetes중급20분ProCICD-105롤백이 앱 차트는 되돌리고 마이그레이션 작업 이미지는 되돌리지 않아 데이터베이스 계약이 코드보다 앞서 있음릴리스 롤백이 끝난 것으로 보이는데 애플리케이션 오류가 계속됩니다 — 마이그레이션 실행 이미지가 더 새로운 스키마 계약에 남아 있습니다.CI/CD고급20분ProLINUX-691애플리케이션은 유니코드 파일명을 제대로 쓰는데 백업·동기화 서비스가 계속 옛 locale로 실행돼 경로 집합 일부를 버림 (권한 모델 평탄화 후)시스템은 파일을 저장하는데 예약 경로 하나가 그것들을 다 보지 못합니다. 명시적 설정은 맞아 보이지만, 정리된 계층에서 상속 정책이 예전처럼 해석되지 않고 위임·상속 경로 하나가 아직 옛 계층 구조를 반영합니다.Linux중급20분ProLINUX-083LUKS 볼륨 해제는 수동으로 되는데 초기 부팅 keyscript 경로가 initramfs에 없음passphrase도 장치도 유효한데 무인 부팅이 실패합니다 — initramfs에 올바른 단계에서 볼륨을 여는 데 필요한 helper가 들어가지 않았습니다.Linux고급21분ProK8S-074zone 하나에 validating webhook의 endpoint가 없어 admission 지연이 급증webhook 서비스는 있는데 한 경로의 요청이 멈춥니다 — 뒤의 Deployment가 zone 커버리지를 잃어 API 서버가 원격 재시도에서 계속 타임아웃합니다.Kubernetes고급21분ProCICD-081승인 워크플로가 엉뚱한 아티팩트를 승격CI/CD고급21분ProCICD-055패키지 저장소가 바뀐 뒤에도 CodeBuild 로컬 캐시가 오래된 base 레이어를 재사용빌드 시간은 좋아 보이는데 만들어진 이미지가 조용히 더 오래된 패키지 baseline을 지닙니다 — 저장소 쪽 base 이미지 갱신에도 로컬 Docker 레이어 캐시가 살아남습니다.CI/CD중급21분ProK8S-099API 서버 감사 로그에는 패치가 보이는데 컨트롤러 캐시가 그것을 끝내 보지 못함Kubernetes고급22분ProK8S-083HPA는 CPU로 스케일하는데 진짜 병목은 단일 스레드 큐 소비자의 파티션 할당오토스케일링이 도움이 되는 듯한데 처리량이 오르지 않습니다 — 워크로드의 shard나 파티션 소유권이 쓸모 있는 작업을 레플리카 하나에 묶어 둡니다.Kubernetes고급22분ProK8S-070front-proxy CA 번들이 어긋난 뒤 metrics-server가 aggregated API를 잃음pod는 돌고 있는데 오토스케일링과 kubectl top이 실패합니다 — aggregated API 신뢰 체인이 API 서버 front-proxy 설정과 더 이상 맞지 않습니다.Kubernetes고급23분ProLINUX-073initramfs가 계속 오래된 메타데이터를 참조해 mdadm 자동 조립이 엉뚱한 멤버 순서를 고름디스크는 다 있는데 복구가 계속 위험합니다 — 부팅 환경이 낡은 메타데이터 가정으로 배열을 조립합니다.Linux고급23분ProLINUX-810애플리케이션은 유니코드 파일명을 제대로 쓰는데 백업·동기화 서비스가 계속 옛 locale로 실행돼 경로 집합 일부를 버림 (무예열 상태 failover 중)시스템은 파일을 저장하는데 예약 경로 하나가 그것들을 다 보지 못합니다. 복원력 훈련이 대체 경로를 켜기 전까지는 평상시 트래픽이 정상으로 보였고, warm 세션·캐시 조회·기억된 신뢰 상태 없이 복구해야 할 때 비로소 드러났습니다.Linux중급23분ProCICD-022canary 배포는 health check를 통과하는데 백그라운드 작업이 실패웹 프로세스는 정상으로 보이는데 worker 이미지가 뒤처져 호환되지 않는 payload를 처리하기 시작합니다.CI/CD중급24분ProK8S-061노드 drain 후 topology spread와 zone taint가 레플리카를 계속 pending으로 둠클러스터에 용량은 아직 있는데 워크로드가 복구되지 못합니다 — spread 규칙과 taint가 겹쳐 합법적인 배치 선택지를 전부 없앱니다.Kubernetes고급24분ProK8S-065시계 drift 후 kubelet 인증서 rotation이 실패해 노드 하나가 새 pod를 거부노드는 계속 보고하는데 admission과 관리 경로가 실패합니다 — 시간 오차가 회전 절차를 무효화하면서 kubelet 신뢰 갱신이 깨졌습니다.Kubernetes고급25분ProK8S-037노드 하나에 여유가 있는데도 TopologySpreadConstraints가 레플리카를 pending으로 둠클러스터에 CPU와 메모리 자체는 충분한데 zone 분산 요구와 maxSkew 때문에 남은 replica를 놓을 자리가 하나도 없습니다.Kubernetes고급26분ProLINUX-1170애플리케이션은 유니코드 파일명을 제대로 씀An application writes Unicode filenames correctly focuses on linux-performance-and-observability and asks the reader to isolate Rollout Stuck. 실무에서는 linux-performance-and-observability 문제를 볼 때 서비스 로그만 보지 말고 inode, 파일시스템 여유, 포트 점유, systemd 상태, 최근 패키지 변경까지 같이 확인해야 원인을 빨리 좁힐 수 있습니다.Linux중급29분ProK8S-1121topology spread 규칙은 균형 잡혀 보임 (Rollout Stuck)A topology spread rule looks balanced (Rollout Stuck) focuses on kubernetes-workload-reliability and asks the reader to isolate Rollout Stuck. 실무에서는 Rollout Stuck 증상만 보고 Pod 하나에 매달리지 말고 이벤트, 이전 로그, Service/Endpoint, 최근 배포 변경을 한 번에 묶어 보는 편이 오진을 줄입니다.Kubernetes고급31분ProCICD-136저장소가 main 브랜치 이름을 바꾼 뒤 커버리지 게이트가 오래된 기본 브랜치 기준선과 비교새 테스트는 충분히 좋은데 게이트가 계속 실패합니다 — 더는 변경이 들어오지 않는 브랜치를 기준으로 계속 측정합니다.CI/CD중급14분Pro