Rollout Stuck
‘Rollout Stuck’ 증상으로 나타나는 장애 문제 384개를 모았습니다.
먼저 읽을 가이드
추천 문제
모든 문제 384개
LINUX-276hostonly dracut 이미지가 재해 복구 host 부류에서만 필요한 드라이버를 제외 (failover 리허설 중)주 시스템은 잘 부팅되는데 복구 호스트가 의존하는 장치 경로를 올리지 못합니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Linux고급19분ProLINUX-114LVM 스냅샷 merge를 예약했는데 initramfs가 재생성되지 않아 재부팅에서 root 롤백이 실패롤백 계획은 준비된 것처럼 보이는데 부팅이 무너집니다 — 초기 userspace 이미지가 새 스토리지 상태를 모릅니다.Linux고급19분ProNETWORK-081route leak 중 BGP max-prefix 보호가 세션을 끊는데 한 방향에서만 그럼peer 둘 다 설정돼 있는데 한쪽만 리셋됩니다 — 수신된 leak이 로컬 보호 임계값을 넘고 반대 방향은 그 아래에 머무릅니다.Network고급19분ProK8S-101StatefulSet ordinal 재시작이 PodDisruptionBudget과 충돌해 노드 점검 후 quorum이 끝내 다시 형성되지 않음레플리카 하나가 다른 하나의 복구를 기다리는데 축출 보호가 quorum 알고리즘에 필요한 재시작 순서를 막습니다.Kubernetes고급19분ProCICD-186검토된 Terraform plan이 다른 provider 컨텍스트에서 적용됨 (failover 리허설 중)diff는 안전해 보이는데 apply 시점의 런타임 별칭이나 계정 컨텍스트가 다른 인프라를 가리킵니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.CI/CD고급19분ProNETWORK-210공유 게이트웨이는 같은 IP를 유지하는데 사이트 하나가 다른 가상 신원으로 어긋남 (failover 리허설 중)의존 통제가 네트워크가 더는 일관되게 제시하지 않는 신원에 묶여 있습니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Network고급19분ProNETWORK-102돌아온 leaf의 EVPN MAC mobility가 더 낮은 시퀀스를 써 원격 사이트가 오래된 위치를 유지서버는 다시 온라인인데 east-west 트래픽이 계속 옛 경로를 따릅니다 — mobility 순서가 peer들에게 새 위치를 신뢰하라고 알리지 않습니다.Network고급19분ProCICD-111병렬 Terraform plan이 같은 원격 state 잠금 타임아웃에서 경합해, 두 번째 파이프라인이 낡은 전제로 apply변경 둘이 같은 workspace를 겨냥하고 하나가 lock을 기다리는데, 그것이 실행될 때쯤엔 상태가 이미 달라져 그 plan을 믿을 수 없습니다.CI/CD고급19분ProNETWORK-174완화용 community를 출발지에서 설정했는데 정작 작동해야 할 edge에 닿기 전에 제거됨 (failover 리허설 중)의도는 한 도메인에는 있는데 네트워크 중간에서 사라집니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Network고급19분ProNETWORK-177완화용 community를 출발지에서 설정했는데 정작 작동해야 할 edge에 닿기 전에 제거됨 (보존 정책 갱신 후)의도는 한 도메인에는 있는데 네트워크 중간에서 사라집니다. 운영 객체는 시스템 어딘가에 여전히 있지만, 그 보조 상태를 둘러싼 수명주기 정책이 현실과 맞지 않습니다.Network고급19분ProCICD-104이미지 승격이 manifest list는 복사하고 arm64 digest를 빠뜨려, 릴리스 후 노드 풀 하나만 실패승격된 태그는 레지스트리에서 유효해 보이는데 arm64 worker가 pull하지 못합니다 — 승격 중에 multi-arch 인덱스가 플랫폼별 자식 이미지를 잃었습니다.CI/CD고급19분ProK8S-073재시도 폭주로 emptyDir 요청 로그가 부풀어 ephemeral-storage 축출이 시작노드에 CPU와 메모리는 남아 있는데 pod가 evict됩니다 — 재시도가 많은 요청 로깅이 emptyDir에 쌓이면서 로컬 임시 스토리지가 찹니다.Kubernetes고급19분ProNETWORK-571정적 summary route는 유효한데 실제 하위 next hop의 추적 객체가 장애 때도 up으로 남는 인터페이스로 옮겨짐 (관리자 계층 평탄화 후)쓸모 있는 경로가 사라진 지 한참 뒤까지 요약만 남아 있습니다. 명시적 설정은 맞아 보이지만, 정리된 계층에서 상속 정책이 예전처럼 해석되지 않고 위임 경로 하나가 아직 옛 다층 관리 모델을 반영합니다.Network중급19분ProNETWORK-113캠퍼스 오버레이 fabric이 겹치는 VNI로 사이트 간 anycast 게이트웨이를 중복시켜 east-west 트래픽이 간헐적으로 잘못 라우팅로컬 라우팅은 대체로 되는데 일부 흐름이 엉뚱한 사이트 경로를 탑니다 — fabric 식별자가 더는 도메인별로 고유하지 않습니다.Network고급19분ProLINUX-081하위 데이터 볼륨은 비어 보이는데 OverlayFS upperdir가 루트 파일시스템을 채움컨테이너 워크로드가 한동안 잘 쓰다가 host 공간이 바닥납니다 — upper 레이어가 운영자가 보는 큰 데이터 장치가 아니라 root에 있습니다.Linux고급19분ProNETWORK-077GRE 터널 MTU가 너무 높아 큰 업데이트 때만 터널 위 BGP가 요동작은 keepalive는 성공하는데 route 변동이 세션 불안정을 유발합니다 — 캡슐화 경로가 더 큰 업데이트 패킷을 깔끔히 나르지 못합니다.Network고급20분ProK8S-084maxUnavailable이, 이미 사용 불가 멤버가 하나 있는 taint 걸린 노드 그룹과 충돌해 DaemonSet 갱신이 멈춤업데이트 전략은 보수적으로 보이는데 롤아웃 진행이 멈춥니다 — taint된 그룹의 현재 불가용 상태가 이미 허용된 업데이트 예산을 넘었습니다.Kubernetes고급20분ProCICD-096롤백 정책이 ALB 5xx에 의존하는데 실패는 gRPC 상태 코드에만 보임릴리스가 불안정한데 롤백이 발동하지 않습니다 — 감시 신호가 이 서비스가 쓰는 애플리케이션 계층 실패 의미를 무시합니다.CI/CD고급20분ProK8S-095마지막 정상 노드가 이미 매칭되는 앱 label을 갖고 있어 pod anti-affinity가 복원을 계속 막음용량은 있는데 엄격한 anti-affinity 규칙이 복구를 막습니다 — 살아남은 노드가 이미 같은 워크로드 계열을 돌리고 있습니다.Kubernetes고급20분ProNETWORK-175완화용 community를 출발지에서 설정했는데 정작 작동해야 할 edge에 닿기 전에 제거됨 (environment 식별자 이름 변경 후)의도는 한 도메인에는 있는데 네트워크 중간에서 사라집니다. 기능 경로는 그대로 있지만 identity·namespace·명명 규칙 중 하나가 아직 이전 환경 계약을 가리킵니다.Network고급20분Pro