Rollout Stuck
‘Rollout Stuck’ 증상으로 나타나는 장애 문제 384개를 모았습니다.
먼저 읽을 가이드
추천 문제
모든 문제 384개
LINUX-090systemd cgroup 메모리 한도가 헬퍼 프로세스를 죽이는데 주 서비스 로그는 무관해 보임애플리케이션이 무관한 코드 경로에서 실패하는 것처럼 보이는데, 숨은 원인은 unit의 cgroup 예산 안에서 헬퍼 프로세스가 OOM으로 죽는 것입니다.Linux고급18분ProLINUX-126systemd mount unit이 network-online보다 먼저 시작해, 빠른 부팅 후 iSCSI 기반 파일시스템이 간헐적으로 실패느린 부팅은 문제를 가리는데 최적화된 시작이 스토리지 의존성과 네트워크 준비 사이의 순서 경합을 드러냅니다.Linux고급18분ProCICD-147Terraform destroy plan이 올바른 워크스페이스를 대상으로 하는데 provider alias 해석이 바뀌어 plan이 공유 서비스 계정을 가리킴리뷰어는 기대한 스택을 봤는데 런타임 provider 배선이 실제 영향 범위를 바꿨습니다.CI/CD고급18분ProCICD-128Terraform plan 파일을 한 provider 플러그인 버전으로 만들고 다른 버전으로 apply해 예상치 못한 드리프트 오류가 남변경은 제대로 리뷰됐는데 저장된 plan이 apply 시점의 provider 동작과 더 이상 맞지 않습니다.CI/CD고급18분ProNETWORK-105VXLAN VTEP 루프백이 기본 테이블에서는 도달되는데 전송 VRF에서는 안 돼 오버레이가 계속 down한 컨텍스트에서의 ping 테스트는 괜찮아 보이는데 실제 캡슐화 출발지가 같은 도달성이 없는 다른 VRF에 있습니다.Network고급18분ProLINUX-246XFS repair가 손상은 정리했는데 애플리케이션이 fstab에서 계속 직전 UUID를 가리킴 (failover 리허설 중)파일시스템은 다시 정상인데 부팅·마운트 계약은 아직 다른 곳을 가리킵니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Linux고급18분ProCICD-234릴리스 후보가 한 리전에서 smoke test를 통과하는 사이 트래픽 예열은 다른 리전을 상대로 일어남 (failover 리허설 중)검증은 빌드가 안전하다고 하는데 실제 트래픽을 받는 워크로드는 테스트가 돌린 그 워크로드가 아닙니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.CI/CD중급18분ProNETWORK-158멀티캐스트 RP failover를 설정했는데 MSDP source-active 필터링이 애플리케이션 하나의 그룹 대역을 버려 복구가 끝내 완료되지 않음코어 이중화는 있는데 failover 컨트롤 플레인 뷰가 해당 스트림 집합을 제외합니다.Network고급18분ProLINUX-345복원된 RAID 배열은 정상으로 보이는데 재생성된 initramfs에 현재 부팅 항목이 기대하는 md 메타데이터 모드가 여전히 없음 (단계적 폐기 중)부팅 후 스토리지는 조립되는데 부팅 체인 자체가 여전히 다른 조립 계약을 기대합니다. 주 경로로는 서비스가 계속 되고, 옛 구성 요소가 완전히 빠질 때만 의존성 하나가 실패합니다.Linux고급18분ProNETWORK-192엔지니어링된 경로는 있는데 포워딩이 실제로는 그것을 전혀 선호하지 않음 (failover 리허설 중)컨트롤 플레인 설정은 눈에 보이는데 데이터 플레인 선택은 그대로입니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Network고급18분ProNETWORK-180오버레이 fabric이 트래픽을 널리 flooding할 수 있는데 endpoint 최적화 하나가 계속 오래된 host 신원을 신뢰 (failover 리허설 중)일반 연결성은 정상으로 보이는데 오래된 로컬 지식 탓에 endpoint 하나가 계속 블랙홀입니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Network고급18분ProNETWORK-173완화용 community를 출발지에서 설정했는데 정작 작동해야 할 edge에 닿기 전에 제거됨 (점검 템플릿 변경 후)의도는 한 도메인에는 있는데 네트워크 중간에서 사라집니다. 템플릿이 바뀌기 전까지는 경로가 안정적으로 보였지만, 상속된 가정 하나가 실제 환경과 맞지 않습니다.Network고급18분ProNETWORK-176완화용 community를 출발지에서 설정했는데 정작 작동해야 할 edge에 닿기 전에 제거됨 (컨트롤 플레인 업그레이드 후)의도는 한 도메인에는 있는데 네트워크 중간에서 사라집니다. 워크로드나 정책은 안정적이었지만, 업그레이드된 컨트롤 레이어가 의존성 하나를 다르게 해석합니다.Network고급18분ProK8S-091요청 body가 리버스 프록시 한도를 넘어 큰 Pod 스펙에서만 mutating webhook이 타임아웃작은 워크로드는 잘 받아들여지는데 큰 것이 실패합니다 — webhook 경로에 API 서버 요청보다 낮은 body 크기 설정을 가진 프록시가 있습니다.Kubernetes고급18분ProK8S-080이전 후에도 Ingress 컨트롤러 leader election lease가 옛 네임스페이스에 남음새 컨트롤러는 깔끔히 배포되는데 replica 하나만 reconcile합니다 — 선출 객체가 아직 이전 릴리스의 namespace 패턴을 가리킵니다.Kubernetes고급18분ProNETWORK-511정적 summary route는 유효한데 실제 하위 next hop의 추적 객체가 장애 때도 up으로 남는 인터페이스로 옮겨짐 (정책 상속 정리 후)쓸모 있는 경로가 사라진 지 한참 뒤까지 요약만 남아 있습니다. 명시적 설정은 맞아 보이지만, 정리된 계층에서 상속 정책이 예전처럼 해석되지 않고 위임 경로 하나가 아직 옛 소유 구조를 반영합니다.Network중급18분ProNETWORK-071BFD 타이머가 WAN 지터에 비해 지나치게 공격적이라 가벼운 손실에도 라우팅이 진동링크는 대체로 쓸 만한데 라우팅이 계속 요동칩니다 — 장애 탐지가 잡음 많은 WAN이 아니라 깨끗한 LAN 기준으로 조정돼 있습니다.Network고급19분ProCICD-072concurrency가 브랜치로만 키잉돼 GitHub Actions matrix 배포가 운영에서 두 번 실행됨워크플로가 직렬화된 것처럼 보이는데 운영 배포 둘이 겹칩니다 — concurrency 그룹이 환경이나 리전을 무시하고 브랜치 이름만 키로 씁니다.CI/CD고급19분ProNETWORK-246EVPN route target import는 맞는데 border leaf 하나가 테넌트를 엉뚱한 VNI로 매핑 (failover 리허설 중)컨트롤 플레인 멤버십은 정상인데 포워딩 도메인 식별자는 그렇지 않습니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Network고급19분ProNETWORK-324EVPN 테넌트는 올바른 route-target을 import하는데 템플릿 복제 후 border leaf 하나가 그것을 엉뚱한 L3VNI로 매핑 (failover 리허설 중)컨트롤 플레인 멤버십은 맞는데 포워딩 도메인 신원이 맞지 않습니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Network고급19분Pro