증상문제 159개· 검수 문제 15개

Resource Exhaustion

‘Resource Exhaustion’ 증상으로 나타나는 장애 문제 159개를 모았습니다.

모든 문제 159개

SECURITY-125취약점 스캐너용 SIEM 억제가 실제 측면 이동을 가림Security고급17분ProSECURITY-160랜섬웨어 격리 워크플로가 볼륨 스냅샷은 제대로 뜨는데 스냅샷 보존 태그가 빠져 정리 자동화가 분류 전에 증거를 삭제봉쇄는 됐는데 사건 보존이 실패했습니다 — 증거 경로에 수명주기 보호가 없었습니다.Security고급18분ProSECURITY-399봉쇄가 침해된 host의 egress를 끊는데 포렌식 이미지·메모리 수집 워크플로가 계속 외부 에스크로 서비스에 의존 (단계적 폐기 중)장애는 봉쇄됐는데 증거 수집 파이프라인이 조용히 깨집니다. 주 경로로는 서비스가 계속 되고, 옛 구성 요소가 완전히 빠질 때만 의존성 하나가 실패합니다.Security고급18분ProLINUX-100일시적 스토리지 오류 후 파일시스템이 읽기 전용으로 다시 마운트되는데 앱이 그것을 일반 500으로 감춤애플리케이션 로그는 시끄러운데 진짜 원인은 앱이 명확히 드러내지 않는 I/O 오류 뒤 커널이 파일시스템을 읽기 전용으로 다시 마운트한 것입니다.Linux고급18분ProSECURITY-228커스텀 WAF 응답이 실제 차단 사유를 숨기는 사이 상류 재시도가 같은 익스플로잇 시도를 내부에서 증폭 (failover 리허설 중)통제는 작동하는데 관측 설계 하나가 그것을 운영 소음으로 만듭니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Security고급18분ProLINUX-068systemd-coredump가 반복 크래시 덤프를 계속 쌓아 tmpfs 기반 런타임 경로가 참서비스 장애가 단순한 재시작 루프처럼 보이는데, 더 깊은 문제는 제한된 tmpfs 경로에 반복 생성되는 큰 coredump가 만드는 런타임 스토리지 압박입니다.Linux고급20분ProK8S-090노드 재부팅 폭풍 후 CSI node 플러그인은 정상인데 볼륨 마운트가 실패Kubernetes고급20분ProSECURITY-089재프로비저닝 후 hostname이 바뀌어 SIEM 억제 규칙이 공격의 2단계를 가림처음 알림은 알려진 잡음인데 실제 침해가 가려집니다 — 억제 로직이 재구축된 호스트들이 재사용하는 명명 패턴을 키로 씁니다.Security고급20분ProLINUX-079auditd backlog 오버플로가 하필 침해 시점을 설명할 이벤트를 버림감사는 켜져 있는데 가장 값진 레코드가 없습니다 — 활동이 몰릴 때 커널 backlog가 넘쳤고 팀이 손실 신호를 알아채지 못했습니다.Linux고급21분ProK8S-097CSI 스냅샷 복원은 끝났는데 파일시스템 UUID 충돌이 부트스트랩 스크립트를 혼란시킴스토리지는 다시 온라인인데 앱이 계속 실패합니다 — 복원된 파일시스템 신원이 시작 로직이 고유하다고 여기는 값과 충돌합니다.Kubernetes고급21분ProCICD-065ECR 라이프사이클 정리가 아키텍처 이미지 하나를 삭제해 arm 노드에서 pull이 실패하기 시작저장소에는 기대한 태그가 그대로 있는데 한 플랫폼에서 멀티 아키텍처 pull이 깨집니다 — manifest list가 이미 만료된 자식 이미지를 가리킵니다.CI/CD고급21분ProK8S-086로컬 ephemeral-storage 요청이 모든 노드 템플릿을 넘어 Cluster Autoscaler가 pending pod를 무시pod가 pending에 머물고 오토스케일링도 반응하지 않습니다 — 요청한 로컬 스토리지 프로파일이 확장 그룹의 어떤 노드 형태에도 맞지 않습니다.Kubernetes고급21분ProCICD-085CloudFormation import는 성공하는데 이후 drift 복구가 수동으로 남긴 리소스를 교체하려 함import 후 스택은 안정되는데 이후 업데이트가 위험해집니다 — import된 리소스 형태가 아직 템플릿이 교체 가능하다고 전제하는 것과 다릅니다.CI/CD고급22분ProSECURITY-070EDR 격리가 로그 shipper 바이너리를 제거해 경보 없이 host 가시성이 사라짐한쪽 관점에서는 엔드포인트 agent가 제 일을 했는데 보안 운영이 telemetry를 잃습니다 — 격리된 구성 요소가 중앙 가시성으로 가는 유일한 경로이기도 했습니다.Security고급22분ProCICD-093Terraform drift 수정이 canary 타깃 그룹 route를 아직 담고 있는 subnet을 교체plan은 교정처럼 보이는데 적용하면 라이브 트래픽이 끊깁니다 — 낡았다던 서브넷 하나가 아직 활성 canary 경로를 붙잡고 있습니다.CI/CD고급22분ProLINUX-085XFS 메타데이터 손상 경고는 오래된 것인데 당직자가 마운트된 볼륨에 파괴적 repair를 계획장애 중 옛 경보가 재등장하는데, 이제 진짜 위험은 운영자의 조치입니다 — 파일시스템이 아직 마운트된 채 운영 쓰기를 처리하고 있습니다.Linux고급22분ProK8S-076복제 복구 테스트 후 VolumeSnapshot 복원이 엉뚱한 PVC 계보에 바인딩됨스냅샷 데이터는 유효한데 이후 복원이 엉뚱한 기대 체인에 붙습니다 — 테스트 중에 스냅샷 내용과 클론 이름을 너무 대충 재사용했습니다.Kubernetes고급22분ProK8S-062노드 상실 후 오래된 VolumeAttachment 객체가 PVC 재연결을 막음대체 노드는 준비됐는데 워크로드가 볼륨을 마운트하지 못합니다 — 스토리지 컨트롤 경로가 아직 옛 attach가 살아 있다고 믿습니다.Kubernetes고급23분ProCICD-080의존하는 스키마 변경이 모든 shard에 닿기 전에 기능 플래그 마이그레이션 단계가 실행롤아웃 스크립트는 중앙에서는 성공하는데 샤드 하나가 아직 옛 스키마를 쓰고 새 플래그 경로가 아직 모든 곳에 없는 컬럼을 부르기 시작합니다.CI/CD고급23분ProK8S-071AZ 장애 후 PodDisruptionBudget과 topology spread가 합법적인 복구 배치를 남기지 않음장애 전에는 워크로드에 replica가 충분했는데 zone 하나가 사라진 뒤 남은 규칙들 때문에 모든 복구 선택지가 분산이나 disruption 보장 중 하나를 어깁니다.Kubernetes고급24분Pro