증상문제 159개· 검수 문제 15개

Resource Exhaustion

‘Resource Exhaustion’ 증상으로 나타나는 장애 문제 159개를 모았습니다.

모든 문제 159개

SECURITY-276장애 격리가 일반 egress는 차단하는데 포렌식 수집이 아티팩트 업로드 엔드포인트 하나에 계속 의존 (failover 리허설 중)봉쇄는 즉시 이뤄지고 가시성도 함께 사라집니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Security고급18분ProCICD-112캐시 예열이 오래된 base 이미지를 내부 mirror에 게시해 이후 모든 빌드가 취약한 레이어를 물려받음의존성 warmup 단계는 성공하는데 이후 빌드가 신선도 정책을 우회한 미러 base 이미지 때문에 오염됩니다.CI/CD고급18분ProCICD-072concurrency가 브랜치로만 키잉돼 GitHub Actions matrix 배포가 운영에서 두 번 실행됨워크플로가 직렬화된 것처럼 보이는데 운영 배포 둘이 겹칩니다 — concurrency 그룹이 환경이나 리전을 무시하고 브랜치 이름만 키로 씁니다.CI/CD고급19분ProSECURITY-336봉쇄가 일반 egress를 회수하는데 증거 수집·텔레메트리 업로드 엔드포인트 하나가 조사에 아직 필요 (failover 리허설 중)격리 조치는 작동하는데 대응자가 장애를 설명할 수 있게 해줄 경로를 잃습니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Security고급19분ProK8S-073재시도 폭주로 emptyDir 요청 로그가 부풀어 ephemeral-storage 축출이 시작노드에 CPU와 메모리는 남아 있는데 pod가 evict됩니다 — 재시도가 많은 요청 로깅이 emptyDir에 쌓이면서 로컬 임시 스토리지가 찹니다.Kubernetes고급19분ProLINUX-081하위 데이터 볼륨은 비어 보이는데 OverlayFS upperdir가 루트 파일시스템을 채움컨테이너 워크로드가 한동안 잘 쓰다가 host 공간이 바닥납니다 — upper 레이어가 운영자가 보는 큰 데이터 장치가 아니라 root에 있습니다.Linux고급19분ProSECURITY-589SIEM 파서 갱신이 타임스탬프를 정규화하는데 레거시 상관 하나가 정규화 이전 hostname 필드를 계속 키로 써 이벤트 연결을 멈춤 (권한 모델 단순화 후)파싱은 개선됐는데 더 오래된 규칙 집합에서 상관 품질이 무너졌습니다. 명목상 접근은 맞아 보이는데 위임되거나 상속된 경로 하나가 계속 이전의 더 계층적인 모델을 반영합니다.Security중급20분ProK8S-095마지막 정상 노드가 이미 매칭되는 앱 label을 갖고 있어 pod anti-affinity가 복원을 계속 막음용량은 있는데 엄격한 anti-affinity 규칙이 복구를 막습니다 — 살아남은 노드가 이미 같은 워크로드 계열을 돌리고 있습니다.Kubernetes고급20분ProSECURITY-649SIEM 파서 갱신이 타임스탬프를 정규화하는데 레거시 상관 하나가 정규화 이전 hostname 필드를 계속 키로 써 이벤트 연결을 멈춤 (권한 계층 평탄화 후)파싱은 개선됐는데 더 오래된 규칙 집합에서 상관 품질이 무너졌습니다. 명목상 권한은 맞아 보이는데 위임되거나 상속된 경로 하나가 계속 이전 계층을 반영합니다.Security중급21분ProLINUX-065LVM 스냅샷이 100%에 도달해 애플리케이션 파일시스템이 멈춤원본 볼륨에는 여유 공간이 있는데 쓰기가 느려지거나 멈춥니다 — 스냅샷 copy-on-write 영역이 찼고 백업 워크플로가 그것을 놓아준 적이 없습니다.Linux고급22분ProK8S-088StatefulSet ordinal이 오래된 PVC를 재사용해 옛 노드 신원을 quorum 클러스터에 다시 밀어 넣음pod는 뜨는데 분산 시스템이 잘못 동작합니다 — 복구된 ordinal이 이전 논리 멤버의 PVC를 달고 있습니다.Kubernetes고급23분ProLINUX-035PAM limit을 올렸는데 systemd 서비스가 계속 too many open files에 걸림대화형 셸은 새 한도를 제대로 물려받는데 데몬은 부하에서 계속 실패합니다 — 서비스 수준 한도가 그대로입니다.Linux고급25분ProK8S-059PriorityClass가 시스템 pod는 보호하는데 노드 압박 중 고객 워크로드를 굶김클러스터는 의도대로 핵심 컨트롤 구성 요소를 살려두는데, 선택된 priority와 preemption 정책 때문에 업무 워크로드가 영구히 스케줄되지 않습니다.Kubernetes고급25분ProLINUX-026메모리 급증이 사라진 뒤에도 swap 활동이 계속 높음장애는 끝났는데 swap 요동이 계속 높아 하루 종일 지연을 예측할 수 없게 만듭니다.Linux고급25분ProLINUX-058볼륨이 비정상 분리된 뒤 XFS 로그 복구 루프가 계속됨블록 장치는 다시 온라인인데 파일시스템이 계속 깨끗이 마운트되지 않습니다 — 복구 경로가 끝난 적이 없는데 운영자가 같은 마운트를 맹목적으로 재시도합니다.Linux고급25분ProCICD-054임시 runner 디스크가 레이어 export 중 가득 차 Buildx multi-arch 파이프라인이 실패이미지는 한 아키텍처에서는 잘 빌드되는데 임시 레이어와 캐시 export가 runner 디스크 예산을 넘으면 전체 배포 단계가 실패합니다.CI/CD고급26분ProLINUX-023임시 디스크 압박이 캐시는 죽이고 근본 원인은 건드리지 못함임시 파일 정리로 시간은 벌지만 다른 프로세스의 쓰기 증폭이 곧 같은 디스크 압박을 다시 만듭니다.Linux고급26분ProLINUX-040df에는 여유 블록이 보이는데 overlay 마운트가 no space left on device를 보고일반 디스크와 inode 확인은 정상으로 보이는데 컨테이너 생성이 스토리지 오류로 실패합니다 — 단순한 디스크 가득 참이 아니라 overlay·마운트·하위 스토리지 한도를 가리킵니다.Linux고급27분ProSECURITY-1009SIEM 파서 갱신이 타임스탬프를 정규화하는데 레거시 상관 하나가 정규화 이전 hostname 필드를 계속 키로 써 이벤트 연결을 멈춤 (상속 통제 정리 후)파싱은 개선됐는데 더 오래된 규칙 집합에서 상관 품질이 무너졌습니다. 명목상 접근은 맞아 보이는데 상속되거나 위임된 제어 경로 하나가 계속 더 오래된 운영 모델을 반영합니다.Security중급27분ProK8S-054볼륨 attach는 성공하는데 pod가 끝내 마운트하지 못함Kubernetes고급27분Pro