증상문제 159개· 검수 문제 15개

Resource Exhaustion

‘Resource Exhaustion’ 증상으로 나타나는 장애 문제 159개를 모았습니다.

모든 문제 159개

CICD-075blue-green 노드 그룹 전환이 대체 경로가 준비되기 전에 유일한 로그 shipper를 drain새 노드는 앱 입장에서는 정상인데 운영 가시성이 사라집니다 — 대체 fleet이 완전히 붙기 전에 drain 순서가 클러스터 전역 DaemonSet을 걷어냈습니다.CI/CD고급24분ProCICD-090canary bake 시간이 큐 가시성 창보다 짧아 실패 신호가 승격 후에 도착롤아웃은 bake 단계를 통과하는데 숨은 worker 실패가 큐 타임아웃 구간이 지난 뒤, 트래픽이 완전히 넘어가고 한참 뒤에야 드러납니다.CI/CD고급24분ProLINUX-062부팅 때 bind 마운트가 없어 rsync --delete가 볼륨 대신 host 경로를 지움동기화 명령은 유효한데 의도한 마운트 지점이 생기지 않아 정리 단계가 이제 루트 파일시스템의 하부 디렉터리를 지웁니다.Linux고급24분ProLINUX-053원격 collector가 도달 불가가 된 뒤 rsyslog 디스크 큐가 /var를 채움정상 구간에는 중앙 로깅이 제대로 설정돼 있는데, collector가 사라지면 버퍼 큐가 자라 로컬 파티션이 압박에 도달합니다.Linux고급24분ProLINUX-009rsync 배포가 임시 파일 때문에 루트 파티션을 가득 채우는 문제배포는 성공하지만 임시 파일 정책이 잘못되어 루트 디스크가 차오르는 사고를 다룹니다.Linux고급26분ProLINUX-057degraded mdadm 복구 후 RAID 재구축이 엉뚱한 장치를 대상으로 함배열은 degraded지만 복구 가능하고, 이제 가장 큰 위험은 압박 속에서 장치 이름을 해석하다 엉뚱한 멤버를 다시 넣거나 표시하는 것입니다.Linux고급27분ProLINUX-098Rsync 전송은 완료됐는데 하드 링크가 풀려 백업 대상이 두 배 빠르게 참복원 경로는 되는데 스토리지 사용량이 폭증합니다 — 전송 옵션이 원본 트리가 의존하던 링크 의미를 보존하지 않았습니다.Linux고급16분ProSECURITY-351SIEM 파서 갱신이 타임스탬프를 정규화하는데 레거시 상관 하나가 정규화 이전 hostname 필드를 계속 키로 써 이벤트 연결을 멈춤 (단계적 폐기 중)파싱은 개선됐는데 더 오래된 규칙 집합에서 상관 품질이 무너졌습니다. 주 경로로는 서비스가 계속 되고, 옛 구성 요소가 완전히 빠질 때만 의존성 하나가 실패합니다.Security중급16분ProSECURITY-116상호 인증 기반 Windows 이벤트 전달은 되는데 구독 콘텐츠 형식이 PowerShell 스크립트 블록 로그를 버림채널은 정상인데 조사 품질이 떨어집니다 — 수집기 쪽 포맷 설정이 탐지 하나가 의존하는 필드를 잘라냅니다.Security고급16분ProLINUX-129auditd backlog 한도가 너무 작아 권한 상승 버스트에서 정작 조사에 필요한 exec 이벤트가 버려짐호스트는 계속 온라인인데 감사 기록이 불완전합니다 — 이벤트 압력이 큐 설계를 넘어섰습니다.Linux고급17분ProLINUX-093감시 대상 파일이 계속 touch돼 systemd path unit이 실패한 헬퍼를 계속 다시 띄움서비스가 스스로 재시작하는 것처럼 보이는데 진짜 원인은 같은 파일 활동 루프에 계속 반응하는 path unit입니다.Linux고급17분ProSECURITY-140장애 격리 규칙이 host를 공격자와 끊으면서 EDR 텔레메트리 경로까지 끊어, 대응자가 눈을 잃음봉쇄는 성공하는데 조사 품질이 무너집니다 — 규칙이 팀 자신의 가시성 채널을 제거했습니다.Security고급17분ProNETWORK-160캠퍼스 fabric 이전이 SVI 게이트웨이 주소는 보존했는데 하류 ACL 하나가 옛 섀시 MAC을 계속 기준으로 삼아 보안 모니터링에 오탐이 쏟아짐라우팅은 괜찮은데 의존 통제가 계속 직전 게이트웨이 신원을 기대합니다.Network고급17분ProCICD-100canary 트래픽은 제대로 옮겨지는데 레거시 cron 노드가 옛 작업 이미지를 계속 별도로 실행서비스 경로는 승격된 것처럼 보이는데 백그라운드 job이 아직 옛 릴리스로 동작합니다 — 스케줄러 풀이 롤아웃 범위에 포함되지 않았습니다.CI/CD고급18분ProSECURITY-469SIEM 파서 갱신이 타임스탬프를 정규화하는데 레거시 상관 하나가 정규화 이전 hostname 필드를 계속 키로 써 조용히 이벤트 연결을 멈춤파싱은 개선됐는데 더 오래된 규칙 집합에서 상관 품질이 무너졌습니다. 명시 설정은 맞아 보이는데 상속된 정책이 정리된 계층에서 다르게 해석됩니다.Security중급18분ProLINUX-090systemd cgroup 메모리 한도가 헬퍼 프로세스를 죽이는데 주 서비스 로그는 무관해 보임애플리케이션이 무관한 코드 경로에서 실패하는 것처럼 보이는데, 숨은 원인은 unit의 cgroup 예산 안에서 헬퍼 프로세스가 OOM으로 죽는 것입니다.Linux고급18분ProLINUX-080XFS project quota가 컨테이너 콘텐츠 경로 안의 쓰기를 조용히 차단파일시스템에는 여유 공간이 남아 있는데 워크로드 하나가 쓰기에 실패하기 시작합니다 — 그 워크로드가 쓰는 하위 트리에서 project quota 한도에 걸렸습니다.Linux고급18분ProNETWORK-336게이트웨이 IP는 그대로인데 fabric 이전 후 하위 보안 정책 하나가 계속 직전 가상 MAC을 기준으로 삼음 (failover 리허설 중)주소는 그대로여서 다른 통제가 신경 쓰는 신원 변경이 가려집니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Network고급18분ProK8S-112메트릭 APIService 인증서 drift로 scrape 절반이 깨져 HorizontalPodAutoscaler가 커스텀 메트릭을 간헐적으로만 봄어댑터에는 닿는데 컨트롤 플레인 구성 요소 사이의 TLS 검증이 산발적으로 실패해 오토스케일링이 무작위처럼 보입니다.Kubernetes고급18분ProLINUX-113셸 정리 trap이 자식 프로세스가 끝나기 전에 bind 마운트를 해제해, 늦은 쓰기가 host 경로에서 사라짐스크립트는 깔끔해 보이는데 teardown이 너무 일찍 돌아 아직 실행 중인 자식 프로세스가 쓴 데이터가 죽은 마운트 namespace로 사라집니다.Linux고급18분Pro