Resource Exhaustion
‘Resource Exhaustion’ 증상으로 나타나는 장애 문제 159개를 모았습니다.
먼저 읽을 가이드
추천 문제
모든 문제 159개
K8S-060HPA와 PodDisruptionBudget이 겹쳐 레플리카가 적은 롤아웃이 교착오토스케일링과 disruption 통제가 각각은 합리적인데, 함께 놓이면 갱신 중 배포가 앞으로 나아가지 못하게 만듭니다.Kubernetes고급28분ProLINUX-146rsyslog ruleset이 중복 메시지를 공격적으로 버려, 재시도가 잡음으로 취급되며 무차별 대입 패턴이 사라짐호스트는 조용해졌는데 중복 제거 로직이 분석가가 의존하는 의미 있는 반복까지 지웠습니다.Linux중급15분ProLINUX-092커널 파라미터를 sysctl.d에서 조정했는데 사전순 때문에 앞선 파일이 이김원하는 설정이 디스크에는 있는데 호스트가 다른 값을 씁니다 — sysctl 로드 순서상 앞이나 뒤의 파일이 덮어씁니다.Linux고급15분ProLINUX-152thin pool autoextend 임계값은 맞는데 모니터링 경보가 data 비율을 감시Linux고급16분ProCICD-134원본 패키지가 회수된 뒤에도 의존성 프록시가 캐시된 패키지 manifest를 서빙해 하위 빌드가 계속 안전하지 않은 버전으로 해석upstream은 문제를 고쳤는데 로컬 가속 계층이 취약한 메타데이터 뷰를 그대로 보존했습니다.CI/CD중급16분ProLINUX-192잡음 억제가, 분석가가 무차별 대입 탐지에 의존하는 반복 신호를 제거 (failover 리허설 중)로그는 깨끗해졌는데 장애 패턴이 잡음과 함께 사라집니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Linux중급16분ProLINUX-118cgroup v2 memory.high가 worker를 throttle해, 서비스가 명백히 고장 난 대신 그냥 느려 보임memory.max에 닿기 한참 전부터 soft 한도가 워크로드를 압박해, 뚜렷한 OOM 없이 지연만 올라갑니다.Linux고급17분ProK8S-369drain했던 노드가 서비스로 복귀했는데 descheduler나 anti-affinity 로직이 임시였어야 할 비상 배치 패턴을 계속 유지 (단계적 폐기 중)클러스터는 다시 정상인데 배치는 아직 장애 당시 구성을 반영합니다. 주 경로로는 서비스가 계속 되고, 옛 구성 요소가 완전히 빠질 때만 의존성 하나가 실패합니다.Kubernetes고급17분ProLINUX-149kdump 대상 경로는 있는데 커널 업데이트 후 crash 커널이 메모리를 너무 적게 예약해 덤프가 조용히 잘림설정상 크래시 캡처는 켜져 있는데 크기 산정 전제 하나가 새 커널 크기에 더는 맞지 않습니다.Linux고급17분ProLINUX-157mdadm write-intent bitmap이 배열 이동은 견디는데 섹터 크기 전제가 바뀌어 새 host에서 복구 성능이 무너짐배열은 유효한데 metadata 최적화 하나가 더는 하드웨어 특성과 맞지 않습니다.Linux고급17분ProLINUX-125rsync inplace 복사가 XFS reflink 기반 볼륨에 떨어져, 나중에 백업 검증이 조용히 공유된 extent를 발견전송은 끝났는데 백업 전략이 전제한 데이터 격리 가정이 더 이상 성립하지 않습니다.Linux고급17분ProLINUX-258thin 스냅샷이 읽기 전용으로 마운트됐는데 housekeeping 타이머 하나가 계속 그 안에서 trim과 purge를 시도 (failover 리허설 중)점검 timer가 같은 쓰기 동작을 더 이상 받아주지 않는 스냅샷을 상대로 계속 돕니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Linux중급17분ProK8S-129topology 인식 라우팅과 sticky session이 겹쳐 확장 이벤트 후 zone 하나에 핫스팟이 생김각 기능이 개별적으로는 틀리지 않은데, 함께 놓이면 줄어드는 endpoint 부분집합에 트래픽을 너무 많이 고정합니다.Kubernetes고급17분ProLINUX-369스토리지 정리가 파일 블록은 비우는데 버려진 overlay나 컨테이너 레이어가 장애를 부른 inode 압박을 그대로 유지 (단계적 폐기 중)용량 그래프는 개선되는데 inode 부족은 그대로입니다. 주 경로로는 서비스가 계속 되고, 옛 구성 요소가 완전히 빠질 때만 의존성 하나가 실패합니다.Linux고급17분ProK8S-148외부 큐 깊이 기반 HPA가 확장은 제대로 하는데 축소가 끝내 일어나지 않음Kubernetes고급17분ProK8S-204autoscaler가, 백로그가 사라진 뒤로도 한참 오래된 상태로 남는 큐 깊이 메트릭을 신뢰 (failover 리허설 중)신선도가 메트릭 계약에 없어 스케일링이 계속 어제의 압박이 남아 있는 것처럼 동작합니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Kubernetes고급18분ProLINUX-145LVM 캐시 풀이 고장 난 SSD를 가리고, writeback 모드가 캐시 metadata가 결국 읽기 전용이 될 때까지 쓰기를 계속 승인실패 모드가 버퍼링되는 바람에 복구가 훨씬 어려워지는 지점까지는 스토리지가 빠르고 정상으로 보입니다.Linux고급18분ProLINUX-138mdadm bitmap이 서류상으로는 복구를 빠르게 하는데, write-mostly 멤버가 resync를 너무 느리게 만들어 부하에서 배열이 끝내 따라잡지 못함스토리지는 살아남는데 degraded 상태가 계속됩니다 — 튜닝 결정 하나와 하드웨어 프로필 하나가 충돌합니다.Linux고급18분ProLINUX-111rsyslog 디스크 보조 전달 큐가 spool 파티션을 채우고 원격 전달 압박 뒤에서 로컬 로깅이 막힘원격 전달이 복원력을 갖춰야 하는데 로컬 관측성이 열화됩니다 — spillover 큐가 핵심 시스템 경로와 공간을 공유합니다.Linux고급18분ProLINUX-306thin pool 데이터 볼륨에는 여유가 있는데 백업 워크플로의 metadata 스냅샷이 병목 자원을 먼저 소진 (failover 리허설 중)숨은 메타데이터 소비자가 경쟁에서 이기기 전까지는 용량 계획이 정상으로 보입니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Linux고급18분Pro