Resource Exhaustion
‘Resource Exhaustion’ 증상으로 나타나는 장애 문제 159개를 모았습니다.
먼저 읽을 가이드
추천 문제
모든 문제 159개
LINUX-104XFS project quota는 켜져 있는데 하위 디렉터리가 엉뚱한 project ID를 물려받아 테넌트 하나가 한도를 넘을 수 있음파일시스템에는 quota가 설정된 것처럼 보이는데 중첩 경로가 의도한 통제를 벗어납니다 — 디렉터리 트리 전체가 배정되지 않았습니다.Linux고급18분ProK8S-160노드 이미지 업그레이드가 cgroup v2를 켜자 Java 워크로드 하나가 힙 한도를 잘못 보고하기 시작해 HPA가 엉뚱한 사용률 기준으로 스케일앱은 계속 도는데 노드 이미지와 함께 런타임 메모리 집계가 바뀌어 오토스케일링 결정을 왜곡합니다.Kubernetes고급18분ProK8S-107이미지 파일시스템 축출 임계값은 설정돼 있는데 정작 노드 압박은 rootfs에 있어 kubelet이 부풀어 오른 로그 디렉터리를 끝내 축출하지 않음노드에 압박 징후가 보이는데 eviction이 발동하지 않습니다 — 고갈된 파티션이 활성 임계값이 다루는 대상이 아닙니다.Kubernetes고급18분ProLINUX-210크래시 덤프는 계속 켜져 있는데 예약된 crash 커널 메모리가 현재 커널 크기와 더는 맞지 않음 (failover 리허설 중)호스트는 보호받고 있다고 여기는데 덤프 경로가 조용히 잘리거나 실패합니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Linux고급18분ProCICD-324canary 승인이 HTTP 성공만 확인하는 사이 작업 큐 깊이가 조용히 늘어 릴리스가 엉뚱한 health 차원에서 통과 (failover 리허설 중)사용자 대면 요청은 멀쩡해 보이는데 비동기 백로그가 이미 그 릴리스가 비정상임을 증명하고 있습니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.CI/CD고급19분ProK8S-276kubelet 축출 임계값은 imagefs를 감시하는데 정작 다른 곳의 emptyDir 증가가 노드 ephemeral 저장소를 고갈 (failover 리허설 중)노드 압박은 실재하는데 선택된 신호가 엉뚱한 파일시스템을 가리킵니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Kubernetes고급19분ProLINUX-095LVM thin pool은 가상 공간이 넉넉하다고 보고하는데 metadata 고갈로 모든 쓰기가 멈춤논리 볼륨은 아직 충분해 보이는데 쓰기가 실패합니다 — 데이터 영역이 아니라 thin pool 메타데이터 영역이 먼저 고갈됐습니다.Linux고급19분ProLINUX-186writeback 캐시가 고장 난 SSD를 가리다가 metadata가 결국 읽기 전용으로 뒤집혀 복구가 훨씬 어려워짐 (failover 리허설 중)성능은 좋게 유지되는데 위험이 캐시 계층 뒤에서 조용히 쌓입니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Linux고급19분ProK8S-115감사 로그 백엔드가 멈추면서 admission 지연이 급증Kubernetes고급19분ProCICD-145단계적 롤백이 트래픽 라우팅은 되돌렸는데 메시지 큐 스키마는 새 버전에 남겨, 옛 worker가 재시도 트래픽을 오염사용자 대면 경로는 회복된 것처럼 보이는데 비동기 경로가 아직 새 계약을 써서 뒤늦은 불안정을 만듭니다.CI/CD고급19분ProCICD-180롤백이 앱 경로는 되돌리고 비동기 계약은 새 버전에 남겨 둠 (failover 리허설 중)사용자 대면 트래픽은 회복되는데 큐 컨슈머·worker·webhook이 아직 호환되지 않는 가정으로 돕니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.CI/CD고급19분ProCICD-115blue-green 전환이 ingress 가중치는 갱신하는데 백그라운드 cron 대상이 계속 옛 데이터베이스 스키마에 씀전환 후 사용자 트래픽은 정상으로 보이는데 예약 job이 아직 옛 스택을 가리켜 환경 간 데이터 정합이 깨집니다.CI/CD고급20분ProLINUX-028컨테이너 host의 CPU는 낮은데 cgroup 하나가 심하게 throttle전체 노드 사용률은 안전해 보이는데 서비스 하나가 심하게 throttle됩니다 — 그 cgroup 한도가 너무 낮습니다.Linux중급20분ProK8S-083HPA는 CPU로 스케일하는데 진짜 병목은 단일 스레드 큐 소비자의 파티션 할당오토스케일링이 도움이 되는 듯한데 처리량이 오르지 않습니다 — 워크로드의 shard나 파티션 소유권이 쓸모 있는 작업을 레플리카 하나에 묶어 둡니다.Kubernetes고급22분ProLINUX-073initramfs가 계속 오래된 메타데이터를 참조해 mdadm 자동 조립이 엉뚱한 멤버 순서를 고름디스크는 다 있는데 복구가 계속 위험합니다 — 부팅 환경이 낡은 메타데이터 가정으로 배열을 조립합니다.Linux고급23분ProK8S-061노드 drain 후 topology spread와 zone taint가 레플리카를 계속 pending으로 둠클러스터에 용량은 아직 있는데 워크로드가 복구되지 못합니다 — spread 규칙과 taint가 겹쳐 합법적인 배치 선택지를 전부 없앱니다.Kubernetes고급24분ProK8S-037노드 하나에 여유가 있는데도 TopologySpreadConstraints가 레플리카를 pending으로 둠클러스터에 CPU와 메모리 자체는 충분한데 zone 분산 요구와 maxSkew 때문에 남은 replica를 놓을 자리가 하나도 없습니다.Kubernetes고급26분ProNETWORK-029CPU가 바빠 보이기도 전에 conntrack 축출이 새 연결을 해침호스트에 CPU 여유는 있는데 새 flow가 실패합니다 — connection tracking 항목이 너무 공격적으로 제거됩니다.Network고급29분ProLINUX-134coredump는 켜져 있는데 외부 coredump 파티션이 가득 차 모든 크래시 리포트가 조용히 사라짐개발자는 사후 분석 산출물을 기대하는데 설정된 저장소 대상에 남은 용량이 없습니다.Linux중급15분ProLINUX-132tmpfs가 바이트보다 한참 먼저 inode를 소진해, 모니터링에는 메모리 여유가 보이는데 애플리케이션은 no-space-left를 보고용량 경보가 메모리 크기에 집중하는데 실제 고갈 지점은 객체 수입니다.Linux중급15분Pro