증상문제 159개· 검수 문제 15개

Resource Exhaustion

‘Resource Exhaustion’ 증상으로 나타나는 장애 문제 159개를 모았습니다.

모든 문제 159개

SECURITY-288파서 정규화 수정으로 사용자명은 개선됐는데 예약된 SIEM 내보내기가 옛 필드 형태를 계속 질의해 빈 리포트를 뱉음 (failover 리허설 중)대시보드는 정상으로 보이고 야간 리포팅은 계속 이전 스키마에 남아 있습니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Security중급17분무료SECURITY-192파서는 더 정확해졌는데 탐지 규칙 하나가 조용히 옛 깨진 필드 형태에 의존 (failover 리허설 중)데이터 품질은 좋아지는데 어제의 버그 위에 만든 규칙이 매칭을 멈춥니다. failover 리허설에서 standby나 대체 경로가 활성화되기 전까지는 평상시 트래픽이 문제를 감췄습니다.Security중급17분무료SECURITY-131CSP report-only 엔드포인트가 같은 프록시 경로로 되돌아와 작은 XSS 버스트를 내부 트래픽 폭주로 키움탐지는 켜져 있는데 보고 경로가 사건을 관측하는 대신 증폭합니다.Security중급15분무료LINUX-071logrotate copytruncate가 쓰기가 많은 프로세스와 경합해 중요한 줄을 버림회전은 끝났는데 장애 증거가 사라졌습니다 — 애플리케이션이 한창 쓰는 중에 copytruncate가 파일을 잘랐습니다.Linux중급15분무료LINUX-061패킷 폭주 중 journald rate limit이 반복되는 커널 경고를 버림장애 중에 호스트는 시끄러운데 가장 쓸모 있는 로그 줄이 디스크에 닿지 못합니다 — journald 억제가 반복 버스트를 가립니다.Linux중급16분무료LINUX-060죽은 프로세스 뒤에 패키지 매니저 잠금이 남아 패치 자동화를 막음예약 패치 job이 다른 패키지 프로세스가 돌고 있다고 하는데, 진짜 원인은 이전 실패에서 남은 버려진 lock이나 낡은 트랜잭션 상태입니다.Linux입문14분무료K8S-106CronJob 타임존은 설정돼 있는데 컨트롤러가 다음 오래된 스케줄 창에 중단된 객체를 재개운영자가 새 타임존이 깔끔히 적용되길 기대하며 작업 중단을 해제하는데, 컨트롤러가 즉시 놓친 옛 스케줄 구간을 실행합니다.Kubernetes중급15분무료K8S-113PersistentVolume 확장은 컨트롤러에서 끝났는데 pod가 재시작하지 않아 파일시스템 resize가 끝내 일어나지 않음API에서는 용량이 커 보이는데 컨테이너는 계속 옛 파일시스템 크기를 봅니다 — 마지막 온라인 resize 단계가 일어나지 않았습니다.Kubernetes중급16분무료LINUX-004logrotate가 돌았는데도 공간이 줄지 않는 열린 로그 파일 문제서비스 재시작 없이 로그 파일만 교체해도 공간이 비지 않는 흔한 운영 함정을 다룹니다.Linux입문18분무료LINUX-037/run의 tmpfs 고갈로 데몬 소켓이 시작하지 못함영구 파일시스템의 디스크 사용량은 정상으로 보이는데 서비스 소켓을 만들지 못합니다 — 런타임 상태용 tmpfs가 가득 찼습니다.Linux입문15분무료K8S-053concurrencyPolicy가 Allow로 남아 CronJob이 겹치는 실행을 띄움일정은 맞아 보이는데 오래 걸리는 실행이 서로 겹쳐 쌓여 같은 작업 구간을 두 번 처리합니다.Kubernetes입문16분무료LINUX-034LVM 확장은 성공하는데 XFS 파일시스템 크기가 끝내 바뀌지 않음볼륨 그룹과 논리 볼륨은 새 용량을 보여주는데 마운트된 파일시스템은 아직 옛 크기를 보고합니다 — 마지막 확장 단계가 돌지 않았습니다.Linux입문16분무료LINUX-015jemalloc 설정 변경 뒤 메모리는 안정적이지만 CPU가 치솟는 문제메모리 최적화를 위해 allocator를 바꿨지만 오히려 CPU 비용이 커진 상황을 분석합니다.Linux고급27분ProK8S-018cluster autoscaler가 켜져 있는데도 GPU 워크로드가 Pending에 머무는 문제오토스케일러는 동작 중이지만 특수 노드 그룹 조건 때문에 워크로드가 대기하는 상황입니다.Kubernetes고급29분ProLINUX-013ulimit 설정이 셸에는 적용됐지만 systemd 서비스에는 반영되지 않는 문제수동 테스트는 정상인데 실제 서비스 프로세스는 파일 디스크립터 부족에 걸리는 상황입니다.Linux고급24분ProK8S-007HPA가 붙어 있는데도 스케일이 오르지 않는 metrics 파이프라인 문제리소스 사용량은 높지만 autoscaler가 반응하지 않는 상황에서 metrics 흐름을 추적합니다.Kubernetes고급26분ProNETWORK-016패킷은 도착하는데 conntrack 테이블 포화로 새 연결이 실패하는 문제방화벽과 네트워크는 살아 있지만 커널 연결 추적 한계 때문에 신규 세션이 열리지 않는 상황입니다.Network고급29분ProSECURITY-156SIEM 대시보드는 새 필드 이름을 보여주는데 예약된 사고 내보내기가 계속 옛 스키마로 질의해 매일 밤 빈 리포트를 보냄대화형 분석은 괜찮은데 자동 리포팅 경로 하나가 계속 레거시 필드 맵에 의존합니다.Security고급16분ProSECURITY-095SIEM 파서 갱신이 출발지 IP 필드 둘을 합쳐 위협 헌팅 질의가 트래픽 절반을 놓침로그는 도착하는데 헌팅 결과가 불완전해 보입니다 — 갱신된 파서가 저장된 검색이 의존하는 필드 이름을 다시 썼습니다.Security고급16분ProSECURITY-110SIEM 상관 규칙이 야간 무차별 대입 연쇄를 놓침Security고급17분Pro