← 문제 라이브러리
Network L4 NETWORK-1484 · 10 min

NGINX upstream DNS 갱신은 맞는데 풀 하나가 계속 죽은 백엔드를 서빙 — keepalive 소켓이 resolver 갱신보다 오래 살아남음

Network 원문 시나리오에서 keepalive-pool-outlived-upstream-resolver-refresh 신호를 기준으로 근본 원인과 안전한 복구 방향을 정리하는 문제입니다.

NetworkFoundation OpsLevel 4무료10 min
시나리오

NGINX 뒤에서 DNS를 전환한 뒤에도 트래픽이 계속 죽은 백엔드 IP를 때립니다.

먼저 볼 것
  • 네트워크 구간을 hop 단위로 나눠서 보기
  • DNS, 포트, 패킷, 방화벽 원인을 각각 검증하기
  • 간헐 장애를 재현 가능한 조건으로 바꾸기
점검 체크리스트
  1. 문제가 이름 해석, 연결, 응답, 성능 중 어디에 있는지 먼저 나눕니다.
  2. tcpdump, ss, curl, traceroute, iptables 정보를 같은 맥락으로 읽습니다.
  3. 한 지점만 고치지 말고 경로 전체의 정책을 검토합니다.
복구와 재발 방지

DNS TTL을 더 줄이기 전에 keepalive 수명과 resolver 갱신 주기를 비교하세요.

같이 보면 좋은 질문
이 문제에서 원문은 그대로 읽어야 하나요?

네. 제목과 시나리오는 실제 장애 단서이므로 그대로 유지합니다. 한국어 풀이는 판단 순서와 답안 구조를 돕기 위한 보조 설명입니다.

기술 용어와 명령어는 번역해야 하나요?

아니요. DNS, route, firewall 같은 기술 용어와 ping 같은 명령어는 영어 원문을 유지하세요.

답안에서 가장 중요한 기준은 무엇인가요?

사용자 영향, 관찰한 근거, 최근 변경, 안전한 복구 방향을 한 번에 연결해 설명하는 것입니다.