Cluster Maintenance
Cluster Maintenance 관련 장애 문제 81개를 모았습니다. 검수된 문제부터 풀어 보세요.
먼저 읽을 가이드
추천 문제
모든 문제 81개
LINUX-1378nftables 이전은 성공한 듯한데 rootless 서비스 하나가 계속 egress를 잃음host 방화벽 이전이 끝난 뒤, 일반 host egress는 되는데 rootless 서비스 하나가 외부 시스템에 닿지 못합니다.Linux고급15분ProK8S-1365OpenSearch StatefulSet의 레플리카 하나가 Pending에 머무름label 이전이 끝난 뒤, 클러스터 용량은 있어 보이는데 검색 레플리카 하나가 계속 스케줄되지 못합니다.Kubernetes고급15분ProK8S-1375OpenSearch StatefulSet의 레플리카 하나가 Pending에 머무름zone label 이전이 끝났는데, zone별 노드가 충분한데도 검색 레플리카 하나가 계속 Pending입니다.Kubernetes고급15분ProK8S-1343OpenSearch 오퍼레이터 롤아웃이 pod를 영원히 재시작차트 이름 변경이 무해해 보였는데 커스텀 리소스 하나가 admission·검증 오류로 계속 reconcile에 실패합니다.Kubernetes고급15분ProK8S-1384Rancher 관리 클러스터 업그레이드는 끝났는데 노드 풀 하나가 끝내 재합류하지 못함관리형 클러스터 업그레이드가 대체로 성공한 듯한데 노드 풀 하나가 관리 플레인과 끊긴 채로 남습니다.Kubernetes고급15분ProCICD-1390Terraform destroy plan이 올바른 스택을 대상으로 하는데 중간에 실패environment 이전이 끝났는데 워크스페이스 하나에서만 provider 읽기가 계속 직전 리전에 닿아 teardown이 실패합니다.CI/CD고급15분ProLINUX-1309Vault Agent가 인증서를 계속 교체하는데 서비스가 끝내 다시 로드하지 않음host가 인증서를 자동 갱신하는데 소비자는 수동 재시작 전까지 옛 인증서를 계속 서빙합니다.Linux고급15분ProLINUX-1318Vault 템플릿이 파일을 갱신하는데 서비스 리로드 훅이 끝내 실행되지 않음secret 교체 시스템이 파일은 안정적으로 갱신하는데 소비 서비스가 새 자료를 끝내 다시 로드하지 않습니다.Linux고급15분ProNETWORK-1372VLAN 이전 후 OSPF 이웃 둘이 EXSTART에 머무름라우팅 VLAN 이전이 끝났는데, 서브인터페이스 계층의 설정이 일치하는데도 OSPF 인접 하나가 EXSTART를 넘지 못합니다.Network고급15분ProK8S-1317네임스페이스 이전 후 HPA가 유휴로 보임워크로드를 새 네임스페이스로 깔끔히 옮겼는데, 대시보드에는 활동이 보이면서 오토스케일링만 반응을 멈춥니다.Kubernetes고급15분ProK8S-1385로컬 PV를 쓰는 StatefulSet의 pod 하나가 계속 Pending노드 교체 후 클러스터 label을 정리했는데 로컬 저장소에 여유가 있는데도 StatefulSet pod 하나가 Pending에 머무릅니다.Kubernetes고급15분ProLINUX-1340부팅 업그레이드 후 host 하나가 DNS를 잃음host 업그레이드가 깨끗해 보였는데, 링크 상태와 주소는 멀쩡한 채로 부팅 시 DNS가 실패합니다.Linux고급15분ProK8S-1389서비스 메시 egress 게이트웨이는 정상으로 보이는데 아웃바운드 TLS가 계속 실패mesh trust 교체가 스테이징에서는 성공했는데, 운영 네임스페이스 하나만 egress 게이트웨이로 외부 TLS 목적지에 닿지 못합니다.Kubernetes고급15분ProLINUX-1334커널 업데이트가 드라이버 문제를 고쳤는데 커스텀 nftables 서비스가 계속 실패host 커널 업그레이드 후, 서비스가 안정될 때까지 초기 부팅에서 산발적으로 트래픽이 노출되거나 방화벽이 적용되지 않습니다.Linux고급15분ProK8S-1351Cilium 업그레이드가 정책은 초록으로 유지하면서 네임스페이스 하나가 east-west 트래픽을 잃음클러스터 네트워킹 업그레이드는 전반적으로 초록인데, pod CIDR를 재할당한 뒤 노드 하나의 워크로드만 peer에 닿지 못합니다.Kubernetes고급16분ProCICD-1304DynamoDB에서 원격 state 잠금이 해제된 것으로 보이는데 다음 plan이 계속 실행을 거부중단된 배포가 잠금 테이블은 풀었는데 이후 실행이 계속 잠금 형태의 오류로 진행을 거부합니다.CI/CD고급16분ProK8S-1303Helm으로 컨트롤러를 이전하기 전까지는 leader election이 정상으로 보임컨트롤러를 재설치하거나 네임스페이스 간에 옮긴 뒤, 뚜렷한 RBAC 거부 없이 요동치기 시작합니다.Kubernetes고급16분ProK8S-1283PodDisruptionBudget이 충분히 느슨해 보이는데 클러스터 업그레이드가 계속 정체PodDisruptionBudget이 최소 하나의 축출은 허용해야 한다고 보는데도 관리형 클러스터 업그레이드가 워크로드 하나에서 멈춥니다.Kubernetes고급17분ProK8S-1295롤아웃이 zone 하나에서만 멈춤클러스터 drain이 깨끗이 시작되는데, 전체 용량은 충분한데도 워크로드 하나가 끝내 재스케줄되지 않습니다.Kubernetes고급18분ProK8S-1287재부팅 후 StatefulSet은 복구되는데 멤버 하나가 계속 엉뚱한 볼륨을 붙임stateful 워크로드를 이전하거나 복원한 뒤 ordinal 하나가 반복해서 엉뚱한 영구 데이터로 부팅합니다.Kubernetes고급18분Pro