벤더문제 586개· 검수 문제 4개

Kubernetes

Kubernetes 환경에서 일어나는 장애 문제 586개를 모았습니다.

모든 문제 586개

K8S-1328다른 팀이 서비스를 추가하고 나서야 Traefik TCP 경로가 사라짐여러 TCP 서비스를 노출 중인데, 다른 팀이 같은 entryPoint에 새 route를 배포하자 그중 하나가 사라집니다.Kubernetes고급16분ProK8S-1307메트릭 어댑터는 커스텀 메트릭을 서빙하는데 HPA가 계속 실패서비스 이름 변경이나 차트 리팩터 후, 어댑터에 직접 요청하면 정상인데 오토스케일링이 멈춥니다.Kubernetes고급16분ProK8S-1312서비스 메시 sidecar는 제대로 주입되는데 egress가 계속 실패성능을 위해 노드 로컬 DNS를 켠 뒤 sidecar가 제어하는 특정 egress 호출만 실패하기 시작합니다.Kubernetes고급16분ProK8S-1320kubelet 인증 문제가 Windows 노드에서만 나타남노드가 섞인 클러스터를 업그레이드한 뒤 Windows 노드에서만 API 서버 경로에 대한 인증 실패가 나타나기 시작합니다.Kubernetes고급17분ProK8S-1594cert-manager DNS01 정리는 끝났는데 order 하나가 계속 대기DNS01 hosted zone을 정리한 뒤에도 cert-manager order 하나가 계속 대기합니다.Kubernetes중급8분ProK8S-1604cert-manager order는 유효한데 챌린지 하나가 계속 대기hosted zone을 이전한 뒤에도 DNS 챌린지 하나가 계속 대기합니다.Kubernetes중급8분ProK8S-1564cert-manager HTTP01 solver를 패치했는데 order 하나가 계속 실패solver를 갱신한 뒤 ingress 경로 하나에서만 HTTP01 검증이 실패합니다.Kubernetes중급9분ProCICD-1554Jenkins 컨트롤러가 자격 증명을 교체했는데 에이전트 하나가 계속 폐기된 토큰으로 clone자격 증명 교체 후 새로 뜬 Jenkins pod agent만 clone에 실패합니다.CI/CD중급9분ProK8S-1534cert-manager DNS 챌린지가 시작되고도 실패reconciler가 여러 개인 zone에서 DNS01 검증이 간헐적으로 실패합니다.Kubernetes중급10분ProK8S-1524cert-manager DNS 챌린지가 잘 시작되고도 실패reconciler가 여러 개인 zone에서 DNS01 검증이 간헐적으로 실패합니다.Kubernetes중급10분ProK8S-1472cert-manager HTTP01 챌린지가 ingress에 도달하고도 실패blue-green 롤아웃용 canary ingress annotation을 추가한 뒤에만 인증서 발급이 실패합니다.Kubernetes중급10분ProK8S-1514cert-manager order는 끝났는데 갱신이 계속 실패cert-manager와 ExternalDNS가 함께 관리하는 zone에서 ACME DNS01 갱신이 간헐적으로 실패합니다.Kubernetes중급10분ProK8S-1554cert-manager 갱신은 시작되는데 Route53 검증이 계속 실패갱신 자동화를 바꾼 뒤 위임된 zone 하나에서만 DNS 검증이 실패합니다.Kubernetes중급10분ProK8S-1458ExternalDNS 롤아웃이 공개 레코드는 갱신하는데 클러스터 경로 하나가 계속 요동두 번째 컨트롤러를 추가한 뒤 사설 zone에서만 DNS 레코드가 요동칩니다.Kubernetes중급10분ProSECURITY-1494Falco 규칙 갱신은 배포됐는데 syscall 알림 하나가 계속 발동클러스터 전역에 ruleset을 갱신했는데 노드 하나가 폐기된 Falco 경보를 계속 발동합니다.Security중급10분ProSECURITY-1504Falco 규칙 갱신은 배포됐는데 syscall 알림 하나가 계속 발동ruleset을 갱신했는데 노드 하나가 폐기된 Falco 경보를 계속 발동합니다.Security중급10분ProSECURITY-1514Falco 규칙 갱신은 배포됐는데 syscall 알림 하나가 계속 발동ruleset을 갱신했는데 노드 하나가 폐기된 Falco 경보를 계속 발동합니다.Security중급10분ProK8S-1498HPA가 메트릭 상승을 보고도 끝내 스케일하지 않음메트릭 어댑터와 Prometheus 백엔드의 query step을 조정한 뒤에만 오토스케일링이 멈춥니다.Kubernetes중급10분ProK8S-1489HPA가 부하 상승을 보고도 스케일을 거부겉보기엔 정상인 deployment 이름 변경과 메트릭 어댑터 갱신 뒤에만 오토스케일링이 멈춥니다.Kubernetes중급10분ProK8S-1508HPA가 수요는 보는데 끝내 스케일하지 않음Prometheus에는 수요 증가가 보이는데 어댑터 query-step을 조정한 뒤 오토스케일링이 멈춥니다.Kubernetes중급10분Pro