#트러블슈팅

4 편의 글

쿠버네티스 컨트롤 플레인이 느려지는 원인: API 서버, etcd, 스케줄러
5 분 소요

쿠버네티스 컨트롤 플레인이 느려지는 원인: API 서버, etcd, 스케줄러

워크로드는 멀쩡한데 kubectl이 느리고 배포가 늦는, 컨트롤 플레인이 느려지는 상황을 진단합니다. API 서버를 두드리는 과도한 LIST·WATCH, etcd의 fsync 지연과 DB 비대화, 스케줄러 지연의 구분법과 각각의 지표, 처방을 다룹니다.

requests와 limits 값을 정하는 기준: 운영에서 통하는 규칙
5 분 소요

requests와 limits 값을 정하는 기준: 운영에서 통하는 규칙

쿠버네티스 requests·limits의 개념이 아니라 "얼마로 설정하는가"를 다룹니다. 실측 기반 requests 산정, CPU limit의 스로틀링 논쟁, memory limit을 거는 이유, QoS 클래스와 축출 순서, VPA 권고 모드 활용, 과대 예약과 무제한 메모리라는 양쪽 사고 유형까지 정리합니다.

HPA가 생각대로 동작하지 않을 때: 흔한 설정 실수 6가지
5 분 소요

HPA가 생각대로 동작하지 않을 때: 흔한 설정 실수 6가지

쿠버네티스 HPA가 안 늘어나거나, 너무 늦게 늘어나거나, 널뛰기하는 원인을 정리합니다. requests 미설정과 타깃 퍼센트의 의미, 스케일업 반응 속도와 안정화 윈도우, 플래핑, GitOps의 replicas 충돌, CPU만 보는 스케일링의 한계까지 확인 방법과 함께 다룹니다.

Pod가 Pending에서 멈출 때: 원인 7가지와 확인 순서
5 분 소요

Pod가 Pending에서 멈출 때: 원인 7가지와 확인 순서

쿠버네티스 Pod가 Pending 상태에서 멈추는 원인을 빈도순으로 정리합니다. describe의 Events 읽는 법부터 리소스 부족, 과도한 requests, nodeSelector·affinity 불일치, taint, PVC 바인딩 대기, ResourceQuota, Cluster Autoscaler가 안 늘어나는 경우까지 확인 명령과 처방을 다룹니다.