Kubernetes

Certified Kubernetes Administrator (CKA) #7 etcd 백업과 복구: etcdctl snapshot save/restore
8 분 소요

Certified Kubernetes Administrator (CKA) #7 etcd 백업과 복구: etcdctl snapshot save/restore

Certified Kubernetes Administrator (CKA) 시리즈 일곱 번째 글입니다. 클러스터 상태 전부를 담은 etcd를 etcdctl로 백업하고 복구하는 절차를 정리합니다. static Pod 매니페스트에서 data-dir과 인증서 경로를 찾아 snapshot save로 스냅샷을 뜨고, snapshot restore로 새 data-dir에 복원한 뒤 etcd를 재기동하는 흐름을 손에 익히겠습니다.

Certified Kubernetes Application Developer (CKAD) #2 Pod와 컨테이너 라이프사이클: restart policy와 컨테이너 상태
9 분 소요

Certified Kubernetes Application Developer (CKAD) #2 Pod와 컨테이너 라이프사이클: restart policy와 컨테이너 상태

Certified Kubernetes Application Developer (CKAD) 시리즈의 두 번째 글입니다. Pod의 생애 주기(Pending,Running,Succeeded,Failed,Unknown)와 restartPolicy(Always,OnFailure,Never)가 워크로드 동작에 미치는 영향, 컨테이너 상태(Waiting,Running,Terminated)와 CrashLoopBackOff,ImagePullBackOff,OOMKilled 같은 reason, 종료 코드 읽는 법, 그리고 시험 단골 트러블슈팅 순서까지 직접 만들어 보며 정리하겠습니다.

Certified Kubernetes Administrator (CKA) #6 클러스터 업그레이드: kubeadm upgrade plan/apply, 노드별 drain
8 분 소요

Certified Kubernetes Administrator (CKA) #6 클러스터 업그레이드: kubeadm upgrade plan/apply, 노드별 drain

Certified Kubernetes Administrator (CKA) 시리즈의 여섯 번째 글입니다. kubeadm 클러스터를 한 마이너 버전 올리는 표준 절차를 control plane부터 워커 노드까지 순서대로 정리하겠습니다. kubeadm upgrade plan/apply, kubelet과 kubectl 패키지 교체, 노드별 drain과 uncordon, 그리고 시험에서 자주 틀리는 함정까지 손에 익히겠습니다.

Certified Kubernetes Application Developer (CKAD) #1 시험 환경: kubectl 마스터와 dry-run, generators
7 분 소요

Certified Kubernetes Application Developer (CKAD) #1 시험 환경: kubectl 마스터와 dry-run, generators

Certified Kubernetes Application Developer (CKAD) 시리즈의 첫 글입니다. 2시간 실기 시험의 구조와 5개 도메인 비중, 합격선과 응시 환경을 정리하고, 시험 시간을 가르는 kubectl 셋업(alias, dry-run, generators, vim 설정)을 손에 익히겠습니다. 이 시리즈는 CKAD 합격을 목표로 하는 21편이며, 마지막 #21에서 실기 모의고사를 풉니다.

Certified Kubernetes Administrator (CKA) #5 HA 클러스터: 여러 control plane, 외부 etcd cluster
11 분 소요

Certified Kubernetes Administrator (CKA) #5 HA 클러스터: 여러 control plane, 외부 etcd cluster

Certified Kubernetes Administrator (CKA) 시리즈 다섯 번째 글입니다. 단일 control plane의 단일 장애점을 없애는 고가용성(HA) 클러스터를 다룹니다. stacked etcd와 external etcd 두 토폴로지의 트레이드오프, apiserver 앞단 로드밸런서와 --control-plane-endpoint, etcd 쿼럼과 내결함성, control plane 노드 조인, 멤버십 검증까지 개념 중심으로 정리하겠습니다.

Certified Kubernetes Administrator (CKA) #4 kubeadm 클러스터 설치: 단일 control plane 부트스트랩
10 분 소요

Certified Kubernetes Administrator (CKA) #4 kubeadm 클러스터 설치: 단일 control plane 부트스트랩

Certified Kubernetes Administrator (CKA) 시리즈 4편입니다. 빈 리눅스 머신에서 kubeadm으로 쿠버네티스 클러스터를 맨손으로 세웁니다. swap 비활성화와 커널 모듈, containerd 설치 같은 사전 준비부터 kubeadm init로 control plane을 부트스트랩하고, CNI를 깔아 노드를 Ready로 만들고, kubeadm join으로 워커를 붙이는 전 과정을 명령 중심으로 정리하겠습니다.

Certified Kubernetes Administrator (CKA) #3 클러스터 아키텍처 2: Node (kubelet/kube-proxy/CRI), Pod 네트워킹 모델
13 분 소요

Certified Kubernetes Administrator (CKA) #3 클러스터 아키텍처 2: Node (kubelet/kube-proxy/CRI), Pod 네트워킹 모델

Certified Kubernetes Administrator (CKA) 시리즈의 세 번째 글입니다. control plane이 결정을 내리면 실제 컨테이너는 노드에서 돕니다. 노드의 세 컴포넌트인 kubelet, kube-proxy, 컨테이너 런타임의 역할과 CRI 인터페이스를 정리하고, 모든 Pod가 NAT 없이 통신하는 쿠버네티스 Pod 네트워킹 모델과 CNI 플러그인의 자리까지 운영 관점에서 살펴보겠습니다.

Certified Kubernetes Administrator (CKA) #2 클러스터 아키텍처 1: Control plane (apiserver/etcd/scheduler/controller-manager)
13 분 소요

Certified Kubernetes Administrator (CKA) #2 클러스터 아키텍처 1: Control plane (apiserver/etcd/scheduler/controller-manager)

Certified Kubernetes Administrator (CKA) 시리즈의 두 번째 글입니다. 클러스터가 어떻게 도는지 control plane부터 들여다봅니다. kube-apiserver(모든 통신의 관문), etcd(클러스터 상태 저장소), kube-scheduler(Pod 배치 결정), kube-controller-manager(reconciliation loop)가 각각 무슨 일을 하는지, control plane이 static Pod로 어떻게 떠 있는지, 그리고 컴포넌트가 죽으면 클러스터에 무슨 일이 생기는지 운영자 관점으로 정리하겠습니다.

Certified Kubernetes Administrator (CKA) #1 시험 환경: alias와 dry-run, vim/yq 셋업, 시간 관리
7 분 소요

Certified Kubernetes Administrator (CKA) #1 시험 환경: alias와 dry-run, vim/yq 셋업, 시간 관리

Certified Kubernetes Administrator (CKA) 시리즈의 첫 글입니다. 2시간 실기 시험의 구조와 5개 도메인 비중(Troubleshooting 30%가 핵심), 합격선과 응시 환경을 정리하고, 시험 시간을 가르는 셋업(alias, dry-run, vim/yq, etcdctl, systemctl)을 손에 익히겠습니다. 이 시리즈는 CKA 합격을 목표로 하는 27편이며, 마지막 #27에서 실기 모의고사를 풉니다.

K8s 실전 #6 운영 체크리스트 — 업그레이드 / 백업, 복구 / 비용 / 보안
12 분 소요

K8s 실전 #6 운영 체크리스트 — 업그레이드 / 백업, 복구 / 비용 / 보안

K8s 실전 시리즈의 마지막 글입니다. 클러스터를 안정적으로 띄우는 일과 한 해 동안 안전하게 운영하는 일은 다른 결의 작업입니다. EKS 클러스터 업그레이드 사이클, 노드 그룹 교체 패턴, RDS 자동 백업과 PITR, Karpenter와 Spot으로 비용을 잡는 길, kube-bench와 Trivy로 보안 점검을 정기화하는 흐름까지 정리하겠습니다. 마지막 글이므로 K8s 실전 6편 회고와 26편짜리 K8s 트랙 전체의 회고도 함께 담겠습니다.

K8s 실전 #5 모니터링, 알람 — Prometheus / CloudWatch / Alertmanager
9 분 소요

K8s 실전 #5 모니터링, 알람 — Prometheus / CloudWatch / Alertmanager

[#4](/ko/posts/k8s-practice-4)까지 만든 myshop-api는 코드부터 배포까지 자동화됐지만, 그 동작을 보지 못하면 운영이 굴러가지 않습니다. 이번 글에서는 EKS 클러스터의 옵저버빌리티 스택을 정리하겠습니다. kube-prometheus-stack으로 Prometheus + Grafana + Alertmanager를 한 번에 설치하고, Container Insights와 Fluent Bit으로 CloudWatch에 메트릭,로그를 보내는 두 축을 결합하고, ServiceMonitor / PrometheusRule로 myshop-api 메트릭과 알람을 표준화하고, 4 golden signals 룰셋과 Slack / PagerDuty 라우팅으로 on-call 흐름까지 정리하겠습니다.

K8s 실전 #4 CI/CD 파이프라인 — GitHub Actions / ECR / ArgoCD
8 분 소요

K8s 실전 #4 CI/CD 파이프라인 — GitHub Actions / ECR / ArgoCD

[#3](/ko/posts/k8s-practice-3)까지 만든 myshop-api는 새 버전이 들어오는 과정이 사람의 손에 묶여 있습니다. 이번 글에서는 그 과정을 자동화하겠습니다. GitHub Actions에서 OIDC로 정적 키 없이 AWS ECR에 컨테이너 이미지를 푸시하고, 매니페스트 repo의 Helm values를 자동 commit해 [고급 #6](/ko/posts/k8s-advanced-6)에서 다룬 ArgoCD가 그 변경을 감지해 클러스터로 동기화하는 흐름을 정리하겠습니다. PR 승인 게이트, dev/prod 분기, 카나리 배포까지 함께 짚겠습니다.