eks
글 6편, 메모 0개
EKS aws-node ipamd 행(hang) — 파드 ContainerCreating 멈춤
Karpenter가 띄운 새 노드에서 모든 파드가 IP를 못 받았습니다. aws-node는 2/2 Running인데 ipamd 프로세스가 초기화 직후 멈춰 있었습니다. 재시작도 안 먹어서 노드를 갈았습니다.
EKS Pod에 IAM 권한 주기 — IRSA vs Pod Identity
둘 다 Pod마다 다른 IAM 권한을 주려는 겁니다. IRSA는 클러스터마다 OIDC를 세팅하고, Pod Identity는 그 과정을 없앴습니다.
EKS 노드 오토스케일링 — Karpenter vs Cluster Autoscaler
Cluster Autoscaler는 미리 만든 Node Group을 늘립니다. Karpenter는 Pod 요구사항을 보고 EC2를 그 자리에서 고릅니다. 이 차이가 비용과 속도로 이어집니다.
IRSA 크로스 계정 인증 — EKS Pod의 다른 계정 Bedrock 접근
ServiceAccount에 붙이는 role-arn과 앱 설정에 쓰는 role은 서로 다른 계정의 다른 역할입니다. 액세스 키를 걷어내면서 이 구분이 필요했습니다.
EKS Thanos 배포 트러블슈팅 — StorageClass·IRSA 연쇄 오류
StorageClass 하나 잘못 잡은 게 StatefulSet 재생성으로 번지고, IRSA Trust Policy에 ServiceAccount 하나 빠진 게 컴포넌트마다 Access Denied로 나왔습니다.
EKS 서브넷 IP 고갈 — 파드 churn과 WARM_IP_TARGET
부하 테스트로 파드를 빠르게 churn하니 서브넷의 사설 IP가 절대적으로 부족해졌습니다. 삭제된 IP가 바로 안 돌아와서 처음엔 회수 시간을 줄이려 했지만, 진짜 문제는 노드가 안 쓰는 IP를 쥐고 있는 것이었습니다.