PE Notes · 서비스
오토스케일
수직 Scale Up과 수평 Scale Out·In을 가르고, 지표·일정 트리거와 쿠버네티스 HPA, 쿨다운을 한 흐름으로 정리합니다.
피크를 서버 한 대로 미리 사 두면, 평일은 빈 자리가 청구서입니다. 은 부하가 커지면 키우고, 줄어들면 거둡니다. 방향은 한 대의 사양과 대수의 두 축입니다.
위가 아니라 옆으로
은 한 노드의 CPU·메모리·디스크를 올립니다. 내리면 Scale Down입니다. 한계는 하드웨어 천장이고, 재시작이 자주 붙습니다. DB처럼 프로세스가 하나인 칸에 맞습니다.
은 같은 사양의 인스턴스를 늘립니다. Scale In은 그 수를 줄입니다. 로드밸런서가 필수이고, 한 대가 꺼져도 옆이 받습니다. 와 이미지가 같아야 새 칸이 같은 일을 합니다.
| 비교축 | Scale Up | Scale Out |
|---|---|---|
| 방법 | 한 대 사양 | 대수 |
| 한계 | 하드웨어 천장 | 사실상 넓다 |
| 중단 | 재시작이 잦다 | 무중단에 가깝다 |
| 장애 | 한 점에 모임 | 분산 |
| 자리 | DB·단일 프로세스 | 웹·MSA |
| 밸런서 | 없어도 됨 | 필요 |
트리거는 CPU·RPS 같은 지표, 장 개시처럼 일정, 예측 모델, 큐 길이 같은 맞춤 값입니다. 임계만 보고 바로 늘리면 출렁입니다.
감지에서 투입, 그리고 기다림
모니터가 임계를 알리면 정책이 평가합니다. 새 인스턴스가 떠서 밸런서에 붙고, 워밍이 끝난 뒤에야 트래픽을 받습니다. 부하가 꺾이면 쿨다운을 지나 Scale In합니다.
쿨다운은 방금 늘린 칸이 안정되기 전에 또 늘리거나, 잠깐 한산하다고 바로 끄지 않게 합니다. 수분대가 흔합니다. 과 같이 쓰면 폭주 요청을 먼저 깎고 용량을 따라가게 합니다.
에서는 가 수를 CPU·메모리·맞춤 지표로 맞춥니다. VPA는 요청량을 세로로 고칩니다. 이벤트 큐가 길면 KEDA류가 가로를 당깁니다.
서버리스와 나란히 두면
인스턴스 오토스케일은 수분 기동이 남고, 상태는 디스크에 둘 수 있습니다. 는 호출 단위로 늘고, 와 무상태가 짝입니다. 상시 뜨거운 API는 예약 용량, 스파이크는 함수가 싸집니다.
답안은 Up/Out/In, 트리거, HPA와 쿨다운을 한 흐름에 씁니다.