[WhaTap] RDS Failover/Reboot 관제 2 – RDS Failover
데브옵스
[WhaTap] RDS Failover/Reboot 관제 2 – RDS Failover
두줄요약
WhaTap에서 RDS Failover를 별도 메트릭 없이 이벤트 기반 스크립트로 관제하는 방법을 소개했습니다. AWS CLI, Focus, Crontab을 활용한 자동화 구성과 주의사항을 정리했습니다.
문제 상황
- WhaTap에서 RDS Failover/Reboot를 직접 감지하는 별도 메트릭 부재
- Failover가 지표가 아닌 이벤트로 분류되어 통합 관제에 어려움
- 신규 RDS 생성·삭제 같은 대상 변경에도 자동 관제 필요
해결 방법
- AWS CLI
describe-events와 쉘 스크립트로 Failover 이벤트 수집 - Cluster와 Instance 목록 파일을 순회하며 대상 리소스별 이벤트 매칭
- WhaTap Focus로 JSON 형식 전송 후 카테고리 기반 관제 구성
주의할 점
- IAM Role과 Access Key 혼용 시 권한 충돌 방지 필요
- RDS Describe 권한 필요, Cron 실행 간격은 5분 정도 여유 권장
describe RDS스크립트가 선행되어 목록 파일 존재해야 함
적용해볼 점
- Failover 발생 시
Failover > 0조건으로 전체 감지 가능 - 이벤트 기반 관제는 별도 메트릭이 없어도 자동화로 보완 가능
