![[WhaTap] RDS Failover/Reboot 관제 2 – RDS Failover](https://i0.wp.com/bespin-wordpress-bucket.s3.ap-northeast-2.amazonaws.com/wp-content/uploads/2025/04/image-508.png?fit=893%2C202&ssl=1)
데브옵스
[WhaTap] RDS Failover/Reboot 관제 2 – RDS Failover
두줄요약
WhaTap에서 RDS Failover/Reboot을 직접 감지할 메트릭이 없어 AWS CLI 기반 스크립트로 이벤트 관제를 구성했습니다. Crontab 주기 실행과 권한 설정, 선행 리스트 파일 구성이 중요했습니다.
문제 상황
- WhaTap에서 RDS Failover/Reboot을 감지하는 별도 메트릭 부재
- Failover/Reboot이 메트릭이 아닌 이벤트로 분류되어 관제 자동화 필요
해결 방법
- AWS CLI의
describe-events결과를 파싱하는 셸 스크립트로 Failover 이벤트 감지 - Cluster/Instance 대상 목록과 이벤트 파일을 대조해 대상 리소스 정보와 함께 JSON 형태로 전송
- Crontab에 주기 실행을 등록해 신규 RDS 생성·삭제 상황에도 관제 범위 유지
주의할 점
- IAM Role과 Access Key 혼용 시 Profile 분리 필요
describe RDS권한과 선행 리스트 파일 존재 필요- AWS CLI 호출 부하를 고려해 5분 간격 실행 권장
