
RDS 모니터링을 위한 나만의 CloudWatch Dashboard 만들기
AWS RDS 모니터링을 위해 CloudWatch Dashboard를 직접 구성하는 방법을 소개했습니다. 가로 임계값과 이상 탐지를 더해 상태 판단을 쉽게 만드는 과정을 설명했습니다.

AWS RDS 모니터링을 위해 CloudWatch Dashboard를 직접 구성하는 방법을 소개했습니다. 가로 임계값과 이상 탐지를 더해 상태 판단을 쉽게 만드는 과정을 설명했습니다.


쿠팡의 머신러닝 플랫폼이 개발부터 배포, 모니터링까지 전 과정을 어떻게 지원하는지 소개했습니다. 노트북, 피처 스토어, 분산 학습, 추론 서빙, 하이브리드 클러스터 운영이 핵심입니다.


분산 환경에서 핀포인트로 트랜잭션 흐름과 병목 구간을 추적하는 방법을 소개했습니다. Server Map과 Call Stack으로 장애 원인을 빠르게 찾는 사례와 장단점을 정리했습니다.

TMAP이 조사차량 이미지로 도로표지판 정보를 추출해 최신 길안내를 유지하는 방식을 소개했습니다. 기존 수작업의 높은 운영비용을 줄이기 위한 딥러닝 활용 내용을 다룹니다.


Go에서 프로파일링과 트레이싱을 활용하는 방법을 소개한 GopherCon 2023 발표입니다. 런타임 성능 분석과 실행 흐름 추적의 실무 팁을 다룹니다.
Elasticsearch 대용량 인덱스 reindex에서 속도와 안정성을 높이는 설정 조정 사례를 다뤘습니다. replica 분리, refresh 비활성화, throttling과 복구 속도 제한으로 장애를 줄였습니다.
쿠팡 파트너스
이 게시물은 쿠팡 파트너스 활동의 일환으로, 이에 따른 일정액의 수수료를 제공받습니다.


컬리 앱에서 뷰티 컬리 런칭 과정과 전환 구조 개선 사례를 공유했습니다. 초기 오픈과 이후 전환율 개선까지 협업과 데이터 기반 대응이 중심이었습니다.

AWS EKS에서 운영 중인 챗봇 서비스의 비용을 Spot by NetApp 도입으로 최적화한 사례입니다. 파드와 노드 교체 안정성을 보완해 수수료 포함 약 40% 절감했습니다.

Debezium connector 재시작 때 오래된 binlog를 다시 읽으며 DB CPU가 급등한 원인을 분석했습니다. heartbeat.interval.ms를 적용해 상태 기록 주기를 보강하고 문제를 해결했습니다.


실시간 위치 검색을 위해 도시 단위 샤딩과 메타데이터 레지스트리를 활용한 인덱스 설계를 소개했습니다. 또한 도시 경계 이슈와 핫스팟 발생 시의 한계와 확장 방향도 함께 다뤘습니다.


광고 플랫폼의 예산 제어 시스템을 개선하는 연재의 첫 글입니다. 캠페인 예산을 안정적으로 분배하지 못하면 조기 소진과 지출 스파이크가 발생할 수 있음을 다뤘습니다.


Datadog Dash 2022 컨퍼런스와 뉴욕 본사 방문 경험을 공유한 글입니다. 신규 기능 소개와 워크샵, 현장 분위기, 오프라인 참석의 장점을 중심으로 정리했습니다.