
Tracing NodeJs Applications with OpenTelemetry
Node.js 애플리케이션에 OpenTelemetry를 붙여 Grafana Tempo로 트레이스를 수집하는 방법을 소개했습니다. 자동 계측과 수동 span, 분산 추적 활용 가능성도 함께 설명했습니다.
새로운 기술 블로그가 추가되었어요

Node.js 애플리케이션에 OpenTelemetry를 붙여 Grafana Tempo로 트레이스를 수집하는 방법을 소개했습니다. 자동 계측과 수동 span, 분산 추적 활용 가능성도 함께 설명했습니다.


AWS EKS 기반 MSA 환경에서 LGTM 스택을 도입해 관측 체계를 통합했습니다. 메트릭, 로그, 트레이스를 연결해 장애 파악과 운영 효율을 개선했습니다.


주문소요시간을 줄이기 위해 결제 동선과 UI를 줄인 사례를 소개했습니다. 고객 행동 데이터를 바탕으로 불필요한 선택과 얼럿을 제거해 결제 속도를 개선했습니다.


광고 예산의 계획 대비 소진 속도를 제어하는 시스템을 마이크로서비스로 단계적으로 분리했습니다. Kafka와 Prometheus 기반 집계·관측을 강화해 제어 주기와 가설 검증 속도를 개선했습니다.

Kubernetes 기반 Spring Boot 서버에 Prometheus·Grafana·BigQuery를 결합한 모니터링 구성을 소개했습니다.\nActuator와 Micrometer로 핵심 지표를 수집하고 장애 대응에 활용하는 방법을 설명합니다.


Grafana로 Azure PlayFab을 모니터링하는 방법을 소개하는 글입니다. 클라우드 환경에서 게임 서비스 관측과 대시보드 구성 방향을 다룹니다.


FrontEnd 성능 측정 항목과 Lighthouse 등 분석 도구를 비교했습니다. Docker 기반 sitespeed.io·Grafana 대시보드 구성 절차를 안내합니다.
이 게시물은 쿠팡 파트너스 활동의 일환으로, 이에 따른 일정액의 수수료를 제공받습니다.


Prometheus와 Grafana로 GPU 클러스터 리소스를 수집·시각화하는 구성을 소개했습니다. Python 커스텀 exporter로 GPU 점유율 등을 보고하고 수집 주기별 부하를 고려했습니다.


Prometheus와 Grafana로 Kubernetes의 Pod·Node 리소스 대시보드를 구성했습니다. 메모리 급증 알림과 Worker Node 자원 현황을 운영 대응에 활용했습니다.


Kubernetes와 기존 시스템을 통합 모니터링하기 위해 Prometheus와 Grafana를 도입했습니다. 데이터 보관 주기와 Persistent Volume 정책을 조정해 운영상 데이터 유실을 방지했습니다.