

페타바이트 트래픽 원인 분석기
EKS의 CloudWatch 대시보드에서 네트워크 메트릭이 페타바이트로 보이는 문제를 분석했습니다. cAdvisor 누적값과 Pod 재시작 시 언더플로우가 원인이었습니다.
새로운 기술 블로그가 추가되었어요


EKS의 CloudWatch 대시보드에서 네트워크 메트릭이 페타바이트로 보이는 문제를 분석했습니다. cAdvisor 누적값과 Pod 재시작 시 언더플로우가 원인이었습니다.


스토리지 엔진의 사용 언어를 C/C++에서 Go로 변경한 과정을 소개했습니다. Cgo를 거쳐 Go로 옮겨가는 전환 흐름을 중심으로 다뤘습니다.

쿠버네티스 Event Watch API로 노드 추가를 감지하는 알림 프로그램 구현 방식을 설명했습니다.\nEvent TTL·중복 처리와 RBAC, 사이드카 프록시를 포함한 배포 구성을 함께 다뤘습니다.


Go·DynamoDB 환경의 고지연 원인을 TLS Handshake와 짧은 타임아웃에 따른 커넥션 종료로 분석했습니다.\n타임아웃을 70ms로 조정해 재시도를 줄이고 커넥션 재활용을 유도했습니다.


트래픽 증가 후 일부 gRPC 요청에서 DynamoDB 응답 시간이 길어지는 현상을 다뤘습니다. Go HTTP Client와 TLS Handshake 관점의 점검 경험을 공유합니다.


Go 서비스에서 HTTP Trace로 DynamoDB 요청 지연 요인을 추적했습니다. AWS Credential Token 발급 로직의 응답 시간 영향을 분석하고 최적화했습니다.


Go의 `http.Transport`를 중심으로 HTTP 커넥션 관리 방식을 분석했습니다. DynamoDB 응답시간 최적화와 커넥션 풀 활용 관점을 다룹니다.


Django 기반 서비스에서 호출 비중이 약 80%인 Allocation API의 성능 병목을 확인했습니다. 해당 API만 Go로 분리 구현하는 방식의 서버 개발을 검토했습니다.
이 게시물은 쿠팡 파트너스 활동의 일환으로, 이에 따른 일정액의 수수료를 제공받습니다.