Elasticsearch 3TB의 인덱스를 reindex 하는 방법
Elasticsearch 대용량 인덱스 reindex에서 속도와 안정성을 높이는 설정 조정 사례를 다뤘습니다. replica 분리, refresh 비활성화, throttling과 복구 속도 제한으로 장애를 줄였습니다.
새로운 기술 블로그가 추가되었어요
Elasticsearch 대용량 인덱스 reindex에서 속도와 안정성을 높이는 설정 조정 사례를 다뤘습니다. replica 분리, refresh 비활성화, throttling과 복구 속도 제한으로 장애를 줄였습니다.
Elasticsearch의 페이지네이션 방식으로 Scroll API와 Search After를 비교해 성능을 점검했습니다. 대용량 조회에서는 병렬 처리와 PIT 조합이 중요하며, 사용 목적에 따라 방식을 선택해야 했습니다.


ICT 인턴십에서 백엔드 실무, 서비스 분석, 기술 세미나를 경험한 후기입니다. 실서비스를 다루며 테스트와 정확한 분석의 중요성을 배웠습니다.


상품 검색 성능 개선을 위해 ElasticSearch를 도입한 사례를 다뤘습니다. 인덱스 설계와 쿼리 점수 조정으로 검색 정확도와 노출 순서를 개선했습니다.
Elasticsearch 한국어 분석기 Mecab-Ko, Nori, Fastcat의 색인 성능을 비교했습니다. 사전 수를 줄이면 색인 시간이 줄어들고, Nori는 상대적으로 느렸습니다.


복잡한 광고 타게팅 조회를 MySQL 조인에서 Elasticsearch inverted index 검색으로 전환했습니다. 단일 샤드·자동 레플리카 확장 구성으로 낮은 지연과 수평 확장을 확보했습니다.
이 게시물은 쿠팡 파트너스 활동의 일환으로, 이에 따른 일정액의 수수료를 제공받습니다.


리워드 광고 플랫폼 성장에 따라 MySQL 기반 광고 서버의 수평 확장 한계가 드러났습니다. 이를 해결하기 위해 엘라스틱서치로 전환해 타게팅과 송출 구조를 개선했습니다.

Elasticsearch 색인 구조를 Kafka와 Debezium 기반 이벤트 처리로 전환한 사례를 소개했습니다. ECK를 함께 적용해 색인 속도와 운영 안정성을 함께 높였습니다.


Elasticsearch에서 문서별 광고 할당 확률을 구현하는 script와 function_score 방식을 비교했습니다. random_score·decay 조합의 구현 원리와 성능 검증 필요성을 설명합니다.


Go의 `http.Transport`를 중심으로 HTTP 커넥션 관리 방식을 분석했습니다. DynamoDB 응답시간 최적화와 커넥션 풀 활용 관점을 다룹니다.


인턴으로 데이터 대시보드, ELT 파이프라인, 검색 엔진, 업무 자동화를 구축한 경험을 공유했습니다. 데이터 품질 관리와 지속적인 파이프라인 유지보수의 중요성을 설명합니다.
![[기술 블로그] 로플랫의 대용량 데이터 처리](https://miro.medium.com/v2/resize:fit:1200/1*gTyZ_EDEHjmjLHoXhTkIPg.png)

월 4.5TB 위치 로그를 처리하기 위한 설계·구현·운영·장애 대응 원칙을 소개했습니다. BigQuery, 사전 집계, Redis와 쿼리 최적화로 대용량 분석 부담을 줄였습니다.

서버 로그를 터미널에서 직접 보던 불편함을 해결하기 위해 ELK 스택을 적용한 과정을 정리했습니다. Spring Boot와 Nginx 로그를 Kibana에서 조회하고 검색하는 방법까지 소개했습니다.

데이터플랫폼셀은 수집부터 분석·제공까지의 플랫폼을 구축해 데이터 기반 업무를 지원합니다. Kubernetes와 클라우드, 협업 문화를 바탕으로 활용성과 운영 품질을 높이고 있습니다.