
백엔드
Amazon Aurora PostgreSQL에서 pgvector를 프로덕션 환경으로 운영하기
두줄요약
Aurora PostgreSQL에서 pgvector를 프로덕션 RAG에 운영하는 방법을 정리했습니다. HNSW 선택, 거리 함수, 메모리 계획, 관측성까지 실무 기준으로 설명했습니다.
핵심 내용
- Amazon Aurora PostgreSQL에서 pgvector를 프로덕션 RAG 워크로드로 운영할 때의 실무 운영 가이드
- HNSW와 IVFFlat, 인덱스 생략 여부, 거리 연산자 선택, 반복 스캔, 양자화, 파티셔닝, 용량 계획, 관측성까지 전반을 다룸
- 특히 프로덕션 트래픽에서 재현율, 지연 시간, 메모리 상주, 인덱스 변동 관리가 핵심 포인트
적용해볼 점
- 기본 선택으로 HNSW를 두되, 소규모 테이블이나 제한된 파티션에서 100% 재현율이 필요하면 인덱스 생략도 검토
- 단위 정규화된 임베딩이면 내적 연산자와
vector_ip_ops를, 필터링 쿼리에는 반복 스캔과 적절한ef_search를 활용 maintenance_work_mem,work_mem,BufferCacheHitRatio를 중심으로 메모리와 관측성을 사전에 점검
