필터 1
엔카닷컴
AI

RAG 없이 20만 대 자동차와 실시간으로 대화하기 (2)

RAG 대신 내부 API를 직접 활용해 실시간 차량 정보를 전달하는 API 증강 생성 아키텍처를 소개했습니다. 병렬 호출, 캐싱, SSE 스트리밍으로 실시간성과 비용 효율을 함께 개선했습니다.

#RAG#LLM
14500
SDUI의 성능 병목을 넘어: 올리브영 로컬 캐시 기반 백엔드 최적화 성공기
올리브영
백엔드

SDUI의 성능 병목을 넘어: 올리브영 로컬 캐시 기반 백엔드 최적화 성공기

SDUI의 트래픽 병목을 Caffeine과 Redis 이중 캐시로 해결한 사례를 소개했습니다. 백오피스 즉시 무효화와 프리워밍으로 1ms 미만 응답 성능을 확보했습니다.

#Kotlin#Spring Boot
23600
SLM 기반 Agentic AI: Planner–Caller–Generator 구조 설계와 성능 분석
한글과컴퓨터
AI

SLM 기반 Agentic AI: Planner–Caller–Generator 구조 설계와 성능 분석

SLM 기반 P–C–G 구조로 Agentic AI의 역할을 분리해 효율성과 안정성을 높였습니다. 한국어 도구 활용 환경에서 GPT-4o-mini 수준의 성능과 토큰 절감 효과를 확인했습니다.

#LLM#prompt
5000
Next.js 프로젝트의 정적 파일 배포 환경 구성
사람인
프론트엔드

Next.js 프로젝트의 정적 파일 배포 환경 구성

Next.js 정적 파일을 개발·운영으로 분리하고 CI/CD로 자동 배포하는 구성을 소개했습니다. 변경된 파일만 rsync와 Purge로 처리해 캐시 비용과 운영 부담을 줄였습니다.

#Next.js#CI/CD
2500
우아한 형제들
백엔드

이제 Redis를 멈춰보겠습니다: @CacheEvict 파헤치기

`@CacheEvict(allEntries = true)`가 내부적으로 어떻게 동작하는지 Spring Cache와 Redis 구현 레벨에서 살펴보았습니다. 기본 `KEYS` 전략이 운영 환경에서 위험할 수 있어 대안도 함께 정리했습니다.

#Spring Boot#Spring Data Redis
6500
RAG 없이 20만 대 자동차와 실시간으로 대화하기 (1)
엔카닷컴
AI

RAG 없이 20만 대 자동차와 실시간으로 대화하기 (1)

20만 대 차량의 실시간 데이터를 다루기 위해 RAG의 한계를 검토했습니다. 검색 기반보다 API로 직접 정보를 조합하는 아키텍처가 더 적합하다고 판단했습니다.

#RAG#LLM
2800
LLM 기반 내비게이션 에이전트 개발기: 에이닷과 함께 진화하는 대화형 모빌리티 AI
데보션
AI

LLM 기반 내비게이션 에이전트 개발기: 에이닷과 함께 진화하는 대화형 모빌리티 AI

SK텔레콤이 에이닷과 티맵을 결합해 LLM 기반 대화형 내비게이션 에이전트를 개발했습니다. 규칙 기반 한계를 보완하기 위해 하이브리드 모델, 캐싱, 검증 로직을 적용했습니다.

#LLM#MCP
5100
RabbitMQ Classic Queue 메모리 장애와 Quorum Queue 전환기
올리브영
백엔드

RabbitMQ Classic Queue 메모리 장애와 Quorum Queue 전환기

대량 쿠폰 발급 중 RabbitMQ Classic Queue 메모리 장애와 동기화 실패 원인을 분석했습니다. 긴급 복구 후 버전 업그레이드와 Quorum Queue 전환으로 안정성을 높였습니다.

#RabbitMQ#AWS
5800
가맹점은 변함없이, 결제창 시스템 전면 재작성하기
토스
아키텍처

가맹점은 변함없이, 결제창 시스템 전면 재작성하기

레거시 결제창을 결제 도메인 중심 구조로 재설계한 사례를 다뤘습니다. 기능 추상화와 단계적 전환, 자동 롤백으로 가맹점 영향 없이 개편했습니다.

#Java#JSP
23200
KPT 회고, 이렇게 했더니 스쿼드 문화가 바뀌었습니다: 올리브영 주문결제 스쿼드의 애자일 성장기
올리브영
백엔드

KPT 회고, 이렇게 했더니 스쿼드 문화가 바뀌었습니다: 올리브영 주문결제 스쿼드의 애자일 성장기

올리브영 주문결제 스쿼드가 KPT 회고로 문제를 실행 과제로 바꾸며 협업 문화를 개선했습니다. PR 템플릿, 데일리 스크럼, 장바구니 캐싱으로 코드 품질과 운영 안정성도 높였습니다.

#agile#회의
9200
SK플래닛
AI

Chat DIC 프로젝트에서 AWS Bedrock Prompt Caching으로 성능 최적화하기

AWS Bedrock Prompt Caching으로 Chat DIC의 반복 프롬프트 재계산을 줄이고 응답 지연과 Throttling을 개선했습니다. 또한 system과 tools 문맥을 캐싱해 평균 응답 시간을 단축하고 비용도 절감했습니다.

#AWS#LLM
5400
우아한 형제들
백엔드

Redis New Connection 증가 이슈 돌아보기

Redis 신규 커넥션 증가 현상을 추적해 파이프라이닝과 커넥션 풀, Elasticache timeout의 영향을 확인했습니다. FIFO 전환과 IDLE 커넥션 정리 방법도 함께 정리했습니다.

#Redis#Lettuce
4900
GraphQL 커스텀 디렉티브로 만드는 선언적 지연 로딩
크리에이트립
프론트엔드

GraphQL 커스텀 디렉티브로 만드는 선언적 지연 로딩

SSR에서 개인화 필드 동기화와 중복 요청 문제를 GraphQL 커스텀 디렉티브로 해결한 사례를 소개했습니다.\n`@lazy`로 필요한 필드만 재조회해 네트워크 비용을 줄이고 개발자 경험을 개선했습니다.

#GraphQL#Apollo Client
6800
29CM 주문서 결제 혜택 UX 개편기:그래서 얼마에 살 수 있는 거에요?
무신사
프론트엔드

29CM 주문서 결제 혜택 UX 개편기:그래서 얼마에 살 수 있는 거에요?

주문서 결제 혜택을 더 직관적으로 보여주도록 UX와 상태 관리 구조를 개편했습니다. 그 결과 구매전환율과 혜택 사용 비중, 결제 속도가 함께 개선되었습니다.

#React#UI/UX
25700