필터 0
선택된 필터 없음
LLM의 thinking_token_budget은 어떤 역할을 하는가?
데보션
AI

LLM의 thinking_token_budget은 어떤 역할을 하는가?

LLM의 `thinking_token_budget`이 내부 추론 토큰의 최대치를 제한하는 설정임을 설명했습니다. 더 깊은 사고를 유도하는 기능이 아니라 빠른 응답을 위한 제어 수단임을 정리했습니다.

#LLM#vLLM
4700
모던 백엔드 - 구조화된 동시성
넥스트리
백엔드

모던 백엔드 - 구조화된 동시성

Java 25 프리뷰의 구조화된 동시성을 소개했습니다. 기존 비동기 처리의 한계를 StructuredTaskScope로 어떻게 보완하는지 살펴봤습니다.

#Java#동시성
3500
헥사고날 아키텍처, Adapter만 바꾸면 될까
flex
아키텍처

헥사고날 아키텍처, Adapter만 바꾸면 될까

AWS S3에서 다른 오브젝트 스토리지로 이전하며, Adapter 교체가 성립하려면 어떤 전제가 필요한지 확인했습니다. 헥사고날 아키텍처는 애플리케이션 코드를 지켜주지만 인프라와 데이터 이전은 별도로 대응해야 했습니다.

#헥사고날 아키텍처#AWS S3
2500
RxJS로 우아하게 사이드 이펙트 통제하기
채널톡
프론트엔드

RxJS로 우아하게 사이드 이펙트 통제하기

RxJS와 zustand로 비동기 사이드 이펙트를 하나의 흐름으로 통제한 개편 사례를 소개했습니다. 액션 완료 기준과 구독 해제를 명확히 해 타이밍 버그와 성능 저하를 해결했습니다.

#RxJS#비동기
4600
여기어때
프론트엔드

항공 프론트엔드 구축기 (7/10): 창구를 하나만 두었습니다

웹과 앱이 통신하는 앱 브릿지 구조를 다룬 글입니다.\n통로를 앱에만 두는 제약 속에서 항공 프론트엔드 구축 방향을 설명했습니다.

#web#mobile
2100
롯데ON
데브옵스

Airflow 3의 새벽 배치를 멈춘 건 JWT가 아니라 OOM이었다

Airflow 3 전환 후 새벽 배치 장애를 겪었지만, 원인은 JWT 만료가 아니라 OOM이었습니다. 로그 해석과 함께 메모리 사용량까지 확인해야 한다는 점을 정리했습니다.

#Airflow#JWT
900
미리디
AI

통합 검색 임베딩 모델 개발기: 9개 태스크를 고르게 학습시키기

통합 검색 임베딩 모델을 개발하며 9개 태스크를 고르게 학습시키는 과정을 다룬 글입니다. 본문이 일부 차단되어 세부 내용은 확인되지 않았습니다.

#검색#ML
2100
토스의 속도와 품질, 상용 도구로 충분한가 — 토션(Tossion)
토스
기타

토스의 속도와 품질, 상용 도구로 충분한가 — 토션(Tossion)

토스 QA 팀이 흩어진 테스트 정보와 상용 TCM의 한계를 해결하기 위해 토션 플랫폼을 만들었습니다. 또한 AI와 에이전트를 결합해 PR 분석, 테스트 케이스 생성, 자동화 실행을 빠르게 연결했습니다.

#test#자동화
7700
네이버 D2
AI

우리 팀만의 vLLM 플러그인 만들기 2편 - 모델 변환부터 배포까지 AI-native로 자동화하기

vLLM 모델 변환과 배포를 Claude Code Skill로 자동화한 과정을 소개했습니다. 필요한 지식만 읽는 구조로 바꾸며 토큰을 97% 줄이고 E2E 배포 흐름까지 만들었습니다.

#vLLM#Claude Code
2700
네이버 D2
AI

우리 팀만의 vLLM 플러그인 만들기 1편 - 검색 AI 모델 서빙 성능 극대화하기

검색·추천 스코어링 모델을 vLLM 기반 풀링 런타임과 IO Processor로 전환해 성능을 크게 높인 사례를 소개했습니다. 전후처리 통합과 배치 최적화로 처리량과 지연 시간을 개선했습니다.

#vLLM#검색
4300
모던 백엔드 - 마이그레이션
넥스트리
백엔드

모던 백엔드 - 마이그레이션

Java 21 기반 게시판 프로젝트를 Java 25 환경으로 옮기는 과정을 다뤘습니다. 호환성 3요소와 Gradle, ByteBuddy, Hibernate 체크 포인트를 함께 살펴봤습니다.

#Java#Spring Boot
3800
이메일 기반 고객 문의를 채널톡 유저챗으로 연결하기
채널톡
백엔드

이메일 기반 고객 문의를 채널톡 유저챗으로 연결하기

이메일로만 들어오던 고객 문의를 채널톡 유저챗으로 연결하는 Mail Relay 설계를 소개했습니다. App Store가 권한과 라우팅을 맡고 연동 앱은 고객 문의 처리에 집중하도록 분리했습니다.

#email#queue
2700
한화솔루션의 Amazon Bedrock 기반 Claude Cowork 전사 도입 여정 — 사내 LLM Gateway로 완성한 거버넌스
AWS
AI

한화솔루션의 Amazon Bedrock 기반 Claude Cowork 전사 도입 여정 — 사내 LLM Gateway로 완성한 거버넌스

한화솔루션은 Amazon Bedrock 기반의 사내 LLM Gateway로 Claude Cowork를 전사 도입했습니다. 멀티테넌트 인증과 비용·보안 거버넌스로 안전한 AI 활용 체계를 만들었습니다.

#Amazon Bedrock#Claude
2900
[신청 중] 핫파티션과 트래픽 폭주, 우리는 이렇게 넘었습니다
채널톡
백엔드

[신청 중] 핫파티션과 트래픽 폭주, 우리는 이렇게 넘었습니다

DynamoDB 실무에서 겪는 핫파티션과 트래픽 폭주 대응 사례를 공유하는 밋업을 소개했습니다. 대규모 마이그레이션과 무중단 재구조화 경험도 함께 다룹니다.

#DynamoDB#트래픽
2600