국내 IT 기업 기술 블로그 최신 글

NEW FEATURE

기술을 읽던 곳에서, 다음 기회를 만나세요.

채용 검색부터 관심사 기반 추천, 내 적합도까지.

새로운 기술 블로그가 추가되었어요

필터 1
Harness를 이용해 LLM 애플리케이션 평가 자동화하기
라인
AI

Harness를 이용해 LLM 애플리케이션 평가 자동화하기

LLM 애플리케이션의 변동성과 복잡성을 줄이기 위해 테스트와 평가를 자동화하는 방법을 소개했습니다. Harness를 커스텀해 프롬프트, 지표, 아웃풋별 평가를 동적으로 처리하는 파이프라인을 구성했습니다.

#LLM#test
5500
똑똑한 Agent는 어떻게 일을 할까? : LLM Workflow상세소개
데보션
AI

똑똑한 Agent는 어떻게 일을 할까? : LLM Workflow상세소개

T멤버십 영화예매 에이전트에 LLM Workflow를 적용한 과정을 소개했습니다. 엔티티 추출, 상태 관리, 개인화 반영으로 멀티턴 대화 품질을 높인 사례입니다.

#LLM#prompt
3100
AI 모름, 진짜 모름 – 가난한 자의 AI 서비스 만들기 (Feat. llama-node )
스마일게이트AI
AI

AI 모름, 진짜 모름 – 가난한 자의 AI 서비스 만들기 (Feat. llama-node )

Node.js와 llama-node로 로컬에서 동작하는 간단한 AI 텍스트 생성 서버를 구성했습니다. 복잡한 설정 없이 프롬프트 입력과 응답 생성을 빠르게 시험해볼 수 있습니다.

#JavaScript#node.js
3900
Gen AI를 활용한 리뷰 하이라이트
여기어때
AI

Gen AI를 활용한 리뷰 하이라이트

숙소 리뷰에서 핵심 정보만 뽑아 보여주기 위해 Gen AI 기반 리뷰 하이라이트를 구현했습니다.전처리와 프롬프트 개선, 사람의 검수를 거쳐 숙소별 TOP 키워드를 자동 추출했습니다.

#LLM#Azure OpenAI
3200
생성형 AI로 QA 업무 수행하기 : 똑똑한 소프트웨어 테스트의 시작
SK플래닛
AI

생성형 AI로 QA 업무 수행하기 : 똑똑한 소프트웨어 테스트의 시작

생성형 AI를 QA 업무에 적용해 요구 사항 분석과 테스트 케이스 작성, 결함 분석의 효율을 높이는 방법을 소개했습니다. 다만 복합 케이스와 최종 검증은 수작업 보완이 필요하다고 정리했습니다.

#LLM#ChatGPT
6700
[에이닷 미디어 에이전트] 대화형 콘텐츠 탐색은 어디까지 왔을까
데보션
AI

[에이닷 미디어 에이전트] 대화형 콘텐츠 탐색은 어디까지 왔을까

에이닷 미디어 에이전트의 대화형 콘텐츠 탐색 구조와 핵심 기술을 설명했습니다. LLM, RAG, 선제 추천을 활용해 개인화된 검색 경험을 강화했습니다.

#LLM#RAG
2600
쿠팡 파트너스

광고

개발자를 위한 서적을 확인해 보세요

이 게시물은 쿠팡 파트너스 활동의 일환으로, 이에 따른 일정액의 수수료를 제공받습니다.

#개발서적#프로그래밍
LLM 품질 테스팅 시작하기
한글과컴퓨터
AI

LLM 품질 테스팅 시작하기

LLM과 sLLM의 자체 품질 평가 필요성을 정리하고, 리더보드 사례와 함께 LLM을 활용한 평가 프로세스를 설계한 글입니다. 프롬프트 일관성과 평가 기준 관리 같은 운영 과제도 함께 다뤘습니다.

#LLM#품질 평가
3200
프롬프트 엔지니어링이란? 부제 : ‘2024 서울 프롬프톤’ 대회 참가
한글과컴퓨터
AI

프롬프트 엔지니어링이란? 부제 : ‘2024 서울 프롬프톤’ 대회 참가

프롬프트 엔지니어링의 개념과 구성 요소, 작성 순서, 대표 기법을 정리했습니다. 공공문서 자동화 사례를 통해 실무 적용 가능성도 함께 살펴봤습니다.

#prompt#자동화
4200
LLM Application 구축 도전기 (feat. 소중한 고객님들의 리뷰) - 1부
마켓컬리
AI

LLM Application 구축 도전기 (feat. 소중한 고객님들의 리뷰) - 1부

베스트 리뷰 요약의 범용성·시의성 한계를 해결하기 위해 LLM 리뷰 선별을 실험했습니다. CoT와 판단 근거 응답을 적용해 검수 정확성과 결론의 투명성을 높였습니다.

#LLM#prompt
000
AWS Bedrock과 Claude 3.5 Sonnet을 활용한 자동 상품 이미지 검수 시스템 구축기
올리브영
AI

AWS Bedrock과 Claude 3.5 Sonnet을 활용한 자동 상품 이미지 검수 시스템 구축기

AWS Bedrock과 Claude 3.5 Sonnet으로 상품 이미지 자동 검수 시스템을 구축한 사례를 다뤘습니다. 프롬프트 최적화와 운영 통제를 통해 정확도와 처리 속도를 개선했습니다.

#AWS#Claude
2700
에이닷은 어떻게 먼저 말을 걸어 오는 걸까?
데보션
AI

에이닷은 어떻게 먼저 말을 걸어 오는 걸까?

에이닷의 선톡 기능을 Context 수집·가공·활용과 평가 시스템으로 구현한 방식을 소개했습니다. 사용자 반응과 피로도를 함께 고려해 먼저 말을 거는 개인화를 고도화했습니다.

#LLM#prompt
2300
LLM 모델이 LLM 성능을 평가한다. LLM-as-a-judge 알아보기
데보션
AI

LLM 모델이 LLM 성능을 평가한다. LLM-as-a-judge 알아보기

LLM이 다른 LLM의 응답 품질을 평가하는 LLM-as-a-Judge 방법을 소개했습니다. 프롬프트를 단순화하고 평가 이유를 요구하면 인간 평가와의 일치도가 크게 높아졌습니다.

#LLM#prompt
3000
효과적인 LLM 품질 평가 : 도구, 기준, 그리고 적용기 톺아보기(SPeCTRA)
데보션
AI

효과적인 LLM 품질 평가 : 도구, 기준, 그리고 적용기 톺아보기(SPeCTRA)

에이닷의 LLM 품질 평가 자동화와 SPeCTRA 기준 도입 사례를 소개했습니다. 사람 평가와 자동 평가를 병행해 QA 효율과 모델 개선 주기를 높였습니다.

#LLM#ChatGPT
4700
[신청 시작] 8월 우아한테크세미나: 생성AI로 똑똑하게 일하는 법
우아한 형제들
AI

[신청 시작] 8월 우아한테크세미나: 생성AI로 똑똑하게 일하는 법

8월 우아한테크세미나의 신청 안내와 세션 구성을 소개했습니다. 생성형 AI 활용법과 로컬 LLM 사례를 중심으로 발표 내용을 예고했습니다.

#LLM#생성형 AI
2800