모든 태그
태그

LLM 기술 블로그 글

LLM 태그가 달린 국내 IT 기업 기술 블로그 글을 최신순으로 모았습니다.

전체 1,062최신 20개 표시
홈에서 필터

최신 게시글

20개 표시

오늘

AI

사내 지식으로 Agentic RAG 만들기 (1/3) : RAG 파이프라인의 바닥 다지기

사내 지식을 활용한 Agentic RAG 구축의 첫 단계로 RAG 파이프라인의 기반을 다지는 내용을 다뤘습니다. 발췌상 사내 공통플랫폼 맥락에서 RAG 설계와 적용을 정리한 글로 보입니다.

#Agentic RAG#RAG#LLM
500

오늘

AI

AI 기반 SCTE-35 자동 삽입으로 라이브 스트리밍 광고 운영 자동화하기

라이브 스트리밍의 SCTE-35 광고 삽입을 AI 화면 인식과 서버리스 오케스트레이션으로 자동화하는 방법을 소개했습니다. 필러 화면 감지를 통해 광고 타이밍을 정밀하게 맞추고 운영 비용도 줄였습니다.

#AWS#LLM#cloud
600

AI

보안 업무를 위한 AI 에이전트 플랫폼 「SAGE」 개발기 1편: 판단은 사람에게 남기는 설계

보안 업무에 AI를 적용할 때 사람의 판단을 남기고 AI는 1차 정리와 근거 수집을 맡기는 SAGE 플랫폼 설계를 소개했습니다. 3개 진입점과 멀티 에이전트, RAG, MCP, 피드백 루프로 운영하는 방식도 정리했습니다.

#LLM#RAG#Jira
2900

AI

Amazon Bedrock에서 LLM 게이트웨이의 두 사각지대 메우기: 사라진 호출자와 흐려진 모델 거버넌스

Amazon Bedrock 앞의 LLM 게이트웨이에서 사라진 호출자와 흐려진 모델 거버넌스를 보완하는 방법을 정리했습니다. requestMetadata와 Application Inference Profile로 추적과 관측을 강화하고, 예산과 네트워크 운영도 함께 다뤘습니다.

#Amazon Bedrock#LLM#CloudWatch
900

AI

AI Agent를 위한 OpenSearch 검색 품질 평가하기 (Part 1)

AI Agent 검색 품질을 OpenSearch와 Bedrock으로 정량 평가하는 방법을 다루었습니다. NDCG와 Recall, LLM Judge 검증, BM25·시멘틱·하이브리드 비교 결과를 함께 설명했습니다.

#OpenSearch#RAG#LLM
900

AI

AI가 이해하는 기업

기업 AI가 ROI로 이어지지 않는 이유를 의미 계층의 부재로 설명했습니다. 온톨로지와 Active Ontology를 통해 맥락을 기계가 읽게 만드는 방향을 제안했습니다.

#LLM#RAG#검색
2100

AI

LLM에게 계산을 시키지 마세요 — 숫자를 '신뢰'할 수 있는 AI 데이터 애널리스트 개발기

형식이 제각각인 대규모 시장 데이터를 다루는 사내 AI 애널리스트 플랫폼 개발기입니다. LLM은 질문 해석만 맡기고 계산은 분리해 숫자 신뢰성을 확보했습니다.

#LLM#데이터 분석#natural language processing
3000

AI

AI에게 투자정보를 말하게 하기까지

투자 정보는 적시성, 정확성, 검증 가능성이 중요해 LLM 출력만으로는 부족했습니다. 근거 선별과 절차 통제, 평가 가능한 구조를 통해 AI가 말해도 되는 상태를 운영했습니다.

#LLM#ML#React
5500

AI

AI 에이전트 스킬이 발동하지 않는 이유: SKILL.md 결함과 개선법

AI 에이전트 스킬 파일 `SKILL.md`에서 발생하는 결함 유형과 원인을 분석했습니다. Frontmatter와 본문을 어떻게 고쳐야 하는지 8가지 점검 항목으로 정리했습니다.

#AI 에이전트#LLM#arXiv
1900

AI

LLM의 thinking_token_budget은 어떤 역할을 하는가?

LLM의 `thinking_token_budget`이 내부 추론 토큰의 최대치를 제한하는 설정임을 설명했습니다. 더 깊은 사고를 유도하는 기능이 아니라 빠른 응답을 위한 제어 수단임을 정리했습니다.

#LLM#vLLM#Claude
5000

AI

통합 검색 임베딩 모델 개발기: 9개 태스크를 고르게 학습시키기

통합 검색 임베딩 모델을 개발하며 9개 태스크를 고르게 학습시키는 과정을 다룬 글입니다. 본문이 일부 차단되어 세부 내용은 확인되지 않았습니다.

#검색#ML#LLM
2200

아키텍처

AWS AI-DLC를 System Maintenance 환경에 맞게 커스터마이징하기

AWS AI-DLC를 System Maintenance 환경에 맞게 3계층 Override 구조로 커스터마이징한 사례를 소개했습니다. 반복 질문 제거, 추측 방지, 자동화로 운영 유지보수 효율을 높인 점이 핵심입니다.

#AWS#LLM#Kiro
1000

AI

데이터 요청 응대 30분을 3분으로 줄인 n8n AI 에이전트

n8n AI 에이전트로 데이터 요청 응대 시간을 30분에서 3분으로 줄인 사례를 다뤘습니다. 미리디 데이터 분석가가 온콜 헬퍼봇을 만든 배경과 활용 방식을 소개했습니다.

#LLM#자동화#모니터링
4900

기타

에이전트 플러그인 등 8월 첫째 주 Google for Developers 위클리 업데이트를 지금 확인하세요!

Google for Developers의 8월 첫째 주 위클리 업데이트를 소개합니다. AI, Android, Google Play, Flutter 관련 최신 개발자 소식과 읽을거리들을 한 번에 확인할 수 있습니다.

#LLM#MCP#API
1700

AI

개인 AI 활용의 다음 단계는 무엇인가 - LY Corporation에서 AIDD 워크숍을 통해 살펴본 AIDD 조직 도입의 조건

LY Corporation이 AIDD 워크숍을 통해 개인의 AI 활용을 조직 차원으로 확장할 조건을 살펴보았습니다. 핵심은 컨텍스트 정비와 팀 단위 협업, 의사결정자 참여였습니다.

#LLM#자동화#test
3900

AI

AI 에이전트, 자율에 맡길까 절차로 통제할까

AI 에이전트는 자율 방식과 워크플로우 방식으로 나뉘며, 차이는 루프 통제 주체에 있습니다. 업무 성격에 따라 유연성과 예측 가능성의 균형을 맞춰 선택해야 합니다.

#AI 에이전트#workflow#LLM
5000

AI

[기술동향] LLM 추론 최적화 핵심 기술: 양자화, KV 캐시, 추론 칩

에이전틱 AI 확산에 따라 LLM 추론 최적화 기술과 추론 전용 칩의 중요성이 커졌습니다. 양자화, KV 캐시 압축, LPU·TPU 활용으로 비용과 지연 시간을 함께 줄이는 방향을 정리했습니다.

#LLM#양자화#KV cache
1600

AI

[클로바 시선 #57] 대화는 순서를 기다리지 않는다: 실시간 음성 대화 AI를 위한 데이터 파이프라인 ‘Sommelier’

실시간 음성 대화 AI가 사람 같은 상호작용을 하려면 순차적 질의응답을 넘어서는 처리가 필요합니다. 대화 중 끼어들기와 짧은 반응을 다루는 데이터 파이프라인 Sommelier를 소개합니다.

#LLM#streaming#데이터 파이프라인
800

AI

AI API Gateway, 무엇을 보고 골라야 할까? 도입부터 운영까지 선택 기준 5단계

AI API Gateway 선택 기준을 도입부터 운영까지 5단계로 정리했습니다. 여러 모델을 쓴다면 모델 다양성, 보안, 결제, 모니터링을 함께 검토해야 합니다.

#API Gateway#LLM#보안
3600

백엔드

모던 백엔드 강좌 소개

2026년 기준 Java 25와 Spring Boot 4.x 중심의 백엔드 변화와 실무 전환 포인트를 소개했습니다. 단일 예제 프로젝트로 마이그레이션 판단과 AI 통합까지 다루는 커리큘럼입니다.

#Java#Spring Boot#GraalVM
8100