목록 보기
Long context LLM : 2부 RoPE Extension Method
AI

Long context LLM : 2부 RoPE Extension Method

데보션
데보션
2024년 10월 8일

두줄요약

RoPE 기반 LLM의 context length를 늘리는 Position Interpolation 방법을 소개했습니다. 제한 범위를 넘어갈 때의 attention score 폭발을 줄이고, 적은 finetuning으로 성능을 유지한 결과를 다뤘습니다.

핵심 내용

  • RoPE 기반 LLM에서 context length 확장 시 Position Interpolation 적용 방식 소개
  • 제한된 context 범위를 넘어선 attention score 폭발 문제와 linear scale 보정 개념 정리
  • 적은 finetuning으로도 perplexity 성능을 유지하거나 개선한 실험 결과 언급
  • 다음 글에서 NTK aware interpolation, NTK by part interpolation, Yarn 확장 예고

다음 읽기

#LLM 주제를 이어서 읽기

AI 학습을 위한 LLM 스터디 - 배치 전략 및 어텐션 개선 방안

LLM 추론 효율을 높이기 위한 배치 전략과 어텐션 개선 방법을 정리한 글입니다. FlashAttention, 페이지 어텐션, 추측 디코딩의 개념과 장점을 설명했습니다.

데보션
데보션
AI

댓글 0

댓글을 작성하려면 로그인이 필요합니다.

댓글을 불러오는 중...