
AI
같은 LLM인데 왜 결과가 다를까? 답은 하네스에 있다.
두줄요약
같은 LLM이라도 결과 차이는 모델보다 하네스 설계에서 크게 갈렸습니다. 지시 문서, 외부 검증, 컨텍스트 관리로 에이전트 성능을 높이는 방법을 정리했습니다.
핵심 내용
- 같은 LLM이라도 성능 차이는 모델 자체보다 하네스, 즉 모델을 둘러싼 실행 환경 설계에서 발생
- 프롬프트 엔지니어링, 컨텍스트 엔지니어링, 하네스 엔지니어링을 서로 다른 층위로 구분
- 하네스를 구성하는 요소로 지시 문서, 자동 규칙 검사, 외부 검증, 컨텍스트 관리, 진행파일을 제시
적용해볼 점
- AGENTS.md 같은 짧은 지시 문서로 역할·형식·금지 규칙부터 시작
- 린터·테스트·스키마 검증을 모델 바깥에 붙여 자동 차단
- 컴팩션, 하위 에이전트, 진행파일로 긴 작업의 컨텍스트 오염 방지


