HARNESSEVO: LLM 에이전트의 최적화 가치 분석
Where Does Harness-Optimization Value Live? Localized Gains and the Budget-Splitting Trap in Self-Evolving LLM Agents
HARNESSEVO는 LLM의 하네스를 역할, 작업 전략, 도구/형식 규칙, 반영/제어의 네 개 슬롯으로 분해하여 최적화 가치를 분석한다. ALFWorld에서 HARNESSEVO는 기존 하네스나 평면 문자열 진화보다 성공률이 크게 개선되지 않았지만, 반영/제어 슬롯에서 +0.119의 유의미한 최적화 가치를 발견했다. 균일한 예산 분배는 해롭고, 예산을 제어 슬롯에 집중하면 성과를 회복할 수 있다.
HARNESSEVO는 반영/제어 슬롯에서 +0.119의 성과 개선을 보여, 슬롯별 최적화의 중요성을 강조한다.
원문 출처
arXiv cs.CL (계산언어학·NLP)