PsyAgentBench: LLM 에이전트의 심리적 효과를 재검토하는 벤치마크
Recognition, Simulation, and Refusal: A Contamination-Aware Study of Classic Psychological Effects in LLM Agents
PsyAgentBench는 LLM 에이전트에서 고전 심리학 실험을 재실행하는 벤치마크로, 각 패러다임은 명시적 레이블링과 블라인드 방식으로 진행된다. 41,904회의 실험을 통해 인간과 유사한 효과가 다양한 경로를 통해 발생함을 보여주며, 페르소나 조작이 효과에 미치는 영향을 분석한다. 연구에서는 페르소나 우세, 집단 붕괴, 안전 선택 등 세 가지 방식으로 심리학 패러다임이 LLM 에이전트에 적용되지 않을 수 있음을 문서화한다.
원문 출처
arXiv cs.CL (계산언어학·NLP)