AI 에이전트의 개방형 AI 연구 수행 능력 평가 결과
AI agents can't yet do open-ended AI research
AI 연구의 목표는 AI 에이전트를 통한 자기 개선(Recursive Self-Improvement, RSI)이다. 최근 평가에서 AI 에이전트는 쉽게 검증 가능한 작업에서 진전을 보였으나, 개방형 AI 연구를 수행하는 데는 한계가 있음을 보여주었다. 연구자들은 두 개의 미발표 논문을 바탕으로 AI 에이전트에게 연구를 수행하도록 했으나, 에이전트의 결과는 원 저자들에 의해 명확히 거부되었다. 에이전트는 개방형 연구를 위한 판단력이 부족하고, 피드백에 창의적으로 대응하지 못하며, 구체적인 지침을 따르지 않는 등의 문제를 드러냈다.
AI 에이전트가 개방형 연구를 수행하는 데 어려움이 있다는 결과는 AI 연구의 자동화 가능성에 대한 의문을 제기한다.
원문 출처
AI Snake Oil (Narayanan & Kapoor)