AI 모델의 퍼즐 해결 능력과 한계
AI models flub these intelligence tests. Can you fare any better?
AI 개발 초기부터 퍼즐과 게임은 중요한 역할을 해왔다. 2024년 말, 컬럼비아 대학교 연구팀은 최고의 AI 모델이 뉴욕 타임스의 Connections 퍼즐을 18%만 해결할 수 있음을 보여주었다. 2025년 초에는 일부 모델이 이 퍼즐을 거의 완벽하게 해결할 수 있게 되었다. 그러나 AI 모델은 여전히 고전적인 수수께끼의 미세한 변화에 어려움을 겪고, 시각적 퍼즐에서는 특히 약점을 보인다. 예를 들어, Knights and Knaves 퍼즐에서는 모델이 훈련 중 본 유사한 문제와의 차이를 간과할 수 있다. ARC-AGI 퍼즐에서도 AI는 일반화된 규칙을 사용하지 못하고 복잡한 규칙으로 답을 내는 경향이 있다.
2024년 연구에서 AI 모델이 뉴욕 타임스의 Connections 퍼즐을 18%만 해결할 수 있었던 점은 AI의 현재 한계를 보여준다.
원문 출처
MIT Technology Review — AI