Claude Fable 5.1 출시 및 Terminal-Bench-Science 0.1 벤치마크 결과
Claude Fable 5.1 made me a really nice animated pelican
Claude Fable 5.1이 출시되었으며, Terminal-Bench-Science 0.1 벤치마크에서 52.6%의 점수를 기록했다. 이는 Fable 5의 24.7%, Opus 5의 29.0%, GPT-5.6 Sol의 22.4%에서 크게 향상된 수치이다. Fable 5.1은 다섯 가지 추론 수준을 제공하며, 추론을 완전히 끌 수 있는 옵션은 없다.
Fable 5.1은 새로운 벤치마크에서 52.6%의 점수를 기록하여 이전 모델들보다 성능이 크게 향상되었다.
원문 출처
Simon Willison's Weblog