Laguna, 118B 파라미터 모델의 Terminal-Bench 2.1 성능
The Sequence AI of the Week #903: Laguna, the 118 Billion Parameters that Walks Into a Trillion-Parameter Bar
Laguna S는 118B 파라미터를 가진 오픈 웨이트 모델로, Terminal-Bench 2.1에서 70.2%의 점수를 기록했다. DeepSeek-V4-Pro-Max는 1.6조 파라미터로 64.0, Inkling은 975B로 63.8, Nemotron 3 Ultra는 550B로 56.4의 점수를 보였다. DeepSWE 벤치마크에서는 Laguna S가 40.4를 기록하며 DeepSeek-V4-Pro-Max의 9.0과 큰 차이를 보였다. 이 결과는 평가 방식에 대한 의문을 불러일으키며, Poolside는 모든 실험의 결과를 공개했다.
Laguna S의 118B 파라미터와 70.2%의 성능은 대규모 모델의 효율성을 보여준다.
원문 출처
TheSequence (Jesus Rodriguez)