LLM 추론의 비결정성 문제
Defeating Nondeterminism in LLM Inference
대형 언어 모델(LLM)에서 재현 가능성은 과학적 진보의 기반이지만, 재현 가능한 결과를 얻기 어렵다. 예를 들어, ChatGPT에 동일한 질문을 여러 번 하면 다른 결과가 나올 수 있다. 온도를 0으로 조정해도 LLM API는 여전히 실제로 비결정적이다. 비결정성의 한 가설은 부동 소수점 비결정성과 동시 실행의 조합이 원인이라는 것이다. 그러나 동일한 행렬 곱셈을 반복적으로 실행할 경우 결과가 항상 동일하다는 점에서 이 가설은 완전한 설명이 아니다.
비결정성 문제를 이해하는 것은 LLM을 사용하는 개발자들이 예측 가능한 결과를 얻기 위해 필요한 조치를 취하는 데 중요하다.
원문 출처
Thinking Machines Lab Blog