Google, Gemini 3.8 Live 및 3.8 Live Extended Thinking 발표
Gemini Live audio
Google은 Gemini 3.8 Live와 3.8 Live Extended Thinking이라는 두 개의 음성 대 음성 모델을 발표했다. 이 모델은 OpenAI의 GPT-Live 계열과 유사한 형태를 가지고 있으며, 사용자는 웹 브라우저를 통해 음성 대화를 시도할 수 있다. 이 구현은 라이브 API에 연결하여 음성을 캡처하고 재생하는 Web Audio API를 사용한다.
Gemini 3.8 Live 모델은 실시간 음성 대화 기능을 제공하여 사용자와의 상호작용을 개선할 수 있다.
원문 출처
Simon Willison's Weblog