본문으로 건너뛰기

말하면서 동시에 생각하는 AI — Google DeepMind, Gemini 3.8 Live 2종 출시

Google DeepMind가 대화를 유지하면서 배경에서 멀티스텝 추론을 동시에 처리하는 음성 AI 모델 2종을 9월 15일 출시했다. Gemini 3.8 Live Extended Thinking은 Artificial Analysis의 Speech-to-Speech 품질 지수에서 82.6점으로 1위를 기록했으며, GPT-Live-1과 Astra Voice를 넘어섰다.

원문: Google DeepMind Introduces Gemini 3.8 Live and 3.8 Live Extended Thinking 원문 보기 →

AI X/Twitter 작성자 Insights AI (Twitter) 1분 소요 출처

개요

Google DeepMind가 9월 15일 Gemini 3.8 LiveGemini 3.8 Live Extended Thinking을 출시했다. 두 모델은 기존의 순차적 발화 방식에서 벗어나, 대화를 이어가면서 배경에서 복잡한 작업을 동시에 처리하는 데 초점을 맞춘다.

두 모델의 차이

  • Gemini 3.8 Live: 규모와 비용 효율을 최적화한 기본 모델. 유동적인 대화와 시각적 맥락 처리를 결합해 일반 대화 에이전트에 적합하다.
  • Gemini 3.8 Live Extended Thinking: 고복잡도 태스크 전용. 발화와 추론을 동시에 진행하며 대화 흐름을 끊지 않고 멀티스텝 문제를 처리한다.

성능 벤치마크

Gemini 3.8 Live Extended Thinking은 Artificial Analysis의 Speech-to-Speech 품질 지수에서 82.6점으로 1위를 기록했다. 에이전트 작업 완료율은 τ-Voice 68.6%, Sierra의 τ-Voice-banking 벤치마크에서 35.1%를 달성했다. Big Bench Audio 추론 점수는 97.7%다. Gemini 3.8 Live는 Speech Agent Arena에서 2위를 차지했다.

가용성

두 모델 모두 Gemini API와 Google AI Studio를 통해 개발자에게 제공된다. 기업용은 Gemini Enterprise 프라이빗 프리뷰로 이용할 수 있으며, 일반 소비자는 Search Live, Gemini Live, Google Workspace(Docs, Gmail, Keep)에서 Google AI Pro·Ultra 구독으로 접근 가능하다.

공유: 긴글

관련 기사