말하면서 동시에 생각하는 AI — Google DeepMind, Gemini 3.8 Live 2종 출시
Google DeepMind가 대화를 유지하면서 배경에서 멀티스텝 추론을 동시에 처리하는 음성 AI 모델 2종을 9월 15일 출시했다. Gemini 3.8 Live Extended Thinking은 Artificial Analysis의 Speech-to-Speech 품질 지수에서 82.6점으로 1위를 기록했으며, GPT-Live-1과 Astra Voice를 넘어섰다.
원문: Google DeepMind Introduces Gemini 3.8 Live and 3.8 Live Extended Thinking 원문 보기 →
개요
Google DeepMind가 9월 15일 Gemini 3.8 Live와 Gemini 3.8 Live Extended Thinking을 출시했다. 두 모델은 기존의 순차적 발화 방식에서 벗어나, 대화를 이어가면서 배경에서 복잡한 작업을 동시에 처리하는 데 초점을 맞춘다.
두 모델의 차이
- Gemini 3.8 Live: 규모와 비용 효율을 최적화한 기본 모델. 유동적인 대화와 시각적 맥락 처리를 결합해 일반 대화 에이전트에 적합하다.
- Gemini 3.8 Live Extended Thinking: 고복잡도 태스크 전용. 발화와 추론을 동시에 진행하며 대화 흐름을 끊지 않고 멀티스텝 문제를 처리한다.
성능 벤치마크
Gemini 3.8 Live Extended Thinking은 Artificial Analysis의 Speech-to-Speech 품질 지수에서 82.6점으로 1위를 기록했다. 에이전트 작업 완료율은 τ-Voice 68.6%, Sierra의 τ-Voice-banking 벤치마크에서 35.1%를 달성했다. Big Bench Audio 추론 점수는 97.7%다. Gemini 3.8 Live는 Speech Agent Arena에서 2위를 차지했다.
가용성
두 모델 모두 Gemini API와 Google AI Studio를 통해 개발자에게 제공된다. 기업용은 Gemini Enterprise 프라이빗 프리뷰로 이용할 수 있으며, 일반 소비자는 Search Live, Gemini Live, Google Workspace(Docs, Gmail, Keep)에서 Google AI Pro·Ultra 구독으로 접근 가능하다.
관련 기사
50년 된 마우스 포인터, AI로 재발명 — Google DeepMind의 Magic Pointer
Google DeepMind가 마우스 커서를 맥락 인식 AI 에이전트로 전환하는 Magic Pointer를 공개했다. 화면 내용을 이해하고 사용자 의도에 맞는 행동을 제안하는 새로운 인터페이스 패러다임이다.
구글 딥마인드, Pro급 품질·Flash 속도의 이미지 모델 'Nano Banana 2' 공개
구글 딥마인드가 Gemini Flash 기반의 이미지 생성·편집 모델 Nano Banana 2(Gemini 3.1 Flash Image)를 출시했다. 프로급 품질과 빠른 생성 속도를 결합해 출시 직후 이미지 생성 벤치마크 1위를 기록했다.
DeepMind 창업자 해사비스, 아모데이의 AI 감속 에세이에 "방향은 옳다"
Google DeepMind 공동 창업자 Demis Hassabis가 9월 12일 Dario Amodei의 AI 개발 감속 에세이를 공개 지지했다. "세부 사항은 다듬어야 하지만 방향은 옳다"며 자신이 제안한 AI 업계 프론티어 표준화 기구 논의와 맥락이 닿는다고 밝혔다.