Gemini 3.8 Live와 Extended Thinking, 달라진 음성 AI

핵심 요약

  • Google은 2026년 9월 15일 실시간 음성 대화 모델 Gemini 3.8 Live와 3.8 Live Extended Thinking을 발표했어요.
  • 3.8 Live는 규모와 비용 효율, Extended Thinking은 복잡한 다단계 작업에 맞춘 모델이라고 Google은 설명해요.
  • 대화를 멈추지 않고 백그라운드에서 도구를 호출하는 기능이 핵심이고, 한국 제공 여부는 공식 발표에서 확인되지 않았어요.

Gemini 3.8 Live는 Google이 2026년 9월 15일 공개한 실시간 음성 대화 모델이에요. 같은 날 더 깊이 추론하는 Extended Thinking 버전도 함께 나왔어요. Google은 두 모델을 자사 라이브 대화 모델 가운데 가장 앞선 모델이라고 소개했어요.

이번 발표의 요점은 “말하면서 일한다”는 데 있어요. 사용자가 말을 걸면 모델이 대답을 이어 가면서, 뒤에서는 도구 호출이나 검색 같은 작업을 동시에 처리하는 방식이에요. 기존 음성 비서가 작업하는 동안 대화가 끊기던 문제를 줄이려는 시도로 읽혀요.

이 글에서는 두 모델이 어떻게 다른지, 어떤 기능이 새로 들어왔는지, 누가 어디서 쓸 수 있는지를 공식 자료 기준으로 정리해요.

Gemini 3.8 Live와 Extended Thinking은 무엇이 다를까

Google은 두 모델의 역할을 분명히 나눴어요. 기본 모델은 많은 사용자를 저렴하게 상대하는 용도, Extended Thinking은 어려운 작업을 끝까지 해내는 용도예요.

구분3.8 Live3.8 Live Extended Thinking
Google이 밝힌 설계 목표규모와 비용 효율복잡도 높은 작업, 다단계 추론
대표 기능자연스러운 대화, 시각 정보 기반 대화생각하면서 동시에 말하기, 진행 상황 음성 안내
추론 설정원문에 별도 언급 없음사고 수준 조절(configurable thinking) 지원
Google이 제시한 성과Speech Agent Arena 2위Artificial Analysis Speech to Speech Quality Index 1위(82.6점)

성과 수치는 모두 Google이 발표한 값이에요. Google은 Extended Thinking이 τ-Voice에서 68.6%, Sierra의 τ-Voice-banking에서 35.1%, Big Bench Audio에서 97.7%를 기록했다고 밝혔어요. 외부에서 같은 조건으로 다시 검증한 결과는 아직 따로 확인하지 못했어요.

음성 AI가 달라지는 네 가지

Google 블로그와 개발자 블로그에 나온 기능을 사용자 입장에서 묶으면 네 가지로 정리돼요.

1. 작업하면서 대화를 이어 가요

가장 큰 변화는 비동기 함수 호출이에요. 모델이 API나 도구를 백그라운드에서 호출하는 동안에도 음성 응답을 계속 보내요. 예를 들어 예약을 부탁하면 “확인해 볼게요” 하고 대답한 뒤, 뒤에서 조회가 끝날 때까지 대화를 멈추지 않는 식이에요.

2. 생각하는 과정을 말로 알려 줘요

Extended Thinking은 추론과 발화를 동시에 한다고 Google은 설명해요. “Let me check that…” 같은 짧은 신호로 요청을 먼저 받아 두고, 여러 단계로 이어지는 작업은 진행 상황을 말로 중계해요. 사용자가 조용한 대기 시간을 견디지 않아도 되도록 설계한 부분이에요.

3. 화면과 카메라 정보를 함께 봐요

3.8 Live는 시각 입력을 거의 실시간으로 처리한다고 해요. Google은 3.8 Live가 화면을 보며 체스를 두는 시연 영상을 공개했고, Extended Thinking이 손 스케치와 음성 피드백을 받아 React 컴포넌트로 바꾸는 영상도 함께 올렸어요.

4. 언어를 오가며 말해도 따라와요

Google은 대화 도중 97개 지원 언어를 자동으로 감지하고 전환한다고 밝혔어요. 다만 지원 언어의 전체 목록은 발표문에 없어서, 한국어 음성 품질이 어느 정도인지는 공식 자료만으로는 판단하기 어려워요.

어디서 쓸 수 있을까

두 모델은 발표 당일부터 순차 제공되기 시작했어요. 이용자 유형별로 정리하면 아래와 같아요.

이용자3.8 Live3.8 Live Extended Thinking
개발자Gemini API, Google AI StudioGemini API, Google AI Studio
기업Gemini Enterprise 비공개 프리뷰Gemini Enterprise 비공개 프리뷰, Workspace 비즈니스 고객은 추후 제공
일반 사용자Search LiveGemini Live, Docs(AI Pro·Ultra), Gmail·Keep(모든 Google AI 구독자)

일반 사용자는 Gemini 앱의 Gemini Live에서 Extended Thinking을 만나게 돼요. Google은 Workspace의 Docs Live, Gmail Live, Keep Live에서도 이 모델을 써 볼 수 있다고 소개했어요. 한국에서 같은 시점에 제공되는지는 공식 발표에서 확인되지 않았어요.

개발자라면 알아 둘 가격과 구조

개발자 블로그에 따르면 두 모델은 Live API로 제공되고, 발표 기준 가격은 오디오 입력 분당 $0.005, 오디오 출력 분당 $0.018이에요. 이 분당 가격은 입력 100만 토큰당 $3, 출력 100만 토큰당 $12를 바탕으로 Google이 계산한 추정치라고 각주에 적혀 있어요. 실제 비용은 대화 길이와 방식에 따라 달라질 수 있어요.

Google은 이 모델들이 여러 모델을 단계별로 이어 붙이는 캐스케이드 구조보다 간결한 대안이라고 설명해요. 확인 코드나 청구 번호 같은 영문·숫자 조합을 정확히 알아듣는 기능도 강조했어요. 콜센터형 음성 상담처럼 번호를 자주 주고받는 서비스를 염두에 둔 기능이에요.

직접 인프라를 구성하기 어렵다면 Agora, LiveKit, Pipecat, Vercel 같은 통합 파트너를 거쳐 쓸 수 있다고 안내돼 있어요. 생성된 모든 음성에는 사람이 알아차리기 어려운 SynthID 워터마크가 들어가요.

확인할 점

  • 벤치마크 순위와 점수는 Google이 발표한 값이에요. 서비스 품질은 언어와 사용 환경에 따라 다를 수 있어요.
  • 한국 제공 시점과 한국어 지원 수준은 공식 발표에 나와 있지 않아요.
  • Docs, Gmail, Keep에서 쓰려면 Google AI 구독이 필요하고, 플랜마다 범위가 달라요.
  • 기업용은 비공개 프리뷰 단계라 일반 계약으로 바로 쓰기는 어려울 수 있어요.

자주 묻는 질문

Gemini 3.8 Live는 한국어로 쓸 수 있나요?

Google은 대화 중 97개 지원 언어를 자동으로 감지하고 전환한다고 밝혔어요. 하지만 발표문에는 지원 언어 목록과 한국 제공 일정이 없어요. 한국어 지원 수준은 공식 발표에서 확인되지 않았어요.

일반 사용자는 어디서 써 볼 수 있나요?

Google은 3.8 Live를 Search Live에서, Extended Thinking을 Gemini Live에서 모든 사용자에게 순차 제공한다고 적었어요. Docs에서는 Google AI Pro·Ultra 구독자, Gmail과 Keep에서는 모든 Google AI 구독자가 대상이에요.

개발자용 가격은 얼마인가요?

발표 기준 Live API 가격은 오디오 입력 분당 $0.005, 오디오 출력 분당 $0.018이에요. Google은 이 값이 100만 토큰당 입력 $3, 출력 $12를 바탕으로 한 추정치라고 밝혔어요.

정리

Gemini 3.8 Live는 대화를 끊지 않고 뒤에서 일하는 음성 AI를 목표로 해요. 가볍고 저렴하게 대량으로 쓰려면 3.8 Live, 여러 단계를 거치는 어려운 요청에는 Extended Thinking을 쓰도록 나뉘어 있어요. 일반 사용자는 Gemini Live와 Workspace 앱에서, 개발자는 Live API에서 만날 수 있어요. 한국 제공 여부는 이후 Google 공지를 확인하는 편이 안전해요.

함께 보면 좋은 글

출처

  • Google, “Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking” (2026-09-15)
  • Google, “Build real-time voice applications with Gemini 3.8 Live and 3.5 Transcribe” (2026-09-15)

댓글 남기기