라이프스타일

Google, Gemini 3.8 Live with Live Avatar 엔터프라이즈 정식 출시 발표: 말하는 AI 가상 인간, 고객 상담에 등장

Google은 실시간 음성 대화와 립싱크 영상 가상 인간을 결합한 Gemini 3.8 Live with Live Avatar를 Gemini Enterprise에서 정식 제공한다고 밝혔으며, SynthID 워터마크와 맞춤형 가상 인간 허용 목록을 오남용 방지책으로 내세웠다. 이 글은 기능, 현재 상태, 일반인에게 미치는 영향을 정리한다.

읽는 데 약 8분

Google, Gemini 3.8 Live with Live Avatar 엔터프라이즈 정식 출시 발표: 말하는 AI 가상 인간, 고객 상담에 등장
사진: Mokaair (Original editorial artwork)

무슨 일이 있었나: Live Avatar, 엔터프라이즈 정식 출시

Google Cloud 블로그는 Gemini 3.8 Live with Live Avatar가 Gemini Enterprise에서 정식 제공(generally available)된다고 발표했다. 정식 제공은 시험 단계를 마치고 정식 서비스로 내놓는다는 뜻이다. Google은 이 기술을 기업 운영 환경에서 사용할 수 있게 됐다고 밝혔다. 해당 Google Cloud 블로그 글의 날짜는 2026년 9월 25일이다. 이 기능을 소개하는 별도 글은 2026년 9월 24일 blog.google에 게시됐다. Google에 따르면 이 기술은 Google Cloud Next 2026에서 처음 프리뷰로 공개됐다.

이번 출시는 Google이 2026년 9월 15일 발표한 Gemini 3.8 Live와 Gemini 3.8 Live Extended Thinking을 기반으로 한다. Google에 따르면 Gemini 3.8 Live는 규모와 비용 효율에 중점을 두고, Extended Thinking은 복잡도가 높은 작업과 다단계 추론을 겨냥한다. 이상의 정보는 모두 Google 자체 웹사이트에서 나온 것으로, 아직 독립적인 출처로 확인되지 않았다.

Google, Gemini 3.8 Live with Live Avatar 엔터프라이즈 정식 출시 발표: 말하는 AI 가상 인간, 고객 상담에 등장
Mokaair 편집 검증 절차 · 사진: Mokaair (Original editorial artwork)
자세한 설명 보기

출처를 수집하고 독립적으로 검증한 뒤 Jev가 판단합니다.

주요 기능과 현재 상태 비교

Google에 따르면 Live Avatar는 웹, 모바일 기기, 인터랙티브 키오스크에서 작동하는 대화형 영상 에이전트를 위해 입 모양이 동기화된 가상 인간을 생성할 수 있다. Gemini 3.8 Live는 97개 언어를 이해하고 말할 수 있으며 언어를 자동 감지하고, 가상 인간의 입 모양과 표정도 이들 언어 사이에서 전환된다. 모델은 대화를 이어가면서 백그라운드에서 도구 및 API 호출(다른 프로그램이나 시스템에 작업을 요청하는 것)을 실행할 수 있다. 실시간 시각 이해 기능은 카메라 화면, 화면 공유, 오디오를 동시에 처리할 수 있다. Google은 또한 정식 버전이 미국 및 EU 엔드포인트(서비스에 접속하는 서버 지점)를 제공한다고 밝혔다. 이와 함께 예약 처리량(처리 용량을 미리 확보해 두는 방식), 기업 규정 준수, 데이터 거버넌스도 제공한다고 덧붙였다.

Gemini 3.8 Live 시리즈 항목별 비교(자료 출처: Google)
항목Google 발표일Google이 설명한 포지셔닝현재 상태(Google 발표 기준)
Gemini 3.8 Live2026년 9월 15일규모와 비용 효율, 자연스러운 대화와 시각 이해발표 완료, Live Avatar의 음성 기반
Gemini 3.8 Live Extended Thinking2026년 9월 15일고난도 작업과 다단계 추론비공개 프리뷰
Gemini 3.8 Live with Live Avatar2026년 9월 24일(blog.google 소개 글) / 9월 25일(Google Cloud 블로그 정식 제공 발표)입 모양이 동기화된 영상 가상 인간Gemini Enterprise 정식 제공, 미국 및 EU 엔드포인트
맞춤형 가상 인간2026년 9월 24일참조 이미지로 브랜드 전용 가상 인간 생성허용 목록에 오르고 검증된 기업 한정

성능 면에서 Google은 Gemini 3.8 Live Extended Thinking이 Artificial Analysis 음성 대 음성 품질 지수에서 82.6점으로 1위를 차지했다고 밝혔다. 또 τ-Voice에서 68.6%, Big Bench Audio에서 97.7%를 기록했다고 했다. Gemini 3.8 Live는 Speech Agent Arena에서 2위를 차지했다. 이 성적은 Google이 자체 공개한 것이므로 독자는 제조사 측 주장으로 받아들이는 것이 좋다.

신원 보호와 워터마크 조치

실제 사람의 외모로 실시간으로 말할 수 있는 AI 가상 인간에서 가장 우려되는 위험은 신원 도용과 오도다. Google에 따르면 고객은 사전 제작된 가상 인간 라이브러리에서 선택할 수 있다. 참조 이미지로 맞춤형 가상 인간을 생성하려면 기업 허용 목록(미리 승인된 고객만 이용할 수 있게 하는 명단)과 검증 절차를 통과해야 한다. Google은 또한 생성된 모든 오디오 및 영상 스트림에 SynthID 워터마크가 포함된다고 밝혔다. SynthID는 Google의 AI 생성물 식별용 워터마크로, 육안으로 알아보기 어렵다. Google은 이것이 AI 생성 콘텐츠를 탐지할 수 있게 하기 위한 것이라고 설명했다.

일반 독자에게 미치는 실제 영향

이번 발표의 대상은 기업과 개발자이며, 일반 소비자가 이 서비스를 직접 구매하거나 활성화하지는 않는다. 실제 영향은 이를 도입한 기업이 AI 가상 인간을 고객 상담, 쇼핑 안내 또는 체크인 절차에 배치할 수 있다는 점이다. Google Cloud 블로그는 Cox Automotive가 Autotrader를 위해 AI 쇼핑 도우미를 만든 사례를 들었다. 이 도우미는 차량 구매자의 차량 검색과 비교를 안내한다. Google은 또한 보험금 청구 접수 데모도 선보였다. 사용자가 카메라를 향해 손상 내용을 설명하면 백그라운드 에이전트가 보험 계약을 확인하고 자료를 정리하는 방식이다.

Google Cloud 블로그는 Equal AI의 CEO Akhilesh Damaraju의 발언도 인용했다. 그는 자사 AI가 매일 9개 인도 언어로 100만 건 이상의 실시간 통화를 처리한다고 말했다. 블로그는 Salesforce의 Bob Van Osten이 Gemini 3.8 Live와 Agentforce의 협력을 언급한 내용도 인용했다. 이는 모두 Google이 선별한 고객 측 발언이다. 여러 언어를 지원하고 화면을 볼 수 있는 AI 상담은 일부 서비스를 더 편리하게 만들 수 있다. 다만 카메라에 공유하는 화면과 목소리가 기업의 AI 시스템에서 처리된다는 의미이기도 하므로, 이용 전에 해당 기업의 개인정보 처리 안내를 살펴볼 필요가 있다.

자주 묻는 질문

일반인도 지금 Live Avatar를 직접 사용할 수 있나요?

Google에 따르면 Gemini 3.8 Live with Live Avatar는 Gemini Enterprise에서 기업 고객에게 제공되며, API(프로그램끼리 기능을 주고받는 연결 창구)를 통해 개발자가 통합할 수 있다. 일반인은 기업의 웹사이트, 앱 또는 안내 키오스크에서 간접적으로 접할 가능성이 더 크다.

Live Avatar는 앞서 발표된 Gemini 3.8 Live와 무엇이 다른가요?

Google이 2026년 9월 15일 발표한 Gemini 3.8 Live는 실시간 음성 대화 모델이다. 이후 공개된 Live Avatar(blog.google 소개 글 9월 24일, Google Cloud 블로그 정식 제공 발표 9월 25일)는 그 위에 입 모양이 동기화된 영상 가상 인간을 더해 대화형 에이전트에 눈에 보이는 모습을 부여한다.

Extended Thinking도 함께 정식 출시됐나요?

아니다. Google Cloud 블로그에 따르면 Gemini 3.8 Live Extended Thinking은 여전히 비공개 프리뷰(일부 고객만 시험 사용하는 단계)이며, 정식 제공되는 것은 Gemini 3.8 Live with Live Avatar다.

누군가 이를 이용해 다른 사람의 얼굴을 도용할 수 있나요?

Google은 맞춤형 가상 인간은 기업 허용 목록과 검증 절차를 거쳐야 하며, 일반 고객은 사전 제작된 가상 인간 라이브러리에서만 선택할 수 있다고 밝혔다. 모든 출력물에는 SynthID 워터마크도 포함된다. 이는 Google이 설명한 보호 조치이며, 실제 효과는 아직 독립적으로 검증되지 않았다.

한국어를 지원하나요?

Google은 Gemini 3.8 Live가 97개 언어를 지원하고 자동 감지할 수 있다고 밝혔지만, 발표문에 전체 언어 목록이 나와 있지 않아 특정 언어의 지원 수준은 확인할 수 없다.

이용 요금은 얼마인가요?

Google Cloud 블로그는 가격이 자사 요금 페이지에 게시돼 있다고만 밝혔으며, 발표문에는 구체적인 금액이 나와 있지 않다.

Google의 다른 관련 음성 모델에는 무엇이 있나요?

Google Cloud 블로그는 Gemini 3.5 Transcribe와 Gemini 3.5 Live Translate 등을 소개했다. Google에 따르면 3.5 Transcribe는 2026년 8월 26일 발표됐으며 85개 이상 언어를 전사할 수 있다. 3.5 Live Translate는 2026년 6월 9일 발표됐으며 70개 이상 언어 간 음성을 거의 실시간으로 번역할 수 있다.

이 주제의 최신 뉴스 보기

최신 여행 소식·가이드

출처

라이프스타일