라이프스타일

Google, Gemini 3.8 Live with Live Avatar 출시: 말하고 표정 짓는 기업용 AI 아바타

Google은 2026년 9월 24일 Gemini 3.8 Live with Live Avatar를 발표했다. 실시간 음성 대화에 거의 실시간으로 생성되는 가상 인물 영상을 더한 기능으로, 기업용 서비스인 Gemini Enterprise에서 제공된다. 기능과 제약, 일반 이용자에게 미치는 영향을 Google 발표 내용을 바탕으로 정리했다.

읽는 데 약 6분

Google, Gemini 3.8 Live with Live Avatar 출시: 말하고 표정 짓는 기업용 AI 아바타
사진: Mokaair (Original editorial artwork)

Google이 발표한 내용

Google은 2026년 9월 24일 공식 블로그를 통해 Gemini 3.8 Live with Live Avatar를 공개했다. Google은 이 기능이 지난주 Gemini 3.8 Live 출시에 이은 새 기능으로, 거의 실시간에 가까운 영상 생성과 음성을 결합해 AI가 듣고 보고 말할 수 있는 움직이는 아바타로 사람과 대화하게 한다고 설명했다.

Google의 설명에 따르면 Live Avatar는 말에 맞춰 입 모양을 정확히 움직이는 립싱크, 자연스러운 표정, 매끄러운 대화 주고받기를 갖추고 있어 고객 서비스나 인터랙티브 안내 같은 기업 환경에 활용할 수 있다. Google은 이 기능이 발표 당일부터 Gemini Enterprise에서 제공되며, 개발자용 API 문서도 함께 제공된다고 밝혔다.

Google, Gemini 3.8 Live with Live Avatar 출시: 말하고 표정 짓는 기업용 AI 아바타
Mokaair 편집 검증 절차 · 사진: Mokaair (Original editorial artwork)
자세한 설명 보기

출처를 수집하고 독립적으로 검증한 뒤 Jev가 판단합니다.

주요 기능: Google의 설명

  • 멀티모달 입력(보고 듣는 정보를 함께 처리): Google은 Live Avatar가 시각 입력과 음성 입력을 동시에 처리한 뒤 표정이 담긴 음성과 영상으로 응답한다고 밝혔다.
  • 비동기 도구 호출(대화를 멈추지 않고 뒤에서 작업 처리): Google은 아바타가 대화를 이어가는 동안 백그라운드에서 도구를 호출하고 데이터를 가져올 수 있다고 설명했으며, 시연 사례는 호텔 투숙객 체크인이었다.
  • 다국어: Google은 97개 언어 사이를 전환할 수 있으며 이 과정에서 영상 충실도가 떨어지거나 화면이 점점 어긋나는 시각적 드리프트가 생기지 않는다고 주장했다.
  • 맞춤형 아바타: 기본 아바타 라이브러리 외에 개발자가 고품질 참조 이미지로 맞춤형 아바타를 생성할 수 있다. Google은 이 기능이 현재 기업 허용 목록을 통해서만 제공된다고 밝혔다.

Gemini 3.8 Live와 Live Avatar 비교

아래 표의 '토큰'은 AI가 글을 처리하는 기본 단위로, 대략 단어 조각에 해당한다. '모델 카드'는 Google DeepMind가 모델의 성능, 한계, 안전성 정보를 정리해 공개하는 문서다.

자료 출처: Google 블로그 및 Google DeepMind Gemini 3.8 Audio 모델 카드
항목Gemini 3.8 LiveLive Avatar 추가 시
출력 유형오디오, 텍스트오디오, 영상, 텍스트
출력 상한64K 토큰24K 토큰
제공 채널Gemini API, Gemini 앱, Google AI Studio, Gemini Enterprise Agent Platform, Google Search Live(모델 카드 기준)Gemini Enterprise(Google 블로그 기준)
연속 상호작용 시간모델 카드에 별도 명시 없음몇 시간이 아닌 몇 분(모델 카드 기준)

Google DeepMind 모델 카드에 따르면 Gemini 3.8 Audio는 Gemini 3 Pro를 기반으로 하며, Gemini 3.8 Live의 입력에는 오디오, 이미지, 영상, 텍스트가 포함될 수 있고 한 번에 다룰 수 있는 입력량인 컨텍스트 창은 최대 128K 토큰이다. 모델 카드는 또 사실이 아닌 내용을 그럴듯하게 말하는 환각 등 기반 모델의 일반적 한계가 나타날 수 있고, 가끔 느려지거나 시간 초과가 발생할 수 있으며, 지식 기준일은 2025년 1월이라고 명시했다.

안전과 투명성: SynthID 워터마크

Google은 자사 AI 제품이 생성하는 모든 출력물에 SynthID 워터마크를 적용하며, 오디오와 영상에 직접 삽입한다고 밝혔다. Google DeepMind에 따르면 SynthID 워터마크는 사람이 알아챌 수 없지만 SynthID 기술로 감지할 수 있다. 이용자는 이미지, 영상, 오디오를 Gemini에 업로드해 Google AI가 생성하거나 수정했는지 물어볼 수 있다. Google DeepMind는 또 SynthID Detector 검증 포털을 현재 기자 및 언론 전문가와 함께 시험 중이라고 밝혔다.

모델 카드는 또 Google이 Gemini 3.7 Flash 평가 결과를 근거로, Gemini 3.8 Live 등의 모델이 자사 프런티어 안전 프레임워크의 추적 또는 핵심 역량 수준에 도달할 가능성이 낮다고 판단했다고 밝혔다. 이는 Google의 자체 평가이며 외부의 독립적 검토 결론이 아니다.

자주 묻는 질문

일반인도 지금 Live Avatar를 사용할 수 있나요?

Google 블로그에 따르면 Gemini 3.8 Live with Live Avatar는 현재 Gemini Enterprise에서 제공되며 주로 기업과 개발자를 대상으로 합니다. 맞춤형 아바타는 기업 허용 목록으로만 제공됩니다. 일반 이용자는 기업의 고객 서비스나 안내 서비스를 통해 간접적으로 접할 가능성이 큽니다.

Live Avatar는 어떤 언어를 말할 수 있나요?

Google은 Live Avatar가 97개 언어 사이를 전환할 수 있으며, 대화 도중 언어를 바꿀 때 립싱크와 표정도 조정한다고 밝혔습니다. Google 발표에는 전체 언어 목록이 나와 있지 않습니다.

오래 대화할 수 있나요?

아닙니다. Google DeepMind 모델 카드에 따르면 Live Avatar를 적용한 버전은 몇 시간이 아닌 몇 분 수준의 연속 상호작용을 지원하며, 가끔 느려지거나 시간 초과가 발생할 수 있습니다.

화면 속 인물이 AI로 생성된 것인지 어떻게 알 수 있나요?

Google은 자사 AI 제품의 출력물에 SynthID 워터마크가 삽입된다고 밝혔습니다. Google DeepMind에 따르면 이미지, 영상, 오디오를 Gemini에 업로드해 Google AI가 생성하거나 수정했는지 물어볼 수 있습니다. 이 방법은 Google AI 콘텐츠만 판별할 수 있습니다.

이 기능 설명들은 독립적으로 검증됐나요?

아닙니다. 이 글의 모든 정보는 Google 및 Google DeepMind 공식 페이지에서 나온 것으로, 기능, 지원 언어 수, 안전성 평가 모두 Google 자체의 주장입니다.

이 주제의 최신 뉴스 보기

최신 여행 소식·가이드

출처

라이프스타일