라이프스타일
Google, Gemini 3.8 Live with Live Avatar 출시: 말하고 표정 짓는 기업용 AI 아바타
Google은 2026년 9월 24일 Gemini 3.8 Live with Live Avatar를 발표했다. 실시간 음성 대화에 거의 실시간으로 생성되는 가상 인물 영상을 더한 기능으로, 기업용 서비스인 Gemini Enterprise에서 제공된다. 기능과 제약, 일반 이용자에게 미치는 영향을 Google 발표 내용을 바탕으로 정리했다.
읽는 데 약 6분

Google이 발표한 내용
Google은 2026년 9월 24일 공식 블로그를 통해 Gemini 3.8 Live with Live Avatar를 공개했다. Google은 이 기능이 지난주 Gemini 3.8 Live 출시에 이은 새 기능으로, 거의 실시간에 가까운 영상 생성과 음성을 결합해 AI가 듣고 보고 말할 수 있는 움직이는 아바타로 사람과 대화하게 한다고 설명했다.
Google의 설명에 따르면 Live Avatar는 말에 맞춰 입 모양을 정확히 움직이는 립싱크, 자연스러운 표정, 매끄러운 대화 주고받기를 갖추고 있어 고객 서비스나 인터랙티브 안내 같은 기업 환경에 활용할 수 있다. Google은 이 기능이 발표 당일부터 Gemini Enterprise에서 제공되며, 개발자용 API 문서도 함께 제공된다고 밝혔다.
자세한 설명 보기
출처를 수집하고 독립적으로 검증한 뒤 Jev가 판단합니다.
주요 기능: Google의 설명
- 멀티모달 입력(보고 듣는 정보를 함께 처리): Google은 Live Avatar가 시각 입력과 음성 입력을 동시에 처리한 뒤 표정이 담긴 음성과 영상으로 응답한다고 밝혔다.
- 비동기 도구 호출(대화를 멈추지 않고 뒤에서 작업 처리): Google은 아바타가 대화를 이어가는 동안 백그라운드에서 도구를 호출하고 데이터를 가져올 수 있다고 설명했으며, 시연 사례는 호텔 투숙객 체크인이었다.
- 다국어: Google은 97개 언어 사이를 전환할 수 있으며 이 과정에서 영상 충실도가 떨어지거나 화면이 점점 어긋나는 시각적 드리프트가 생기지 않는다고 주장했다.
- 맞춤형 아바타: 기본 아바타 라이브러리 외에 개발자가 고품질 참조 이미지로 맞춤형 아바타를 생성할 수 있다. Google은 이 기능이 현재 기업 허용 목록을 통해서만 제공된다고 밝혔다.
Gemini 3.8 Live와 Live Avatar 비교
아래 표의 '토큰'은 AI가 글을 처리하는 기본 단위로, 대략 단어 조각에 해당한다. '모델 카드'는 Google DeepMind가 모델의 성능, 한계, 안전성 정보를 정리해 공개하는 문서다.
| 항목 | Gemini 3.8 Live | Live Avatar 추가 시 |
|---|---|---|
| 출력 유형 | 오디오, 텍스트 | 오디오, 영상, 텍스트 |
| 출력 상한 | 64K 토큰 | 24K 토큰 |
| 제공 채널 | Gemini API, Gemini 앱, Google AI Studio, Gemini Enterprise Agent Platform, Google Search Live(모델 카드 기준) | Gemini Enterprise(Google 블로그 기준) |
| 연속 상호작용 시간 | 모델 카드에 별도 명시 없음 | 몇 시간이 아닌 몇 분(모델 카드 기준) |
Google DeepMind 모델 카드에 따르면 Gemini 3.8 Audio는 Gemini 3 Pro를 기반으로 하며, Gemini 3.8 Live의 입력에는 오디오, 이미지, 영상, 텍스트가 포함될 수 있고 한 번에 다룰 수 있는 입력량인 컨텍스트 창은 최대 128K 토큰이다. 모델 카드는 또 사실이 아닌 내용을 그럴듯하게 말하는 환각 등 기반 모델의 일반적 한계가 나타날 수 있고, 가끔 느려지거나 시간 초과가 발생할 수 있으며, 지식 기준일은 2025년 1월이라고 명시했다.
안전과 투명성: SynthID 워터마크
Google은 자사 AI 제품이 생성하는 모든 출력물에 SynthID 워터마크를 적용하며, 오디오와 영상에 직접 삽입한다고 밝혔다. Google DeepMind에 따르면 SynthID 워터마크는 사람이 알아챌 수 없지만 SynthID 기술로 감지할 수 있다. 이용자는 이미지, 영상, 오디오를 Gemini에 업로드해 Google AI가 생성하거나 수정했는지 물어볼 수 있다. Google DeepMind는 또 SynthID Detector 검증 포털을 현재 기자 및 언론 전문가와 함께 시험 중이라고 밝혔다.
모델 카드는 또 Google이 Gemini 3.7 Flash 평가 결과를 근거로, Gemini 3.8 Live 등의 모델이 자사 프런티어 안전 프레임워크의 추적 또는 핵심 역량 수준에 도달할 가능성이 낮다고 판단했다고 밝혔다. 이는 Google의 자체 평가이며 외부의 독립적 검토 결론이 아니다.
자주 묻는 질문
일반인도 지금 Live Avatar를 사용할 수 있나요?
Google 블로그에 따르면 Gemini 3.8 Live with Live Avatar는 현재 Gemini Enterprise에서 제공되며 주로 기업과 개발자를 대상으로 합니다. 맞춤형 아바타는 기업 허용 목록으로만 제공됩니다. 일반 이용자는 기업의 고객 서비스나 안내 서비스를 통해 간접적으로 접할 가능성이 큽니다.
Live Avatar는 어떤 언어를 말할 수 있나요?
Google은 Live Avatar가 97개 언어 사이를 전환할 수 있으며, 대화 도중 언어를 바꿀 때 립싱크와 표정도 조정한다고 밝혔습니다. Google 발표에는 전체 언어 목록이 나와 있지 않습니다.
오래 대화할 수 있나요?
아닙니다. Google DeepMind 모델 카드에 따르면 Live Avatar를 적용한 버전은 몇 시간이 아닌 몇 분 수준의 연속 상호작용을 지원하며, 가끔 느려지거나 시간 초과가 발생할 수 있습니다.
화면 속 인물이 AI로 생성된 것인지 어떻게 알 수 있나요?
Google은 자사 AI 제품의 출력물에 SynthID 워터마크가 삽입된다고 밝혔습니다. Google DeepMind에 따르면 이미지, 영상, 오디오를 Gemini에 업로드해 Google AI가 생성하거나 수정했는지 물어볼 수 있습니다. 이 방법은 Google AI 콘텐츠만 판별할 수 있습니다.
이 기능 설명들은 독립적으로 검증됐나요?
아닙니다. 이 글의 모든 정보는 Google 및 Google DeepMind 공식 페이지에서 나온 것으로, 기능, 지원 언어 수, 안전성 평가 모두 Google 자체의 주장입니다.
같은 주제의 글
라이프스타일
NVIDIA, DGX Spark 64GB 모델 출시: 10월 23일 판매 시작, 시작가 4,999달러, 두 대 연결 시 128GB
NVIDIA는 2026년 10월 2일 개인용 AI 컴퓨터 DGX Spark에 더 저렴한 64GB 메모리 모델을 추가한다고 발표했다. 10월 23일부터 Acer, ASUS 등 6개 제조사를 통해 공급되며, 주요 대상은 자신의 기기에서 AI 모델을 실행하려는 개발자와 연구자다. NVIDIA가 공개한 사양, 두 대 연결에 관한 설명, 그리고 일반 독자에게 갖는 의미를 정리했다.
라이프스타일
Google Cloud, Spanner queues 정식 출시 발표: 메시지 큐를 데이터베이스 트랜잭션에 통합해 AI 에이전트 신뢰성 겨냥
Google Cloud가 Spanner queues 정식 출시를 발표했다. 메시지 생성을 데이터베이스 트랜잭션의 일부로 만들어 AI 에이전트의 '상태'와 '동작'이 어긋나는 문제를 해결하겠다는 것이다. 공식 설명, 주요 기능, 일반 독자에게 갖는 의미를 정리했다.
라이프스타일
GPT-6.1 Sol 출시: 새 버전 Sol, API·Codex·ChatGPT Work에서 제공, Chat에는 없음
OpenAI는 2026년 9월 29일 GPT-6.1 Sol을 출시했습니다. API 이름은 gpt-6.1-sol이며, Plus, Pro, Business, Enterprise, Edu 요금제의 Codex와 ChatGPT Work가 출시 시 제공 범위에 포함되고(Enterprise와 Edu는 관리자가 켜야 함), Free와 Go는 출시 시 포함되지 않으며, Chat에는 없습니다(2026년 9월 확인).
라이프스타일
Claude Sonnet 5.5 출시: 정가는 Sonnet 5와 같고, API·클라우드 플랫폼·Claude.ai에서 사용 가능
Anthropic은 2026년 9월 28일 Claude Sonnet 5.5를 출시했습니다. API 정가는 Sonnet 5와 같고(100만 tokens당 입력 2달러, 출력 10달러), Claude.ai, API, 여러 클라우드 플랫폼에서 사용할 수 있으며, 위험도가 높은 사이버 보안 요청은 Sonnet 5로 되돌려 처리됩니다(2026년 9월 확인).
최신 여행 소식·가이드

가이드도쿄
도쿄 어디에 묵을까? 신주쿠·우에노·도쿄역·시부야·아사쿠사·이케부쿠로·긴자 일곱 지역 비교: 공항 교통, 숙박세, 짐 배송까지
도쿄 어디에 묵을까? 신주쿠, 우에노, 도쿄역, 시부야, 아사쿠사, 이케부쿠로, 긴자 일곱 지역을 같은 기준으로 비교한다. 나리타·하네다 공항에서 오는 방법, 교통 노선, 주변의 볼거리, 동네 분위기, 적합한 여행자를 비교표와 야마노테선 안내도로 살펴보고, 2026년 9월에 확인한 도쿄도 숙박세(2027년 4월부터 3%)와 공항 택배로 짐을 보내는 규정도 정리했다.
- 예산
- 호텔

가이드도쿄
도쿄 교통패스 선택법: Suica/Welcome Suica, Tokyo Subway Ticket, JR Pass는 살 만할까?
도쿄를 처음 여행한다면 먼저 1인당 IC 카드 한 장으로 탈 때마다 결제한다(Welcome Suica는 보증금이 없고 28일간 유효). 하루에 지하철을 4번 이상 타면 2,000엔짜리 Tokyo Subway Ticket 72시간권을 추가하고, 간사이에 가지 않고 도쿄만 여행한다면 JR Pass는 반드시 손해다. TOURIST PASMO, iPhone의 Suica, 도쿄 Metro 하루권의 이용 가능·불가 범위를 결정도로 비교한다. 가격은 2026년 9월 확인.
- 교통
- 예산

가이드도쿄
도쿄 디즈니랜드·디즈니씨 가이드: 티켓 가격, 판타지 스프링스 Fantasy Springs, 디즈니 프리미어 액세스 DPA와 스탠바이 패스 이용법, 첫 방문에는 어느 파크가 좋을까
도쿄 디즈니 하루짜리 패스포트는 변동 가격제로, 2026년 9월에는 평일 대부분이 9,900엔, 주말이 10,900엔이다. 공식 홈페이지에서 매일 14:00에 두 달 뒤 같은 날짜의 티켓을 판매한다. 무료 프라이오리티 패스는 공식 서비스 목록에서 빠져 대기 시간을 줄이는 방법은 유료 디즈니 프리미어 액세스(한 사람당 한 번 1,000~3,500엔)뿐이다. 운영 시간, 25주년 행사, 스탠바이 패스, 엔트리 리퀘스트, 판타지 스프링스 이용법, 첫 방문 때 디즈니랜드와 디즈니씨 중 어디를 고를지도 담았다. 2026년 9월 공식 홈페이지에서 확인했다.
- 추천 일정
- 가족 여행