라이프스타일

GPT-Live로 들으면서 말하는 ChatGPT 음성: 끼어들기, 요금제별 사용량, 녹음 설정

OpenAI가 2026년 7월 GPT-Live를 발표하면서 ChatGPT 음성 대화는 듣기와 말하기를 동시에 하고 중간에 끼어들 수 있게 되었으며, 검색과 추론은 백그라운드 모델이 맡습니다. 이 글은 공식 설명을 바탕으로 대화 흐름의 변화, 9월 조정 이후 요금제별 모델과 사용량, 요리와 말하기 연습 등의 활용 상황, 녹음 보관과 학습 설정을 정리하고 API 가격도 간단히 다룹니다.

수정일: 읽는 데 약 11분

휴대폰 화면에서 음성 파형과 대화 말풍선이 교차하며 들으면서 말하는 모습을 표현한 오리지널 일러스트
사진: Mokaair (© Mokaair)

OpenAI는 2026년 7월 8일 차세대 음성 모델 GPT-Live를 발표했으며, 공식 블로그와 ChatGPT 릴리스 노트 모두 이 날짜를 표기하고 있습니다. GPT-Live는 전이중 구조를 채택해 듣기와 말하기를 동시에 할 수 있고, 현재 ChatGPT 음성 대화에 쓰이고 있습니다. 웹 검색, 더 깊은 추론, 더 복잡한 작업이 필요한 질문을 받으면 백그라운드에서 다른 프런티어 모델(출시 초기에는 GPT-5.5)에 작업을 맡기고, 결과가 준비되면 다시 대화로 가져옵니다. OpenAI는 GPT-Live-1과 GPT-Live-1 mini 두 가지 버전을 함께 내놓았습니다.

이 글은 2026년 9월 15일 OpenAI 발표문, 도움말 센터의 ChatGPT 음성 대화 페이지, 릴리스 노트를 확인했습니다. 발표문은 전 세계 iOS, Android, ChatGPT.com 사용자에게 순차적으로 제공한다고 적었고, 릴리스 노트는 지원 지역에서 제공하며 출시 시점에는 Business, Enterprise, Edu 워크스페이스가 포함되지 않는다고 적었습니다. 그러나 두 곳 모두 지역 목록을 밝히지 않았고 대만도 따로 언급하지 않았습니다. 본 사이트는 직접 사용해 보지 않았으며, 기능에 대한 설명은 모두 OpenAI의 설명입니다. 대만 계정에 이 옵션이 나타났는지는 앱 내 설정에서 확인하시기 바랍니다. 본문의 요리, 말하기 연습, 차량 내 상황은 에디터가 설계한 예시입니다.

들으면서 말하게 되면 대화의 흐름은 어떻게 달라지나

OpenAI의 설명에 따르면 초기 ChatGPT 음성은 음성-텍스트 변환, 언어 모델, 텍스트-음성 변환의 세 모델을 이어 붙인 방식이어서 응답이 느리고 딱딱했습니다. 이후의 고급 음성 모드는 하나의 모델 안에서 오디오를 처리하도록 바뀌었지만, 여전히 사용자가 말을 마칠 때까지 기다린 뒤 응답했고 침묵으로 차례를 판단했기 때문에 짧은 멈춤이나 배경 소음도 말이 끝난 것으로 오인될 수 있었습니다.

반면 GPT-Live는 음성을 생성하는 동안에도 계속 듣습니다. OpenAI는 모델이 1초에 여러 번 말할지, 계속 들을지, 잠시 멈출지, 끼어들지, 도구를 호출할지를 결정할 수 있다고 밝혔습니다. 대화 중에는 답변 도중에 끼어들어 질문하거나, 잠시 멈춰 생각을 정리하거나, 천천히 말해 달라고 요청할 수 있습니다. ChatGPT는 “음음”, “알겠어요” 같은 맞장구로 대화를 따라가고 있음을 나타낼 수 있으며, 조용히 듣기만 해 달라고 요청하면 그대로 따라야 합니다.

도움말 센터는 겹치는 음성, 배경 소음, 네트워크 상태, 마이크 설정이 들리는 내용에 영향을 줄 수 있고, 긴 침묵이나 주변 사람의 말소리 때문에 여전히 말을 시작할 수 있다고 함께 안내합니다. 공식적으로는 헤드폰을 사용하거나 더 조용한 곳으로 옮기는 방법을 권하며, iPhone 사용자는 제어 센터의 마이크 모드에서 음성 분리를 켤 수 있습니다. 생각하면서 말하고 싶다면 대화를 시작할 때 “응답하라고 할 때까지 기다려 줘”라고 먼저 말해 둘 수 있습니다. Live는 주로 일대일 대화를 위해 설계되었으며, 여러 사람이 동시에 말하는 상황에는 아직 최적화되지 않았습니다.

정보를 찾는 동안의 기다림도 예전과 다릅니다. OpenAI에 따르면 검색이나 추론을 백그라운드 모델이 처리하는 동안에도 GPT-Live는 계속 대화를 이어갈 수 있고, 결과가 준비되면 대화로 가져옵니다. 에디터는 기다리는 동안 나온 임시 응답을 결론으로 받아들이지 말고, 결과가 돌아온 뒤 근거를 설명해 달라고 요청하기를 권합니다.

요금제별로 쓰는 모델과 하루 사용 시간

발표 당일 OpenAI는 GPT-Live-1이 Go, Plus, Pro 사용자의 기본 모델이고 무료 요금제는 GPT-Live-1 mini가 기본이라고 밝혔습니다. 당시 음성 대화에서는 빠르게 답할지, 시간을 더 들여 생각할지를 정하는 추론 수준도 따로 고를 수 있었습니다. Go의 모델과 이 추론 수준은 모두 2026년 9월 9일 릴리스 노트에서 조정되었으므로, 초기 보도를 읽은 분은 현재 상황을 기준으로 삼아야 합니다.

9월 9일 릴리스 노트와 도움말 센터에 따르면 Go는 기존 GPT-Live-1 대신 GPT-Live-1 mini를 최대 3시간 사용하도록 바뀌었고, Plus는 GPT-Live-1을 최대 3시간, 월 100달러 Pro는 최대 15시간 사용할 수 있으며, 월 200달러 Pro는 시간 제한이 없습니다. Plus와 Pro는 한도에 도달해도 더 이상 mini로 전환되지 않습니다. 사용량은 최근 24시간 롤링 방식으로 계산하며, 무료 요금제는 제한적으로 이용할 수 있고 한도는 조정될 수 있습니다.

9월 9일 릴리스 노트에는 음성 대화에서 검색하거나 어려운 질문을 생각해야 할 때 GPT-5.6 또는 GPT-6 Astra를 사용할 수 있고, 모델과 추론 강도는 텍스트 채팅과 같은 컨트롤로 선택하며, 사용할 수 있는 모델과 사용량은 요금제에 따라 다르다는 내용도 있습니다. 기존의 음성 전용 추론 수준 세 가지는 폐지되었습니다. 현재 도움말 센터에는 이용 자격이 있는 Business, Enterprise, Edu, Healthcare 워크스페이스도 워크스페이스 설정의 제약 안에서 음성 대화를 사용할 수 있다고 적혀 있습니다.

2026년 9월 15일 확인. OpenAI 도움말 센터와 9월 9일 릴리스 노트 기준이며, 사용량은 최근 24시간 롤링 방식으로 계산하고 워크스페이스 요금제는 싣지 않았습니다.
요금제Live 모델사용량 한도
무료GPT-Live-1 mini제한적, 조정될 수 있음
GoGPT-Live-1 mini3시간
PlusGPT-Live-13시간
Pro(월 100달러)GPT-Live-115시간
Pro(월 200달러)GPT-Live-1무제한

요리, 말하기 연습, CarPlay: 세 가지 활용 상황

첫 번째 상황은 요리하면서 묻는 경우입니다. 손에 밀가루가 묻어 있어도 어떤 재료를 다른 것으로 대체할 수 있는지 바로 물어볼 수 있고, 답을 듣던 중 집에 달걀이 두 개밖에 없다는 사실을 알게 되면 끝까지 기다리지 않고 끼어들어 조건을 바로잡을 수 있습니다. 다만 조리 온도, 알레르기 유발 성분, 보관 방법은 들은 한마디에만 의존하지 말고 레시피나 식품 포장에서 다시 확인해야 합니다.

두 번째 상황은 말하기 연습입니다. OpenAI는 발표문에서 매주 1억 5천만 명 이상이 음성과 받아쓰기 같은 기능으로 ChatGPT와 대화하며, 그 용도에는 언어 연습도 포함된다고 밝혔습니다. 설정 → 음성에서 가장 자주 쓰는 언어를 선택할 수 있고, 대화 중에 언어를 바꾸거나 천천히 말해 달라고 요청할 수도 있지만, 도움말 센터에 따르면 현재 재생 속도를 정밀하게 조절할 수는 없습니다. OpenAI는 가장 많이 쓰이는 일부 언어에 맞춰 최적화했다고 밝혔으나 목록은 공개하지 않았고, 일부 언어는 원어민과 다른 억양이 섞이거나 유창함이 부족할 수 있으므로 발음을 연습할 때 그 억양을 표준으로 여기지 않는 것이 좋습니다.

세 번째 상황은 차 안입니다. 도움말 센터에 따르면 ChatGPT는 지원되는 iPhone에서 Apple CarPlay를 통해 사용할 수 있으며, 법적으로 허용되고 안전하게 사용할 수 있는 상황에서만 모바일 기기를 사용하고, 운전하기 전에 앱을 설정하며, 차량이 움직이는 동안에는 기기 조작을 피하라고 함께 안내합니다. 에디터는 운전 중에는 화면에 표시되는 텍스트 응답을 보지 말고, 영업시간이나 주소 같은 정보는 주차한 뒤 공식 출처에서 확인하기를 권합니다.

다른 앱으로 전환하거나 휴대폰이 잠긴 상태에서도 대화를 이어가려면 설정 → 음성에서 백그라운드 대화를 켜야 합니다. 2026년 8월 31일 릴리스 노트에는 iPhone 잠금 화면과 Dynamic Island에 Live 음성 대화 내용을 표시할 수 있다는 내용도 있습니다. 백그라운드 대화는 사용자가 대화를 종료하거나, 앱을 강제 종료하거나, 사용량 한도나 최대 세션 길이에 도달하면 끝납니다.

GPT-Live 음성 대화의 네 가지 핵심을 정리한 도해: 듣기와 말하기 동시 진행, 백그라운드 정보 검색, 요금제와 사용량, 녹음과 확인
GPT-Live 음성의 네 가지 핵심: 듣기와 말하기 동시 진행, 백그라운드 정보 검색, 요금제별 모델과 사용량, 녹음 보관과 답변 확인. OpenAI 공식 설명을 바탕으로 정리했습니다. · 사진: Mokaair (© Mokaair)

녹음, 대화 내용, 학습: 공식 데이터 제어 안내부터 확인

도움말 센터에 따르면 Live와 고급 음성 대화의 오디오 클립은 채팅 기록에 표시되는 대화 내용과 함께 저장되며 30일 동안 보관됩니다. 채팅을 삭제하면 관련 오디오 클립도 30일 이내에 삭제되지만, 보안, 안전 또는 법적 사유로 보관해야 하는 경우나 이전에 공유를 선택해 클립이 이미 계정과의 연결이 해제된 경우는 예외입니다. 삭제는 되돌릴 수 없으며, 보관 처리는 채팅을 사이드바에서 없앨 뿐 오디오를 삭제하지 않습니다.

녹음이 모델 학습에 쓰이는지는 두 가지 설정에 달려 있습니다. 도움말 센터는 사용자가 공유를 선택하지 않는 한 오디오 클립을 학습에 사용하지 않는다고 설명합니다. 개인 워크스페이스의 무료, Plus, Pro 사용자는 설정 → 데이터 제어에서 ‘모두를 위한 모델 개선’을 먼저 켜고 ‘오디오 녹음 포함’까지 켜야 클립이 공유되며, Business, Enterprise, Edu 워크스페이스에서는 클립을 공유할 수 없습니다. 또한 ‘모두를 위한 모델 개선’이 켜져 있기만 하면 음성 대화의 텍스트 기록과 기타 파일이 요금제와 설정에 따라 학습에 사용될 수 있다는 점에도 유의해야 합니다.

공유된 클립은 OpenAI 팀이 검토할 수 있으며, 공유를 중지한 뒤에도 이전에 연결이 해제된 클립은 계속 사용될 수 있습니다. OpenAI는 또한 2026년 7월 31일 발표문을 업데이트해 GPT-Live가 생성한 지원 대상 오디오에 SynthID 워터마크를 넣었다고 밝혔습니다. 부모는 자녀 보호 기능을 통해 청소년 자녀의 음성 대화 사용 여부를 정할 수도 있습니다.

음성 답변도 확인이 필요하고, API 가격은 간단히

말로 들은 답변은 듣고 나면 지나가 버리기 때문에 텍스트보다 다시 확인하기 어렵습니다. 도움말 센터는 ChatGPT가 실수할 수 있으며, 특히 날짜, 시간, 위치와 관련된 질문은 확인해야 한다고 안내합니다. 음성은 기기나 브라우저의 시간대를 기준으로 ‘오늘’, ‘내일’을 이해하므로, 답이 맞지 않으면 정확한 날짜와 위치를 직접 말하면 됩니다. Live를 사용하면 답변이 음성으로 나오는 동시에 텍스트로도 표시되고 대화가 끝난 뒤 채팅 기록에서 볼 수 있지만, 화면에 표시되는 텍스트는 말한 그대로 받아 적은 기록이 아니어서 실제로 말한 내용과 완전히 일치하지 않을 수 있습니다.

Live에는 현재 기능상의 한계도 있습니다. 도움말 센터에 따르면 Live는 동영상, 화면 공유, 연결된 앱이나 플러그인을 지원하지 않으며, 동영상이나 화면 공유가 필요하면 이용 자격이 있는 구독자는 iOS와 Android 앱에서 고급 모드로 바꿔 사용할 수 있습니다. 음성 대화는 한 번에 하나만 진행할 수 있고, 사용량 한도나 최대 세션 길이, 긴 대화의 컨텍스트 한도에 도달했을 때도 대화가 끝날 수 있습니다.

개발자용 제공과 ChatGPT에서의 출시는 별개입니다. OpenAI API 변경 기록에는 2026년 9월 10일 GPT-Live 1이 API에서 정식 제공되었으며, 음성 세션은 분당 0.05달러로 초 단위 과금되고 뒤에서 함께 쓰이는 모델과 도구 사용량은 별도로 과금된다고 적혀 있습니다.

최신 여행 소식·가이드

출처

라이프스타일