라이프스타일
GPT-5.5 Instant, ChatGPT 기본 모델이 되다: OpenAI가 밝힌 개선점과 퇴보, 새 기능
2026년 5월 5일, OpenAI는 GPT-5.3 Instant를 GPT-5.5 Instant로 교체해 ChatGPT의 기본 모델로 삼았습니다. 이 글은 OpenAI의 공식 발표와 System Card를 바탕으로, 사실 확인에서 공개된 개선 수치, gore(잔혹 묘사)와 성적 콘텐츠 두 항목의 퇴보, 새로 추가된 개인화 기능의 대상과 지역별 단서, 같은 해 8월 6일 OpenAI가 새 모델이 이를 대체할 것이라고 명시한 시점, 그리고 공식 수치가 일상적인 오류율을 뜻하지 않는 이유를 정리합니다.
읽는 데 약 15분

2026년 5월 5일, OpenAI는 GPT-5.5 Instant를 공개해 GPT-5.3 Instant를 대신해 ChatGPT의 기본 모델로 삼았습니다. OpenAI는 이번 업데이트가 더 똑똑하고 더 정확한 버전으로 바뀐 것이며, 답변이 더 명확하고 간결해지고 사용자에게 더 잘 맞춰졌다고 설명합니다. 같은 날 공개된 System Card는 이것이 OpenAI가 Preparedness Framework에 따라 사이버보안과 생물·화학 두 영역 모두에서 High capability로 취급하는 첫 번째 Instant 모델이라고 밝혔습니다.
이 글은 2026년 9월 18일에 OpenAI 공식 발표 페이지, Deployment Safety Hub에 실린 System Card 전문, API Changelog, 그리고 같은 해 8월 6일에 공개된 또 다른 System Card를 확인했습니다. 본 사이트는 직접 시험해 보지 않았고, 아래의 기능과 평가 수치는 모두 OpenAI가 직접 공개한 내용이며, 이 글은 어떠한 구독이나 구매도 권하지 않습니다.
GPT-5.5 Instant란 무엇이고, 어떤 모델을 대체했나
System Card는 GPT-5.5 Instant의 비교 대상을 GPT-5.3 Instant로 설정하며, GPT-5.4 Instant라는 모델은 존재하지 않는다고 밝히고 있습니다. 본 사이트가 4월에 소개한 GPT-5.5는 System Card에서 ‘GPT-5.5 Thinking’이라고 부르며, 이는 여기서 다루는 Instant 버전과 구분하기 위한 명칭으로 둘은 서로 다른 모델입니다.
공식 발표 페이지에 따르면 GPT-5.5 Instant는 5월 5일부터 모든 사용자에게 순차적으로 제공되어 GPT-5.3 Instant를 대신해 기본 모델이 되었고, API에서는 chat-latest라는 이름으로 제공됩니다. 유료 사용자는 모델 설정에서 GPT-5.3 Instant로 되돌릴 수 있으며, 이 옵션은 3개월간 유지된 뒤 종료됩니다. System Card는 별도로, 실제 배포 시에는 낮은 추론 강도(low reasoning effort)를 사용하지만 사이버보안 영역의 High capability 판정은 최대 능력을 파악하기 위해 더 높은 xhigh 추론 강도에서 진행되었다고 설명합니다.
OpenAI가 밝힌 수치: 사실 확인이 얼마나 개선되었나
공식 발표에 따르면 내부 평가에서 GPT-5.5 Instant는 의료, 법률, 금융 등의 영역을 포함한 고위험 프롬프트에서 GPT-5.3 Instant보다 환각 주장이 52.5% 줄었고, 사용자가 사실 오류로 신고한 어려운 대화에서는 부정확한 주장이 37.3% 줄었습니다. System Card는 Factuality Heavy, User Flagged Failures, High Stakes(아래 표 참고) 세 가지 평가 세트로 더 자세한 수치를 제시하며, 각각 ‘답변’과 ‘주장’에 오류가 포함된 비율을 집계합니다.
HealthBench 시리즈 평가에서도 대부분 개선이 나타났습니다. HealthBench Professional의 길이 보정 점수는 32.9점에서 38.4점으로 올랐지만, HealthBench Consensus에 대해서는 OpenAI가 ‘거의 변화가 없다’고 설명합니다. 발표에서는 사진·이미지 분석, STEM 관련 질문 답변 등 다른 능력 향상도 언급하지만, 이는 ‘포함(including)’이라는 예시적 표현이며 전체 목록은 아닙니다.
이런 개선에는 두 가지 단서가 붙습니다. 첫째, System Card는 비교에 쓰인 이전 세대 수치가 해당 모델들의 최신 버전에서 가져온 것이며, 출시 당시 공개된 점수와 다소 차이가 있을 수 있다고 밝힙니다. 둘째, OpenAI는 이 문제들이 모델이 실수하기 쉬운 상황을 일부러 골라 어렵게 설계한 것으로, 장기적인 연구 신호를 얻기 위한 것이며 일상적인 오류율이나 일반 사용자의 평균적인 경험을 나타내지 않는다고 밝혔습니다.
| 평가 세트 | GPT-5.3 Instant | GPT-5.5 Instant |
|---|---|---|
| High Stakes(의료·법률·금융) | 10.1% | 4.8% |
| User Flagged Failures(사용자 신고) | 25.2% | 15.8% |
| Factuality Heavy(사실 밀도 높은 대화) | 7.4% | 4.4% |
퇴보한 부분: gore와 성적 콘텐츠 평가, 그리고 일상적인 오류율이 아닌 이유
System Card의 Table 1에는 금지 콘텐츠에 대한 평가 점수가 실려 있으며, 통계 검정을 통해 ‘이전 세대 대비 유의미하게 변화한’ 항목을 표시합니다. 유의미하다고 표시된 항목은 단 두 가지뿐이며, 둘 다 퇴보입니다. gore(잔혹 묘사) 점수는 0.867에서 0.703으로, 성적 콘텐츠 점수는 0.857에서 0.806으로 낮아졌습니다(점수가 높을수록 규정을 어긴 답변이 적다는 뜻입니다). 나머지 항목들은 OpenAI에 따르면 이전 세대와 통계적으로 유의미한 차이가 없습니다.
‘gore’는 System Card가 이전의 ‘violence(폭력)’ 항목 이름을 바꾼 새로운 명칭으로, OpenAI는 불법 폭력 행위 관련 요청과 더 명확히 구분하기 위한 명칭 변경일 뿐이며 평가 자체는 바뀌지 않았다고 밝힙니다. 각주는 범위를 ‘노골적이거나 지나치게 잔혹한 콘텐츠(graphic or gratuitously gory content)’로 한정하며, 폭력적인 롤플레이, 폭력적인 관념, 폭력 행위 조력은 포함하지 않고 이는 ‘violent illicit behavior(폭력적 불법 행위)’ 항목에서 다룬다고 밝힙니다. OpenAI는 또한 금지된 성적 콘텐츠에 대해 시스템 차원의 완화 조치를 추가했고, 18세 미만으로 추정되는 사용자에게는 성적 콘텐츠와 gore에 대해 더 엄격한 제한을 적용합니다.
퇴보는 이 두 항목만이 아닙니다. ‘정서적 의존(emotional reliance)’ 점수는 0.995에서 0.963으로 낮아졌지만, OpenAI는 이 퇴보가 통계적으로 유의미하지 않으며 온라인 실험에서도 바람직하지 않은 답변이 늘어나는 현상은 관찰되지 않았다고 밝혔습니다. jailbreak(탈옥) 평가에서는 GPT-5.3 Instant 대비 퇴보했다고 OpenAI가 스스로 인정했으며, System Card의 꺾은선 그래프에서는 모든 공격 예산 구간에서 방어 성공률이 이전 세대보다 낮게 나타납니다. OpenAI는 평가 구조를 조정하는 중이며, 이를 확정적인 결론이 아니라 방향성을 보여주는 중간 결과로 본다고 설명합니다.
System Card는 위 점수들이 시스템 차원의 보호 장치가 없는 ‘기반 모델(base model)’에서 측정된 것이며, 이는 모델 자체의 동작이 안전 기준을 충족하는지 확인하기 위한 것이라고 명시합니다. 같은 절에서 이 오류율이 일반적인 프로덕션 트래픽의 평균을 나타내지 않는다고도 밝힙니다. 시스템 차원의 보호 장치는 이번 평가 범위에 포함되지 않습니다. High capability로 판정된 생물·화학과 사이버보안 두 영역에는 자동 모니터링과 행위자 수준의 단속 등 별도의 보호 장치가 있다고 OpenAI는 설명합니다.
새로 추가된 개인화 기능: 누구에게, 언제
공식 발표에 따르면 GPT-5.5 Instant는 과거 대화, 파일, 그리고 연결된 Gmail(연결되어 있는 경우)을 개인화 근거로 더 잘 활용하게 되었으며, 이런 맥락을 활용하는 것이 답변에 더 도움이 되는지를 판단합니다. OpenAI는 동시에 모든 ChatGPT 모델에 메모리 소스(memory sources)를 도입해, 사용자가 답변에 어떤 근거가 쓰였는지 확인하고 오래되거나 더 이상 맞지 않는 내용을 삭제하거나 수정할 수 있게 했습니다. 임시 대화를 사용하면 메모리를 사용하거나 업데이트하지 않습니다. OpenAI는 또한 메모리 소스가 답변에 영향을 준 모든 요소를 다 보여주는 것은 아니라고 덧붙였습니다.
제공 대상과 시점은 각각 다릅니다. 기본 모델 교체는 발표 당일 모든 사용자에게 순차적으로 제공되었습니다. 고급 개인화 기능(과거 대화, 파일, Gmail)은 먼저 웹 버전의 Plus와 Pro 사용자에게 제공되고, 모바일 버전은 ‘곧’ 제공될 예정이며, 앞으로 몇 주 안에 Free, Go, Business, Enterprise로 확대할 계획입니다. 메모리 소스는 모든 소비자용 요금제의 웹 버전에서 순차적으로 제공되고 있으며, 모바일 버전도 마찬가지로 ‘곧’ 제공될 예정입니다. 발표 페이지에는 개인화 소스의 제공 여부가 지역에 따라 ‘달라질 수 있다’는 설명이 있지만 구체적인 지역 목록은 없으며, 이 글이 확인한 네 개의 출처 모두 대만이 포함되는지는 적혀 있지 않습니다.
발표 페이지에는 2026년 6월 9일 자로 표시된 업데이트도 있습니다. 개인화 개선 사항이 ChatGPT Go와 무료 버전으로 확대되고 있으며, 무료 버전의 답변은 더 적은 양의 과거 대화를 참고한다는 내용입니다. 이는 이후 날짜가 표시된 업데이트이며, 5월 5일 당일의 내용이 아닙니다.
8월의 모델 교체, 그리고 현재 상태를 직접 확인하는 방법
OpenAI가 2026년 8월 6일에 공개한 또 다른 System Card에는 그날부터 ChatGPT의 모델을 업데이트하고 제공 범위를 넓힌다고 명시되어 있습니다. 무료 버전과 Go 사용자는 일상 대화용 새 기본 모델을, Plus와 Pro 사용자는 업데이트된 GPT-5.6 Sol과 답변에 얼마나 공을 들일지 고를 수 있는 슬라이더를 받게 됩니다. 공식 원문은 ‘이 모델들이 GPT-5.5 Instant를 대체할 것’이라고 되어 있습니다. 같은 날의 API Changelog에서도 같은 교체 흔적이 보입니다. chat-latest에 대한 설명이 ‘ChatGPT에서 현재 쓰이는 최신 Instant 모델을 가리킴’에서 ‘ChatGPT가 Plus와 Pro 사용자에게 제공하는 최신 모델을 가리킴’으로 바뀌었고, 정식 용도로는 GPT-5.6 Sol을 쓰라고 권장하는 쪽으로 바뀌었습니다. 두 문서 모두 교체가 완료된 날짜나 서비스를 종료하는 날짜는 적혀 있지 않습니다.
OpenAI의 System Card는 공개 후에도 수정됩니다. 8월 6일 자 System Card에는 2026년 8월 19일 자 정정 기록이 붙어 있는데, GPT-5.5의 단백질 결합 예측 평가에서 pass@4 점수를 0.4%에서 1.48%로 정정하고, 앞서 게시됐던 수치가 사실은 pass@1 점수였다고 설명합니다. GPT-5.5 Instant의 System Card에는 현재 정정 기록이 붙어 있지 않지만, 이는 어디까지나 확인 당일의 상태일 뿐입니다.
현재 상태를 확인하고 싶다면 OpenAI 공식 발표 페이지, Deployment Safety Hub, API Changelog를 직접 확인하면 됩니다. 이 경로들을 2026년 9월 18일까지 확인한 결과, GPT-5.5 Instant 자체에 대한 새로운 공식 발표나 정정은 보이지 않았습니다.
자주 묻는 질문
GPT-5.5 Instant는 지금도 ChatGPT의 기본 모델인가요?
공식 문서에는 ‘대체할 것’이라고만 적혀 있을 뿐, 완료 시점은 나와 있지 않습니다. OpenAI가 2026년 8월 6일에 공개한 System Card에는 그날부터 무료 버전과 Go 사용자는 일상 대화용 새 기본 모델을, Plus와 Pro 사용자는 업데이트된 GPT-5.6 Sol을 받게 된다고 적혀 있으며, ‘이 모델들이 GPT-5.5 Instant를 대체할 것’이라고 적혀 있습니다. 같은 날의 API Changelog에서도 chat-latest 스냅숏에 대한 설명이 ‘ChatGPT에서 현재 쓰이는 최신 Instant 모델을 가리킴’에서 ‘ChatGPT가 Plus와 Pro 사용자에게 제공하는 최신 모델을 가리킴’으로 바뀌었습니다. 두 문서 모두 교체가 완료된 날짜나 서비스 종료일은 적혀 있지 않으므로, 이 글은 이미 종료되었다고도, 지금도 여전히 기본 모델이라고도 쓰지 않습니다. 공식 발표 페이지, Deployment Safety Hub, API Changelog를 2026년 9월 18일까지 확인했지만, GPT-5.5 Instant 자체에 대한 새로운 공식 발표는 찾지 못했습니다.
OpenAI가 발표한 환각 감소 수치는, 제가 평소에 사용할 때의 오류 확률도 그만큼 줄어든다는 뜻인가요?
그렇게 해석하는 것은 권하지 않습니다. System Card의 세 가지 평가 세트는 모델이 실수하기 쉬운 상황으로 일부러 고른 사실 밀도가 높은 대화, 과거에 신고된 실패 사례, 고위험 문제들로, 장기적인 연구 신호를 얻기 위해 어렵게 설계된 것입니다. System Card는 이 백분율이 프로덕션 환경에서의 일상적인 오류율을 반영하지 않으며, 일반 사용자의 평균적인 경험도 아니라고 명확히 밝힙니다. 또한 비교에 쓰인 이전 세대 점수는 해당 모델들의 최신 버전에서 가져온 것으로, 출시 당시 공개된 점수와 다소 차이가 있을 수 있다고 설명합니다.
gore 점수가 낮아진 것은 이 모델이 더 폭력적이라는 뜻인가요?
그렇게 해석하는 것은 권하지 않습니다. System Card는 이전의 ‘violence’ 항목 이름을 ‘gore’로 바꿨을 뿐이며, 공식 각주는 범위를 노골적이거나 지나치게 잔혹한 콘텐츠로 한정하고 폭력적인 롤플레이, 폭력적인 관념, 폭력 행위 조력은 명확히 제외한다고 밝힙니다. 이런 항목들은 ‘violent illicit behavior’ 항목에서 다룹니다. OpenAI는 이것이 명칭 조정일 뿐 기반 평가의 변경은 아니라고도 밝힙니다. gore와 성적 콘텐츠 두 점수는 System Card의 Table 1에서 통계적으로 유의미한 변화로 표시된 단 두 항목이며 둘 다 퇴보로, 수치는 각각 0.867에서 0.703으로, 0.857에서 0.806으로 낮아졌고, 이 글은 이를 생략하지 않았습니다.
개인화 기능을 대만 계정에서도 지금 쓸 수 있나요?
공식 발표에서는 개인화 기능이 먼저 웹 버전의 Plus와 Pro 사용자에게 제공되며, 앞으로 몇 주 안에 Free, Go, Business, Enterprise로 확대할 계획이라고 설명합니다. 발표 페이지에는 2026년 6월 9일 자 업데이트도 있는데, 개인화 개선 사항이 ChatGPT Go와 무료 버전으로 확대되고 있다는 내용입니다. 발표에서는 또한 개인화 소스의 제공 여부가 지역에 따라 ‘달라질 수 있다’고 덧붙였지만 구체적인 지역 목록은 없으며, 이 글이 확인한 네 개의 출처 모두 대만이 포함되는지는 적혀 있지 않습니다. 자신의 계정에서 지금 어떤 옵션을 쓸 수 있는지 확인하려면 ChatGPT 안의 설정 화면을 직접 확인해 보시기 바랍니다.
GPT-5.3 Instant는 지금도 쓸 수 있나요?
당시 공식 발표에서는 유료 사용자가 모델 설정에서 수동으로 GPT-5.3 Instant로 되돌릴 수 있으며, 이 옵션은 3개월간 유지된 뒤 종료된다고 설명했습니다. 무료 사용자에게도 이 옵션이 있는지는 발표에 나와 있지 않습니다. 3개월의 기한은 2026년 5월 5일부터 계산되며, 실제 종료 시점은 이 글에서 다시 확인하지 않았으므로 ChatGPT의 모델 설정에서 지금도 이 옵션이 보이는지 직접 확인해 보시기를 권합니다.
이 기사는 실제로 테스트를 거쳤나요?
아니요. 이 글의 모든 수치와 설명은 OpenAI의 공식 발표 페이지, System Card, API Changelog에 공개된 내용입니다. 본 사이트는 GPT-5.5 Instant를 직접 사용하거나 시험해 보지 않았으며, 구독, 구매, 투자에 관한 어떠한 조언도 제공하지 않습니다.
2026년 AI 뉴스 총정리: 1월부터 9월까지의 핵심과 일상 적용2026년 AI 뉴스 총정리: 1월부터 9월까지의 핵심과 일상 적용2026년 1월부터 9월까지의 주요 AI 뉴스를 월별로 정리하여 5개 언어 상세 심층 분석으로 연결합니다. 모델, 업무 도구, 창작, 비용, 투명성을 아우르며 사건 배경과 일상적 활용, 서비스 제공 제한 사항을 설명합니다.전체 글 읽기
Gemini 3.8 Live와 Extended Thinking: 새 음성 모델, 내 계정으로 쓸 수 있을까Gemini 3.8 Live와 Extended Thinking: 새 음성 모델, 내 계정으로 쓸 수 있을까2026년 9월 15일, Google은 음성 대화 모델 Gemini 3.8 Live와 Gemini 3.8 Live Extended Thinking 두 가지를 발표했습니다. 본 기사는 Google 공식 발표문, 개발자 게시물, 모델 카드, 가격 페이지를 바탕으로 개발자·기업·일반 사용자·Workspace 구독자가 각각 무엇을 쓸 수 있는지, 요금은 어떻게 계산되는지, 모델 카드가 명시한 지식 컷오프 날짜, 그리고 공식 문서가 밝히지 않은 제공 지역을 정리합니다.전체 글 읽기
같은 주제의 글
라이프스타일
GPT-5.5 다단계 업무로 확장: 모호한 요구사항을 검수 가능한 납품물로 전환하기
2026년 OpenAI의 GPT-5.5 발표 배경을 돌아보고, 팀이 모호하고 긴 작업을 검수 가능한 산출물로 분해하며 명확한 수동 확인 지점과 품질 지표를 구축하는 방법을 살펴봅니다.
라이프스타일
Gemini 3.8 Live와 Extended Thinking: 새 음성 모델, 내 계정으로 쓸 수 있을까
2026년 9월 15일, Google은 음성 대화 모델 Gemini 3.8 Live와 Gemini 3.8 Live Extended Thinking 두 가지를 발표했습니다. 본 기사는 Google 공식 발표문, 개발자 게시물, 모델 카드, 가격 페이지를 바탕으로 개발자·기업·일반 사용자·Workspace 구독자가 각각 무엇을 쓸 수 있는지, 요금은 어떻게 계산되는지, 모델 카드가 명시한 지식 컷오프 날짜, 그리고 공식 문서가 밝히지 않은 제공 지역을 정리합니다.
라이프스타일
ChatGPT 광고, 셀프서브 구매 시작: OpenAI가 5월에 발표한 도구·과금·타겟팅 방식
2026년 5월 5일, OpenAI는 베타 버전 셀프서브 광고 관리 도구, 클릭당 과금(CPC) 입찰, 그리고 더 다양한 측정 도구를 통해 ChatGPT 광고 구매 방식을 확대한다고 발표했습니다. 본 기사는 발표 원문과 개발자 문서를 근거로, 광고 계정·캠페인·광고 그룹·광고의 4단계 구조, 세 가지 캠페인 목표의 과금 방식, 입찰 전략을 고르는 법, 그리고 지역·플랫폼·context hints 타겟팅 방식을 설명하며, 검증 당일 확인한 문서 버전과 5월 5일 발표 내용의 차이도 함께 밝힙니다.
라이프스타일
NVIDIA, DGX Spark 64GB 모델 출시: 10월 23일 판매 시작, 시작가 4,999달러, 두 대 연결 시 128GB
NVIDIA는 2026년 10월 2일 개인용 AI 컴퓨터 DGX Spark에 더 저렴한 64GB 메모리 모델을 추가한다고 발표했다. 10월 23일부터 Acer, ASUS 등 6개 제조사를 통해 공급되며, 주요 대상은 자신의 기기에서 AI 모델을 실행하려는 개발자와 연구자다. NVIDIA가 공개한 사양, 두 대 연결에 관한 설명, 그리고 일반 독자에게 갖는 의미를 정리했다.
이 글을 인용한 글
최신 여행 소식·가이드

가이드도쿄
도쿄 어디에 묵을까? 신주쿠·우에노·도쿄역·시부야·아사쿠사·이케부쿠로·긴자 일곱 지역 비교: 공항 교통, 숙박세, 짐 배송까지
도쿄 어디에 묵을까? 신주쿠, 우에노, 도쿄역, 시부야, 아사쿠사, 이케부쿠로, 긴자 일곱 지역을 같은 기준으로 비교한다. 나리타·하네다 공항에서 오는 방법, 교통 노선, 주변의 볼거리, 동네 분위기, 적합한 여행자를 비교표와 야마노테선 안내도로 살펴보고, 2026년 9월에 확인한 도쿄도 숙박세(2027년 4월부터 3%)와 공항 택배로 짐을 보내는 규정도 정리했다.
- 예산
- 호텔

가이드도쿄
도쿄 교통패스 선택법: Suica/Welcome Suica, Tokyo Subway Ticket, JR Pass는 살 만할까?
도쿄를 처음 여행한다면 먼저 1인당 IC 카드 한 장으로 탈 때마다 결제한다(Welcome Suica는 보증금이 없고 28일간 유효). 하루에 지하철을 4번 이상 타면 2,000엔짜리 Tokyo Subway Ticket 72시간권을 추가하고, 간사이에 가지 않고 도쿄만 여행한다면 JR Pass는 반드시 손해다. TOURIST PASMO, iPhone의 Suica, 도쿄 Metro 하루권의 이용 가능·불가 범위를 결정도로 비교한다. 가격은 2026년 9월 확인.
- 교통
- 예산

가이드도쿄
도쿄 디즈니랜드·디즈니씨 가이드: 티켓 가격, 판타지 스프링스 Fantasy Springs, 디즈니 프리미어 액세스 DPA와 스탠바이 패스 이용법, 첫 방문에는 어느 파크가 좋을까
도쿄 디즈니 하루짜리 패스포트는 변동 가격제로, 2026년 9월에는 평일 대부분이 9,900엔, 주말이 10,900엔이다. 공식 홈페이지에서 매일 14:00에 두 달 뒤 같은 날짜의 티켓을 판매한다. 무료 프라이오리티 패스는 공식 서비스 목록에서 빠져 대기 시간을 줄이는 방법은 유료 디즈니 프리미어 액세스(한 사람당 한 번 1,000~3,500엔)뿐이다. 운영 시간, 25주년 행사, 스탠바이 패스, 엔트리 리퀘스트, 판타지 스프링스 이용법, 첫 방문 때 디즈니랜드와 디즈니씨 중 어디를 고를지도 담았다. 2026년 9월 공식 홈페이지에서 확인했다.
- 추천 일정
- 가족 여행