生活分享
GPT-5.5 Instant 成为 ChatGPT 默认模型:官方公布的进步、退步与新功能
2026 年 5 月 5 日,OpenAI 以 GPT-5.5 Instant 取代 GPT-5.3 Instant,成为 ChatGPT 的默认模型。本文依官方公告与 System Card,整理事实核查进步的数字、gore(血腥)与性内容两项退步、新增个性化功能的开放对象与地区但书,以及同年 8 月 6 日官方写明新模型将取代它的时间点,并说明官方数字为何不代表日常出错率。
阅读时间约 11 分钟

2026 年 5 月 5 日,OpenAI 发布 GPT-5.5 Instant,取代 GPT-5.3 Instant 成为 ChatGPT 的默认模型;官方表示这次是换成更聪明、更准确的版本,回答更清楚简洁、也更贴合用户。同一天发布的 System Card 指出,这是第一个被 OpenAI 依 Preparedness Framework 在网络安全、生物与化学两类都视为 High capability 的 Instant 模型。
本文于 2026 年 9 月 18 日查核了 OpenAI 官方公告页、Deployment Safety Hub 上的 System Card 全文、API Changelog,以及同年 8 月 6 日发布的另一份 System Card。本站没有实测 GPT-5.5 Instant,下列功能与评测数字皆为 OpenAI 自行公布的说法,本文不提供任何订阅或购买建议。
GPT-5.5 Instant 是什么,换掉了哪个模型
System Card 把 GPT-5.5 Instant 的对照对象设定为 GPT-5.3 Instant,并注明没有 GPT-5.4 Instant 这个模型。本站 4 月介绍过的 GPT-5.5,System Card 称为“GPT-5.5 Thinking”,用来与这里的 Instant 版本区分,两者是不同模型。
官方公告页说明,GPT-5.5 Instant 从 5 月 5 日起对所有用户陆续推出,取代 GPT-5.3 Instant 成为默认模型,在 API 中则以 chat-latest 名称提供;付费用户可在模型设置里选回 GPT-5.3 Instant,这个选项会保留三个月后停用。System Card 另外说明,它部署时用的是低推理强度,而网络安全的 High capability 判定是在更高的 xhigh 推理强度下跑出来的,为的是看出能力上限。
官方公布的数字:事实核查进步了多少
官方公告表示,在内部评测中,GPT-5.5 Instant 在涵盖医疗、法律、财务等领域的高风险提示上,比 GPT-5.3 Instant 减少 52.5% 幻觉主张;在用户标记过含事实错误的困难对话上,减少 37.3% 不准确主张。System Card 用三个题组列出更细的数字:Factuality Heavy、User Flagged Failures、High Stakes(见下表),分别统计“回答”与“主张”含错误比例。
HealthBench 系列评测多数也显示进步,其中 HealthBench Professional 的长度校正分数从 32.9 分进步到 38.4 分,但 HealthBench Consensus 官方形容大致持平。公告也提到分析图片、回答 STEM 问题等其他能力提升,但用的是“包括”这种举例写法,并非完整清单。
这些进步有两个限定。第一,System Card 写明用来比较的前一代数字取自那些模型的最新版本,可能和它们发布当时公布的分数略有出入。第二,官方声明这些题目刻意挑出模型容易出错的情境、设计得困难,目的是取得长期研究信号,不代表日常出错率,也不是一般用户的平均体验。
| 题组 | GPT-5.3 Instant | GPT-5.5 Instant |
|---|---|---|
| High Stakes(医疗/法律/财务) | 10.1% | 4.8% |
| User Flagged Failures(用户标记) | 25.2% | 15.8% |
| Factuality Heavy(高事实密度对话) | 7.4% | 4.4% |
退步的部分:gore(血腥)与性内容评测,和为什么不是日常出错率
System Card 的 Table 1 列出禁止内容的评测分数,并用统计检验标出“相对前一代显著变动”的项目——只有两项达到显著,而且都是退步:gore(血腥)分数从 0.867 降到 0.703,性内容分数从 0.857 降到 0.806(分数越高代表越少违规回答)。其余类别,OpenAI 表示与前一代没有统计上的显著差异。
“gore”是 System Card 把先前“violence”(暴力)类别改的新名称,官方注明只是为了与非法暴力行为的请求更清楚区分,评测本身没有改变;注脚把范围限定在“图像化或毫无节制的血腥内容”,不含暴力角色扮演、暴力意念或协助暴力行为,那些由“暴力违法行为”那一列涵盖。OpenAI 也已针对禁止的性内容加了系统层级缓解措施,并对疑似未满 18 岁的用户套用更严格的性内容与血腥限制。
退步不只这两项:“情感依赖”分数从 0.995 降到 0.963,OpenAI 表示这项退步统计上不显著、线上实验也未观察到不良回应增加;越狱(jailbreak)评测官方自承相对 GPT-5.3 Instant 退步,System Card 的折线图在每个攻击预算下的防守成功率都低于前一代,OpenAI 说明正在调整评测架构,视为方向性而非定论的中期结果。
以上分数,System Card 特别声明是在没有系统层防护的“基础模型”上测出来的,用意是确认模型本身行为符合安全门槛,官方同一节并写明这些错误率不代表一般正式流量的平均情形。系统层级的防护不在这次评测的范围内;被判定为高风险的生物化学与网络安全两个领域,官方说明另有自动监测与行为人层级执法等防护。
新增的个性化功能:给谁、什么时候
官方公告说明,GPT-5.5 Instant 更擅长运用过去对话、文件,以及已连接的 Gmail(如果有连接)做个性化依据,会判断何时用这些内容能让回答更有帮助。OpenAI 同时在所有 ChatGPT 模型推出“记忆来源”(memory sources),让用户看到回答用了哪些依据,并能删除或修正过时内容;使用临时对话则不会用到或更新记忆。官方也加注,记忆来源不一定显示每一个影响答案的因素。
开放对象与时间表不同:默认模型替换当天对所有用户陆续推出;进阶个性化功能(过去对话、文件与 Gmail)先开放网页版 Plus 与 Pro,手机版“即将”推出,计划接下来几周扩及 Free、Go、Business 与 Enterprise;记忆来源则在所有消费版方案的网页版逐步推出,手机版同样“即将”。公告页加注,个性化来源的开放情形“可能”依地区而不同,但没有列出地区清单,本文查核的四个来源也都没有写台湾是否在内。
公告页上另有一则标明 2026 年 6 月 9 日的更新:个性化改进正推展到 ChatGPT Go 与免费版,免费版的回答会参考较少量的过去对话。那是标着后续日期的更新,不是 5 月 5 日当天的内容。
8 月的模型交接,以及怎么自己查现状
OpenAI 在 2026 年 8 月 6 日发布的另一份 System Card 写明,当天起要更新 ChatGPT 的模型并扩大开放:免费版与 Go 会拿到新的日常聊天默认模型,Plus 与 Pro 会拿到更新版 GPT-5.6 Sol 与一个选择回答投入多少心力的滑块,官方原话是“这些模型将取代 GPT-5.5 Instant”。同一天的 API Changelog 也看得到交接:chat-latest 的说明从“指向 ChatGPT 目前使用的最新 Instant 模型”改成“指向 ChatGPT 提供给 Plus 与 Pro 用户的最新模型”,并改口建议正式用途改用 GPT-5.6 Sol。两份文件都没有写替换完成或停止服务的日期。
OpenAI 的 System Card 会被事后修订:8 月 6 日那份 System Card 附有一则 2026 年 8 月 19 日的更正记录,把 GPT-5.5 在一项蛋白质结合预测评测上的 pass@4 分数从 0.4% 订正为 1.48%,并说明先前公布的其实是 pass@1 的分数。GPT-5.5 Instant 这份 System Card 目前没有附上更正记录,但这只是查核当天的状态。
想确认现状,可以直接查 OpenAI 官方公告页、Deployment Safety Hub 与 API Changelog。以这几个渠道查核到 2026 年 9 月 18 日,未见官方再对 GPT-5.5 Instant 发布新公告或更正。
常见问题
GPT-5.5 Instant 现在还是 ChatGPT 的默认模型吗?
官方文件只写到“将取代”,没有给这件事一个完成日。OpenAI 在 2026 年 8 月 6 日发布的 System Card 写明,当天起免费版与 Go 用户会拿到新的日常聊天默认模型,Plus 与 Pro 用户会拿到更新版 GPT-5.6 Sol,并写着“这些模型将取代 GPT-5.5 Instant”。API Changelog 在同一天也把 chat-latest 快照的说明,从指向 ChatGPT 目前使用的最新 Instant 模型改成指向 ChatGPT 提供给 Plus 与 Pro 用户的最新模型。两份文件都没有写替换完成或停止服务的日期,本文因此不写它已经停用,也不写它现在仍是默认模型;以官方公告页、Deployment Safety Hub 与 API Changelog 查核到 2026 年 9 月 18 日,未见官方再对 GPT-5.5 Instant 本身发布新的公告。
官方公布的幻觉减少数字,代表我平常使用出错的概率降低这么多吗?
不建议这样解读。System Card 的三个题组是刻意挑选、容易让模型出错的高事实密度、用户标记失败案例与高风险题目,设计得比较困难,目的是取得长期研究信号;System Card 明白声明,这些百分比不反映正式环境里的日常出错率,也不是一般用户的平均体验。System Card 也说明,用来比较的前一代分数取自那些模型的最新版本,可能和它们当初发布时公布的分数略有出入。
gore(血腥)分数退步,是不是代表这个模型比较暴力?
不建议这样解读。System Card 把先前的“violence”类别改名为“gore”,官方注脚把范围限定在图像化或毫无节制的血腥内容,并明白排除暴力角色扮演、暴力意念与协助暴力行为——那些由“暴力违法行为”那一列涵盖。官方也写明这只是名称的调整,不是底层评测的改变。血腥与性内容两项分数确实是 System Card Table 1 里唯二标上统计显著的变动,而且都是退步,数字分别是 0.867 降到 0.703、0.857 降到 0.806,本文并未省略。
个性化功能,台湾的账号现在用得到吗?
官方公告说明个性化功能是先开放给网页版的 Plus 与 Pro 用户,并计划在接下来几周扩及 Free、Go、Business 与 Enterprise;公告页另有一则标明 2026 年 6 月 9 日的更新,写着个性化改进正推展到 ChatGPT Go 与免费版。公告同时加注,个性化来源的开放情形“可能”依地区而不同,但没有列出地区清单,本文查核的四个来源也都没有写台湾是否在内。想确认自己的账号目前有哪些选项,建议直接查看 ChatGPT 里的设置画面。
GPT-5.3 Instant 现在还能用吗?
官方公告当时说明,付费用户可以在模型设置里手动选回 GPT-5.3 Instant,这个选项会保留三个月,之后就会停用;公告没有说明免费用户是否有这个选项。三个月的期限从 2026 年 5 月 5 日算起,实际停用时间本文未再查核,建议直接到 ChatGPT 的模型设置确认目前还看不看得到这个选项。
这篇报道做过实际测试吗?
没有。本文所有数字与描述都是 OpenAI 官方公告页、System Card 与 API Changelog 公布的内容,本站没有实测或使用 GPT-5.5 Instant,也不提供订阅、购买或投资方面的建议。
2026 年 AI 新闻总整理:1 月至 9 月的重点与生活应用2026 年 AI 新闻总整理:1 月至 9 月的重点与生活应用从 2026 年 1 月至 9 月,按月份整理 AI 重要新闻,直达五语完整解析。涵盖模型、工作工具、创作、费用与透明度,说明事件背景、生活用途与开放限制。阅读全文
Gemini 3.8 Live 与 Extended Thinking:新语音模型,你的账号能用吗?Gemini 3.8 Live 与 Extended Thinking:新语音模型,你的账号能用吗?2026 年 9 月 15 日,Google 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款语音对话模型。本文依据 Google 官方发布文章、开发者文章、模型卡与定价页,整理开发者、企业、普通用户与 Workspace 订阅者各自能用到什么、费用怎么计算,以及模型卡写明的知识截止日与官方未说明的开放地区。阅读全文
同主题延伸阅读
生活分享
GPT-5.5 走向多步骤工作:把模糊需求变成能验收的交付
回顾 2026 年 OpenAI 发布 GPT-5.5 的发布背景,探讨团队如何将模糊的长任务拆解为可验收的交付物,并建立明确的人工确认点与质量指标。
生活分享
Gemini 3.8 Live 与 Extended Thinking:新语音模型,你的账号能用吗?
2026 年 9 月 15 日,Google 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款语音对话模型。本文依据 Google 官方发布文章、开发者文章、模型卡与定价页,整理开发者、企业、普通用户与 Workspace 订阅者各自能用到什么、费用怎么计算,以及模型卡写明的知识截止日与官方未说明的开放地区。
生活分享
ChatGPT 广告开放自助购买:OpenAI 5 月公告的工具、计费与定向机制
2026 年 5 月 5 日,OpenAI 宣布以测试版自助广告管理工具、按点击出价与更多效果衡量工具,扩大 ChatGPT 广告的购买方式。本文依据公告原文与开发者文档,说明广告账户、广告活动、广告组与广告的四层结构、三种广告活动目标的计费方式、出价策略怎么选,以及地域、平台与 context hints 的定向机制,并说明查核当天读到的文档版本与 5 月 5 日公告之间的差异。
生活分享
NVIDIA 推出 DGX Spark 64GB 版:10 月 23 日上市、起价 4,999 美元,两台可串接成 128GB
NVIDIA 于 2026 年 10 月 2 日宣布,个人 AI 电脑 DGX Spark 新增较平价的 64GB 内存版本,10 月 23 日起由 Acer、ASUS 等六家厂商供应,主要面向希望在自己机器上运行 AI 模型的开发者与研究人员。以下整理 NVIDIA 公布的规格、双机串接说法,以及对普通读者的意义。
引用本文的文章
最新旅游情报攻略

攻略东京
东京住哪一区:新宿、上野、东京站、涩谷、浅草、池袋、银座七区比较,机场交通、住宿税、行李寄送一次看
东京住哪一区?用同一套标准比较新宿、上野、东京站、涩谷、浅草、池袋、银座七个区域:从成田、羽田机场怎么过来、有哪些线路、周边有什么、街区氛围、适合谁。附比较表与山手线示意图,以及 2026 年 9 月核实的东京都住宿税(2027 年 4 月改为 3%)和机场宅急便寄送行李的规则。
- 预算
- 酒店

攻略东京
东京交通票券怎么选:Suica/Welcome Suica、Tokyo Subway Ticket、JR Pass 值不值得买
第一次去东京,每人先用一张 IC 卡按次付费(Welcome Suica 免押金、有效期 28 天)。一天搭四趟以上地铁,再加买 2,000 日元的 Tokyo Subway Ticket 72 小时券;只玩东京、不去关西,买 JR Pass 一定不划算。用决策图比较 TOURIST PASMO、iPhone 里的 Suica、东京 Metro 一日券能搭什么、不能搭什么;价格于 2026 年 9 月核实。
- 交通
- 预算

攻略东京
东京迪士尼乐园、海洋攻略:票价、梦幻泉乡 Fantasy Springs、尊享卡 DPA 与预约等候卡怎么用,第一次去选哪个园区
东京迪士尼一日护照采用浮动票价,2026 年 9 月平日大多为 9,900 日元、周末为 10,900 日元,官网每天 14:00 开售两个月后同一天的门票;免费的优先通行卡已不在官网服务清单,缩短排队时间只剩付费的迪士尼尊享卡(每人每次 1,000 至 3,500 日元)。另有运营时间与 25 周年活动、预约等候卡与报名体验、梦幻泉乡如何进入,以及第一次去选乐园还是海洋;2026 年 9 月通过东京迪士尼度假区官网核实。
- 行程范例
- 亲子