生活分享

GPT-5.5 Instant 成为 ChatGPT 默认模型:官方公布的进步、退步与新功能

2026 年 5 月 5 日,OpenAI 以 GPT-5.5 Instant 取代 GPT-5.3 Instant,成为 ChatGPT 的默认模型。本文依官方公告与 System Card,整理事实核查进步的数字、gore(血腥)与性内容两项退步、新增个性化功能的开放对象与地区但书,以及同年 8 月 6 日官方写明新模型将取代它的时间点,并说明官方数字为何不代表日常出错率。

阅读时间约 11 分钟

原创插图:左边一个对话框里画着一个齿轮,代表看不见的底层模型换了一颗;一支箭头指向右边一份核对清单,五行里前三行打勾、后两行是虚线圆圈,代表官方公布了数字的项目与还没公布的项目。
图片:Mokaair (© Mokaair)

2026 年 5 月 5 日,OpenAI 发布 GPT-5.5 Instant,取代 GPT-5.3 Instant 成为 ChatGPT 的默认模型;官方表示这次是换成更聪明、更准确的版本,回答更清楚简洁、也更贴合用户。同一天发布的 System Card 指出,这是第一个被 OpenAI 依 Preparedness Framework 在网络安全、生物与化学两类都视为 High capability 的 Instant 模型。

本文于 2026 年 9 月 18 日查核了 OpenAI 官方公告页、Deployment Safety Hub 上的 System Card 全文、API Changelog,以及同年 8 月 6 日发布的另一份 System Card。本站没有实测 GPT-5.5 Instant,下列功能与评测数字皆为 OpenAI 自行公布的说法,本文不提供任何订阅或购买建议。

GPT-5.5 Instant 是什么,换掉了哪个模型

System Card 把 GPT-5.5 Instant 的对照对象设定为 GPT-5.3 Instant,并注明没有 GPT-5.4 Instant 这个模型。本站 4 月介绍过的 GPT-5.5,System Card 称为“GPT-5.5 Thinking”,用来与这里的 Instant 版本区分,两者是不同模型。

官方公告页说明,GPT-5.5 Instant 从 5 月 5 日起对所有用户陆续推出,取代 GPT-5.3 Instant 成为默认模型,在 API 中则以 chat-latest 名称提供;付费用户可在模型设置里选回 GPT-5.3 Instant,这个选项会保留三个月后停用。System Card 另外说明,它部署时用的是低推理强度,而网络安全的 High capability 判定是在更高的 xhigh 推理强度下跑出来的,为的是看出能力上限。

官方公布的数字:事实核查进步了多少

官方公告表示,在内部评测中,GPT-5.5 Instant 在涵盖医疗、法律、财务等领域的高风险提示上,比 GPT-5.3 Instant 减少 52.5% 幻觉主张;在用户标记过含事实错误的困难对话上,减少 37.3% 不准确主张。System Card 用三个题组列出更细的数字:Factuality Heavy、User Flagged Failures、High Stakes(见下表),分别统计“回答”与“主张”含错误比例。

HealthBench 系列评测多数也显示进步,其中 HealthBench Professional 的长度校正分数从 32.9 分进步到 38.4 分,但 HealthBench Consensus 官方形容大致持平。公告也提到分析图片、回答 STEM 问题等其他能力提升,但用的是“包括”这种举例写法,并非完整清单。

这些进步有两个限定。第一,System Card 写明用来比较的前一代数字取自那些模型的最新版本,可能和它们发布当时公布的分数略有出入。第二,官方声明这些题目刻意挑出模型容易出错的情境、设计得困难,目的是取得长期研究信号,不代表日常出错率,也不是一般用户的平均体验。

含事实错误主张比例(越低越好),依 System Card Figure 2 整理,查核日 2026 年 9 月 18 日;官方刻意设计的高风险测试集,不代表日常出错率。
题组GPT-5.3 InstantGPT-5.5 Instant
High Stakes(医疗/法律/财务)10.1%4.8%
User Flagged Failures(用户标记)25.2%15.8%
Factuality Heavy(高事实密度对话)7.4%4.4%

退步的部分:gore(血腥)与性内容评测,和为什么不是日常出错率

System Card 的 Table 1 列出禁止内容的评测分数,并用统计检验标出“相对前一代显著变动”的项目——只有两项达到显著,而且都是退步:gore(血腥)分数从 0.867 降到 0.703,性内容分数从 0.857 降到 0.806(分数越高代表越少违规回答)。其余类别,OpenAI 表示与前一代没有统计上的显著差异。

“gore”是 System Card 把先前“violence”(暴力)类别改的新名称,官方注明只是为了与非法暴力行为的请求更清楚区分,评测本身没有改变;注脚把范围限定在“图像化或毫无节制的血腥内容”,不含暴力角色扮演、暴力意念或协助暴力行为,那些由“暴力违法行为”那一列涵盖。OpenAI 也已针对禁止的性内容加了系统层级缓解措施,并对疑似未满 18 岁的用户套用更严格的性内容与血腥限制。

退步不只这两项:“情感依赖”分数从 0.995 降到 0.963,OpenAI 表示这项退步统计上不显著、线上实验也未观察到不良回应增加;越狱(jailbreak)评测官方自承相对 GPT-5.3 Instant 退步,System Card 的折线图在每个攻击预算下的防守成功率都低于前一代,OpenAI 说明正在调整评测架构,视为方向性而非定论的中期结果。

以上分数,System Card 特别声明是在没有系统层防护的“基础模型”上测出来的,用意是确认模型本身行为符合安全门槛,官方同一节并写明这些错误率不代表一般正式流量的平均情形。系统层级的防护不在这次评测的范围内;被判定为高风险的生物化学与网络安全两个领域,官方说明另有自动监测与行为人层级执法等防护。

四格图解:默认模型换手、官方数字的性质、个性化分阶段开放、8 月 6 日官方写明将换新模型
依 OpenAI 2026 年 5 月 5 日公告与 System Card 整理:默认模型、官方数字的性质、个性化开放阶段与 8 月 6 日的交接时点,查核日 2026 年 9 月 18 日。 · 图片:Mokaair (© Mokaair)

新增的个性化功能:给谁、什么时候

官方公告说明,GPT-5.5 Instant 更擅长运用过去对话、文件,以及已连接的 Gmail(如果有连接)做个性化依据,会判断何时用这些内容能让回答更有帮助。OpenAI 同时在所有 ChatGPT 模型推出“记忆来源”(memory sources),让用户看到回答用了哪些依据,并能删除或修正过时内容;使用临时对话则不会用到或更新记忆。官方也加注,记忆来源不一定显示每一个影响答案的因素。

开放对象与时间表不同:默认模型替换当天对所有用户陆续推出;进阶个性化功能(过去对话、文件与 Gmail)先开放网页版 Plus 与 Pro,手机版“即将”推出,计划接下来几周扩及 Free、Go、Business 与 Enterprise;记忆来源则在所有消费版方案的网页版逐步推出,手机版同样“即将”。公告页加注,个性化来源的开放情形“可能”依地区而不同,但没有列出地区清单,本文查核的四个来源也都没有写台湾是否在内。

公告页上另有一则标明 2026 年 6 月 9 日的更新:个性化改进正推展到 ChatGPT Go 与免费版,免费版的回答会参考较少量的过去对话。那是标着后续日期的更新,不是 5 月 5 日当天的内容。

8 月的模型交接,以及怎么自己查现状

OpenAI 在 2026 年 8 月 6 日发布的另一份 System Card 写明,当天起要更新 ChatGPT 的模型并扩大开放:免费版与 Go 会拿到新的日常聊天默认模型,Plus 与 Pro 会拿到更新版 GPT-5.6 Sol 与一个选择回答投入多少心力的滑块,官方原话是“这些模型将取代 GPT-5.5 Instant”。同一天的 API Changelog 也看得到交接:chat-latest 的说明从“指向 ChatGPT 目前使用的最新 Instant 模型”改成“指向 ChatGPT 提供给 Plus 与 Pro 用户的最新模型”,并改口建议正式用途改用 GPT-5.6 Sol。两份文件都没有写替换完成或停止服务的日期。

OpenAI 的 System Card 会被事后修订:8 月 6 日那份 System Card 附有一则 2026 年 8 月 19 日的更正记录,把 GPT-5.5 在一项蛋白质结合预测评测上的 pass@4 分数从 0.4% 订正为 1.48%,并说明先前公布的其实是 pass@1 的分数。GPT-5.5 Instant 这份 System Card 目前没有附上更正记录,但这只是查核当天的状态。

想确认现状,可以直接查 OpenAI 官方公告页、Deployment Safety Hub 与 API Changelog。以这几个渠道查核到 2026 年 9 月 18 日,未见官方再对 GPT-5.5 Instant 发布新公告或更正。

常见问题

GPT-5.5 Instant 现在还是 ChatGPT 的默认模型吗?

官方文件只写到“将取代”,没有给这件事一个完成日。OpenAI 在 2026 年 8 月 6 日发布的 System Card 写明,当天起免费版与 Go 用户会拿到新的日常聊天默认模型,Plus 与 Pro 用户会拿到更新版 GPT-5.6 Sol,并写着“这些模型将取代 GPT-5.5 Instant”。API Changelog 在同一天也把 chat-latest 快照的说明,从指向 ChatGPT 目前使用的最新 Instant 模型改成指向 ChatGPT 提供给 Plus 与 Pro 用户的最新模型。两份文件都没有写替换完成或停止服务的日期,本文因此不写它已经停用,也不写它现在仍是默认模型;以官方公告页、Deployment Safety Hub 与 API Changelog 查核到 2026 年 9 月 18 日,未见官方再对 GPT-5.5 Instant 本身发布新的公告。

官方公布的幻觉减少数字,代表我平常使用出错的概率降低这么多吗?

不建议这样解读。System Card 的三个题组是刻意挑选、容易让模型出错的高事实密度、用户标记失败案例与高风险题目,设计得比较困难,目的是取得长期研究信号;System Card 明白声明,这些百分比不反映正式环境里的日常出错率,也不是一般用户的平均体验。System Card 也说明,用来比较的前一代分数取自那些模型的最新版本,可能和它们当初发布时公布的分数略有出入。

gore(血腥)分数退步,是不是代表这个模型比较暴力?

不建议这样解读。System Card 把先前的“violence”类别改名为“gore”,官方注脚把范围限定在图像化或毫无节制的血腥内容,并明白排除暴力角色扮演、暴力意念与协助暴力行为——那些由“暴力违法行为”那一列涵盖。官方也写明这只是名称的调整,不是底层评测的改变。血腥与性内容两项分数确实是 System Card Table 1 里唯二标上统计显著的变动,而且都是退步,数字分别是 0.867 降到 0.703、0.857 降到 0.806,本文并未省略。

个性化功能,台湾的账号现在用得到吗?

官方公告说明个性化功能是先开放给网页版的 Plus 与 Pro 用户,并计划在接下来几周扩及 Free、Go、Business 与 Enterprise;公告页另有一则标明 2026 年 6 月 9 日的更新,写着个性化改进正推展到 ChatGPT Go 与免费版。公告同时加注,个性化来源的开放情形“可能”依地区而不同,但没有列出地区清单,本文查核的四个来源也都没有写台湾是否在内。想确认自己的账号目前有哪些选项,建议直接查看 ChatGPT 里的设置画面。

GPT-5.3 Instant 现在还能用吗?

官方公告当时说明,付费用户可以在模型设置里手动选回 GPT-5.3 Instant,这个选项会保留三个月,之后就会停用;公告没有说明免费用户是否有这个选项。三个月的期限从 2026 年 5 月 5 日算起,实际停用时间本文未再查核,建议直接到 ChatGPT 的模型设置确认目前还看不看得到这个选项。

这篇报道做过实际测试吗?

没有。本文所有数字与描述都是 OpenAI 官方公告页、System Card 与 API Changelog 公布的内容,本站没有实测或使用 GPT-5.5 Instant,也不提供订阅、购买或投资方面的建议。

  • 生活分享

    GPT-5.5 走向多步骤工作:把模糊需求变成能验收的交付

    回顾 2026 年 OpenAI 发布 GPT-5.5 的发布背景,探讨团队如何将模糊的长任务拆解为可验收的交付物,并建立明确的人工确认点与质量指标。

  • 生活分享

    Gemini 3.8 Live 与 Extended Thinking:新语音模型,你的账号能用吗?

    2026 年 9 月 15 日,Google 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款语音对话模型。本文依据 Google 官方发布文章、开发者文章、模型卡与定价页,整理开发者、企业、普通用户与 Workspace 订阅者各自能用到什么、费用怎么计算,以及模型卡写明的知识截止日与官方未说明的开放地区。

  • 生活分享

    ChatGPT 广告开放自助购买:OpenAI 5 月公告的工具、计费与定向机制

    2026 年 5 月 5 日,OpenAI 宣布以测试版自助广告管理工具、按点击出价与更多效果衡量工具,扩大 ChatGPT 广告的购买方式。本文依据公告原文与开发者文档,说明广告账户、广告活动、广告组与广告的四层结构、三种广告活动目标的计费方式、出价策略怎么选,以及地域、平台与 context hints 的定向机制,并说明查核当天读到的文档版本与 5 月 5 日公告之间的差异。

  • 生活分享

    NVIDIA 推出 DGX Spark 64GB 版:10 月 23 日上市、起价 4,999 美元,两台可串接成 128GB

    NVIDIA 于 2026 年 10 月 2 日宣布,个人 AI 电脑 DGX Spark 新增较平价的 64GB 内存版本,10 月 23 日起由 Acer、ASUS 等六家厂商供应,主要面向希望在自己机器上运行 AI 模型的开发者与研究人员。以下整理 NVIDIA 公布的规格、双机串接说法,以及对普通读者的意义。

最新旅游情报攻略

资料来源

生活分享