生活分享

GPT-5.5 Instant 成為 ChatGPT 預設模型:官方公布的進步、退步與新功能

2026 年 5 月 5 日,OpenAI 以 GPT-5.5 Instant 取代 GPT-5.3 Instant,成為 ChatGPT 的預設模型。本文依官方公告與系統卡,整理事實查核進步的數字、血腥與性內容兩項退步、新增個人化功能的開放對象與地區但書,以及同年 8 月 6 日官方寫明新模型將取代它的時間點,並說明官方數字為何不代表日常出錯率。

閱讀時間約 11 分鐘

原創插圖:左邊一個對話框裡畫著一個齒輪,代表看不見的底層模型換了一顆;一支箭頭指向右邊一份核對清單,五列裡前三列打勾、後兩列是虛線圓圈,代表官方公布了數字的項目與還沒公布的項目。
圖片:Mokaair (© Mokaair)

2026 年 5 月 5 日,OpenAI 發布 GPT-5.5 Instant,取代 GPT-5.3 Instant 成為 ChatGPT 的預設模型;官方表示這次是換成更聰明、更準確的版本,回答更清楚簡潔、也更貼合使用者。同一天發布的系統卡指出,這是第一個被 OpenAI 依 Preparedness Framework 在網路安全、生物與化學兩類都視為 High capability 的 Instant 模型。

本文於 2026 年 9 月 18 日查核 OpenAI 官方公告頁、Deployment Safety Hub 上的系統卡全文、API 變更紀錄,以及同年 8 月 6 日發布的另一份系統卡。本站沒有實際使用 GPT-5.5 Instant,下列功能與評測數字皆為 OpenAI 自行公布的說法,本文不提供任何訂閱或購買建議。

GPT-5.5 Instant 是什麼,換掉了哪個模型

系統卡把 GPT-5.5 Instant 的對照對象設定為 GPT-5.3 Instant,並註明沒有「GPT-5.4 Instant」這個模型。本站四月介紹過的 GPT-5.5,系統卡稱為「GPT-5.5 Thinking」,用來與這裡的 Instant 版本區分,兩者是不同模型。

官方公告頁說明,GPT-5.5 Instant 從 5 月 5 日起對所有使用者陸續推出,取代 GPT-5.3 Instant 成為預設模型,在 API 則以 chat-latest 名稱提供;付費使用者可在模型設定裡選回 GPT-5.3 Instant,這個選項會保留三個月後停用。系統卡另外說明,它部署時用的是低推理強度,而網路安全的 High capability 判定是在更高的 xhigh 推理強度下跑出來的,為的是看出能力上限。

官方公布的數字:事實查核進步了多少

官方公告表示,在內部評測中,GPT-5.5 Instant 在涵蓋醫療、法律、財務等領域的高風險提示上,比 GPT-5.3 Instant 減少 52.5% 幻覺主張;在使用者標記過含事實錯誤的困難對話上,減少 37.3% 不準確主張。系統卡用三個題組列出更細的數字:Factuality Heavy、User Flagged Failures、High Stakes(見下表),分別統計「回答」與「主張」含錯誤比例。

HealthBench 系列評測多數也顯示進步,其中 HealthBench Professional 的長度校正分數從 32.9 分進步到 38.4 分,但 HealthBench Consensus 官方形容大致持平。公告也提到分析圖片、回答 STEM 問題等其他能力提升,但用的是「包括」這種舉例寫法,並非完整清單。

這些進步有兩個限定。第一,系統卡寫明用來比較的前一代數字取自那些模型的最新版本,可能和它們發布當時公布的分數略有出入。第二,官方聲明這些題目刻意挑出模型容易出錯的情境、設計得困難,目的是取得長期研究訊號,不代表日常出錯率,也不是一般使用者的平均體驗。

含事實錯誤主張比例(越低越好),依系統卡 Figure 2 整理,查核日 2026 年 9 月 18 日;官方刻意設計的高風險測試集,不代表日常出錯率。
題組GPT-5.3 InstantGPT-5.5 Instant
High Stakes(醫療/法律/財務)10.1%4.8%
User Flagged Failures(使用者標記)25.2%15.8%
Factuality Heavy(高事實密度對話)7.4%4.4%

退步的部分:血腥與性內容評測,和為什麼不是日常出錯率

系統卡的 Table 1 列出禁止內容的評測分數,並用統計檢定標出「相對前一代顯著變動」的項目——只有兩項達到顯著,而且都是退步:血腥(gore)分數從 0.867 降到 0.703,性內容分數從 0.857 降到 0.806(分數越高代表越少違規回答)。其餘類別,OpenAI 表示與前一代沒有統計上的顯著差異。

「gore」是系統卡把先前「violence」類別改的新名稱,官方註明只是為了與非法暴力行為的請求更清楚區分,評測本身沒有改變;註腳把範圍限定在「圖像化或毫無節制的血腥內容」,不含暴力角色扮演、暴力意念或協助暴力行為,那些由「暴力違法行為」那一列涵蓋。OpenAI 也已針對禁止的性內容加了系統層級緩解措施,並對疑似未滿 18 歲的使用者套用更嚴格的性內容與血腥限制。

退步不只這兩項:「情感依賴」分數從 0.995 降到 0.963,OpenAI 表示這項退步統計上不顯著、線上實驗也未觀察到不良回應增加;越獄(jailbreak)評測官方自承相對 GPT-5.3 Instant 退步,系統卡的折線圖在每個攻擊預算下的防守成功率都低於前一代,OpenAI 說明正在調整評測架構,視為方向性而非定論的中期結果。

以上分數,系統卡特別聲明是在沒有系統層防護的「基礎模型」上測出來的,用意是確認模型本身行為符合安全門檻,官方同一節並寫明這些錯誤率不代表一般正式流量的平均情形。系統層級的防護不在這次評測的範圍內;被判定為高風險的生物化學與網路安全兩個領域,官方說明另有自動監測與行為人層級執法等防護。

四格圖解:預設模型換手、官方數字的性質、個人化分階段開放、8 月 6 日官方寫明將換新模型
依 OpenAI 2026 年 5 月 5 日公告與系統卡整理:預設模型、官方數字的性質、個人化開放階段與 8 月 6 日的交接時點,查核日 2026 年 9 月 18 日。 · 圖片:Mokaair (© Mokaair)

新增的個人化功能:給誰、什麼時候

官方公告說明,GPT-5.5 Instant 更擅長運用過去對話、檔案,以及已連結的 Gmail(如果有連結)做個人化依據,會判斷何時用這些內容能讓回答更有幫助。OpenAI 同時在所有 ChatGPT 模型推出「記憶來源」(memory sources),讓使用者看到回答用了哪些依據,並能刪除或修正過時內容;使用暫時對話則不會用到或更新記憶。官方也加註,記憶來源不一定顯示每一個影響答案的因素。

開放對象與時程不同:預設模型替換當天對所有使用者陸續推出;進階個人化功能(過去對話、檔案與 Gmail)先開放網頁版 Plus 與 Pro,手機版「即將」推出,計畫接下來幾週擴及 Free、Go、Business 與 Enterprise;記憶來源則在所有消費版方案的網頁版逐步推出,手機版同樣「即將」。公告頁加註,個人化來源的開放情形「可能」依地區而不同,但沒有列出地區清單,本文查核的四個來源也都沒有寫台灣是否在內。

公告頁上另有一則標明 2026 年 6 月 9 日的更新:個人化改進正推展到 ChatGPT Go 與免費版,免費版的回答會參考較少量的過去對話。那是標著後續日期的更新,不是 5 月 5 日當天的內容。

8 月的模型交接,以及怎麼自己查現況

OpenAI 在 2026 年 8 月 6 日發布的另一份系統卡寫明,當天起要更新 ChatGPT 的模型並擴大開放:免費版與 Go 會拿到新的日常聊天預設模型,Plus 與 Pro 會拿到更新版 GPT-5.6 Sol 與一個選擇回應投入多少心力的滑桿,官方原話是「這些模型將取代 GPT-5.5 Instant」。同一天的 API 變更紀錄也看得到交接:chat-latest 的說明從「指向 ChatGPT 目前使用的最新 Instant 模型」改成「指向 ChatGPT 提供給 Plus 與 Pro 使用者的最新模型」,並改口建議正式用途改用 GPT-5.6 Sol。兩份文件都沒有寫替換完成或停止服務的日期。

OpenAI 的系統卡會被事後修訂:8 月 6 日那份系統卡附有一則 2026 年 8 月 19 日的更正紀錄,把 GPT-5.5 在一項蛋白質結合預測評測上的 pass@4 分數從 0.4% 訂正為 1.48%,並說明先前刊出的其實是 pass@1 的分數。GPT-5.5 Instant 這份系統卡目前沒有附上更正紀錄,但這只是查核當天的狀態。

想確認現況,可以直接查 OpenAI 官方公告頁、Deployment Safety Hub 與 API 變更紀錄。以這幾個管道查核到 2026 年 9 月 18 日,未見官方再對 GPT-5.5 Instant 發布新公告或更正。

常見問題

GPT-5.5 Instant 現在還是 ChatGPT 的預設模型嗎?

官方文件只寫到「將取代」,沒有給這件事一個完成日。OpenAI 在 2026 年 8 月 6 日發布的系統卡寫明,當天起免費版與 Go 使用者會拿到新的日常聊天預設模型,Plus 與 Pro 使用者會拿到更新版 GPT-5.6 Sol,並寫著「這些模型將取代 GPT-5.5 Instant」。API 的變更紀錄在同一天也把 chat-latest 快照的說明,從指向 ChatGPT 目前使用的最新 Instant 模型改成指向 ChatGPT 提供給 Plus 與 Pro 使用者的最新模型。兩份文件都沒有寫替換完成或停止服務的日期,本文因此不寫它已經停用,也不寫它現在仍是預設模型;以官方公告頁、Deployment Safety Hub 與 API 變更紀錄查核到 2026 年 9 月 18 日,未見官方再對 GPT-5.5 Instant 本身發布新的公告。

官方公布的幻覺減少數字,代表我平常使用出錯的機率降低這麼多嗎?

不建議這樣解讀。系統卡的三個題組是刻意挑選、容易讓模型出錯的高事實密度、使用者標記失敗案例與高風險題目,設計得比較困難,目的是取得長期研究訊號;系統卡明白聲明,這些百分比不反映正式環境裡的日常出錯率,也不是一般使用者的平均體驗。系統卡也說明,用來比較的前一代分數取自那些模型的最新版本,可能和它們當初發布時公布的分數略有出入。

血腥(gore)分數退步,是不是代表這個模型比較暴力?

不建議這樣解讀。系統卡把先前的「violence」類別改名為「gore」,官方註腳把範圍限定在圖像化或毫無節制的血腥內容,並明白排除暴力角色扮演、暴力意念與協助暴力行為——那些由「暴力違法行為」那一列涵蓋。官方也寫明這只是名稱的調整,不是底層評測的改變。血腥與性內容兩項分數確實是系統卡 Table 1 裡唯二標上統計顯著的變動,而且都是退步,數字分別是 0.867 降到 0.703、0.857 降到 0.806,本文並未省略。

個人化功能,台灣的帳號現在用得到嗎?

官方公告說明個人化功能是先開放給網頁版的 Plus 與 Pro 使用者,並計畫在接下來幾週擴及 Free、Go、Business 與 Enterprise;公告頁另有一則標明 2026 年 6 月 9 日的更新,寫著個人化改進正推展到 ChatGPT Go 與免費版。公告同時加註,個人化來源的開放情形「可能」依地區而不同,但沒有列出地區清單,本文查核的四個來源也都沒有寫台灣是否在內。想確認自己的帳號目前有哪些選項,建議直接查看 ChatGPT 裡的設定畫面。

GPT-5.3 Instant 現在還能用嗎?

官方公告當時說明,付費使用者可以在模型設定裡手動選回 GPT-5.3 Instant,這個選項會保留三個月,之後就會停用;公告沒有說明免費使用者是否有這個選項。三個月的期限從 2026 年 5 月 5 日算起,實際停用時間本文未再查證,建議直接到 ChatGPT 的模型設定確認目前還看不看得到這個選項。

這篇報導做過實際測試嗎?

沒有。本文所有數字與描述都是 OpenAI 官方公告頁、系統卡與 API 變更紀錄公布的內容,本站沒有實際使用或測試 GPT-5.5 Instant,也不提供訂閱、購買或投資方面的建議。

  • 生活分享

    GPT-5.5 走向多步驟工作:把模糊需求變成能驗收的交付

    回顧 2026 年 OpenAI 發布 GPT-5.5 的發布背景,探討團隊如何將模糊的長任務拆解為可驗收的交付物,並建立明確的人工確認點與品質指標。

  • 生活分享

    Gemini 3.8 Live 與 Extended Thinking:新語音模型,你的帳號能用嗎?

    2026 年 9 月 15 日,Google 發表 Gemini 3.8 Live 與 Gemini 3.8 Live Extended Thinking 兩款語音對話模型。本文依 Google 官方發表文、開發者文、模型卡與定價頁,整理開發者、企業、一般使用者與 Workspace 訂閱者各自能用到什麼、費用怎麼計算,以及模型卡寫的知識截止日與官方未說明的開放地區。

  • 生活分享

    ChatGPT 廣告開放自助購買:OpenAI 5 月公告的工具、計費與鎖定機制

    2026 年 5 月 5 日,OpenAI 公告以測試版自助廣告管理工具、按點擊出價與更多量測工具擴大 ChatGPT 廣告的購買方式。本文依公告原文與開發者文件,說明廣告帳戶、活動、廣告組與廣告的四層架構、三種活動目標怎麼計費、出價策略怎麼選,以及地區、平台與 context hints 的鎖定機制,並說明查核當天讀到的文件版本與 5 月 5 日公告的差別。

  • 生活分享

    NVIDIA 推出 DGX Spark 64GB 版:10 月 23 日上市、起價 4,999 美元,兩台可串接成 128GB

    NVIDIA 於 2026 年 10 月 2 日宣布,個人 AI 電腦 DGX Spark 新增較平價的 64GB 記憶體版本,10 月 23 日起由 Acer、ASUS 等六家廠商供應,主要對象是想在自己機器上執行 AI 模型的開發者與研究人員。以下整理 NVIDIA 公布的規格、雙機串接說法,以及對一般讀者的意義。

最新旅遊情報攻略

資料來源

生活分享