生活分享
GPT-5.5 Instant 成為 ChatGPT 預設模型:官方公布的進步、退步與新功能
2026 年 5 月 5 日,OpenAI 以 GPT-5.5 Instant 取代 GPT-5.3 Instant,成為 ChatGPT 的預設模型。本文依官方公告與系統卡,整理事實查核進步的數字、血腥與性內容兩項退步、新增個人化功能的開放對象與地區但書,以及同年 8 月 6 日官方寫明新模型將取代它的時間點,並說明官方數字為何不代表日常出錯率。
閱讀時間約 11 分鐘

2026 年 5 月 5 日,OpenAI 發布 GPT-5.5 Instant,取代 GPT-5.3 Instant 成為 ChatGPT 的預設模型;官方表示這次是換成更聰明、更準確的版本,回答更清楚簡潔、也更貼合使用者。同一天發布的系統卡指出,這是第一個被 OpenAI 依 Preparedness Framework 在網路安全、生物與化學兩類都視為 High capability 的 Instant 模型。
本文於 2026 年 9 月 18 日查核 OpenAI 官方公告頁、Deployment Safety Hub 上的系統卡全文、API 變更紀錄,以及同年 8 月 6 日發布的另一份系統卡。本站沒有實際使用 GPT-5.5 Instant,下列功能與評測數字皆為 OpenAI 自行公布的說法,本文不提供任何訂閱或購買建議。
GPT-5.5 Instant 是什麼,換掉了哪個模型
系統卡把 GPT-5.5 Instant 的對照對象設定為 GPT-5.3 Instant,並註明沒有「GPT-5.4 Instant」這個模型。本站四月介紹過的 GPT-5.5,系統卡稱為「GPT-5.5 Thinking」,用來與這裡的 Instant 版本區分,兩者是不同模型。
官方公告頁說明,GPT-5.5 Instant 從 5 月 5 日起對所有使用者陸續推出,取代 GPT-5.3 Instant 成為預設模型,在 API 則以 chat-latest 名稱提供;付費使用者可在模型設定裡選回 GPT-5.3 Instant,這個選項會保留三個月後停用。系統卡另外說明,它部署時用的是低推理強度,而網路安全的 High capability 判定是在更高的 xhigh 推理強度下跑出來的,為的是看出能力上限。
官方公布的數字:事實查核進步了多少
官方公告表示,在內部評測中,GPT-5.5 Instant 在涵蓋醫療、法律、財務等領域的高風險提示上,比 GPT-5.3 Instant 減少 52.5% 幻覺主張;在使用者標記過含事實錯誤的困難對話上,減少 37.3% 不準確主張。系統卡用三個題組列出更細的數字:Factuality Heavy、User Flagged Failures、High Stakes(見下表),分別統計「回答」與「主張」含錯誤比例。
HealthBench 系列評測多數也顯示進步,其中 HealthBench Professional 的長度校正分數從 32.9 分進步到 38.4 分,但 HealthBench Consensus 官方形容大致持平。公告也提到分析圖片、回答 STEM 問題等其他能力提升,但用的是「包括」這種舉例寫法,並非完整清單。
這些進步有兩個限定。第一,系統卡寫明用來比較的前一代數字取自那些模型的最新版本,可能和它們發布當時公布的分數略有出入。第二,官方聲明這些題目刻意挑出模型容易出錯的情境、設計得困難,目的是取得長期研究訊號,不代表日常出錯率,也不是一般使用者的平均體驗。
| 題組 | GPT-5.3 Instant | GPT-5.5 Instant |
|---|---|---|
| High Stakes(醫療/法律/財務) | 10.1% | 4.8% |
| User Flagged Failures(使用者標記) | 25.2% | 15.8% |
| Factuality Heavy(高事實密度對話) | 7.4% | 4.4% |
退步的部分:血腥與性內容評測,和為什麼不是日常出錯率
系統卡的 Table 1 列出禁止內容的評測分數,並用統計檢定標出「相對前一代顯著變動」的項目——只有兩項達到顯著,而且都是退步:血腥(gore)分數從 0.867 降到 0.703,性內容分數從 0.857 降到 0.806(分數越高代表越少違規回答)。其餘類別,OpenAI 表示與前一代沒有統計上的顯著差異。
「gore」是系統卡把先前「violence」類別改的新名稱,官方註明只是為了與非法暴力行為的請求更清楚區分,評測本身沒有改變;註腳把範圍限定在「圖像化或毫無節制的血腥內容」,不含暴力角色扮演、暴力意念或協助暴力行為,那些由「暴力違法行為」那一列涵蓋。OpenAI 也已針對禁止的性內容加了系統層級緩解措施,並對疑似未滿 18 歲的使用者套用更嚴格的性內容與血腥限制。
退步不只這兩項:「情感依賴」分數從 0.995 降到 0.963,OpenAI 表示這項退步統計上不顯著、線上實驗也未觀察到不良回應增加;越獄(jailbreak)評測官方自承相對 GPT-5.3 Instant 退步,系統卡的折線圖在每個攻擊預算下的防守成功率都低於前一代,OpenAI 說明正在調整評測架構,視為方向性而非定論的中期結果。
以上分數,系統卡特別聲明是在沒有系統層防護的「基礎模型」上測出來的,用意是確認模型本身行為符合安全門檻,官方同一節並寫明這些錯誤率不代表一般正式流量的平均情形。系統層級的防護不在這次評測的範圍內;被判定為高風險的生物化學與網路安全兩個領域,官方說明另有自動監測與行為人層級執法等防護。
新增的個人化功能:給誰、什麼時候
官方公告說明,GPT-5.5 Instant 更擅長運用過去對話、檔案,以及已連結的 Gmail(如果有連結)做個人化依據,會判斷何時用這些內容能讓回答更有幫助。OpenAI 同時在所有 ChatGPT 模型推出「記憶來源」(memory sources),讓使用者看到回答用了哪些依據,並能刪除或修正過時內容;使用暫時對話則不會用到或更新記憶。官方也加註,記憶來源不一定顯示每一個影響答案的因素。
開放對象與時程不同:預設模型替換當天對所有使用者陸續推出;進階個人化功能(過去對話、檔案與 Gmail)先開放網頁版 Plus 與 Pro,手機版「即將」推出,計畫接下來幾週擴及 Free、Go、Business 與 Enterprise;記憶來源則在所有消費版方案的網頁版逐步推出,手機版同樣「即將」。公告頁加註,個人化來源的開放情形「可能」依地區而不同,但沒有列出地區清單,本文查核的四個來源也都沒有寫台灣是否在內。
公告頁上另有一則標明 2026 年 6 月 9 日的更新:個人化改進正推展到 ChatGPT Go 與免費版,免費版的回答會參考較少量的過去對話。那是標著後續日期的更新,不是 5 月 5 日當天的內容。
8 月的模型交接,以及怎麼自己查現況
OpenAI 在 2026 年 8 月 6 日發布的另一份系統卡寫明,當天起要更新 ChatGPT 的模型並擴大開放:免費版與 Go 會拿到新的日常聊天預設模型,Plus 與 Pro 會拿到更新版 GPT-5.6 Sol 與一個選擇回應投入多少心力的滑桿,官方原話是「這些模型將取代 GPT-5.5 Instant」。同一天的 API 變更紀錄也看得到交接:chat-latest 的說明從「指向 ChatGPT 目前使用的最新 Instant 模型」改成「指向 ChatGPT 提供給 Plus 與 Pro 使用者的最新模型」,並改口建議正式用途改用 GPT-5.6 Sol。兩份文件都沒有寫替換完成或停止服務的日期。
OpenAI 的系統卡會被事後修訂:8 月 6 日那份系統卡附有一則 2026 年 8 月 19 日的更正紀錄,把 GPT-5.5 在一項蛋白質結合預測評測上的 pass@4 分數從 0.4% 訂正為 1.48%,並說明先前刊出的其實是 pass@1 的分數。GPT-5.5 Instant 這份系統卡目前沒有附上更正紀錄,但這只是查核當天的狀態。
想確認現況,可以直接查 OpenAI 官方公告頁、Deployment Safety Hub 與 API 變更紀錄。以這幾個管道查核到 2026 年 9 月 18 日,未見官方再對 GPT-5.5 Instant 發布新公告或更正。
常見問題
GPT-5.5 Instant 現在還是 ChatGPT 的預設模型嗎?
官方文件只寫到「將取代」,沒有給這件事一個完成日。OpenAI 在 2026 年 8 月 6 日發布的系統卡寫明,當天起免費版與 Go 使用者會拿到新的日常聊天預設模型,Plus 與 Pro 使用者會拿到更新版 GPT-5.6 Sol,並寫著「這些模型將取代 GPT-5.5 Instant」。API 的變更紀錄在同一天也把 chat-latest 快照的說明,從指向 ChatGPT 目前使用的最新 Instant 模型改成指向 ChatGPT 提供給 Plus 與 Pro 使用者的最新模型。兩份文件都沒有寫替換完成或停止服務的日期,本文因此不寫它已經停用,也不寫它現在仍是預設模型;以官方公告頁、Deployment Safety Hub 與 API 變更紀錄查核到 2026 年 9 月 18 日,未見官方再對 GPT-5.5 Instant 本身發布新的公告。
官方公布的幻覺減少數字,代表我平常使用出錯的機率降低這麼多嗎?
不建議這樣解讀。系統卡的三個題組是刻意挑選、容易讓模型出錯的高事實密度、使用者標記失敗案例與高風險題目,設計得比較困難,目的是取得長期研究訊號;系統卡明白聲明,這些百分比不反映正式環境裡的日常出錯率,也不是一般使用者的平均體驗。系統卡也說明,用來比較的前一代分數取自那些模型的最新版本,可能和它們當初發布時公布的分數略有出入。
血腥(gore)分數退步,是不是代表這個模型比較暴力?
不建議這樣解讀。系統卡把先前的「violence」類別改名為「gore」,官方註腳把範圍限定在圖像化或毫無節制的血腥內容,並明白排除暴力角色扮演、暴力意念與協助暴力行為——那些由「暴力違法行為」那一列涵蓋。官方也寫明這只是名稱的調整,不是底層評測的改變。血腥與性內容兩項分數確實是系統卡 Table 1 裡唯二標上統計顯著的變動,而且都是退步,數字分別是 0.867 降到 0.703、0.857 降到 0.806,本文並未省略。
個人化功能,台灣的帳號現在用得到嗎?
官方公告說明個人化功能是先開放給網頁版的 Plus 與 Pro 使用者,並計畫在接下來幾週擴及 Free、Go、Business 與 Enterprise;公告頁另有一則標明 2026 年 6 月 9 日的更新,寫著個人化改進正推展到 ChatGPT Go 與免費版。公告同時加註,個人化來源的開放情形「可能」依地區而不同,但沒有列出地區清單,本文查核的四個來源也都沒有寫台灣是否在內。想確認自己的帳號目前有哪些選項,建議直接查看 ChatGPT 裡的設定畫面。
GPT-5.3 Instant 現在還能用嗎?
官方公告當時說明,付費使用者可以在模型設定裡手動選回 GPT-5.3 Instant,這個選項會保留三個月,之後就會停用;公告沒有說明免費使用者是否有這個選項。三個月的期限從 2026 年 5 月 5 日算起,實際停用時間本文未再查證,建議直接到 ChatGPT 的模型設定確認目前還看不看得到這個選項。
這篇報導做過實際測試嗎?
沒有。本文所有數字與描述都是 OpenAI 官方公告頁、系統卡與 API 變更紀錄公布的內容,本站沒有實際使用或測試 GPT-5.5 Instant,也不提供訂閱、購買或投資方面的建議。
2026 年 AI 新聞總整理:1 月至 9 月的重點與生活應用2026 年 AI 新聞總整理:1 月至 9 月的重點與生活應用從 2026 年 1 月至 9 月,依月份整理 AI 重要新聞,連到完整解析,多數另有簡體中文、英文、日文與韓文版。涵蓋模型、工作工具、創作、費用與透明度,說明事件背景、生活用途與開放限制。閱讀全文
Gemini 3.8 Live 與 Extended Thinking:新語音模型,你的帳號能用嗎?Gemini 3.8 Live 與 Extended Thinking:新語音模型,你的帳號能用嗎?2026 年 9 月 15 日,Google 發表 Gemini 3.8 Live 與 Gemini 3.8 Live Extended Thinking 兩款語音對話模型。本文依 Google 官方發表文、開發者文、模型卡與定價頁,整理開發者、企業、一般使用者與 Workspace 訂閱者各自能用到什麼、費用怎麼計算,以及模型卡寫的知識截止日與官方未說明的開放地區。閱讀全文
同主題延伸閱讀
生活分享
GPT-5.5 走向多步驟工作:把模糊需求變成能驗收的交付
回顧 2026 年 OpenAI 發布 GPT-5.5 的發布背景,探討團隊如何將模糊的長任務拆解為可驗收的交付物,並建立明確的人工確認點與品質指標。
生活分享
Gemini 3.8 Live 與 Extended Thinking:新語音模型,你的帳號能用嗎?
2026 年 9 月 15 日,Google 發表 Gemini 3.8 Live 與 Gemini 3.8 Live Extended Thinking 兩款語音對話模型。本文依 Google 官方發表文、開發者文、模型卡與定價頁,整理開發者、企業、一般使用者與 Workspace 訂閱者各自能用到什麼、費用怎麼計算,以及模型卡寫的知識截止日與官方未說明的開放地區。
生活分享
ChatGPT 廣告開放自助購買:OpenAI 5 月公告的工具、計費與鎖定機制
2026 年 5 月 5 日,OpenAI 公告以測試版自助廣告管理工具、按點擊出價與更多量測工具擴大 ChatGPT 廣告的購買方式。本文依公告原文與開發者文件,說明廣告帳戶、活動、廣告組與廣告的四層架構、三種活動目標怎麼計費、出價策略怎麼選,以及地區、平台與 context hints 的鎖定機制,並說明查核當天讀到的文件版本與 5 月 5 日公告的差別。
生活分享
NVIDIA 推出 DGX Spark 64GB 版:10 月 23 日上市、起價 4,999 美元,兩台可串接成 128GB
NVIDIA 於 2026 年 10 月 2 日宣布,個人 AI 電腦 DGX Spark 新增較平價的 64GB 記憶體版本,10 月 23 日起由 Acer、ASUS 等六家廠商供應,主要對象是想在自己機器上執行 AI 模型的開發者與研究人員。以下整理 NVIDIA 公布的規格、雙機串接說法,以及對一般讀者的意義。
引用本文的文章
最新旅遊情報攻略

情報
2026 韓國楓葉預測:雪嶽山 10 月 20 日、首爾近郊 10 月底、內藏山與漢拏山 11 月上旬
韓國山林廳 2026 年 9 月 22 日公布的楓紅高峰預測:雪嶽山 10 月 20 日,春川、國立樹木園到首爾植物園落在 10 月 28 日到 11 月 2 日,內藏山 11 月 4 日、漢拏山 11 月 6 日,整體比最近 5 年晚約 0.8 天。整理各地楓樹與銀杏的預測日、首爾出發怎麼排,以及出發前去哪裡看即時楓況。2026 年 10 月查證。
- 季節活動
- 自然
- 觀景

攻略胡志明市
胡志明市到頭頓一日遊:白藤碼頭搭高速船、船票與班次,下船就是胡梅纜車與耶穌基督像
人在胡志明市挪一天去頭頓看海:市中心的白藤高速船碼頭搭船,航程 120 分鐘到頭頓的胡梅碼頭,平日成人 320,000 越南盾、週末 350,000,回程末班平日 15:00。下船就是胡梅纜車站,同一條路上有白宮,小山頂上是耶穌基督像。平日一天只有兩班船,整天要從末班船倒推著排。
- 交通
- 行程範例
- 海灘

攻略沖繩
沖繩不開車攻略:單軌只到浦添,美麗海水族館要坐兩個多小時的巴士,回那霸的最後一班直達車 17:22 就開走
不租車的沖繩怎麼移動:那霸市區靠沖繩都市單軌電車(ゆいレール),那霸機場站到終點てだこ浦西 19 站、17 公里、37 分鐘,一日券 1,000 日圓;美麗海水族館有那霸機場直達的高速巴士,單程 2,000 日圓起、官方時刻表上 2 小時上下,下車後還要走 10 分鐘;古宇利島要在今帰仁村役場轉車,當天來回光坐車就六個半小時;回程的最後一班直達車 17:22 就從記念公園前開走(2026 年 9 月查證)。
- 交通
- 行程範例
- 預算