ライフスタイル
GPT-5.5 InstantがChatGPTの既定モデルに:公式発表の進歩・後退・新機能
2026年5月5日、OpenAIはGPT-5.3 InstantをGPT-5.5 Instantに切り替え、ChatGPTの既定モデルとしました。本稿はOpenAIの公式発表とSystem Cardに基づき、事実確認で公表された改善の数値、gore(グロテスクな残虐表現)と性的コンテンツという2つの後退、新しい個人化機能の対象者と地域による但し書き、同年8月6日に公式が新モデルによる置き換えを予告した時点、そして公式の数値が日常のエラー率を意味しない理由を整理します。
読了目安 17 分

2026年5月5日、OpenAIはGPT-5.5 Instantを公開し、GPT-5.3 InstantからChatGPTの既定モデルを切り替えました。OpenAIによると、今回の更新はより賢く、より正確なバージョンへの切り替えで、回答はより明確で簡潔になり、ユーザーによりよく合わせたものになるとしています。同日公開されたSystem Cardでは、これはOpenAIがPreparedness Frameworkに基づき、サイバーセキュリティと生物・化学の両分野でHigh capabilityとみなす最初のInstantモデルだと述べています。
本稿は2026年9月18日に、OpenAIの公式発表ページ、Deployment Safety Hub上のSystem Card全文、API Changelog、そして同年8月6日に公開されたもう一つのSystem Cardを確認しました。当サイトは実地の検証を行っておらず、以下の機能や評価数値はすべてOpenAIが自ら公表した内容であり、本稿はいかなる契約や購入も勧めるものではありません。
GPT-5.5 Instantとは何か、何を置き換えたのか
System CardはGPT-5.5 Instantの比較対象をGPT-5.3 Instantに設定しており、GPT-5.4 Instantというモデルは存在しないと注記しています。当サイトが4月に紹介したGPT-5.5は、System Cardでは「GPT-5.5 Thinking」と呼ばれ、ここでのInstant版と区別するための名称であり、両者は別のモデルです。
公式発表ページによると、GPT-5.5 Instantは5月5日から全ユーザーに順次展開され、GPT-5.3 Instantに代わって既定モデルとなり、APIではchat-latestという名称で提供されます。有料ユーザーはモデル設定でGPT-5.3 Instantに切り替えることができ、このオプションは3か月間保持された後に廃止されます。System Cardは別途、実運用ではlow reasoning effort(低い推論強度)で展開されている一方、サイバーセキュリティにおけるHigh capabilityの判定は、能力の上限を把握するためにより高いxhigh推論強度で行われたと説明しています。
公式が公表した数値:事実確認はどれだけ改善したか
公式発表によると、内部評価においてGPT-5.5 Instantは、医療・法律・財務などの分野を含む高リスクなプロンプトで、GPT-5.3 Instantより幻覚に基づく主張が52.5%減少し、ユーザーが事実誤りとして報告した難しい会話では不正確な主張が37.3%減少しました。System Cardは3つの評価セット、Factuality Heavy、User Flagged Failures、High Stakes(下表を参照)で、より詳細な数値を示しており、それぞれ「回答」と「主張」に誤りが含まれる割合を集計しています。
HealthBenchシリーズの評価も大半で改善が見られ、HealthBench Professionalの長さ補正後のスコアは32.9点から38.4点に上昇しましたが、HealthBench Consensusについて公式は「ほぼ横ばい」としています。発表では画像の分析やSTEM関連の質問への回答など他の能力向上にも触れていますが、これは「including(含む)」という例示的な書き方であり、完全なリストではありません。
これらの改善には2つの留保があります。第一に、System Cardは比較に使う前世代の数値がそれらのモデルの最新版から取られたものであり、発表当時に公表されたスコアとは多少異なる可能性があると明記しています。第二に、公式はこれらの問題がモデルが誤りやすい状況をあえて選び、難しく設計されたものであり、長期的な研究シグナルを得るためのものであって、日常のエラー率や一般ユーザーの平均的な体験を表すものではないと述べています。
| 評価セット | GPT-5.3 Instant | GPT-5.5 Instant |
|---|---|---|
| High Stakes(医療・法律・財務) | 10.1% | 4.8% |
| User Flagged Failures(ユーザー報告) | 25.2% | 15.8% |
| Factuality Heavy(事実密度の高い会話) | 7.4% | 4.4% |
後退した部分:gore(残虐表現)と性的コンテンツの評価、そしてなぜ日常のエラー率ではないのか
System CardのTable 1には禁止コンテンツの評価スコアが示されており、統計的検定によって「前世代と比較して有意な変化があった」項目に印がついています。有意とされたのは2項目のみで、いずれも後退でした。gore(グロテスクな残虐表現)のスコアは0.867から0.703に、性的コンテンツのスコアは0.857から0.806に低下しました(スコアが高いほど違反する回答が少ないことを意味します)。それ以外のカテゴリーについては、OpenAIは前世代と統計的に有意な差はないとしています。
「gore」は、System Cardが以前の「violence(暴力)」というカテゴリー名を変更した新しい名称で、公式は違法な暴力行為に関する要求とより明確に区別するための変更に過ぎず、評価自体は変わっていないと注記しています。脚注では範囲を「graphic(生々しい)または過度に残虐な内容」に限定しており、暴力的なロールプレイ、暴力的な観念、暴力行為への加担は含まれず、それらは「violent illicit behavior(暴力的な違法行為)」の項目でカバーされるとしています。OpenAIはまた、禁止されている性的コンテンツに対してシステム層の緩和策を追加し、18歳未満と思われるユーザーには性的コンテンツとgoreについてより厳しい制限を適用しています。
後退はこの2項目だけではありません。「情緒的依存(emotional reliance)」のスコアは0.995から0.963に低下しましたが、OpenAIはこの後退は統計的に有意ではなく、オンライン実験でも望ましくない回答の増加は見られなかったとしています。jailbreak(脱獄)の評価については、GPT-5.3 Instantと比べて後退したことを公式自ら認めており、System Cardの折れ線グラフでは、あらゆる攻撃予算において防御成功率が前世代を下回っています。OpenAIは評価の枠組みを見直している最中であり、これは確定的な結論ではなく方向性を示す中間結果だと説明しています。
System Cardは、以上のスコアがシステム層の保護がない「ベースモデル」で測定されたものであり、モデル自体の挙動が安全基準を満たしているかを確認するためのものだと明記しています。同じ節では、これらのエラー率は一般的な本番トラフィックの平均を表すものではないとも述べています。システム層の保護は今回の評価の対象外です。High capabilityと判定された生物・化学とサイバーセキュリティの2分野については、公式は自動監視や行為者レベルでの取り締まりなど別途の保護策があると説明しています。
新しい個人化機能:誰に、いつ提供されるのか
公式発表によると、GPT-5.5 Instantは過去の会話やファイル、連携済みのGmail(連携している場合)をより効果的に個人化の根拠として活用できるようになり、これらの情報をいつ使えば回答がより役立つかを判断するとしています。OpenAIは同時に、すべてのChatGPTモデルにメモリーソース(memory sources)を展開し、回答にどのような根拠が使われたかをユーザーが確認でき、古くなった内容を削除・修正できるようにしました。一時的な会話ではメモリーは使用も更新もされません。公式は、メモリーソースが回答に影響したすべての要因を示すとは限らないとも付け加えています。
対象ユーザーと時期はそれぞれ異なります。既定モデルの切り替えはその当日にすべてのユーザーへ順次展開されました。高度な個人化機能(過去の会話・ファイル・Gmail)はまずウェブ版のPlusとProユーザーに提供され、モバイル版は「近日提供予定」で、今後数週間でFree、Go、Business、Enterpriseにも拡大する計画です。メモリーソースはすべての消費者向けプランのウェブ版で順次展開されており、モバイル版も同様に「近日提供予定」です。発表ページには、個人化ソースの利用可否は地域によって異なる「可能性がある」との注記がありますが、具体的な地域リストは示されておらず、本稿が確認した4つの情報源にも台湾が含まれるかどうかは記載されていません。
発表ページにはさらに、2026年6月9日付けの更新として、個人化の改善がChatGPT Goと無料版にも展開されており、無料版の回答は参照する過去の会話の量が少なくなるとの記載があります。これは後日付けの更新であり、5月5日当日の内容ではありません。
8月のモデル交代と、現状を自分で確認する方法
OpenAIが2026年8月6日に公開したもう一つのSystem Cardには、その日からChatGPTのモデルを更新し提供範囲を広げると明記されています。無料版とGoユーザーには日常会話用の新しい既定モデルが、PlusとProユーザーには更新版のGPT-5.6 Solと、回答にどれだけ力を入れるかを選べるスライダーが提供されます。公式の原文は「これらのモデルはGPT-5.5 Instantを置き換えます」です。同日のAPI Changelogにも同じ交代の跡が見られます。chat-latestの説明は「ChatGPTで現在使われている最新のInstantモデルを指す」から「ChatGPTがPlusとProユーザーに提供する最新モデルを指す」に変わり、本番用途にはGPT-5.6 Solの利用を推奨するよう書き換えられました。どちらの文書にも、置き換えが完了した日付やサービスを終了する日付は記載されていません。
OpenAIのSystem Cardは公開後に修正されることがあります。8月6日のSystem Cardには2026年8月19日付けの訂正記録が付いており、GPT-5.5のタンパク質結合予測評価におけるpass@4スコアを0.4%から1.48%に訂正し、以前掲載されていた数値は実はpass@1のスコアだったと説明しています。GPT-5.5 InstantのSystem Cardには現時点で訂正記録は付いていませんが、これはあくまで確認当日の状態にすぎません。
現状を確認したい場合は、OpenAIの公式発表ページ、Deployment Safety Hub、API Changelogを直接確認できます。これらの情報源を2026年9月18日まで確認しましたが、GPT-5.5 Instant自体について公式から新たな発表や訂正は見つかりませんでした。
よくある質問
GPT-5.5 Instantは今もChatGPTの既定モデルですか?
公式文書には「置き換える」としか書かれておらず、完了時期は示されていません。OpenAIが2026年8月6日に公開したSystem Cardには、その日から無料版とGoユーザーは日常会話用の新しい既定モデルを、PlusとProユーザーは更新版のGPT-5.6 Solを利用できるようになると明記されており、「これらのモデルはGPT-5.5 Instantを置き換えます」と書かれています。同日のAPI Changelogでも、chat-latestスナップショットの説明が「ChatGPTで現在使われている最新のInstantモデルを指す」から「ChatGPTがPlusとProユーザーに提供する最新モデルを指す」に変更されました。どちらの文書にも置き換えが完了した日付やサービス終了日は記載されていないため、本稿はGPT-5.5 Instantがすでに廃止されたとも、今も既定モデルのままだとも書きません。公式発表ページ、Deployment Safety Hub、API Changelogを2026年9月18日まで確認しましたが、GPT-5.5 Instant自体についての新しい公式発表は見当たりませんでした。
公式が公表した幻覚の減少数値は、自分が普段使う際のエラー率もそれだけ下がることを意味しますか?
そのように読み取ることはお勧めしません。System Cardの3つの評価セットは、モデルが誤りやすい状況としてあえて選ばれた事実密度の高い会話、過去に報告された失敗事例、高リスクな問題であり、難しく設計されているのは長期的な研究シグナルを得るためです。System Cardは、これらのパーセンテージが本番環境における日常的なエラー率を反映するものではなく、一般ユーザーの平均的な体験でもないと明言しています。また、比較に使われた前世代のスコアはそれらのモデルの最新版から取られたものであり、発表当時に公表された数値とは多少異なる可能性があるとも説明しています。
gore(残虐表現)のスコアが下がったのは、このモデルがより暴力的になったということですか?
そのように読み取ることはお勧めしません。System Cardは以前の「violence(暴力)」というカテゴリー名を「gore」に変更したもので、公式の脚注は範囲をgraphic(生々しい)または過度に残虐な内容に限定しており、暴力的なロールプレイ、暴力的な観念、暴力行為への加担は明確に除外され、それらは「violent illicit behavior(暴力的な違法行為)」の項目でカバーされるとしています。公式はこれが名称の変更に過ぎず、評価自体の変更ではないとも明記しています。goreと性的コンテンツの2項目は、System CardのTable 1で統計的に有意な変化と印がついた唯一の2項目であり、いずれも後退で、数値はそれぞれ0.867から0.703、0.857から0.806であり、本稿はこれを省略していません。
個人化機能は、台湾のアカウントでも今使えますか?
公式発表では、個人化機能はまずウェブ版のPlusとProユーザーに提供され、今後数週間でFree、Go、Business、Enterpriseにも拡大する計画だと説明されています。発表ページにはさらに2026年6月9日付けの更新として、個人化の改善がChatGPT Goと無料版にも展開されているとの記載があります。発表ではまた、個人化ソースの利用可否は地域によって異なる「可能性がある」としていますが、具体的な地域リストは示されておらず、本稿が確認した4つの情報源にも台湾が含まれるかどうかは記載がありません。自分のアカウントで現在どの機能が使えるか確認したい場合は、ChatGPT内の設定画面を直接ご確認ください。
GPT-5.3 Instantは今も使えますか?
当時の公式発表によると、有料ユーザーはモデル設定で手動でGPT-5.3 Instantに戻すことができ、このオプションは3か月間保持された後に廃止されるとされていました。無料ユーザーにこのオプションがあるかどうかは発表に記載がありません。3か月の期限は2026年5月5日から起算されますが、実際に廃止された時期については本稿では改めて確認していないため、ChatGPTのモデル設定で現在もこのオプションが表示されるかどうか直接ご確認いただくことをお勧めします。
この記事では実際にテストを行いましたか?
行っていません。本稿の数値や説明はすべて、OpenAIの公式発表ページ、System Card、API Changelogに公表された内容です。当サイトはGPT-5.5 Instantを実際に使用・検証しておらず、契約・購入・投資に関する助言も行いません。
2026年AIニュース総まとめ:1月から9月までの重要動向と実生活への応用2026年AIニュース総まとめ:1月から9月までの重要動向と実生活への応用2026年1月から9月までの重要AIニュースを月別に整理し、5言語の詳細解説へリンク。モデル、業務ツール、創作、コスト、透明性まで、背景、実生活での用途、利用制限を解説。記事全文を読む
Gemini 3.8 LiveとExtended Thinking:新しい音声モデル、あなたのアカウントは使えるかGemini 3.8 LiveとExtended Thinking:新しい音声モデル、あなたのアカウントは使えるか2026年9月15日、Googleは音声対話モデル「Gemini 3.8 Live」と「Gemini 3.8 Live Extended Thinking」の2機種を発表しました。本稿はGoogle公式の発表文、開発者向け記事、モデルカード、料金ページをもとに、開発者・企業・一般ユーザー・Workspace加入者それぞれが使える範囲、料金の仕組み、モデルカードに記された知識のカットオフ日、そして公式が明記していない提供地域を整理します。記事全文を読む
同じテーマの記事
ライフスタイル
GPT-5.5が拓く多段階ワークフロー:曖昧な要件を検収可能な成果物へ
2026年のOpenAIによるGPT-5.5発表の背景を振り返り、曖昧な長期タスクを検収可能な成果物へと分解し、明確な人間による確認ポイントと品質指標を確立する方法を考察します。
ライフスタイル
Gemini 3.8 LiveとExtended Thinking:新しい音声モデル、あなたのアカウントは使えるか
2026年9月15日、Googleは音声対話モデル「Gemini 3.8 Live」と「Gemini 3.8 Live Extended Thinking」の2機種を発表しました。本稿はGoogle公式の発表文、開発者向け記事、モデルカード、料金ページをもとに、開発者・企業・一般ユーザー・Workspace加入者それぞれが使える範囲、料金の仕組み、モデルカードに記された知識のカットオフ日、そして公式が明記していない提供地域を整理します。
ライフスタイル
ChatGPT広告がセルフサーブ購入に対応:OpenAIが5月に発表したツールと課金・ターゲティングの仕組み
2026年5月5日、OpenAIはベータ版のセルフサーブ広告管理ツール、クリック課金(CPC)入札、計測ツールの拡充により、ChatGPT広告の購入方法を拡大すると発表しました。本記事は発表原文と開発者ドキュメントに基づき、広告アカウント・キャンペーン・広告グループ・広告の4階層構造、3種類のキャンペーン目的の課金方法、入札戦略の選び方、地域・プラットフォーム・context hintsによるターゲティングの仕組みを説明し、確認当日に読んだドキュメントのバージョンと5月5日の発表との違いも記します。
ライフスタイル
NVIDIA、DGX Spark 64GB版を発表:10月23日発売、価格は4,999ドルから、2台接続で128GBに
NVIDIAは2026年10月2日、パーソナルAIコンピューター「DGX Spark」に、より手頃な64GBメモリ版を追加すると発表した。10月23日からAcer、ASUSなど6社が供給し、主な対象は自分のマシンでAIモデルを実行したい開発者や研究者。NVIDIAが公表した仕様、2台接続に関する説明、一般読者にとっての意味を整理する。
この記事を引用している記事
最新の旅の情報・ガイド

ガイド東京
東京ではどのエリアに泊まる?新宿・上野・東京駅・渋谷・浅草・池袋・銀座の七エリア比較。空港アクセス、宿泊税、荷物配送も解説
東京ではどのエリアに泊まる?新宿、上野、東京駅、渋谷、浅草、池袋、銀座の七エリアを同じ基準で比較。成田・羽田空港からのアクセス、利用できる路線、周辺にあるもの、街の雰囲気、向いている人を、比較表と山手線の概略図とともに紹介します。2026年9月に確認した東京都の宿泊税(2027年4月から3%)と、空港宅急便で荷物を送る際のルールも解説します。
- 予算
- ホテル

ガイド東京
東京の交通パスの選び方:Suica/Welcome Suica、Tokyo Subway Ticket、JR Passは買うべき?
初めての東京では、まず一人一枚ICカードで都度払い(Welcome Suicaはデポジット不要、有効期間28日)。一日に地下鉄へ4回以上乗るならTokyo Subway Ticketの72時間券2,000円を追加し、関西へ行かず東京だけならJR Passは必ず割高です。TOURIST PASMO、iPhoneのSuica、東京メトロ一日乗車券で乗れる路線・乗れない路線を決定チャートで比較。価格は2026年9月に確認。
- 交通
- 予算

ガイド東京
東京ディズニーランド・シー攻略:チケット料金、ファンタジースプリングス、ディズニー・プレミアアクセス(DPA)とスタンバイパスの使い方、初めてならどちらを選ぶ?
東京ディズニーの一日パスポートは変動価格制で、2026 年 9 月は平日の多くが 9,900 円、週末が 10,900 円。公式サイトでは毎日 14:00 に二か月後の同日分を発売します。無料のプライオリティパスは公式サイトのサービス一覧に載っておらず、待ち時間を短縮できるのは有料のディズニー・プレミアアクセス(一人一回 1,000~3,500 円)のみ。運営時間、25 周年イベント、スタンバイパス、エントリー受付、ファンタジースプリングスの利用方法、初回にランドとシーのどちらを選ぶかも解説。2026 年 9 月に公式サイトで確認しました。
- モデルコース
- 家族向け