生活分享
AI 圖片工具總覽:ChatGPT、Nano Banana、Midjourney、Flux 怎麼選
給沒用過 AI 生圖的人的地圖:ChatGPT 的圖片生成、Gemini 的 Nano Banana、Midjourney 與可下載的 FLUX 四條路線,各自的入口、免費層限制、付費月費、官方文件寫的參考圖與局部修改能力、輸出的商用授權原文與 AI 標示方式,最後用一張決策樹把用途對應到工具。價格與規格為 2026 年 9 月 14 日當天查官網的結果。
更新日期: 閱讀時間約 7 分鐘

第一次要用 AI人工智慧(Artificial Intelligence)是什麼人工智慧是涵蓋多種技術與應用的總稱,不等於聊天機器人,也不必一定會產生文字。本文從 OECD 的系統定義出發,以照片分類和社區資源推薦為例,說明輸入、推導、輸出與人的目標如何連結,整理它與機器學習、深度學習和生成式 AI 的關係。讀完能用具體問題判斷一項 AI 功能在做什麼,並分辨能力、自治程度與可信度。閱讀全文 生圖,該從哪一個開始?答案是先看你要它做什麼,再看免費層給你什麼。目前的主流是四條路線:ChatGPT 的圖片生成、Gemini 的 Nano Banana、Midjourney,以及 FLUX 這類可以下載到自己電腦跑的開放權重開放權重(Open Weights):能下載模型,還要確認什麼開放權重通常表示模型的已訓練參數可取得,讓使用者有機會自行部署或調整,但不等於訓練資料與程式都公開。本文用本機筆記摘要示範權重、架構、tokenizer 和推論程式的分工,區分下載、可修改、商業使用與完整開源,也解釋為什麼本機執行不自動保證隱私。讀完能檢查模型版本、授權文件、硬體需求和來源完整性。閱讀全文模型。差別不在誰畫得好看,而在免費層的限制、能不能改你手上的圖、輸出能不能拿去賣。
這篇把四條路線的入口、月費、官方文件寫的能力與商用授權整理成一張地圖,數字都是 2026 年 9 月 14 日當天查官網的結果,查不到的寫「以官網為準」。最後有一張決策樹把用途對應到工具;操作步驟站上已有專篇,這裡不重複。
四條路線各是什麼
ChatGPT 的圖片生成長在對話裡:描述你要的圖,生成完可以繼續在同一段對話裡要求修改,手機上也能先畫草圖再叫它變成成品。官方在 2026 年 9 月 8 日換上 ChatGPT Images 2.5,發布文說它的細節更銳利、編輯更精準,生成延遲比 Images 2.0 最多降低 50%。
ChatGPT Images 2.5:圖片生成、局部修改與草圖功能更新ChatGPT Images 2.5:圖片生成、局部修改與草圖功能更新OpenAI 在 2026 年 9 月 8 日發布 ChatGPT Images 2.5,主打更細緻的圖片、局部編輯與多輪修改,並介紹 Sketch、模板和圖片註解功能。這篇從海報、旅行照片與社群素材出發,說明如何準備素材、保留不想改的部分、核對細節,以及分清楚消費者圖片工具和開發者 API 模型,避免把生成速度與可用性宣傳當成個人實測。閱讀全文
Gemini 的圖片功能叫「Create images」,主力模型是 Nano Banana 2(代號 gemini-3.1-flash-image),上面有走複雜任務的 Nano Banana Pro,下面有速度取向的 Nano Banana 2 Lite。官方介紹頁把「把參考照片的材質、顏色或風格套到你的主體上」與「做出字清楚的標誌與海報」列為特色。
Midjourney 是獨立的訂閱服務,入口是官方網站的網頁版與 Discord,現行版本 V8.2。文件寫在預設的 1:1 比例下,HD 圖是 2048 乘 2048 像素、SD 圖是 1024 乘 1024 像素。
第四條是開放權重:黑森林實驗室(Black Forest Labs)的 FLUX 與 Stability AI 的 Stable Diffusion 都公開模型權重,你可以呼叫官方 API,也可以下載到自己的電腦跑。官方模型頁列出 FLUX.2 klein 的 4B 版本需要 8.4 GB 顯示記憶體、9B 版本需要 19.6 GB。
ChatGPT 畫圖教學:圖片生成、修圖與風格提示詞怎麼寫ChatGPT 畫圖教學:圖片生成、修圖與風格提示詞怎麼寫ChatGPT 的畫圖 AI 叫 ChatGPT Images,2026 年 9 月更新到 Images 2.5,免費版也能用。這篇依 OpenAI 官網說明,教你從輸入框、Images 頁面與 Sketch 畫圖,把提示詞拆成主體、風格、構圖與比例、文字四個部件,附五個可直接貼的提示詞,上傳照片後怎麼講換背景、去物件,同一角色畫多張,不能畫的真人與版權角色,以及 C2PA 標示與商用規定。閱讀全文
Gemini 圖片生成與修圖:提示詞與參考圖Gemini 圖片生成與修圖:提示詞與參考圖把 Gemini 當修圖 AI:這篇用一張自製杯子商品概念圖,練習圖片生成、參考圖與局部修改。學完可以把主體、背景、構圖和要保留的細節寫清楚,並用前後對照檢查修改是否符合需求。本篇的提示詞與預期結果是教學範例,沒有冒充實際由 Gemini 生成的作品。閱讀全文
本機跑 Stable Diffusion 與 Flux:ComfyUI 入門本機跑 Stable Diffusion 與 Flux:ComfyUI 入門ComfyUI 是一套開源的節點式生成引擎,可以在自己的電腦上跑 Stable Diffusion 與 Flux。這篇照官方文件整理三種安裝方式與系統需求、模型檔要放進哪個子資料夾、怎麼載入官方範本完成第一張圖,以及每個節點在做什麼;並逐版本核對 Flux 與 Stable Diffusion 的授權、商用條件與官方寫的顯示記憶體需求。閱讀全文
免費層各給你什麼
ChatGPT 的免費方案能生圖,定價頁把它寫成「有限且較慢的圖片生成」,而「帶思考的圖片生成」免費與 Go 都沒有,要 Plus 或 Pro。免費方案說明頁只寫圖片生成有獨立於聊天的用量上限、到了會跳通知,沒有公布每天幾張,實際額度以官網為準。
Gemini 的免費帳號也能生圖,Google 同樣沒有公布張數,方案頁只寫倍數:Google AI Plus 是標準用量的 2 倍、AI Pro 4 倍、AI Ultra 是 AI Pro 的 5 倍或 20 倍。官方也註明圖片生成需求很高、上限可能經常調整,而且每天重置。
Midjourney 沒有免費層,文件寫得很直接:Discord 與官方網站目前都沒有免費試用,只有 niji journey 的 iOS 與 Android App 有限定試用,想試只能先付一個月。
自己下載模型跑是另一種免費:軟體與權重不用錢,成本換成顯示卡與電費,授權要自己讀。
付費方案與月費
下表 Google 用台灣頁的新台幣定價,其他三家只有美元。
| 工具 | 免費層 | 付費方案(每月) | 官方寫的特色 |
|---|---|---|---|
| ChatGPT Images 2.5 | 有,官網寫「有限且較慢」,未公布張數 | Plus 20 美元;Pro 從 100 起(200 方案暫停申購);Go 以官網為準 | 對話中改圖、圈選局部重畫、範本與草圖生圖 |
| Gemini Nano Banana 2 | 有,未公布張數 | AI Plus NT$165;AI Pro NT$650;AI Ultra 從 NT$3,300 起 | 預設 1K、可指定 2K 與 4K,10 種比例,多張參考圖 |
| Midjourney V8.2 | 無;只有 niji journey App 有限定試用 | Basic 10、Standard 30、Pro 60、Mega 120 美元(年繳八折) | Fast GPU 每月 3.3 至 60 小時,Editor 局部重畫與外擴 |
| FLUX 與 Stable Diffusion | 權重可免費下載,授權依模型而定 | 官方 API 依用量計費;商用授權另購 | 可離線執行、可微調,klein 4B 為 Apache 2.0 |
兩個容易誤會的地方:ChatGPT 比 Plus 便宜的 Go 方案含圖片生成、額度比免費高,但說明頁沒有列月費;Pro 的 200 美元方案自 2026 年 9 月 10 日起暫停新申購。Midjourney 年繳打八折,Basic 一年 96 美元、Mega 一年 1,152 美元,Standard 以上在 Relax 模式產圖不限張數,Stealth 模式只有 Pro 與 Mega 有。
參考圖、局部修改與文字
參考圖上 Gemini 的文件列得最細:Nano Banana 2 可以吃到 10 個物件與 4 個角色,3 張風格參考要用 Nano Banana Pro。Midjourney 的 Edit Model 最多掛 4 張。ChatGPT 則是上傳既有圖片再描述要改什麼。
局部修改三家都有。ChatGPT 用選取工具圈出要改的區域再描述,或直接在對話裡講;Midjourney 的 Editor 用同一個 Edit Model 做局部重畫與往外擴圖;Gemini 的文件把做法寫成語意遮罩與局部重繪。
輸出規格是 Gemini 寫得最清楚:預設 1K,可指定 2K 與 4K,比例有 1:1、3:2、2:3、3:4、4:3、4:5、5:4、9:16、16:9、21:9 這十種。Midjourney 用比例參數模型參數(Model Parameters)是什麼模型參數是訓練時調整、用來把輸入轉成輸出的數值,例如權重與偏差。本文用簡單算式示例說明參數如何影響預測,區分模型參數、訓練超參數、提示詞與生成設定,並解釋參數量、數值精度和啟用參數為何是不同指標。讀完能更準確閱讀模型規格,理解參數增加不等於知識逐條增加,也不代表每次聊天都在重新訓練模型。閱讀全文指定,預設 1:1 且不接受小數。ChatGPT 只寫可以換比例重新生成,沒有公布像素對照表。
- 同一個人或商品換場景:先看參考圖上限,Nano Banana 2 到 10 個物件、Midjourney 到 4 張。
- 圖上要放清楚的字:Google 把它列為 Nano Banana 2 的特色,可先從這條試。
- 要一整組風格一致的圖:用風格參考圖比在提示詞裡堆形容詞穩定。
- 素材完全不能上傳:只有把模型裝在自己電腦這條路能滿足。
文字生圖(Text-to-Image)是什麼:把描述轉成可挑選的影像文字生圖(Text-to-Image)是什麼:把描述轉成可挑選的影像文字生圖就是生圖 AI 在做的事:把主體、場景和風格描述轉成影像,但提示詞不是每個像素都會遵守的施工圖。本文以校園閱讀角提案為例,示範如何寫出可驗收的要求、比較候選圖與處理不合格細節,並區分文字生圖、圖片編修和擴散模型,說明負面提示與引導設定的適用界線,讓生成素材能接進實際設計工作。閱讀全文
擴散模型(Diffusion Model)是什麼:從雜訊逐步生成影像擴散模型(Diffusion Model)是什麼:從雜訊逐步生成影像擴散模型先學習不同雜訊程度下的去噪關係,再透過反覆更新產生新內容。本文用植物展覽海報的示意案例,說明訓練與生成為何方向不同、文字條件如何參與,以及步數、種子和潛在空間各自控制什麼,幫你分清影像逐漸清晰、畫面符合要求與內容真實可信之間的差別,也釐清擴散模型和文字生圖的關係。閱讀全文
輸出的商用權與 AI 標示
OpenAI 的常見問題寫得最白:在內容政策與條款的前提下,你擁有你用 ChatGPT 產生的輸出,包含重製、販售與製成商品的權利,而且不分免費或付費方案。
Midjourney 的文件寫你擁有你建立的所有圖片與影片,取消訂閱也一樣,但有兩個例外:放大別人建立的圖仍屬於原作者;年營收超過 100 萬美元的公司要用 Pro 或 Mega 方案,才能把圖用在公司的商業用途上。
開放權重要看授權。官方模型頁寫 FLUX.2 klein 的 4B 版本走 Apache 2.0、可以商用,9B 版本走 FLUX 非商業授權;其他模型的授權各不相同,下載前先看模型卡的 license 欄位,不要假設開源等於可商用。Google 官方頁面沒有寫一句「你擁有生成的圖片」,商用條件以其服務條款為準。
標示三家都做,形式不同。OpenAI 說支援的圖片同時含 C2PA 內容憑證內容憑證(Content Credentials):查來源歷程,不替真假背書內容憑證以可驗證的來源資訊記錄影像等內容的製作與編輯歷程,C2PA 提供其技術規範。本文用活動照片的裁切與發布示範簽署、內容綁定和驗證,說明有效、失效與沒有憑證各代表什麼,也區分來源憑證、水印和真假判斷。讀完能檢查簽署者、記錄範圍與缺失資訊,避免把有效憑證當成事件真實的保證,或把無憑證內容直接判為偽造。閱讀全文與 SynthID 浮水印,並提供官方驗證頁。Gemini 產生或編輯的所有媒體都含隱形的 SynthID,看得見的浮水印可在設定裡開關,在印度、南韓、越南要有 AI Ultra 訂閱才看得到這個設定。Midjourney 在每個檔案裡藏一個 ID 標籤,但官方承認截圖、編輯與多數社群網站會把它移除。
AI 生成圖片的版權:台灣法規與商用注意事項AI 生成圖片的版權:台灣法規與商用注意事項智慧財產局的函釋怎麼看 AI 生成圖片:關鍵在創作過程有沒有人類實際的創意投入,完全由演算法獨立完成的產出無法享有著作權。這篇整理智財局兩則電子郵件函釋與著作權法第 3 條、第 10 條、第 10 條之 1 原文,對照 OpenAI、Google、Midjourney、Stability AI 等五家平台條款怎麼寫輸出所有權與商用條件,並給從生成到商用的 5 個檢查關卡。不做法律結論。閱讀全文
AI 圖片的浮水印與 C2PA:怎麼標示、怎麼辨識AI 圖片的浮水印與 C2PA:怎麼標示、怎麼辨識AI 圖片的標示分成看得見的浮水印與看不見的訊號:SynthID 這類隱形浮水印、C2PA 內容憑證與 IPTC 中繼資料。這篇照 OpenAI、Google、Adobe 與 Meta 官方說明整理各家的做法,示範用 Verify、Inspect 與 Gemini 三個入口查一張圖,說明截圖與轉檔為什麼會讓標示消失,以及自己發布 AI 圖片時可以怎麼標。閱讀全文
怎麼選:從用途回推工具
把用途分成四類就好決定:要一張說明用的圖、要改手上的照片、要一整組風格一致的作品、素材不能離開電腦。前兩類用你已經在付錢的聊天工具最省事;第三類是 Midjourney 的主場,代價是沒有免費層;第四類只有開放權重能滿足。
閱讀完整文字說明
一張三列的決策樹。左欄是用途,中欄是先試哪一個工具,右欄是要注意的地方。第一列:要一張說明用的圖或改手上的照片,先試 ChatGPT Images 2.5 或 Gemini Nano Banana 2,兩家都有免費層但官網未公布每天張數。第二列:要一整組風格一致的作品,用 Midjourney V8.2,它沒有免費層,Basic 方案月費 10 美元。第三列:素材不能上傳、要在自己電腦處理,用 FLUX.2 klein 離線跑,4B 版本走 Apache 2.0 授權,9B 版本為 FLUX 非商業授權。底部提醒不論走哪一條路都要先確認兩件事:商用權方面,OpenAI 寫你擁有 ChatGPT 的輸出,Midjourney 規定年營收 100 萬美元的公司要用 Pro 或 Mega 方案;標示方面,OpenAI 的圖片含 C2PA 與 SynthID,Gemini 全部含 SynthID,Midjourney 在檔案裡藏一個 ID 標籤。
Midjourney 入門:網頁版、參數與訂閱Midjourney 入門:網頁版、參數與訂閱Midjourney 在網頁版與 Discord 都沒有免費試用,要先訂閱才畫得到第一張圖。這篇依 2026 年 9 月當天的官方文件,寫清楚註冊方式、Basic 到 Mega 四個方案的月費年費與 Fast GPU 時數、Fast 與 Relax 與 Turbo 各吃多少分鐘、拿到四張圖後怎麼用 Vary、Upscale、Pan、Zoom Out 修改與下載、常用參數寫法、預設版本 V8.2,以及條款裡的所有權、年營收 100 萬美元門檻與 Stealth 屬於哪個方案。閱讀全文
AI 繪圖風格提示參考:50 種風格描述AI 繪圖風格提示參考:50 種風格描述把風格變成可以查的詞:媒材、攝影、設計、時代流派、光線氛圍五類共 50 條,每條給中英文描述詞與適合的用途,每類再附三段可直接貼上的提示詞。文中也說明風格詞該擺在提示詞的哪一段、為什麼用通用美術與攝影術語而不是創作者的名字,以及同一句話在不同工具結果不同時怎麼自己比對。描述詞依 Midjourney、Google 與 OpenAI 的官方提示詞說明整理,撰稿環境未實際生圖。閱讀全文
同主題延伸閱讀
生活分享
本機跑 Stable Diffusion 與 Flux:ComfyUI 入門
ComfyUI 是一套開源的節點式生成引擎,可以在自己的電腦上跑 Stable Diffusion 與 Flux。這篇照官方文件整理三種安裝方式與系統需求、模型檔要放進哪個子資料夾、怎麼載入官方範本完成第一張圖,以及每個節點在做什麼;並逐版本核對 Flux 與 Stable Diffusion 的授權、商用條件與官方寫的顯示記憶體需求。
生活分享
MiniMax 語音合成:中文配音、有聲書與影片旁白
把 MiniMax 的 Speech 系列當配音 AI,把文字變成音檔:網頁版與 API 兩條路的最小步驟、332 個系統音色怎麼挑、情緒與語速停頓的參數範圍、輸出格式與取樣率、每百萬字元的費用與免費額度、聲音複製要通過的驗證與授權規則,以及有聲書的分段工作流。規格與價格以官網 2026 年 9 月 14 日的頁面為準。
生活分享
MiniMax 音樂生成怎麼用:從一段描述與歌詞做出一首歌
MiniMax 的作曲 AI(音樂生成)在 2026 年換了入口:付費 API 自 8 月 20 日起不再開放給新使用者,官方把一般使用者指向 MiniMax Audio、開發者指向 Hugging Face 上的開源權重 MiniMax Music 3。這篇照官網整理提示詞與歌詞怎麼寫、14 種段落標記、長度與音檔格式、費用與免費額度、API 最小呼叫範例,以及輸出音檔的商用與著作權。
生活分享
MiniMax 海螺影片生成教學:從註冊到下載第一支 AI 影片
海螺 AI(Hailuo AI)是 MiniMax 的影片生成產品,網頁版與 iOS、Android App 都能用。這篇帶台灣使用者走完第一次:入口與登入方式、免費版的浮水印與排隊限制、點數與訂閱方案怎麼算、文生影片與圖生影片的操作順序、提示詞的四段寫法,以及官方公布的時長與解析度規格,最後說明服務條款怎麼寫生成內容的授權與商用。
引用本文的文章
最新旅遊情報攻略

情報
2026 韓國楓葉預測:雪嶽山 10 月 20 日、首爾近郊 10 月底、內藏山與漢拏山 11 月上旬
韓國山林廳 2026 年 9 月 22 日公布的楓紅高峰預測:雪嶽山 10 月 20 日,春川、國立樹木園到首爾植物園落在 10 月 28 日到 11 月 2 日,內藏山 11 月 4 日、漢拏山 11 月 6 日,整體比最近 5 年晚約 0.8 天。整理各地楓樹與銀杏的預測日、首爾出發怎麼排,以及出發前去哪裡看即時楓況。2026 年 10 月查證。
- 季節活動
- 自然
- 觀景

攻略胡志明市
胡志明市到頭頓一日遊:白藤碼頭搭高速船、船票與班次,下船就是胡梅纜車與耶穌基督像
人在胡志明市挪一天去頭頓看海:市中心的白藤高速船碼頭搭船,航程 120 分鐘到頭頓的胡梅碼頭,平日成人 320,000 越南盾、週末 350,000,回程末班平日 15:00。下船就是胡梅纜車站,同一條路上有白宮,小山頂上是耶穌基督像。平日一天只有兩班船,整天要從末班船倒推著排。
- 交通
- 行程範例
- 海灘

攻略沖繩
沖繩不開車攻略:單軌只到浦添,美麗海水族館要坐兩個多小時的巴士,回那霸的最後一班直達車 17:22 就開走
不租車的沖繩怎麼移動:那霸市區靠沖繩都市單軌電車(ゆいレール),那霸機場站到終點てだこ浦西 19 站、17 公里、37 分鐘,一日券 1,000 日圓;美麗海水族館有那霸機場直達的高速巴士,單程 2,000 日圓起、官方時刻表上 2 小時上下,下車後還要走 10 分鐘;古宇利島要在今帰仁村役場轉車,當天來回光坐車就六個半小時;回程的最後一班直達車 17:22 就從記念公園前開走(2026 年 9 月查證)。
- 交通
- 行程範例
- 預算
資料來源
- OpenAI 說明中心|Images in ChatGPT(ChatGPT Images 2.5 的功能、編輯與比例) · 查證日期:
- OpenAI|Introducing ChatGPT Images 2.5(發布日期與延遲改善) · 查證日期:
- OpenAI|ChatGPT 定價頁(各方案的圖片生成說明與比較表) · 查證日期:
- OpenAI 說明中心|ChatGPT Free Tier FAQ(免費層的獨立用量上限) · 查證日期:
- OpenAI 說明中心|What is ChatGPT Plus?(Plus 月費與 Pro 方案暫停公告) · 查證日期:
- OpenAI 說明中心|What is ChatGPT Go?(Go 方案的圖片生成額度說明) · 查證日期:
- OpenAI 說明中心|ChatGPT 常見問題(輸出的所有權與商用) · 查證日期:
- OpenAI 說明中心|內容來源標示:Content Credentials 與 SynthID · 查證日期:
- Google|Gemini API 圖片生成文件(模型、解析度、比例、參考圖上限、SynthID) · 查證日期:
- Google|Gemini 圖片生成介紹頁(Create images 的官方特色說明) · 查證日期:
- Google|Gemini 訂閱方案台灣頁(Google AI Plus、Pro、Ultra 的新台幣月費與用量倍數) · 查證日期:
- Google 說明中心|Gemini Apps 訂閱者的用量上限與升級(倍數說明) · 查證日期:
- Google 說明中心|管理 Gemini Apps 的浮水印設定 · 查證日期:
- Midjourney 文件|Comparing Midjourney Plans(方案月費、年費與 GPU 時數) · 查證日期:
- Midjourney 文件|Free Trials(目前沒有免費試用的官方說明) · 查證日期:
- Midjourney 文件|Using Images & Videos Commercially(所有權與年營收門檻) · 查證日期:
- Midjourney 文件|Image Size & Resolution(V8.2 的 HD 與 SD 像素) · 查證日期:
- Midjourney 文件|Edit Model(參考圖張數、局部重畫與外擴) · 查證日期:
- Midjourney 文件|Content Authenticity(檔案裡的 ID 標籤與驗證) · 查證日期:
- Black Forest Labs|FLUX.2 klein 模型頁(各變體的授權與顯示記憶體需求) · 查證日期: