Favicon02

ChatGPT Images 2.5:特色與圖片模型比較

ChatGPT Images 2.5 有哪些特色?一次看懂主體保留、局部修改、Sketch 草圖,以及與 Nano Banana、Midjourney、FLUX、Adobe Firefly 的差異,附商品圖提示詞與選用方法。

ChatGPT Images 2.5 是 OpenAI 在 2026 年 9 月 8 日公布的圖片生成與編輯更新。它最值得注意的進步,是提高參考照片的主體辨識度、局部修改的準確性,以及反覆改稿時的一致性;OpenAI 也表示,生成延遲相較 Images 2.0 最多降低 50%。這是官方比較前代的說法,不能直接推論它比所有圖片模型都快。〔OpenAI 更新公告〕

對行銷人、內容創作者或小型商家來說,評估圖片工具時,可以多問一個問題:第一張圖做出來後,能不能按照要求繼續修改?例如換背景時保留商品標籤,修改標題後保留版面,或讓同一個角色出現在不同場景。這些工作比「生成一張漂亮的圖」更接近日常需求。

以下依 2026 年 9 月 9 日查核的官方文件,說明 Images 2.5 的特色,並比較 Nano Banana、Midjourney、FLUX 與 Adobe Firefly。比較著重已公開的功能與工作方式;文中的選用方向是依任務提出的建議,沒有把官方展示當成跨模型實測排名。


ChatGPT Images 2.5 是什麼?先分清楚功能與模型

ChatGPT Images 是在 ChatGPT 裡生成與修改圖片的功能。你可以描述想畫的內容,也可以上傳照片,再用文字要求它更換背景、增減物件或調整風格。Images 2.5 是這套圖片能力的更新名稱,不是一般聊天模型的版本號。剛接觸 ChatGPT 的讀者,可以搭配ChatGPT 中文入門教學,先熟悉上傳檔案與對話操作。

需要把生圖接進網站或公司流程時,才會進一步碰到 API。這次 OpenAI 提供兩個 API 模型:GPT-Image-2.5 Flare 偏向快速、日常的高品質生圖;GPT-Image-2.5 Sunburst 偏向更重視修改精準度的工作。正式模型識別碼分別是 gpt-image-2.5-flaregpt-image-2.5-sunburst。一般讀者不需要先懂 API,才能在 ChatGPT 裡做圖。〔Flare 文件〕〔Sunburst 文件〕


Images 2.5 的特色:讓修改更接近原本的要求

依 OpenAI 的發布說明,這次模型更新可歸納成四個方向:參考照片中的人物與寵物更容易保留原本特徵;局部修改更能維持其餘細節;多輪編輯更容易延續先前修改;光線、材質、複雜構圖與風格遵循也有所改善。速度方面,官方的「最多降低 50% 延遲」有比較基準,不代表每張圖片都只要原來一半時間。〔特色與速度基準〕

把這些能力放進一個商品情境會比較好懂。假設你有一張保溫杯照片,想做三張不同季節的廣告圖,驗收時至少有三件事:杯身比例有沒有改變、商標與標籤是否保留,以及背景變化是否符合指定場景。背景漂亮,只回答了其中一部分。

另一種情況是活動海報。第一輪先調構圖,第二輪改標題,第三輪修改背景色;如果每次更改都讓已確認的元素走樣,就會增加重做成本。因此,Images 2.5 所強調的持續編輯能力,值得用自己的同一份素材測試。這裡的商品與海報是測試情境示例,並非本文已完成的實測結果。

使用時仍應逐輪核對。OpenAI 的操作說明明確提醒:選取範圍不一定精準,修改可能延伸到選取區域以外。「更能保留原圖」應理解為改進方向,不能當成把其他像素全部鎖住的保證。〔圖片編輯限制〕

AI 改圖的三個驗收面向:主體保留、局部修改與持續編輯
AI 改圖的三個驗收面向:主體保留、局部修改與持續編輯。

Sketch、範本與圖片註解,改變的是操作方式

除了模型能力,這次也增加更直覺的創作入口。Sketch 讓草圖成為構圖參考;範本提供海報等常見格式的起點;圖片註解則能幫助你指出需要修改的位置。模型負責理解與生成,這些介面功能負責讓需求更容易表達,兩者要分開看。

以 Sketch 為例,若你希望左邊放商品、右邊留標題,可以畫出大致位置,再補充材質與風格。依目前 Help Center 的操作說明,Sketch 步驟是針對 ChatGPT 行動版:在輸入區打 @、選 Sketch、畫草圖,再加文字描述。範本則可從 Images 的 Templates 進入,但目前尚未提供於 Work mode;各功能不宜一律解讀為所有介面完全相同。〔Sketch 與範本操作〕

這對不習慣寫長提示詞的人很有幫助。文字適合說明目的、風格與不能改的條件,草圖適合表達左右位置、大小比例和留白。兩種資訊一起提供,通常比反覆描述「再往左一點」更容易讓需求具體化。



與其他圖片模型相比,差異在哪裡?

下面列的是值得比較的功能方向,不是畫質名次。今日的圖片模型已有不少重疊能力,不能再簡化成「ChatGPT 才能改圖,其他工具只能畫新圖」。真正要比的是:你的工作需要哪種控制方式,以及做完後要交給哪套工具繼續處理。

工具/模型 官方功能所呈現的重點 可優先比較的任務
ChatGPT Images 2.5 對話改圖、主體保留、多輪修改;另有 Sketch 與範本入口 已有參考圖,需要持續溝通與改稿
Nano Banana 2 Gemini 3.1 Flash Image;結合搜尋資訊、文字與快速編輯 需要特定真實主題、文字本地化的圖像
Midjourney V8.2 風格與個人化;搭配 Edit Model 修改及參考圖控制 探索品牌調性、概念視覺與多種美術方向
FLUX.2 家族 多參考圖編輯、多種模型定位;部分版本可本地部署 整合素材、串接批量流程或自建生圖系統
Adobe Firefly/Image 5 Adobe 自有模型與合作模型選擇,銜接設計工具 已有 Photoshop 等設計流程,需要繼續精修

各列依下方官方來源整理;右欄為本文依功能提出的試用方向,同一任務可能有多個合適選項。


與 Nano Banana 相比:兩者都要測試編輯與文字能力

Google 的 Nano Banana 2 正式名稱是 Gemini 3.1 Flash Image。它強調 Flash 速度、搜尋資訊與圖片輔助、圖中文字的生成及翻譯,以及跨編輯的主體一致性。Google 同時保留 Nano Banana Pro 的定位,因此比較時要寫清楚到底用了哪個版本,不能只寫「Gemini」。〔Google:Nano Banana 2〕

如果工作是做一張帶繁體中文的商品海報,可以讓 Images 2.5 與 Nano Banana 使用相同照片、文案和修改順序,再看哪個更接近要求。檢查應包含字形、文字內容、商品保留程度與總修改次數;只選各自最漂亮的一張,容易忽略實際製作成本。想了解 Google 端的入口,可參考Gemini 功能與使用教學


與 Midjourney 相比:風格探索仍重要,也已能用文字改圖

截至查核日,Midjourney 官方文件列出的預設版本是 V8.2,更新重點包括美感、影像品質與 Personalization,也就是依使用者偏好調整視覺方向。把 Midjourney 只當成早期的文字生圖工具,會漏掉目前的編輯能力。〔Midjourney 版本文件〕

它的 Edit Model 已支援文字指令修改、最多四張參考圖,以及局部重繪與向外擴圖。因此,如果你重視藝術方向、風格參考與個人化,可以把 Midjourney 納入測試;如果已有詳細改稿需求,也應比較兩者在同一份素材上的保留程度,而不是先假設其中一方不能編輯。〔Midjourney Edit Model〕


與 FLUX 相比:自建流程與部署彈性是另一個評估面向

FLUX.2 是 Black Forest Labs 的圖片模型家族。官方提供不同定位的型號;多圖編輯文件列出 API 最多八張參考圖、Playground 最多十張,不能混寫成每個入口都支援十張。需要把不同照片裡的物件組合進同一畫面時,這類參考圖控制值得納入評估。〔FLUX.2 編輯文件〕

另一項差異是部署方式:FLUX.2 的部分 kleindev 版本可在自己的硬體上執行。對開發團隊而言,這會影響系統建置方式;但必須分別確認型號、硬體與授權條件,不能把整個 FLUX 家族概括成免費商用或都能本地運作。〔FLUX.2 模型家族〕


與 Adobe Firefly 相比:先確認你比較的是平台還是模型

Firefly 同時涉及 Adobe 的創作平台與自有模型。Adobe 的生圖說明列出 Firefly Image 5,也允許選擇合作模型;Photoshop 的生圖流程同樣提供模型選擇。也就是說,「在 Firefly 裡生成」不足以告訴我們是哪個模型做的。〔Firefly 模型選擇〕〔Photoshop 生圖流程〕

如果設計師原本就會接手修改圖層、文字與素材,評估時可以把「生成後還要花多少時間整理」算進去。對這類工作,模型輸出的美感與後續編輯工具是否順手,都會影響最後的交付成本。

如果需求還包含把圖片接成短影片,則可以另外閱讀Grok Imagine 生圖與影片教學。靜態圖片的修改品質和影片生成能力,適合分成兩個任務評估。

依反覆改稿、風格探索、正式製作與系統整合選擇圖片工具
依反覆改稿、風格探索、正式製作與系統整合選擇圖片工具。

ChatGPT Images 2.5 怎麼用?從一張商品圖開始

第一次測試不必追求複雜場景。選一張主體清楚的照片,先把用途、要改的部分與要保留的部分寫出來。下面是一組可自行改寫的示範提示詞,不是本文的實測紀錄。

請以我上傳的保溫杯照片製作一張 4:3 商品情境圖。把背景改成自然採光的木質辦公桌,杯子放在畫面左側,右側保留約三分之一空間,之後我要自行加上廣告文字。請保留原照片的杯身形狀、杯蓋結構、顏色與商標,不新增文字。

第一輪完成後,先核對杯子是否正確,再提出一個範圍明確的修改:

沿用上一張圖片的構圖與保溫杯,只把背景中的盆栽移除。請保留杯子位置、右側留白、桌面材質與光線方向。

這種寫法把「要改什麼」和「要留什麼」放在同一個指令裡,比「再精緻一點」更容易驗收。如果主體已經走樣,回到原始參考照片重新指定保留條件,通常比沿著錯誤版本一直修改更容易追查問題。

實際流程可以分成四步:提供清楚素材、列出保留條件、逐輪提出修改、最後核對細節。需要繁體中文時,把文案逐字列出;字很多或必須精準排版的成品,則可先保留空白,再用設計工具排字。這是製作上的選擇,不代表模型完全不能生成中文。

AI 改圖四步驟:提供素材、列出保留條件、分輪修改與核對成品
AI 改圖四步驟:提供素材、列出保留條件、分輪修改與核對成品。


免費能用嗎?費用與限制要怎麼看?

OpenAI Help Center 表示,ChatGPT Images 提供於所有方案;Images with thinking 則列為 Plus、Pro、Business 可用,Enterprise 與 Edu 尚待推出。「所有方案可用」只說明可用資格,沒有承諾每個帳號的額度、速度與功能完全一致。〔方案可用性〕

如果使用 API,應看 API 模型的計價,而不是拿 ChatGPT 月費除以想做的圖片張數。官方模型頁以文字輸入、圖片輸入與圖片輸出 token 列價;實際單張費用還會受到請求內容與輸出設定影響。因此,想比較成本,最好固定素材與需求,再記錄做到可用版本的總費用。〔Flare 計價欄位〕〔Sunburst 計價欄位〕

此外,生圖工具仍可能在文字、跨張一致性與精準構圖上出錯。圖中文字看起來順眼,不表示日期、數字或繁體字形都正確;一張資訊圖的視覺完整,也不能代替內容查證。對商品圖而言,標誌、包裝與規格尤其適合拿原始素材逐項對照。〔OpenAI 圖片生成限制〕


選擇圖片模型,從修改需求開始

Images 2.5 值得關注的方向,是讓參考素材更容易延續到後續修改。對經常做商品圖、人物素材或反覆改海報的人來說,可以從「同一張圖連改三次」開始測試,觀察每次修改後,原本要保留的內容是否還在。

而在不同工具之間,最有用的比較方式是固定同一份需求。先列出必須保留的條件,再檢查修改結果、重做次數與後續排版時間。當比較基準清楚,你就比較容易找到適合自己工作的工具,也能知道哪些部分仍需要人來完成。


ChatGPT Images 2.5 常見問題

Images 2.5 就是 GPT-6 嗎?

不是。Images 2.5 指圖片生成與編輯更新;GPT-6 是另一套通用模型命名。開發者使用這次圖片 API 時,應依官方文件選擇 Flare 或 Sunburst 的模型識別碼,不要把聊天模型名稱直接當成圖片模型。〔圖片 API 型號〕

Images 2.5 一定比 Nano Banana 或 Midjourney 好嗎?

不能只靠版本號判斷。不同模型與介面各有控制方式;若要知道哪個符合需求,應使用相同參考圖、提示詞與修改次序,檢查主體、文字和構圖。本文比較官方功能,沒有提供跨模型勝負實測。

可以完全依靠 AI 完成正式海報嗎?

可以用它製作候選畫面,但正式交付前仍應校對文字、日期、標誌和版面。如果要求可編輯文字或精準排版,保留原始素材並接續設計工具會比較容易維護;圖片生成能力提升,不會自動等於交付一份可編輯的設計原始檔。

Frank Chiu
Frank Chiu

SEO/GEO 顧問、行銷顧問。協助本地企業與跨國企業導入 SEO、GEO 跟行銷方案,包括:雀巢、凱基銀行、大人學、居家先生、IKEA、vocus 等。

訂閱電子報