想用 ChatGPT Images 2.5 做圖,又不希望已經確認的構圖在修改時被毀掉,關鍵是把流程拆開:先用 Sketch 或範本定出圖片基礎,再用留言處理局部調整,並保留版本以便隨時回退。
OpenAI 在 2026 年 9 月 8 日推出 ChatGPT Images 2.5,並逐步開放至桌面、行動裝置與網頁版的 ChatGPT、ChatGPT Work 和 Codex。OpenAI 表示,相較於 Images 2.0,這次更新提升了參考圖還原度、局部編輯能力、多次修改的一致性,並最多將生成延遲降低 50%(OpenAI)。不過,這些是相對改善,並不代表每個像素都能完全維持不變。
一張表掌握 ChatGPT Images 2.5 的實用流程
這套可重複使用的流程是:需求定稿 → 結構定位 → 建立主版本 → 局部修改 → 儲存檢查點 → 匯出。開啟 ChatGPT 後選擇 Images,再依照目前已掌握的資訊決定起手工具。
| 目前情況 | 先從哪個工具開始 | 下一步 | 核准條件 |
|---|---|---|---|
| 知道構圖,但很難用文字講清楚 | Sketch | 生成主版本圖片 | 主要物件位於正確區域 |
| 已確定成品類型,例如海報、商品周邊或產品照 | Template | 完成引導式需求填答 | 文案、風格、來源素材與格式皆已齊備 |
| 圖片大致正確 | Comment 或 Erase | 進行一項局部修改 | 指定修改正確完成,且固定元素未受影響 |
| 後續修訂開始走樣 | 先前儲存的版本 | 從最後一個乾淨狀態繼續 | 不要無止境修補已損壞的分支 |
| 內容已確認,但平台格式不同 | Resize 或 Remove BG | 匯出並檢查 | 尺寸、裁切、透明度與文字全數過關 |
OpenAI 將 Sketch、範本、圖片留言與提示詞分享列為新增功能。TechRadar 在 24 小時實測中也發現 Edit 工具列包含 Markup、Comment、Remove BG、Erase 與 Resize,Resize 提供 3:4、16:9、4:3 等預設比例(TechRadar)。由於功能仍在分批推出,實際可用的工具列可能因帳號或平台而異。
第一階段:生成前先把需求鎖定
先把需求定清楚,才能避免提示詞彼此矛盾。在要求 ChatGPT Images 2.5 製作精緻畫面前,先定義成品、畫面文字、不可變更的素材、構圖與匯出目標。
可用五行需求簡報整理:
- 成品:「一張 16:9 的線上研討會橫幅。」
- 精確文案:「AUTOMATE THE BORING WORK」和「September 24 · 10 AM PT。」
- 固定素材:「保留上傳的產品、logo 拼寫與品牌配色,不得變更。」
- 構圖:「產品放右側;標題置於左上;左下保留空白,之後要加入按鈕。」
- 驗收標準:「縮圖尺寸下仍清晰可讀;不得出現額外文字;產品不可被裁切;畫面必須有一個明確焦點。」
必須出現在畫面上的文字,請放進引號裡。與其只說「做出好看的排版」,不如明確指定標題、輔助說明與頁尾的層級。AI 生成的文字應盡量簡短;法律文字或細小註記,還是建議在傳統設計工具中補上。
位置比細節重要時,先用 Sketch
當你的難題是空間配置,例如人物要站在哪裡、產品要多大,或哪個區域必須留白,Sketch 就是合適的起點。依 OpenAI 的發布說明,行動版使用者可輸入 @ 後選取 Sketch;主介面的 Images 中也可能會顯示此功能(OpenAI release notes)。
草圖只要畫出結構資訊即可:
- 用矩形標示文字區塊;
- 用圓形或火柴人表示主體;
- 用箭頭標示視線或移動方向;
- 在刻意留白處畫上 X;
- 若會影響畫面平衡,再畫出地平線或分隔線。
接著補上一段文字指令:
將這個粗略版面轉成乾淨的編輯風格線上研討會橫幅。保留各元素的相對位置與左下留白區。使用海軍藍與暖白色調。標題為「AUTOMATE THE BORING WORK。」不要加入任何其他文字。
Sketch 不是用來畫迷你插畫的工具。相較於再寫一大段位置描述,一份粗略的視覺限制通常更有效率地傳達構圖。
成品格式已確定時,用範本補齊需求
如果成品類型已經明確,但需求還不完整,範本會比 Sketch 更適合。OpenAI 主打 Poster、Merch 等格式;TechRadar 則發現海報、logo、圖示與產品攝影的引導式流程(OpenAI;TechRadar)。
把範本視為一場需求訪談,而不是一鍵套用的風格預設。生成前就提供來源圖片、精確文案、視覺調性、場景與輸出格式。以產品照為例,已知的操作流程提供 Clean Studio、Editorial、Lifestyle、Dramatic 等風格,接著再選擇場景。
「我試了一個新的『範本』,但它基本上就只是一段提示詞。」— u/Musing_About(Reddit)。
若範本把問題或欄位標籤直接畫進圖片,請取消這次生成,改為在一段提示詞內提供所有答案,並加上:「Do not render questions or field labels.」
第二階段:生成並確認主版本
主版本是第一張構圖、主體辨識度與視覺方向都已核准的圖片。在這些基礎條件過關前,不要急著開始微調。
可使用以下主版本提示詞結構:
依照附上的草圖/參考圖製作 [成品]。保留 [固定素材]。將 [主體] 放在 [位置],並將 [精確文字] 放在 [位置與層級]。使用 [光線、色盤、媒材]。保持 [留白區] 為空白。不要加入 [禁止元素或額外文案]。
檢查生成結果時,建議依序確認:
- 構圖與裁切;
- 主體辨識度或產品外型;
- 必要文字與 logo 拼寫;
- 光線、質感與風格;
- 手部、邊緣、反光與透明物件的瑕疵。
構圖不對,就回到 Sketch 或重寫需求。若構圖正確、只有某一個物件出錯,請保留主版本並進入局部編輯。這個判斷能避免為了小修正而不必要地整張重生。
第三階段:用留言逐項處理局部修改
以留言進行編輯時,效果最好的做法是把精準指令掛在可見位置上。選取相關物件或區域,說明一項要改的內容,同時列出必須維持不變的元素。
可套用這個句型:
將 [選取元素] 從 [目前狀態] 改為 [新狀態]。保留 [人物特徵、姿勢、取景、光線、背景、排版、logo 與其他物件]。不要做任何其他變更。
例如:
- 「將這件外套改成鈷藍色。保留臉部、姿勢、手部、鏡頭角度、光線與背景。不要做任何其他變更。」
- 「將這個標題替換為『AUTOMATE THE BORING WORK。』保留它的位置、字體風格、大小、換行與周圍構圖。」
- 「移除這個背景人物。只重建其後方的牆面;保留前景主體與裁切方式。」
每次只提交一項概念上的改動。不要在同一次編輯裡同時要求「改標題、提亮臉部、移動 logo、讓畫面更高級」。OpenAI 宣稱多輪修改的一致性已有改善,但早期使用者測試仍發現短暫的修改鏈中會出現走樣,因此最終微調前應先鎖定主版本(X)。
每次修改後,都要拿完整畫面與主版本比對:
| 檢查項目 | 常見的無聲走樣 |
|---|---|
| 主體 | 臉部、手指、衣物接縫、姿勢 |
| 產品 | 標籤、瓶蓋、反射、比例 |
| 版面 | 文字位置、邊界、物件大小 |
| 背景 | 多出物件、陰影改變、材質偏移 |
| 文案 | 拼寫、標點、換行 |
不想要的物件可用 Erase;需要透明背景時用 Remove BG;內容確認後再使用 Resize。TechRadar 指出 Resize 會改變長寬比例,因此匯出前務必檢查裁切結果與構圖(TechRadar)。
第四階段:把編輯紀錄當成檢查點
TechRadar 發現可回看先前的編輯版本;你可以用它回退,但仍應下載已核准的檢查點,因為 OpenAI 並未說明提供完整的版本控制功能(TechRadar)。
在 ChatGPT 外部建立有名稱的檢查點:
v1-master-composition-approved.pngv2-copy-approved.pngv3-background-approved.pngv4-channel-resize-16x9.png
只要構圖、文案或關鍵製作素材獲得核准,就下載一個檢查點。若某次編輯動到了受保護元素,請回到最後一個乾淨版本,以更收斂的指令重試,而不是持續修補已經損壞的分支。
Sketch 是視覺指引,並非已記錄為可持續存在的圖層。請另行保存草圖;後續編輯若仍仰賴原本版面,也要重新說明布局限制(OpenAI)。
從草圖到匯出:一套可重複執行的海報流程
這套精簡的海報流程,能降低後續修改破壞既有決策的風險。
- 寫需求、畫草圖。 指定 3:4 海報、精確活動文案、配色、主體與頁尾空間,再透過 Sketch 標記這些區域。
- 生成主版本。 要求 ChatGPT 保留草圖配置、禁止額外文字,確認結構後,下載第一個可接受的版本。
- 用一則留言修正文案。 選取標題,只替換這段字串,並將版面與主體列為受保護元素。
- 一次只修一個視覺細節。 在選取物件上留言或使用 Erase,接著將完整畫面與主版本比較。
- 出現走樣就回退。 若臉部、產品或構圖改變,重新開啟最後一個乾淨版本。
- 調整尺寸、匯出、封存。 內容核准後再製作各平台版本;保留草圖、需求、主版本、最終版本與輸出檔。
真正的實務上限,就是第一次修改到受保護元素卻造成損壞的時候。OpenAI 沒有公布保證可乾淨編輯的次數,而早期回報也不一致(OpenAI;Reddit)。
遇到問題時,回到真正出錯的階段
多數問題與其在當前編輯不斷加字補救,不如退回前一個階段處理更有效。再按下一次生成前,先判斷故障發生在哪一段。
| 問題 | 可能原因 | 處理方式 |
|---|---|---|
| Sketch 生成結果無視配置 | 草圖缺少明確錨點,或提示詞與草圖互相矛盾 | 用文字標示關鍵區域,重新生成主版本 |
| 範本把問題文字印進圖片 | 工作流程指令被理解為可見文案 | 在一則訊息中回答所有問題,並禁止生成欄位標籤 |
| 一則留言改掉整個場景 | 編輯指令太寬泛,或周邊內容被重新生成 | 回到最後一個乾淨版本;選取更小區域;加入保留清單 |
| 好圖片經過數次修改後變差 | 修改鏈累積了走樣 | 從最後一個核准檢查點建立新分支 |
| 找不到 Sketch 或工具列 | 帳號、平台或分批推出狀態不同 | 在網頁版與行動版確認 Images;輸入 @Sketch;更新 App;稍後再試 |
| 介面沒有顯示模型標籤 | 不清楚功能是否已開放 | 透過 Images 工具確認存取權,不要只憑生成品質判斷 |
OpenAI 表示這次更新將逐步開放給所有方案。早期使用者提問顯示,不同帳號未必會在同一時間取得功能(Reddit)。
ChatGPT Images 2.5 常見問題
如何使用 ChatGPT Images 2.5?
開啟 ChatGPT 後選擇 Images,或直接在一般對話中生成圖片。OpenAI 表示 Images 2.5 正逐步開放至桌面、行動裝置與網頁版的各個 ChatGPT 方案;使用額度會依方案而異(OpenAI)。
Sketch 要怎麼用?
在行動版輸入 @,再選取 Sketch;Images 介面也可能將 Sketch 顯示為起始選項。先畫出版面、確認草圖,再補上風格、文案與保留元素等文字指令(OpenAI release notes)。
Sketch、範本與留言能透過 API 使用嗎?
OpenAI 為圖片生成與編輯推出名為 GPT-Image-2.5 Flare 與 Sunburst 的 API 模型。OpenAI 的發布資料記錄了 API 圖片生成與編輯能力,但未將 Sketch、引導式範本、留言或視覺化版本瀏覽列為 API 原生功能;開發者必須自行在應用程式中建立相應的需求、標註與版本保存機制(OpenAI)。
範本是可重複使用的自訂預設嗎?
OpenAI 描述的是 Poster、Merch 等內建起始格式。發布資料並未證實使用者能儲存任意自訂範本並鎖定品牌素材,因此應另行封存已驗證有效的需求與提示詞。
圖片留言是否只會修改選取區域?
留言能為目標指令提供空間脈絡,但不保證像素級鎖定。每次根據留言完成編輯後,都應檢查完整圖片;若受保護元素被更動,就回到上一個檢查點。
ChatGPT Images 2.5 有編輯紀錄嗎?
TechRadar 發現,在 Edit 模式中捲動即可回看不同的儲存版本。請將這視為簡單的回退機制,而不是已有文件說明的分支功能、圖層歷史,或下載檢查點的替代方案(TechRadar)。
ChatGPT Images 2.5 免費嗎?
OpenAI 表示此模型正逐步開放至所有 ChatGPT 方案。免費方案仍受各方案專屬的生成額度限制;發布公告沒有公布新的通用圖片額度。
交付前的最終檢查清單
只有在需求、主版本、修改過程與匯出結果都能重建時,這張完成的圖片才算適合交付。
- 精確文案與標點符合需求。
- 主體或產品與核准的主版本一致。
- 沒有任何留言編輯動到受保護元素。
- 調整尺寸後,已檢查正確的長寬比例。
- 若使用 Remove BG,已在 ChatGPT 外檢查透明度。
- 草圖、需求、主版本、最終版本與各平台輸出檔皆已封存。
- 關鍵製作所需的 logo、法律文案、價格與細小註記,均已經過人工審核。