ChatGPT Images 2.5:更快、更清晰,終於讓你畫草圖

OpenAI 於 2026 年 9 月 8 日推出 ChatGPT Images 2.5,大家最先抓到的數字是速度:延遲比前一版最多降低 50%。這很重要,但其實還不足以說明這次改動。更有意思的是,模型現在能讓你畫粗略草圖並交給它當參考,而且多輪編輯能保持穩定,不再漂移。
如果你上次使用這些工具是在春季,差異會立刻有感。第一個注意到的是等待時間。以前需要六秒的生成,現在大約三秒就好。第二個注意到的是,當你要求小幅修改時,畫面的其餘部分會保持不變。
實際改善的地方
官方清單涵蓋三個面向:速度、細節與編輯穩定性。
速度是最容易驗證的。OpenAI 表示延遲最多降低一半,模型在桌面、行動裝置與網頁版都可用,所以改善涵蓋所有平台,而不只是 API。
細節是模型最有成長空間的地方。先前版本在構圖上很強,但可能把細微紋理抹糊、失去材質的定義。2.5 強化了光線與材質渲染,因此皮膚、布料、金屬看起來是該有的質感,而不是光滑的近似。
編輯穩定性是真正使用這些工具的人最在意的部分。長期以來對圖像模型的抱怨,就是多輪編輯會漂移。你改了襯衫顏色,結果臉突然變得不一樣。2.5 的設計目標是在你要求針對性修改時,保留主體、產品外型、構圖與整體風格。光這一項修正,省下的實際時間就超過任何延遲數字。

Sketch 功能是隱藏版亮點
最大的產品新增功能是 Sketch。你可以直接在 ChatGPT 裡畫出粗略版面配置,模型會把它變成完整圖像。你不需要會畫畫。幾個方框、一個火柴人、一條地平線和一個顏色註記,就足以傳達用三段提示詞才能描述清楚的意圖。
這補上了從第一代文字生成圖像工具以來就存在的缺口。提示詞不擅長空間思考。「把產品放在左邊、標題放右上、人物放在下三分之一」用文字寫要一堆字,草圖十秒就能表達。Sketch 給模型的東西更接近分鏡腳本,而分鏡腳本就是視覺工作實際交付需求的方式。
兩種 API 型號,對應兩種不同工作
在 API 方面,OpenAI 將這次發布拆成兩種角色明確的型號。
GPT-Image-2.5 Flare 是通用型模型。它具備 2.5 系列的速度、品質和編輯能力,目標是社群媒體素材、產品原型,以及需要快速大量生成圖像的情境。
GPT-Image-2.5 Sunburst 是精準型模型。它是為了廣告靜態圖和商業產品照而打造,這類工作對控制力的要求高於產量。你能更精確控制圖像,代價是生成時間較長。
這種區分是市場成熟的有用訊號。兩年前,一個模型試圖服務所有人。現在廠商按工作負載切分,因為「做一百張迷因圖」和「做一張行銷活動主視覺」確實是不同工作。
實用上的轉變:把它當成編輯器,而不是生成器
如果你不再把模型當吃角子老虎機,而是開始把它當編輯器,這次升級就會最有用。舊工作流程是寫提示詞、生成四張圖、挑最好的一張;如果都不行,就寫更好的提示詞再生成一次。大部分挫折感都來自這個循環。
2.5 的工作流程不同。你從粗略想法開始,生成一張還可以的圖,然後透過一連串小型、針對性的編輯來精修。換背景、調整光線、移動物件。因為編輯現在能讓畫面其餘部分保持穩定,每一步都是真正的改善,而不是賭注。
這也是 Sketch 真正派上用場的地方。當空間配置很重要時,一張畫得不好的草圖勝過長篇描述。畫出標題放哪、產品放哪、人物站在哪。模型補上品質,你提供意圖。
有個習慣值得保留:完成前檢查細節。沒有模型是完美的,2.5 偶爾還是會出現畫壞的手或錯誤字母。差別在於,現在錯誤已經少到值得再編輯一次,而不是足以讓你放棄圖像、重新開始的理由。這比任何基準測試更能說明「可用」是什麼意思。
這對市場格局的意義
值得了解的背景是規模。OpenAI 曾表示,ChatGPT Images 系列與其 API 每週產生超過三十億張圖像。這個數字在 2023 年聽起來很荒謬,現在卻只是基本盤。
這也解釋了為什麼 OpenAI 有本錢整合。在推出 2.5 的同一週,該公司悄悄在 ChatGPT 內退役了舊的 DALL-E GPT,將所有人導向 ChatGPT Images。DALL-E 這個名字或許消失了,但它原本的工作已被完全吸收進更快、更清晰的流程中。
對競爭對手而言,壓力非常具體。Midjourney 仍掌握純美學廣度,這點沒人認真質疑。Adobe Firefly 仍在謹慎企業看重的商業授權角度占有優勢。Google 的 Nano Banana 系列仍在原生高解析度與角色一致性上勝出。ChatGPT Images 2.5 不是要在各自的強項擊敗它們,而是想成為最好的預設選擇:夠快、夠清晰,而且現在編輯能力好到讓你不再需要第二個工具。
誠實的結論是,2.5 是一次迭代,不是革命。但它迭代的,正好是讓圖像模型在實際工作中令人困擾的那三件事。速度、細節與編輯穩定性並不光鮮亮麗,但它們正是人們放棄一個工具的原因。OpenAI 用這次版本更新,把這些原因一個一個拿掉。
相關文章
9月國產開源生圖模型接連放招:商湯、螞蟻、書生都坐不住了
商湯8B、螞蟻6B、書生InternLumina-U2接連開源,本文拆解三家路線差異與開源潮對創作者的真實影響。
騰訊混元把 AI 生圖送進了影視片場:HyImage 3.5 預覽版上手
HyImage 3.5 preview 盲測提升約 30%,支援 5 圖參考與 2K 輸出,已接入 WorkRally 並在《行鏢》中實戰,本文拆解其能力與使用路徑。
2026 年 9 月最佳 AI 圖像生成器排名
GPT Image 2.5、Midjourney V8.2、Nano Banana 2、Flux 2 等,依價格與用途推薦排名。
微軟的 MAI-Image-2.6 正悄悄逼近 GPT Image 2
微軟的挑戰者已將 Elo 差距縮小到 21 分。MAI-Image-2.6 崛起對 AI 影像市場意味著什麼。