BTC $78,214.46 -0.15%
ETH $2,465.37 -0.49%
BNB $737.51 -1.42%
XRP $1.40 -1.13%
SOL $102.37 -0.54%
TRX $0.3394 +0.31%
DOGE $0.0867 -2.99%
ADA $0.2143 -2.69%
BCH $254.82 -0.54%
LINK $11.89 -5.30%
HYPE $84.77 +0.80%
AAVE $126.21 -1.99%
SUI $0.7867 -3.03%
XLM $0.1830 -2.56%
ZEC $1,248.93 +8.86%
BTC $78,214.46 -0.15%
ETH $2,465.37 -0.49%
BNB $737.51 -1.42%
XRP $1.40 -1.13%
SOL $102.37 -0.54%
TRX $0.3394 +0.31%
DOGE $0.0867 -2.99%
ADA $0.2143 -2.69%
BCH $254.82 -0.54%
LINK $11.89 -5.30%
HYPE $84.77 +0.80%
AAVE $126.21 -1.99%
SUI $0.7867 -3.03%
XLM $0.1830 -2.56%
ZEC $1,248.93 +8.86%

ChatGPT Images 2.5 來了:這次,其他生圖模型真的要緊張了

核心觀點
Summary: 新版本重點提升了圖片編輯、參考圖保真和多輪修改的一致性。
騰訊科技
2026-09-09 23:50:47
新版本重點提升了圖片編輯、參考圖保真和多輪修改的一致性。

作者:曉靜,騰訊科技

編輯:徐青陽,騰訊科技

美國當地時間9月8日,OpenAI發布了最新生圖模型ChatGPT Images 2.5。

新版本重點提升了圖片編輯、參考圖保真和多輪修改的一致性。用戶連續修改一張圖片時,前面已經調整好的內容更容易保留下來。修改人物、產品或背景時,也更容易只改變指定部分。生成速度最高比Images 2.0快50%。

同時,ChatGPT增加了Sketch、Templates和圖片評論功能。用戶可以直接畫草圖作為參考,也可以在圖片上標記需要修改的位置。開發者則可以通過API使用GPT-Image-2.5 Flare和GPT-Image-2.5 Sunburst。

OpenAI稱,目前用戶每週通過ChatGPT Images和API中的GPT-Image模型生成超過30億張圖片。Images 2.5已經向ChatGPT、ChatGPT Work和Codex用戶開放,覆蓋網頁、桌面和移動端。

ChatGPT Images 2.5 來了:這次,其他生圖模型真的要緊張了

01 改一處,不亂全圖

AI生圖真正麻煩的地方,往往出現在第一張圖生成以後。比如人物已經滿意,只想換衣服。產品已經確定,只想換背景。海報已經做好,只想改一行字。過去繼續修改時,圖片裡的其他部分也可能跟著發生變化。

Images 2.5把精準編輯放在了重要位置。OpenAI給出的案例包括"全身編輯"和"多城市旅行票"。這些演示都採用連續圖片展示修改過程,重點看模型能否按照指令調整指定內容,同時保留原來的主體、構圖和其他細節。

ChatGPT Images 2.5 來了:這次,其他生圖模型真的要緊張了

"多城市旅行票"這個案例比較容易理解。圖片中如果只需要改變其中一項信息,模型需要識別具體修改對象,同時維持整張票的設計結構。對於產品圖、廣告素材、品牌海報來說,這種能力比單純生成一張漂亮圖片更實用。

另一個重點是多輪編輯。OpenAI展示了"立方體旋轉""旅行信息圖"和"生日蠟燭"三個案例。它們都不是生成一次就結束,而是連續進行多次修改。OpenAI希望證明的是,前面的修改能夠繼續保留下來,後面的操作不會不斷破壞已經完成的內容。

ChatGPT Images 2.5 來了:這次,其他生圖模型真的要緊張了

這也是Images 2.5這次升級最值得關注的地方。

X用戶@thesoragirls做了個很直接的測試:在圖片中畫出蠟燭,同時指定一片花瓣保持不變,再觀察模型修改其他區域時是否會動到原來的內容。她的測試結果顯示,被固定的花瓣得到了保留,其他部分按照要求發生了變化。

ChatGPT Images 2.5 來了:這次,其他生圖模型真的要緊張了

不過,連續編輯並沒有完全解決細節問題。日本動畫製作師@genel_ai在實際測試中發現,雖然官方強調多次編輯後畫質能夠保持,但當編輯不斷疊加時,圖片仍可能出現鋸齒和質感變化。

ChatGPT Images 2.5 來了:這次,其他生圖模型真的要緊張了

也就是說,2.5在穩定性上有所改善,但複雜場景下仍會出現畫質損失。

02 參考圖,更穩了

Images 2.5的第二個變化,是對參考圖片的處理。

用戶可以提供人物、寵物或者其他主體的照片,再要求它進入新的場景、換一種視覺風格或者改變構圖。OpenAI稱,新版本更容易保留人物的識別特徵,同時改善光線和紋理表現。

官方一次給出了五個案例:"重新設計的嬰兒肖像""穿著服裝的狗""照相亭頭像""多人派對合成照片"和"整理床鋪"。

ChatGPT Images 2.5 來了:這次,其他生圖模型真的要緊張了

這幾個案例覆蓋了不同情況。嬰兒肖像和照相亭頭像主要看人物特徵能否保持;狗的案例看主體換裝後還能不能維持原來的形象;多人派對合成照片則涉及多個人物同時出現在一張圖裡;"整理床鋪"則更接近日常圖片編輯,需要對原始場景進行具體調整。

ChatGPT Images 2.5 來了:這次,其他生圖模型真的要緊張了

這種能力對需要連續使用同一個人物、產品或者品牌素材的工作比較重要。API用戶可以基於同一張參考圖生成不同版本,減少每次重新生成時出現明顯變化的情況。

複雜畫面也是這次官方案例的重點。OpenAI展示了一張20世紀50年代風格的家庭插畫:一家人站在巨大的圓柱形太空棲息地前,裡面包含綠色景觀、湖泊和未來建築。

ChatGPT Images 2.5 來了:這次,其他生圖模型真的要緊張了

OpenAI官方介紹頁展示了一個宜昌旅行頁面:把旅行目的地、景點信息、圖片和文字內容放在同一張頁面裡,整體做成一份完整的旅行攻略。它需要同時處理多張圖片、不同層級的文字和頁面佈局,不能只把單個元素做好。

ChatGPT Images 2.5 來了:這次,其他生圖模型真的要緊張了

還有一組九宮格的中世紀現代主義海報,每張海報都有不同的幾何圖形和文字,包括"Create""Grow together""Choose kindness"。

另一張圖是舊金山街道的印象派畫面,街道從彩色房屋之間向下延伸,可以看到海灣和金門大橋。

ChatGPT Images 2.5 來了:這次,其他生圖模型真的要緊張了

此外還有奶油金色的Lake Como婚禮請柬、倒置未來城市、八張美國國家公園復古郵票、太陽耀斑科普幻燈片、藍金色地球馬賽克、ChatGPT貼紙海報,以及雨夜未來城市。

ChatGPT Images 2.5 來了:這次,其他生圖模型真的要緊張了

這些案例覆蓋了插畫、海報、請柬、信息圖、科普圖和產品宣傳圖等不同類型。OpenAI想展示的重點也比較明確:當Prompt同時規定畫面結構、文字、視覺風格和具體元素時,Images 2.5能夠更完整地執行這些要求。

時尚創業者雅娜·維蘭德(Yana Welinder)測試後認為,Images 2.5在時尚設計上的表現有明顯提升。她此前使用舊模型時,參考設計能夠保留下來,但最終效果有時比較平;她認為2.5能夠讓原本的設計呈現出更完整的視覺效果。

ChatGPT Images 2.5 來了:這次,其他生圖模型真的要緊張了

但也有人給出了相反的測試結果。AI與軟件工程師馬克·克雷奇曼(Mark Kretschmann)專門進行了森林場景的噪聲和偽影測試。

ChatGPT Images 2.5 來了:這次,其他生圖模型真的要緊張了

他認為2.5雖然有不少改進,但測試結果並不穩定。隨後他又把Images 2.5和Images 2.0進行對比,認為自己測試的多個案例中,2.0在真實感方面反而更好。

所以,目前更準確的判斷是,Images 2.5重點改善了編輯控制和複雜指令處理,但不同圖片類型下的實際效果仍有差異。

03 畫幾筆,它就懂了

除了模型本身,OpenAI還給ChatGPT增加了幾個新的操作方式。

最直接的是Sketch。用戶可以在ChatGPT裡直接畫草圖,然後讓模型根據這張草圖生成最終圖片。比如想設計一個房間,可以先畫出大致佈局;想做一件衣服,可以先畫出輪廓;甚至只是隨手畫一個很粗的構圖,也可以交給ChatGPT繼續完成。之後再補充視覺風格和其他要求即可。

使用時輸入"@Sketch"就可以調用。這實際上減少了對文字Prompt的依賴。有些構圖很難靠語言描述,尤其是物體的位置、比例和大致輪廓。現在用戶可以先畫,再讓模型補全。

X用戶@fquolodasha測試後,對GPT-Image2.5的手繪能力評價很高,直言這次效果"有點牛",並感嘆OpenAI近期的更新速度和能力提升都很猛。

ChatGPT Images 2.5 來了:這次,其他生圖模型真的要緊張了

Templates解決的是另一個問題。ChatGPT新增了一些常見創作格式,例如Poster和Merch。用戶先選擇模板,再填寫想表達的信息、設計元素和視覺風格,不需要每次面對一張空白畫布從頭開始。

圖片分享也增加了Prompt選項。用戶現在可以分享圖片時,同時分享生成這張圖片所使用的Prompt。別人拿到後,可以換成自己的照片和細節繼續生成。

OpenAI給出的例子是一張20世紀80年代風格的人像:捲髮、彩色夾克、金鏈、霓虹燈和音樂播放器。其他用戶可以沿用這個思路,把自己的照片換進去。

ChatGPT Images 2.5 來了:這次,其他生圖模型真的要緊張了

04 兩個 API 版本

Images 2.5也同步進入API。OpenAI推出GPT-Image-2.5 Flare和GPT-Image-2.5 Sunburst。

Flare是默認版本,重點放在速度、質量和編輯能力。OpenAI稱,它比GPT-Image-2生成質量更高,同時延遲降低50%,適合社交內容、產品體驗、視覺搜索、快速原型以及大量圖片生成。

Sunburst則更偏向需要精細控制的工作,例如正式廣告素材和高質量產品圖片。它允許更長的生成時間,用來換取更高的編輯精度。

OpenAI公布的早期用戶反饋,也集中在編輯控制上。

Higgsfield AI產品負責人阿克蘇爾坦·阿利姆庫洛夫(Axultan Alimkulov)特別提到,Flare能夠較好理解哪些內容應該保持不變。對於影視、UGC和廣告團隊來說,這意味著修改一個元素時,可以儘量保留原來的角色、構圖和視覺識別。

連續創業者@gkxspace則把這次更新放到了商業圖片工作流裡觀察。他認為,過去AI生圖最大的限制之一,是第一張圖可能很好,但很難繼續基於它穩定製作第二張、第三張。Images 2.5在連續編輯、速度和參考圖保真上的變化,讓電商換裝、品牌素材延展和連續插畫等場景更有實際使用空間。

ChatGPT Images 2.5 來了:這次,其他生圖模型真的要緊張了

目前,Images 2.5已經覆蓋ChatGPT、ChatGPT Work和Codex用戶,API中的Flare和Sunburst也同步開放。OpenAI同時保留了提示詞和圖片安全檢查、C2PA元數據以及不可見水印等機制,用於識別由其工具生成的圖片。

從官方案例和目前的用戶測試來看,這次更新的重點很集中:讓圖片生成之後的修改更容易控制,讓參考圖在連續使用時更穩定,再把Sketch、模板和圖片標註這些操作補進工作流。

至於真實感、細節和多輪編輯後的畫質,現有測試已經出現了不同結果。Images 2.5最終能把這些問題改善到什麼程度,還需要更多實際使用來驗證。

欢迎加入 ChainCatcher 官方社群
Telegram 订阅: @chaincatcher
X (Twitter): @ChainCatcher_
warnning 風險提示
app_icon
ChainCatcher 與創新者共建Web3世界