BTC $78,214.46 -0.15%
ETH $2,465.37 -0.49%
BNB $737.51 -1.42%
XRP $1.40 -1.13%
SOL $102.37 -0.54%
TRX $0.3394 +0.31%
DOGE $0.0867 -2.99%
ADA $0.2143 -2.69%
BCH $254.82 -0.54%
LINK $11.89 -5.30%
HYPE $84.77 +0.80%
AAVE $126.21 -1.99%
SUI $0.7867 -3.03%
XLM $0.1830 -2.56%
ZEC $1,248.93 +8.86%
BTC $78,214.46 -0.15%
ETH $2,465.37 -0.49%
BNB $737.51 -1.42%
XRP $1.40 -1.13%
SOL $102.37 -0.54%
TRX $0.3394 +0.31%
DOGE $0.0867 -2.99%
ADA $0.2143 -2.69%
BCH $254.82 -0.54%
LINK $11.89 -5.30%
HYPE $84.77 +0.80%
AAVE $126.21 -1.99%
SUI $0.7867 -3.03%
XLM $0.1830 -2.56%
ZEC $1,248.93 +8.86%

ChatGPT Images 2.5 đã đến: Lần này, các mô hình hình ảnh sinh khác thật sự phải lo lắng rồi

Quan điểm cốt lõi
Summary: Phiên bản mới tập trung nâng cao tính nhất quán của chỉnh sửa hình ảnh, độ trung thực của hình ảnh tham khảo và việc sửa đổi nhiều lần.
Tencent Technology
2026-09-09 23:50:47
Phiên bản mới tập trung nâng cao tính nhất quán của chỉnh sửa hình ảnh, độ trung thực của hình ảnh tham khảo và việc sửa đổi nhiều lần.
  • tác giả: Tiểu Tĩnh, Công nghệ Tencent *

  • biên tập: Từ Thanh Dương, Công nghệ Tencent *

Vào lúc 9 giờ sáng theo giờ địa phương của Mỹ ngày 8 tháng 9, OpenAI đã phát hành mô hình hình ảnh mới nhất ChatGPT Images 2.5.

Phiên bản mới tập trung nâng cao khả năng chỉnh sửa hình ảnh, độ trung thực của hình ảnh tham khảo và tính nhất quán trong việc chỉnh sửa nhiều lần. Khi người dùng liên tục chỉnh sửa một hình ảnh, nội dung đã được điều chỉnh trước đó sẽ dễ dàng được giữ lại hơn. Khi chỉnh sửa nhân vật, sản phẩm hoặc bối cảnh, cũng dễ dàng chỉ thay đổi phần được chỉ định. Tốc độ tạo hình nhanh hơn đến 50% so với Images 2.0.

Đồng thời, ChatGPT đã thêm các chức năng Sketch, Templates và bình luận hình ảnh. Người dùng có thể trực tiếp vẽ phác thảo làm tham khảo, hoặc đánh dấu vị trí cần chỉnh sửa trên hình ảnh. Các nhà phát triển có thể sử dụng GPT-Image-2.5 Flare và GPT-Image-2.5 Sunburst thông qua API.

OpenAI cho biết, hiện tại người dùng mỗi tuần tạo ra hơn 3 tỷ hình ảnh thông qua ChatGPT Images và mô hình GPT-Image trong API. Images 2.5 đã được mở cho người dùng ChatGPT, ChatGPT Work và Codex, bao phủ trên web, máy tính để bàn và di động.

ChatGPT Images 2.5 đã đến: Lần này, các mô hình hình ảnh sinh khác thật sự phải lo lắng rồi

01 Chỉnh sửa một chỗ, không làm rối toàn bộ hình

Điều thực sự gây rắc rối cho hình ảnh AI thường xuất hiện sau khi hình ảnh đầu tiên được tạo ra. Ví dụ, nếu nhân vật đã hài lòng, chỉ muốn thay đổi trang phục. Sản phẩm đã được xác định, chỉ muốn thay đổi bối cảnh. Áp phích đã hoàn thành, chỉ muốn sửa một dòng chữ. Trong quá khứ, khi tiếp tục chỉnh sửa, các phần khác trong hình ảnh cũng có thể thay đổi theo.

Images 2.5 đã đặt chỉnh sửa chính xác ở vị trí quan trọng. Các trường hợp mà OpenAI đưa ra bao gồm "chỉnh sửa toàn thân" và "vé du lịch nhiều thành phố". Những màn trình diễn này đều sử dụng hình ảnh liên tiếp để hiển thị quá trình chỉnh sửa, tập trung vào việc mô hình có thể điều chỉnh nội dung được chỉ định theo chỉ dẫn, đồng thời giữ lại chủ thể, bố cục và các chi tiết khác.

ChatGPT Images 2.5 đã đến: Lần này, các mô hình hình ảnh sinh khác thật sự phải lo lắng rồi

Trường hợp "vé du lịch nhiều thành phố" dễ hiểu hơn. Nếu hình ảnh chỉ cần thay đổi một thông tin nào đó, mô hình cần nhận diện đối tượng chỉnh sửa cụ thể, đồng thời duy trì cấu trúc thiết kế của toàn bộ vé. Đối với hình ảnh sản phẩm, tài liệu quảng cáo, áp phích thương hiệu, khả năng này thực tế hơn so với việc chỉ tạo ra một hình ảnh đẹp.

Một điểm nhấn khác là chỉnh sửa nhiều lần. OpenAI đã trình bày ba trường hợp "quay hình khối", "hình ảnh thông tin du lịch" và "nến sinh nhật". Chúng không phải là tạo ra một lần là xong, mà là thực hiện nhiều lần chỉnh sửa liên tiếp. OpenAI hy vọng chứng minh rằng các chỉnh sửa trước đó có thể được giữ lại, và các thao tác sau sẽ không liên tục phá hủy nội dung đã hoàn thành.

ChatGPT Images 2.5 đã đến: Lần này, các mô hình hình ảnh sinh khác thật sự phải lo lắng rồi

Đây cũng là điểm đáng chú ý nhất trong lần nâng cấp Images 2.5 này.

Người dùng X @thesoragirls đã thực hiện một bài kiểm tra rất trực tiếp: vẽ nến trong hình ảnh, đồng thời chỉ định một cánh hoa giữ nguyên, sau đó quan sát xem mô hình có làm thay đổi nội dung ban đầu khi chỉnh sửa các khu vực khác hay không. Kết quả thử nghiệm của cô cho thấy, cánh hoa được cố định đã được giữ lại, các phần khác đã thay đổi theo yêu cầu.

ChatGPT Images 2.5 đã đến: Lần này, các mô hình hình ảnh sinh khác thật sự phải lo lắng rồi

Tuy nhiên, việc chỉnh sửa liên tiếp vẫn chưa hoàn toàn giải quyết được vấn đề chi tiết. Nhà sản xuất hoạt hình Nhật Bản @genel_ai trong thử nghiệm thực tế đã phát hiện rằng, mặc dù chính thức nhấn mạnh rằng chất lượng hình ảnh có thể được giữ sau nhiều lần chỉnh sửa, nhưng khi các chỉnh sửa liên tiếp chồng lên nhau, hình ảnh vẫn có thể xuất hiện răng cưa và thay đổi về chất liệu.

ChatGPT Images 2.5 đã đến: Lần này, các mô hình hình ảnh sinh khác thật sự phải lo lắng rồi

Điều này có nghĩa là, 2.5 đã cải thiện về độ ổn định, nhưng vẫn có thể xảy ra mất chất lượng hình ảnh trong các cảnh phức tạp.

02 Hình ảnh tham khảo, ổn định hơn

Thay đổi thứ hai của Images 2.5 là cách xử lý hình ảnh tham khảo.

Người dùng có thể cung cấp ảnh của nhân vật, thú cưng hoặc các chủ thể khác, sau đó yêu cầu nó vào một bối cảnh mới, thay đổi phong cách thị giác hoặc thay đổi bố cục. OpenAI cho biết, phiên bản mới dễ dàng giữ lại các đặc điểm nhận diện của nhân vật, đồng thời cải thiện ánh sáng và biểu hiện kết cấu.

Chính thức đã đưa ra năm trường hợp: "Chân dung em bé được thiết kế lại", "Chó mặc trang phục", "Ảnh chân dung trong buồng chụp", "Hình ảnh tổng hợp bữa tiệc nhiều người" và "Dọn dẹp giường".

ChatGPT Images 2.5 đã đến: Lần này, các mô hình hình ảnh sinh khác thật sự phải lo lắng rồi

Những trường hợp này bao phủ các tình huống khác nhau. Chân dung em bé và ảnh chân dung trong buồng chụp chủ yếu xem liệu các đặc điểm của nhân vật có thể được giữ lại hay không; trường hợp chó xem liệu chủ thể có thể duy trì hình ảnh ban đầu sau khi thay đổi trang phục hay không; hình ảnh tổng hợp bữa tiệc nhiều người liên quan đến việc nhiều nhân vật xuất hiện cùng một lúc trong một hình ảnh; "Dọn dẹp giường" gần gũi hơn với việc chỉnh sửa hình ảnh hàng ngày, cần điều chỉnh cụ thể cho cảnh ban đầu.

ChatGPT Images 2.5 đã đến: Lần này, các mô hình hình ảnh sinh khác thật sự phải lo lắng rồi

Khả năng này rất quan trọng đối với công việc cần sử dụng liên tục cùng một nhân vật, sản phẩm hoặc tài liệu thương hiệu. Người dùng API có thể dựa trên cùng một hình ảnh tham khảo để tạo ra các phiên bản khác nhau, giảm thiểu tình huống xuất hiện sự thay đổi rõ rệt mỗi lần tái tạo.

Hình ảnh phức tạp cũng là điểm nhấn trong các trường hợp chính thức lần này. OpenAI đã trình bày một bức tranh minh họa gia đình theo phong cách những năm 50: một gia đình đứng trước một nơi cư trú hình trụ khổng lồ, bên trong có cảnh quan xanh, hồ nước và kiến trúc tương lai.

ChatGPT Images 2.5 đã đến: Lần này, các mô hình hình ảnh sinh khác thật sự phải lo lắng rồi

Trang giới thiệu chính thức của OpenAI đã trình bày một trang du lịch Yichang: đặt điểm đến du lịch, thông tin điểm tham quan, hình ảnh và nội dung văn bản vào cùng một trang, tạo thành một hướng dẫn du lịch hoàn chỉnh. Nó cần xử lý nhiều hình ảnh, văn bản ở các cấp độ khác nhau và bố cục trang, không thể chỉ làm tốt từng yếu tố đơn lẻ.

ChatGPT Images 2.5 đã đến: Lần này, các mô hình hình ảnh sinh khác thật sự phải lo lắng rồi

Còn có một bộ áp phích chủ nghĩa hiện đại trung cổ theo dạng lưới 3x3, mỗi áp phích có hình dạng hình học và văn bản khác nhau, bao gồm "Tạo ra", "Phát triển cùng nhau", "Chọn lòng tốt".

Một bức tranh khác là hình ảnh ấn tượng của đường phố San Francisco, con đường kéo dài giữa những ngôi nhà màu sắc, có thể nhìn thấy vịnh và cầu Cổng Vàng.

ChatGPT Images 2.5 đã đến: Lần này, các mô hình hình ảnh sinh khác thật sự phải lo lắng rồi

Ngoài ra còn có thiệp mời đám cưới màu vàng kem ở Lake Como, thành phố tương lai lộn ngược, tám con tem cổ điển của các công viên quốc gia Mỹ, slide khoa học về bùng nổ mặt trời, hình khối trái đất màu xanh vàng, áp phích dán ChatGPT, và thành phố tương lai trong đêm mưa.

ChatGPT Images 2.5 đã đến: Lần này, các mô hình hình ảnh sinh khác thật sự phải lo lắng rồi

Những trường hợp này bao phủ các loại hình minh họa, áp phích, thiệp mời, đồ họa thông tin, hình ảnh khoa học và hình ảnh quảng cáo sản phẩm. Điểm mà OpenAI muốn thể hiện cũng khá rõ ràng: khi Prompt đồng thời quy định cấu trúc hình ảnh, văn bản, phong cách thị giác và các yếu tố cụ thể, Images 2.5 có thể thực hiện những yêu cầu này một cách hoàn chỉnh hơn.

Doanh nhân thời trang Yana Welinder sau khi thử nghiệm cho rằng, Images 2.5 có sự cải thiện rõ rệt trong thiết kế thời trang. Trước đây, khi sử dụng mô hình cũ, thiết kế tham khảo có thể được giữ lại, nhưng hiệu quả cuối cùng đôi khi khá phẳng; cô cho rằng 2.5 có thể giúp thiết kế ban đầu thể hiện hiệu ứng thị giác hoàn chỉnh hơn.

ChatGPT Images 2.5 đã đến: Lần này, các mô hình hình ảnh sinh khác thật sự phải lo lắng rồi

Nhưng cũng có người đưa ra kết quả thử nghiệm trái ngược. Kỹ sư AI và phần mềm Mark Kretschmann đã thực hiện một bài kiểm tra về tiếng ồn và hiện tượng giả trong cảnh rừng.

ChatGPT Images 2.5 đã đến: Lần này, các mô hình hình ảnh sinh khác thật sự phải lo lắng rồi

Ông cho rằng 2.5 mặc dù có nhiều cải tiến, nhưng kết quả thử nghiệm không ổn định. Sau đó, ông đã so sánh Images 2.5 với Images 2.0, cho rằng trong nhiều trường hợp mà ông thử nghiệm, 2.0 lại tốt hơn về độ chân thực.

Vì vậy, hiện tại đánh giá chính xác hơn là, Images 2.5 đã cải thiện đáng kể khả năng kiểm soát chỉnh sửa và xử lý các chỉ dẫn phức tạp, nhưng hiệu quả thực tế dưới các loại hình ảnh khác nhau vẫn có sự khác biệt.

03 Vẽ vài nét, nó sẽ hiểu

Ngoài mô hình chính, OpenAI còn bổ sung cho ChatGPT một số cách thao tác mới.

Cách trực tiếp nhất là Sketch. Người dùng có thể trực tiếp vẽ phác thảo trong ChatGPT, sau đó để mô hình tạo ra hình ảnh cuối cùng dựa trên phác thảo này. Ví dụ, nếu muốn thiết kế một căn phòng, có thể vẽ ra bố cục tổng thể; nếu muốn làm một bộ quần áo, có thể vẽ ra hình dáng; thậm chí chỉ cần vẽ một bố cục rất thô, cũng có thể giao cho ChatGPT tiếp tục hoàn thành. Sau đó chỉ cần bổ sung phong cách thị giác và các yêu cầu khác.

Khi sử dụng, chỉ cần nhập "@Sketch" để gọi. Điều này thực tế đã giảm bớt sự phụ thuộc vào Prompt bằng văn bản. Một số bố cục rất khó mô tả bằng ngôn ngữ, đặc biệt là vị trí, tỷ lệ và hình dáng tổng thể của vật thể. Bây giờ người dùng có thể vẽ trước, rồi để mô hình hoàn thiện.

Người dùng X @fquolodasha sau khi thử nghiệm đã đánh giá rất cao khả năng vẽ tay của GPT-Image2.5, thẳng thắn cho rằng hiệu quả lần này "có chút tuyệt vời", và cảm thán tốc độ cập nhật và khả năng cải thiện của OpenAI gần đây rất mạnh mẽ.

ChatGPT Images 2.5 đã đến: Lần này, các mô hình hình ảnh sinh khác thật sự phải lo lắng rồi

Templates giải quyết một vấn đề khác. ChatGPT đã thêm một số định dạng sáng tạo phổ biến, chẳng hạn như Poster và Merch. Người dùng trước tiên chọn mẫu, sau đó điền thông tin muốn thể hiện, các yếu tố thiết kế và phong cách hình ảnh, không cần phải bắt đầu từ một bức tranh trắng mỗi lần.

Chia sẻ hình ảnh cũng đã tăng thêm tùy chọn Prompt. Người dùng bây giờ có thể chia sẻ hình ảnh trong khi cùng lúc chia sẻ Prompt đã sử dụng để tạo ra bức hình này. Người khác nhận được có thể thay thế bằng ảnh và chi tiết của riêng họ để tiếp tục tạo ra.

Ví dụ mà OpenAI đưa ra là một bức chân dung theo phong cách thập niên 80: tóc xoăn, áo khoác màu sắc, dây chuyền vàng, đèn neon và máy phát nhạc. Những người dùng khác có thể tiếp tục theo ý tưởng này và thay thế bằng ảnh của họ.

ChatGPT Images 2.5 đã đến: Lần này, các mô hình hình ảnh sinh khác thật sự phải lo lắng rồi

04 Hai phiên bản API

Images 2.5 cũng đã đồng bộ vào API. OpenAI đã ra mắt GPT-Image-2.5 Flare và GPT-Image-2.5 Sunburst.

Flare là phiên bản mặc định, tập trung vào tốc độ, chất lượng và khả năng chỉnh sửa. OpenAI cho biết, nó tạo ra chất lượng cao hơn so với GPT-Image-2, đồng thời giảm độ trễ 50%, phù hợp cho nội dung xã hội, trải nghiệm sản phẩm, tìm kiếm hình ảnh, nguyên mẫu nhanh và tạo ra nhiều hình ảnh.

Sunburst thì thiên về những công việc cần kiểm soát tinh vi hơn, chẳng hạn như tài liệu quảng cáo chính thức và hình ảnh sản phẩm chất lượng cao. Nó cho phép thời gian tạo ra lâu hơn để đổi lấy độ chính xác chỉnh sửa cao hơn.

Phản hồi từ người dùng sớm mà OpenAI công bố cũng tập trung vào kiểm soát chỉnh sửa.

Người phụ trách sản phẩm AI Higgsfield, Axultan Alimkulov, đặc biệt nhấn mạnh rằng Flare có thể hiểu tốt hơn những nội dung nào nên giữ nguyên. Đối với các nhóm phim ảnh, UGC và quảng cáo, điều này có nghĩa là khi sửa đổi một yếu tố, có thể giữ lại các nhân vật, bố cục và nhận diện hình ảnh ban đầu.

Doanh nhân liên tục @gkxspace đã đưa bản cập nhật này vào quy trình làm việc hình ảnh thương mại để quan sát. Ông cho rằng, một trong những hạn chế lớn nhất của hình ảnh AI trước đây là bức hình đầu tiên có thể rất tốt, nhưng rất khó để tiếp tục tạo ra bức thứ hai, thứ ba một cách ổn định. Những thay đổi trong Images 2.5 về chỉnh sửa liên tục, tốc độ và độ trung thực của hình tham khảo đã tạo ra không gian sử dụng thực tế hơn cho các tình huống như thay đổi trang phục thương mại điện tử, mở rộng tài liệu thương hiệu và minh họa liên tục.

ChatGPT Images 2.5 đã đến: Lần này, các mô hình hình ảnh sinh khác thật sự phải lo lắng rồi

Hiện tại, Images 2.5 đã bao phủ người dùng ChatGPT, ChatGPT Work và Codex, Flare và Sunburst trong API cũng đã được mở đồng bộ. OpenAI cũng giữ lại các cơ chế kiểm tra an toàn cho từ khóa và hình ảnh, siêu dữ liệu C2PA và watermark vô hình để nhận diện hình ảnh được tạo ra bởi công cụ của họ.

Từ các trường hợp chính thức và các thử nghiệm người dùng hiện tại, trọng tâm của bản cập nhật lần này rất rõ ràng: làm cho việc chỉnh sửa sau khi tạo hình ảnh dễ kiểm soát hơn, làm cho hình tham khảo ổn định hơn khi sử dụng liên tục, và bổ sung các thao tác như Sketch, mẫu và chú thích hình ảnh vào quy trình làm việc.

Về độ chân thực, chi tiết và chất lượng hình ảnh sau nhiều lần chỉnh sửa, các thử nghiệm hiện có đã cho ra những kết quả khác nhau. Images 2.5 cuối cùng có thể cải thiện những vấn đề này đến mức nào vẫn cần nhiều sử dụng thực tế để xác minh.

Join ChainCatcher Official
Telegram Feed: @chaincatcher
X (Twitter): @ChainCatcher_
warnning Cảnh báo rủi ro
app_icon
ChainCatcher Building the Web3 world with innovations.