BTC $78,214.46 -0.15%
ETH $2,465.37 -0.49%
BNB $737.51 -1.42%
XRP $1.40 -1.13%
SOL $102.37 -0.54%
TRX $0.3394 +0.31%
DOGE $0.0867 -2.99%
ADA $0.2143 -2.69%
BCH $254.82 -0.54%
LINK $11.89 -5.30%
HYPE $84.77 +0.80%
AAVE $126.21 -1.99%
SUI $0.7867 -3.03%
XLM $0.1830 -2.56%
ZEC $1,248.93 +8.86%
BTC $78,214.46 -0.15%
ETH $2,465.37 -0.49%
BNB $737.51 -1.42%
XRP $1.40 -1.13%
SOL $102.37 -0.54%
TRX $0.3394 +0.31%
DOGE $0.0867 -2.99%
ADA $0.2143 -2.69%
BCH $254.82 -0.54%
LINK $11.89 -5.30%
HYPE $84.77 +0.80%
AAVE $126.21 -1.99%
SUI $0.7867 -3.03%
XLM $0.1830 -2.56%
ZEC $1,248.93 +8.86%

Пришли ChatGPT Images 2.5: на этот раз другим моделям с живыми изображениями действительно стоит волноваться

Ключевые тезисы
Summary: Новая версия сосредоточена на улучшении согласованности редактирования изображений, сохранения точности эталонных изображений и многократных правок.
Tencent Technology
2026-09-09 23:50:47
Новая версия сосредоточена на улучшении согласованности редактирования изображений, сохранения точности эталонных изображений и многократных правок.

Автор:Сяо Цзин,Tencent Technology

Редактор:Сюй Циньян,Tencent Technology

8 сентября по местному времени в США OpenAI выпустила последнюю версию модели генерации изображений ChatGPT Images 2.5.

Новая версия сосредоточена на улучшении редактирования изображений, сохранении точности референсных изображений и согласованности многократных изменений. Когда пользователи вносят последовательные изменения в одно изображение, ранее отредактированные элементы легче сохраняются. При изменении персонажей, продуктов или фонов также легче изменять только указанные части. Скорость генерации на 50% быстрее, чем у Images 2.0.

Кроме того, ChatGPT добавил функции Sketch, Templates и комментариев к изображениям. Пользователи могут рисовать эскизы в качестве референса или отмечать места, которые нужно изменить, прямо на изображении. Разработчики могут использовать GPT-Image-2.5 Flare и GPT-Image-2.5 Sunburst через API.

OpenAI заявляет, что в настоящее время пользователи генерируют более 3 миллиардов изображений каждую неделю с помощью ChatGPT Images и модели GPT-Image в API. Images 2.5 уже доступна для пользователей ChatGPT, ChatGPT Work и Codex, охватывая веб, настольные и мобильные платформы.

Пришли ChatGPT Images 2.5: на этот раз другим моделям с живыми изображениями действительно стоит волноваться

01 Измените одно, не нарушая целостности изображения

Настоящая проблема с AI-генерацией изображений часто возникает после создания первого изображения. Например, если персонаж уже устраивает, но нужно только сменить одежду. Продукт уже определен, но нужно только изменить фон. Постер уже готов, но нужно изменить одну строку текста. Ранее, продолжая редактирование, другие части изображения также могли измениться.

Images 2.5 придает важное значение точному редактированию. Примеры, предоставленные OpenAI, включают "Редактирование всего тела" и "Многогородские билеты на поезд". Эти демонстрации используют последовательные изображения для отображения процесса редактирования, акцентируя внимание на том, может ли модель корректировать указанные элементы в соответствии с инструкциями, сохраняя при этом оригинальные объекты, композицию и другие детали.

Пришли ChatGPT Images 2.5: на этот раз другим моделям с живыми изображениями действительно стоит волноваться

Пример "Многогородские билеты на поезд" довольно легко понять. Если нужно изменить только одну информацию на изображении, модель должна распознать конкретный объект для изменения, сохраняя при этом структуру дизайна всего билета. Для изображений продуктов, рекламных материалов и брендовых постеров такая способность более практична, чем простое создание красивого изображения.

Другим важным аспектом является многократное редактирование. OpenAI продемонстрировала три примера: "Вращение куба", "Инфографика о путешествиях" и "День рождения с свечами". Они не заканчиваются на одном генерировании, а требуют многократных изменений. OpenAI стремится доказать, что предыдущие изменения могут быть сохранены, а последующие действия не будут постоянно разрушать уже завершенные элементы.

Пришли ChatGPT Images 2.5: на этот раз другим моделям с живыми изображениями действительно стоит волноваться

Это также является наиболее заметным аспектом обновления Images 2.5.

Пользователь X @thesoragirls провела прямой тест: она нарисовала свечу на изображении, одновременно указав, что один лепесток должен остаться неизменным, а затем наблюдала, изменит ли модель другие области, затрагивая оригинальный контент. Результаты ее теста показали, что зафиксированный лепесток был сохранен, а другие части изменились по запросу.

Пришли ChatGPT Images 2.5: на этот раз другим моделям с живыми изображениями действительно стоит волноваться

Тем не менее, последовательное редактирование не решило полностью проблему с деталями. Японский аниматор @genel_ai в ходе практического тестирования обнаружил, что, хотя официально подчеркивается, что качество изображения может сохраняться после многократного редактирования, при наложении изменений изображение все еще может проявлять зубчатость и изменения текстуры.

Пришли ChatGPT Images 2.5: на этот раз другим моделям с живыми изображениями действительно стоит волноваться

Это означает, что версия 2.5 улучшила стабильность, но в сложных сценах все еще может происходить потеря качества изображения.

02 Референсные изображения, более стабильные

Второе изменение в Images 2.5 касается обработки референсных изображений.

Пользователи могут предоставить фотографии персонажей, домашних животных или других объектов, а затем запросить их в новом контексте, с другим визуальным стилем или изменением композиции. OpenAI утверждает, что новая версия легче сохраняет распознаваемые черты персонажей, одновременно улучшая освещение и текстурное отображение.

Официально было представлено пять примеров: "Переработанный портрет младенца", "Собака в одежде", "Фотография в фотобудке", "Составное фото с несколькими людьми на вечеринке" и "Уборка постели".

Пришли ChatGPT Images 2.5: на этот раз другим моделям с живыми изображениями действительно стоит волноваться

Эти примеры охватывают различные ситуации. Портрет младенца и фотография в фотобудке в основном проверяют, могут ли сохраняться черты персонажа; пример с собакой показывает, может ли основной объект сохранить свой первоначальный облик после смены одежды; составное фото с несколькими людьми включает несколько персонажей на одном изображении; "Уборка постели" ближе к повседневному редактированию изображений, требуя конкретных изменений в исходной сцене.

Пришли ChatGPT Images 2.5: на этот раз другим моделям с живыми изображениями действительно стоит волноваться

Эта способность важна для работы, требующей последовательного использования одного и того же персонажа, продукта или брендового материала. Пользователи API могут генерировать разные версии на основе одного референсного изображения, уменьшая вероятность значительных изменений при каждом новом создании.

Сложные изображения также стали акцентом официальных примеров. OpenAI продемонстрировала семейную иллюстрацию в стиле 50-х годов: семья стоит перед огромным цилиндрическим космическим жилищем, внутри которого находятся зеленые пейзажи, озера и здания будущего.

Пришли ChatGPT Images 2.5: на этот раз другим моделям с живыми изображениями действительно стоит волноваться

Официальная страница OpenAI демонстрирует страницу путешествия в Ичан: информация о месте назначения, достопримечательностях, изображения и текст размещены на одной странице, создавая полноценный туристический гид. Это требует одновременной обработки нескольких изображений, текстов разных уровней и макета страницы, а не просто хорошей работы с отдельными элементами.

Пришли ChatGPT Images 2.5: на этот раз другим моделям с живыми изображениями действительно стоит волноваться

Также есть набор из девяти квадратов с постерами в стиле средневекового модернизма, каждый постер имеет разные геометрические формы и тексты, включая "Создавать", "Расти вместе", "Выбрать доброту".

Еще одно изображение — импрессионистский пейзаж улицы Сан-Франциско, улица тянется вниз между цветными домами, виден залив и Золотые ворота.

Пришли ChatGPT Images 2.5: на этот раз другим моделям с живыми изображениями действительно стоит волноваться

Кроме того, есть свадебное приглашение в кремово-золотом цвете на озере Комо, перевернутый город будущего, восемь ретро-марок национальных парков США, научно-популярные слайды о солнечных вспышках, мозаика Земли в синих и золотых тонах, постеры с наклейками ChatGPT и будущее города в дождливую ночь.

Пришли ChatGPT Images 2.5: на этот раз другим моделям с живыми изображениями действительно стоит волноваться

Эти примеры охватывают различные типы, включая иллюстрации, постеры, приглашения, инфографику, научно-популярные изображения и рекламные материалы. Основная цель, которую OpenAI хочет продемонстрировать, также довольно ясна: когда Prompt одновременно определяет структуру изображения, текст, визуальный стиль и конкретные элементы, Images 2.5 может более полно выполнять эти требования.

Предприниматель в моде Яна Виланд (Yana Welinder) после тестирования отметила, что Images 2.5 значительно улучшила свои показатели в области модного дизайна. Ранее, используя старую модель, она могла сохранить референсный дизайн, но конечный результат иногда выглядел плоско; она считает, что 2.5 позволяет оригинальному дизайну проявлять более полное визуальное восприятие.

Пришли ChatGPT Images 2.5: на этот раз другим моделям с живыми изображениями действительно стоит волноваться

Однако некоторые пользователи представили противоположные результаты тестирования. Инженер по программному обеспечению и AI Марк Кретшман (Mark Kretschmann) специально провел тестирование шума и артефактов в лесной сцене.

Пришли ChatGPT Images 2.5: на этот раз другим моделям с живыми изображениями действительно стоит волноваться

Он считает, что хотя 2.5 имеет множество улучшений, результаты тестирования не стабильны. Затем он сравнил Images 2.5 с Images 2.0 и пришел к выводу, что в нескольких тестовых примерах 2.0 на самом деле показала лучшую реалистичность.

Таким образом, в настоящее время более точная оценка заключается в том, что Images 2.5 сосредоточена на улучшении контроля редактирования и обработки сложных инструкций, но фактические результаты для различных типов изображений все еще различаются.

03 Нарисуйте несколько линий, и она поймет

Кроме самой модели, OpenAI также добавила несколько новых способов взаимодействия с ChatGPT.

Самый прямой из них — Sketch. Пользователи могут прямо в ChatGPT рисовать эскизы, а затем позволить модели сгенерировать окончательное изображение на основе этого эскиза. Например, если хотите спроектировать комнату, можно сначала нарисовать приблизительную планировку; если хотите создать одежду, можно сначала нарисовать контур; даже если просто нарисовать грубую композицию, можно передать это ChatGPT для завершения. Затем можно добавить визуальный стиль и другие требования.

Для использования введите "@Sketch". Это фактически уменьшает зависимость от текстовых подсказок. Некоторые композиции трудно описать словами, особенно положение объектов, пропорции и приблизительные контуры. Теперь пользователи могут сначала нарисовать, а затем позволить модели дополнить.

Пользователь X @fquolodasha после тестирования высоко оценил способности GPT-Image2.5 в рисовании от руки, прямо заявив, что результат "немного крут", и восхитился тем, как быстро OpenAI обновляет свои возможности.

Пришли ChatGPT Images 2.5: на этот раз другим моделям с живыми изображениями действительно стоит волноваться

Шаблоны решают другую проблему. ChatGPT добавил несколько распространенных форматов творчества, таких как Постер и Мерч. Пользователи сначала выбирают шаблон, затем заполняют информацию, которую хотят выразить, элементы дизайна и визуальный стиль, не начиная каждый раз с пустого холста.

Обмен изображениями также добавил опцию Подсказки. Теперь пользователи могут делиться изображениями, одновременно делясь Подсказкой, использованной для создания этого изображения. Получившие его могут заменить свои фотографии и детали, чтобы продолжить генерацию.

Пример, приведенный OpenAI, — это портрет в стиле 80-х: кудрявые волосы, цветная куртка, золотая цепь, неоновые огни и музыкальный плеер. Другие пользователи могут использовать эту идею, заменив свои фотографии.

Пришли ChatGPT Images 2.5: на этот раз другим моделям с живыми изображениями действительно стоит волноваться

04 Две версии API

Images 2.5 также синхронно вошел в API. OpenAI выпустил GPT-Image-2.5 Flare и GPT-Image-2.5 Sunburst.

Flare — это версия по умолчанию, сосредоточенная на скорости, качестве и возможностях редактирования. OpenAI утверждает, что она генерирует более качественные изображения, чем GPT-Image-2, при этом задержка снижена на 50%, что делает ее подходящей для социального контента, продуктового опыта, визуального поиска, быстрого прототипирования и массовой генерации изображений.

Sunburst, в свою очередь, больше ориентирован на работу, требующую тонкого контроля, например, для официальных рекламных материалов и высококачественных изображений продуктов. Он позволяет более длительное время генерации в обмен на более высокую точность редактирования.

Ранние отзывы пользователей, опубликованные OpenAI, также сосредоточены на контроле редактирования.

Руководитель продуктов Higgsfield AI Аксултан Алимукулов (Axultan Alimkulov) особенно отметил, что Flare хорошо понимает, какие элементы должны оставаться неизменными. Для команд, работающих с кино, UGC и рекламой, это означает, что при изменении одного элемента можно максимально сохранить оригинальные персонажи, композицию и визуальную идентификацию.

Непрерывный предприниматель @gkxspace также наблюдает за этим обновлением в коммерческом рабочем процессе с изображениями. Он считает, что одним из основных ограничений прошлых AI-генераций изображений было то, что первое изображение могло быть хорошим, но было трудно стабильно создавать второе и третье на его основе. Изменения в Images 2.5 в непрерывном редактировании, скорости и точности ссылочных изображений открывают больше возможностей для использования в таких сценариях, как электронная коммерция, расширение брендовых материалов и непрерывная иллюстрация.

Пришли ChatGPT Images 2.5: на этот раз другим моделям с живыми изображениями действительно стоит волноваться

В настоящее время Images 2.5 уже охватывает пользователей ChatGPT, ChatGPT Work и Codex, а Flare и Sunburst в API также открыты. OpenAI одновременно сохраняет механизмы проверки безопасности подсказок и изображений, метаданные C2PA и невидимые водяные знаки для идентификации изображений, созданных с помощью его инструментов.

Судя по официальным примерам и текущему тестированию пользователей, акцент этого обновления очень сосредоточен: сделать изменения после генерации изображений более контролируемыми, обеспечить стабильность ссылочных изображений при их непрерывном использовании и добавить такие операции, как Эскиз, шаблоны и аннотации изображений в рабочий процесс.

Что касается реалистичности, деталей и качества изображений после многократного редактирования, существующие тесты уже показали разные результаты. Насколько Images 2.5 сможет улучшить эти проблемы, еще предстоит проверить на практике.

Join ChainCatcher Official
Telegram Feed: @chaincatcher
X (Twitter): @ChainCatcher_
warnning Предупреждение о рисках
app_icon
ChainCatcher Building the Web3 world with innovations.