BTC $78,214.46 -0.15%
ETH $2,465.37 -0.49%
BNB $737.51 -1.42%
XRP $1.40 -1.13%
SOL $102.37 -0.54%
TRX $0.3394 +0.31%
DOGE $0.0867 -2.99%
ADA $0.2143 -2.69%
BCH $254.82 -0.54%
LINK $11.89 -5.30%
HYPE $84.77 +0.80%
AAVE $126.21 -1.99%
SUI $0.7867 -3.03%
XLM $0.1830 -2.56%
ZEC $1,248.93 +8.86%
BTC $78,214.46 -0.15%
ETH $2,465.37 -0.49%
BNB $737.51 -1.42%
XRP $1.40 -1.13%
SOL $102.37 -0.54%
TRX $0.3394 +0.31%
DOGE $0.0867 -2.99%
ADA $0.2143 -2.69%
BCH $254.82 -0.54%
LINK $11.89 -5.30%
HYPE $84.77 +0.80%
AAVE $126.21 -1.99%
SUI $0.7867 -3.03%
XLM $0.1830 -2.56%
ZEC $1,248.93 +8.86%

ChatGPT 이미지 2.5가 왔습니다: 이번에는 다른 생사진 모델들이 정말 긴장해야 할 것입니다

핵심 관점
Summary: 새로운 버전은 이미지 편집, 참조 이미지의 진실성 및 다중 수정의 일관성을 크게 향상시켰습니다.
텐센트 테크놀로지
2026-09-09 23:50:47
새로운 버전은 이미지 편집, 참조 이미지의 진실성 및 다중 수정의 일관성을 크게 향상시켰습니다.

저자:샤오징, 텐센트 테크

편집:쉬칭양, 텐센트 테크

미국 현지 시간 9월 8일, OpenAI는 최신 생화상 모델 ChatGPT Images 2.5를 발표했습니다.

새로운 버전은 이미지 편집, 참조 이미지의 보존 및 다중 수정의 일관성을 크게 향상시켰습니다. 사용자가 한 이미지를 연속적으로 수정할 때, 이전에 조정한 내용이 더 쉽게 보존됩니다. 인물, 제품 또는 배경을 수정할 때도 지정된 부분만 변경하기가 더 쉬워졌습니다. 생성 속도는 Images 2.0보다 최대 50% 빨라졌습니다.

동시에 ChatGPT는 스케치, 템플릿 및 이미지 코멘트 기능을 추가했습니다. 사용자는 직접 스케치를 그려 참조로 사용할 수 있으며, 이미지에서 수정이 필요한 위치를 표시할 수도 있습니다. 개발자는 API를 통해 GPT-Image-2.5 Flare와 GPT-Image-2.5 Sunburst를 사용할 수 있습니다.

OpenAI는 현재 사용자가 매주 ChatGPT Images와 API의 GPT-Image 모델을 통해 30억 장 이상의 이미지를 생성하고 있다고 밝혔습니다. Images 2.5는 이미 ChatGPT, ChatGPT Work 및 Codex 사용자에게 개방되어 웹, 데스크톱 및 모바일을 아우릅니다.

ChatGPT 이미지 2.5가 왔습니다: 이번에는 다른 생사진 모델들이 정말 긴장해야 할 것입니다

01 한 곳을 수정해도 전체 이미지가 흐트러지지 않음

AI 생화상의 진짜 문제는 종종 첫 번째 이미지가 생성된 후에 발생합니다. 예를 들어, 인물에 만족하지만 옷만 바꾸고 싶을 때, 제품이 이미 확정되었지만 배경만 바꾸고 싶을 때, 포스터가 이미 완성되었지만 한 줄의 글자만 수정하고 싶을 때, 과거에는 계속 수정할 때 이미지의 다른 부분도 함께 변화할 수 있었습니다.

Images 2.5는 정밀 편집을 중요한 위치에 두었습니다. OpenAI가 제시한 사례에는 "전신 편집"과 "다중 도시 여행 티켓"이 포함됩니다. 이러한 데모는 연속 이미지를 사용하여 수정 과정을 보여주며, 모델이 지시에 따라 지정된 내용을 조정할 수 있는지, 동시에 원래의 주체, 구도 및 기타 세부 사항을 보존할 수 있는지를 중점적으로 살펴봅니다.

ChatGPT 이미지 2.5가 왔습니다: 이번에는 다른 생사진 모델들이 정말 긴장해야 할 것입니다

"다중 도시 여행 티켓" 사례는 비교적 이해하기 쉽습니다. 이미지에서 단지 하나의 정보만 변경해야 할 경우, 모델은 구체적인 수정 대상을 인식해야 하며, 동시에 전체 티켓의 디자인 구조를 유지해야 합니다. 제품 이미지, 광고 자료, 브랜드 포스터의 경우, 이러한 능력은 단순히 아름다운 이미지를 생성하는 것보다 더 실용적입니다.

또 다른 주요 포인트는 다중 편집입니다. OpenAI는 "큐브 회전", "여행 정보 그래픽" 및 "생일 촛불" 세 가지 사례를 보여주었습니다. 이들은 한 번 생성하고 끝나는 것이 아니라 연속적으로 여러 번 수정됩니다. OpenAI가 증명하고자 하는 것은 이전의 수정이 계속 보존될 수 있으며, 이후의 작업이 이미 완료된 내용을 계속 파괴하지 않는다는 것입니다.

ChatGPT 이미지 2.5가 왔습니다: 이번에는 다른 생사진 모델들이 정말 긴장해야 할 것입니다

이것이 바로 Images 2.5 이번 업그레이드에서 가장 주목할 만한 점입니다.

X 사용자 @thesoragirls는 매우 직접적인 테스트를 수행했습니다: 이미지에서 촛불을 그리면서 한 송이 꽃잎은 변하지 않도록 지정하고, 모델이 다른 영역을 수정할 때 원래의 내용이 영향을 받는지 관찰했습니다. 그녀의 테스트 결과는 고정된 꽃잎이 보존되었고, 다른 부분은 요구 사항에 따라 변화했다고 나타났습니다.

ChatGPT 이미지 2.5가 왔습니다: 이번에는 다른 생사진 모델들이 정말 긴장해야 할 것입니다

그러나 연속 편집이 세부 사항 문제를 완전히 해결하지는 못했습니다. 일본 애니메이션 제작자 @genel_ai는 실제 테스트에서 공식이 여러 번 편집 후 화질을 유지할 수 있다고 강조했지만, 편집이 계속 겹칠 때 이미지에서 여전히 톱니 모양과 질감 변화가 발생할 수 있음을 발견했습니다.

ChatGPT 이미지 2.5가 왔습니다: 이번에는 다른 생사진 모델들이 정말 긴장해야 할 것입니다

즉, 2.5는 안정성에서 개선되었지만 복잡한 장면에서는 여전히 화질 손실이 발생할 수 있습니다.

02 참조 이미지, 더 안정적이 됨

Images 2.5의 두 번째 변화는 참조 이미지 처리입니다.

사용자는 인물, 애완동물 또는 기타 주체의 사진을 제공하고, 이를 새로운 장면으로 이동시키거나 다른 시각적 스타일로 변경하거나 구성을 변경하도록 요청할 수 있습니다. OpenAI는 새로운 버전이 인물의 인식 특성을 더 쉽게 보존하고, 동시에 조명과 질감 표현을 개선한다고 밝혔습니다.

공식은 다섯 가지 사례를 제시했습니다: "재디자인된 아기 초상화", "의상을 입은 개", "사진 부스 프로필", "다인 파티 합성 사진" 및 "침대 정리".

ChatGPT 이미지 2.5가 왔습니다: 이번에는 다른 생사진 모델들이 정말 긴장해야 할 것입니다

이 몇 가지 사례는 다양한 상황을 다룹니다. 아기 초상화와 사진 부스 프로필은 주로 인물 특성이 유지될 수 있는지를 살펴보며, 개의 사례는 주체가 의상을 바꾼 후에도 원래의 이미지를 유지할 수 있는지를 확인합니다. 다인 파티 합성 사진은 여러 인물이 동시에 한 이미지에 나타나는 것을 포함하며, "침대 정리"는 일상적인 이미지 편집에 더 가까워 원래 장면을 구체적으로 조정해야 합니다.

ChatGPT 이미지 2.5가 왔습니다: 이번에는 다른 생사진 모델들이 정말 긴장해야 할 것입니다

이러한 능력은 동일한 인물, 제품 또는 브랜드 자료를 지속적으로 사용하는 작업에 매우 중요합니다. API 사용자는 동일한 참조 이미지를 기반으로 다양한 버전을 생성하여 매번 재생성할 때 발생하는 뚜렷한 변화를 줄일 수 있습니다.

복잡한 화면도 이번 공식 사례의 주요 포인트입니다. OpenAI는 1950년대 스타일의 가족 일러스트를 보여주었습니다: 가족이 거대한 원통형 우주 거주지 앞에 서 있으며, 그 안에는 녹색 경관, 호수 및 미래 건축물이 포함되어 있습니다.

ChatGPT 이미지 2.5가 왔습니다: 이번에는 다른 생사진 모델들이 정말 긴장해야 할 것입니다

OpenAI 공식 소개 페이지는 이창 여행 페이지를 보여주었습니다: 여행 목적지, 관광 정보, 이미지 및 텍스트 내용을 동일한 페이지에 배치하여 전체 여행 가이드를 작성합니다. 이는 여러 이미지를 동시에 처리하고, 다양한 수준의 텍스트와 페이지 레이아웃을 조정해야 하며, 단일 요소만 잘 만드는 것이 아닙니다.

ChatGPT 이미지 2.5가 왔습니다: 이번에는 다른 생사진 모델들이 정말 긴장해야 할 것입니다

또한 중세 현대주의 포스터의 9개 격자 세트가 있으며, 각 포스터에는 "Create", "Grow together", "Choose kindness"와 같은 다양한 기하학적 도형과 텍스트가 포함되어 있습니다.

또 다른 이미지는 샌프란시스코 거리의 인상파 장면으로, 거리는 다채로운 집들 사이로 내려가며, 만과 금문교를 볼 수 있습니다.

ChatGPT 이미지 2.5가 왔습니다: 이번에는 다른 생사진 모델들이 정말 긴장해야 할 것입니다

또한 크림 금색의 레이크 코모 결혼식 초대장, 거꾸로 된 미래 도시, 8장의 미국 국립공원 복고풍 우표, 태양 플레어 과학 슬라이드, 파란 금색 지구 모자이크, ChatGPT 스티커 포스터, 그리고 비 오는 밤의 미래 도시가 있습니다.

ChatGPT 이미지 2.5가 왔습니다: 이번에는 다른 생사진 모델들이 정말 긴장해야 할 것입니다

이러한 사례는 일러스트, 포스터, 초대장, 인포그래픽, 과학 그래픽 및 제품 홍보 그래픽 등 다양한 유형을 포괄합니다. OpenAI가 보여주고자 하는 핵심도 비교적 명확합니다: 프롬프트가 동시에 화면 구조, 텍스트, 시각적 스타일 및 구체적인 요소를 규정할 때, Images 2.5는 이러한 요구 사항을 더 완전하게 수행할 수 있습니다.

패션 기업가 야나 웰린더는 테스트 후 Images 2.5가 패션 디자인에서의 성능이 눈에 띄게 향상되었다고 평가했습니다. 그녀는 이전에 구형 모델을 사용할 때 참조 디자인이 보존될 수 있었지만 최종 효과가 때때로 평면적이었다고 언급했습니다. 그녀는 2.5가 원래의 디자인을 더 완전한 시각적 효과로 나타낼 수 있다고 생각합니다.

ChatGPT 이미지 2.5가 왔습니다: 이번에는 다른 생사진 모델들이 정말 긴장해야 할 것입니다

하지만 반대의 테스트 결과를 제시한 사람도 있습니다. AI 및 소프트웨어 엔지니어 마크 크레치만은 숲 장면의 노이즈와 아티팩트 테스트를 수행했습니다.

ChatGPT 이미지 2.5가 왔습니다: 이번에는 다른 생사진 모델들이 정말 긴장해야 할 것입니다

그는 2.5가 많은 개선이 있지만 테스트 결과가 불안정하다고 생각했습니다. 이후 그는 Images 2.5와 Images 2.0을 비교하며 자신이 테스트한 여러 사례 중 2.0이 사실감 면에서 오히려 더 좋다고 평가했습니다.

따라서 현재 더 정확한 판단은, Images 2.5가 편집 제어 및 복잡한 지시 처리에서 주요 개선을 이루었지만, 서로 다른 이미지 유형에서의 실제 효과는 여전히 차이가 있다는 것입니다.

03 몇 번 그리면, 이해함

모델 자체 외에도 OpenAI는 ChatGPT에 몇 가지 새로운 작업 방식을 추가했습니다.

가장 직접적인 것은 스케치입니다. 사용자는 ChatGPT에서 직접 스케치를 그린 다음, 모델이 이 스케치를 기반으로 최종 이미지를 생성하도록 할 수 있습니다. 예를 들어 방을 디자인하고 싶다면 대략적인 레이아웃을 먼저 그릴 수 있습니다. 옷을 만들고 싶다면 윤곽을 먼저 그릴 수 있습니다. 심지어 매우 대충 그린 구도를 ChatGPT에게 계속 완성하도록 할 수도 있습니다. 이후 시각적 스타일 및 기타 요구 사항을 추가하면 됩니다.

사용 시 " @Sketch"를 입력하면 호출할 수 있습니다. 이는 실제로 텍스트 프롬프트에 대한 의존도를 줄입니다. 어떤 구성은 언어로 설명하기 어려운 경우가 많으며, 특히 물체의 위치, 비율 및 대략적인 윤곽이 그렇습니다. 이제 사용자는 먼저 그리고 모델이 보완하도록 할 수 있습니다.

X 사용자 @fquolodasha는 테스트 후 GPT-Image2.5의 손그림 능력에 대해 매우 높은 평가를 하며, 이번 효과가 "조금 대단하다"고 말하며 OpenAI의 최근 업데이트 속도와 능력 향상이 매우 빠르다고 감탄했습니다.

ChatGPT 이미지 2.5가 왔습니다: 이번에는 다른 생사진 모델들이 정말 긴장해야 할 것입니다

Templates는 또 다른 문제를 해결합니다. ChatGPT는 포스터와 머천다이즈와 같은 일반적인 창작 형식을 추가했습니다. 사용자는 먼저 템플릿을 선택한 다음, 표현하고자 하는 정보, 디자인 요소 및 시각적 스타일을 입력하면 매번 빈 캔버스에서 시작할 필요가 없습니다.

이미지 공유는 프롬프트 옵션도 추가되었습니다. 사용자는 이제 이미지를 공유할 때, 이 이미지를 생성하는 데 사용된 프롬프트도 함께 공유할 수 있습니다. 다른 사람은 이를 받아 자신의 사진과 세부 사항으로 교체하여 계속 생성할 수 있습니다.

OpenAI가 제시한 예시는 1980년대 스타일의 인물 사진입니다: 곱슬머리, 컬러 재킷, 금 체인, 네온사인 및 음악 플레이어. 다른 사용자들은 이 아이디어를 따라 자신의 사진으로 교체할 수 있습니다.

ChatGPT 이미지 2.5가 왔습니다: 이번에는 다른 생사진 모델들이 정말 긴장해야 할 것입니다

04 두 개의 API 버전

Images 2.5도 API에 동기화되었습니다. OpenAI는 GPT-Image-2.5 Flare와 GPT-Image-2.5 Sunburst를 출시했습니다.

Flare는 기본 버전으로, 속도, 품질 및 편집 능력에 중점을 두고 있습니다. OpenAI는 이것이 GPT-Image-2보다 더 높은 품질을 생성하며, 지연 시간을 50% 줄여 소셜 콘텐츠, 제품 경험, 시각적 검색, 빠른 프로토타입 및 대량 이미지 생성에 적합하다고 말합니다.

Sunburst는 공식 광고 자료 및 고품질 제품 이미지와 같이 세밀한 제어가 필요한 작업에 더 적합합니다. 더 높은 편집 정확도를 얻기 위해 더 긴 생성 시간을 허용합니다.

OpenAI가 발표한 초기 사용자 피드백도 편집 제어에 집중되었습니다.

Higgsfield AI 제품 책임자 아크술탄 알리믹울로프는 Flare가 어떤 내용을 유지해야 하는지 잘 이해한다고 특별히 언급했습니다. 영화, 사용자 생성 콘텐츠 및 광고 팀에게 이는 하나의 요소를 수정할 때 원래의 캐릭터, 구성 및 시각적 인식을 최대한 유지할 수 있음을 의미합니다.

연속 창업자 @gkxspace는 이번 업데이트를 상업 이미지 작업 흐름에 적용하여 관찰했습니다. 그는 과거 AI 생 이미지의 가장 큰 제한 중 하나가 첫 번째 이미지가 좋더라도 두 번째, 세 번째 이미지를 안정적으로 제작하기 어려웠다고 생각합니다. Images 2.5의 연속 편집, 속도 및 참조 이미지의 보존 변화는 전자상거래 의상 변경, 브랜드 자료 확장 및 연속 일러스트와 같은 장면에서 실제 사용 공간을 더 넓혔습니다.

ChatGPT 이미지 2.5가 왔습니다: 이번에는 다른 생사진 모델들이 정말 긴장해야 할 것입니다

현재 Images 2.5는 ChatGPT, ChatGPT Work 및 Codex 사용자에게 적용되었으며, API의 Flare와 Sunburst도 동시 개방되었습니다. OpenAI는 또한 프롬프트 및 이미지 안전 검사, C2PA 메타데이터 및 보이지 않는 워터마크와 같은 메커니즘을 유지하여 자사의 도구로 생성된 이미지를 식별합니다.

공식 사례와 현재 사용자 테스트를 보면, 이번 업데이트의 초점은 매우 집중되어 있습니다: 이미지 생성 후 수정이 더 쉽게 제어되도록 하고, 참조 이미지가 연속 사용 시 더 안정적이도록 하며, 스케치, 템플릿 및 이미지 주석과 같은 작업을 작업 흐름에 추가하는 것입니다.

실감, 세부 사항 및 다중 편집 후 화질에 관해서는 기존 테스트에서 다양한 결과가 나타났습니다. Images 2.5가 이러한 문제를 얼마나 개선할 수 있을지는 더 많은 실제 사용을 통해 검증해야 합니다.

Join ChainCatcher Official
Telegram Feed: @chaincatcher
X (Twitter): @ChainCatcher_
warnning 위험 경고
app_icon
ChainCatcher Building the Web3 world with innovations.