# OpenAI, 신 모델 “ChatGPT Images 2.5” 발표! 진화 포인트 완벽 해설

> https://bookfactory.kr/board/news/16998
> 게시판: 뉴스
> 작성자: admin
> 작성일: 2026-09-17T02:29:43.703Z

---

![見出し画像](https://assets.st-note.com/production/uploads/images/311966128/rectangle_large_type_2_3c4aeaba23bf37789db5706ddc6fa7b4.png?width=1280)

안녕하세요, 여러분! 야샤리아입니다!

최근 SNS를 열 때마다 생각하는 것이 있다. “이건 이미 AI가 만든 이미지야, 분명”하고 바로 알아차리는 순간이 줄어들고 있다는 것이다. 몇 년 전만 해도 손이 6本이었거나, 글자들이 엉망진창이었을 때 바로 드러났다. 하지만 지금은 ぱっと見에서는 판단이 서지 않는다. 나 역시 자주 이미지 생성 기술을 업무적으로 활용하기 때문에, 이러한 발전 속도에 매번 놀라곤 한다.

그 가운데 2026년 9월 8일, OpenAI가 새로운 이미지 생성 모델을 발표했다. 그 이름은 “ChatGPT Images 2.5”였다. 이전 버전에서 단 5개월 만에 업데이트된 것이다. 너무 빠르다. 솔직히 말해서 따라가느라 숨 막힐 지경이다.

오늘은 이 새로운 모델이 무엇이 어떻게 발전했는지 살펴보겠습니다. 전문 지식이 없어도 이해하기 쉽도록, 제가 생각하는 대로 풀어서 설명해 보고 싶습니다.

## そもそも「이미지 2.0」에서 무엇이 어떻게 달라졌는지에 대한 질문은 많은 사진작가와 창작자 사이에서 꾸준히 제기되는 의문입니다. 2.0 버전이 출시된 초기에는 변경점이나 개선 사항이 명확하게 제시되지 않아 혼란을 겪었다는 목소리가 많았습니다. 특히 새로운 기능 활용 방법이나 기존 워크플로우에 통합하는 방식에 대한 충분한 정보가 제공되지 않아 많은 사용자의 당혹감을 낳았습니다. 또한 업데이트 후 호환성 문제가 발생하여 일부 작품이 정상적으로 표시되지 않는 문제도 보고되었습니다. 이러한 문제들이 2.0 버전의 보급을 저해하는 요인 중 하나가 되었다고 할 수 있습니다.

먼저 전제부터 정리하고자 한다. 이번 업데이트의 기반이 된 것은 2026년 4월에 출시된 “ChatGPT Images 2.0”이다. 이 버전에서는 2K 해상도 출력이 가능했으며, 여러 비율에 대한 대응도 이루어졌다. 웹 검색을 통해 최신 정보를 반영하는 기능과 비라틴 문자 지원 강화도 화제가 된 바 있다. 나 역시 그 때, 일본어 간판을 어느 정도 생성할 수 있게 된 것에 약간 감동한 기억이 있다.

그 이후 약 5개월 후. OpenAI는 뜻을 내세워 “Images 2.5”를 도입했다. OpenAI 공식 발표 페이지를 따르면 매주 30억 개 이상의 이미지가 ChatGPT Images 및 관련 모델을 통해 생성된다는 놀라운 숫자가 나온다. 이러한 규모로 사용되는 기능을 더욱 발전시키기 위해 나섰다. 진정성이 느껴지는 발표였다.

## 생성 속도가 최대 50% 단축되었습니다.

이번 업데이트에서 가장 체감하기 쉬운 변화는 이것이라고 생각합니다. 이미지 생성에 소요되는 시간이 Images 2.0과 비교하여 최대 50% 단축되었습니다. 대기 시간이 길면, 아무리 좋은 아이디어가 떠올랐더라도 금방 식어버릴 수 있습니다. 이는 이미지 생성 기능을 자주 사용하는 사람이라면 공감할 수 있을 것입니다. 저 또한 그렇지만, “아, 이렇게 하고 싶다!”라고 생각하는 순간의 열정은 생각보다 오래 지속되지 않는다는 것을 알 수 있습니다.

그 열기가 식기 전에 실현될 수 있다. 이는 눈에 띄지 않지만 상당히 큰 진화라고 생각한다. 일러스트레이터나 디자이너가 러프 카운트를 여러 패턴으로 만들고 싶을 때, 대기 시간 단축은 곧 작업 효율에 직접 연결된다. 15초 대기와 7초 대기 간에는 집중력의 유지 시간이 완전히 다르다. 작은 개선의 누적은 체감상으로는 큰 차이를 만들어낸다.

## 참조 이미지의 “얼굴”과 “특징”이 손상되는 현상이 줄어들었습니다.

또 다른 큰 진화로 거론되는 것이 “충실성” 향상이다. 참조 사진으로 전달한 인물이나 피사체의 특징을 보다 정확하게 보존하면서 새로운 장면이나 스타일에 변환할 수 있게 되었다고 한다. 이전 모델의 경우, 원본 사진의 얼굴이 약간 변형되는 경우가 종종 있었다. 자신의 얼굴을 아바타처럼 변환해 보려고 시도해 본 사람들도 많을 텐데, 마치 다른 사람처럼 되어버리는 경험이 있었다. 그것이 이번에 상당히 개선되었다고 한다.

조명의 자연스러움과 질감의 풍요로움도 향상되고 있습니다. 여러 번에 걸쳐 편집을 거쳐도 피사체의 특징이 훼손되기 어려워졌다고 합니다. 이전에는 편집을 거칠수록 이미지가 점차 저하되는 느낌이 있었습니다. 1회차 편집은 깨끗했지만, 5회차에는 완전히 다른 그림이 된 것과 같았습니다. Images 2.5는 이러한 ‘편집 피로’를 상당히 해소해 줄 것 같습니다.

## 지정된 부분만을 정확히 찾아 바로잡을 수 있습니다.

편집 환경의 발전은 실무적으로도 매우 긍정적인 부분이다. 지정한 부분만 변경하고 나머지 부분은 유지하는 편집 성능이 강화되었다. 예를 들어 상품 사진의 배경만 교체하고 싶을 때, 이전에는 상품 자체의 질감까지 미세하게 변하는 경우가 있었다. Images 2.5에서는 해당 부분의 정확도가 훨씬 높아졌다고 한다. 여러 턴에 걸친 편집에서도 이전의 변경 내용을 유지하기 쉬워진 점도 큰 장점이다.

복잡한 시각적 지시를 이해하는 능력 자체도 향상되고 있습니다. 현실 세계의 정보가 포함된 이미지의 내용을 보다 정확하게 처리할 수 있게 되었습니다. 투명 배경을 사용한 복잡한 레이아웃이나 지정된 비주얼 스타일에 대한 대응력도 강화되고 있습니다. 직접 테스트해 본 느낌으로는 지시를 ‘어느 정도 파악한다’는 느낌에서 ‘말로 한 바 대로 실행한다’는 느낌으로 조금씩 변화하고 있습니다. 이는 미미하지만 실무에서 사용하는 경우 신뢰감에 상당히 영향을 미치는 부분입니다.

## 새로운 기능 “스케치”를 통해 낙서가 바로 구도를 형성한다.

기능 면에서 개인적으로 가장 흥미로웠던 것은 이 “Sketch”다. ChatGPT 내에 직접 그림을 그리고, 이를 최종 이미지의 구도 지시서로 활용할 수 있는 신규 기능이다. 사용법은 간단해, ChatGPT 내에서 “@Sketch”라고 입력하면 된다. 공식 소개 영상을 보면, 어설픈 원이나 선 같은 스케치가 순식간에 완성된 일러스트로 변환되는 것을 확인할 수 있다. 글로 설명하는 것보다 그림으로 표현하는 것이 더 빠진 아이디어가 상당히 많다.

저도 예전에 UI 디자인 상담을 할 때, 구두로 전달하는 것보다 종이에 대충 스케치를 하는 것이 더 빠르고 효율적이라고 느낀 경우가 많았습니다. 그것과 같은 감각을 AI와의 대화에서도 활용할 수 있게 되었다는 뜻입니다. 글로 자세하게 설명하는 것이 어려운 사람들에게는 꽤 혁신적인 기능이라고 생각합니다. 구도의 의도를 잘 파악시켜 줄 수 있다는 점에서 실용성은 높을 것입니다.

## 템플릿과 댓글 편집으로 작업이 훨씬 수월해집니다.

지저분하지만 실용적인 것이 “템플릿 기능”이다. 브로셔나 상품 사진 등 자주 사용되는 형식에 맞춰 즉시 생성을 시작할 수 있게 되었다. 매번 처음부터 프롬프트를 생각하는 것은 생각보다 번거롭다. 템플릿이 있다면 거기에 올라타는 것만으로 충분하다. 나와 같이 서두르는 성격에는 유용한 기능이다.

또 다른 기능으로 이미지에 직접 댓글을 남길 수 있는 기능도 추가되었다. “여기를 좀 더 밝게 해줘” 또는 “이 부분만 바꿔줘”와 같은 지시를 이미지 상의 해당 부분에 직접 적을 수 있는 시스템이다. 글만으로는 어디를 어떻게 수정해 달라고 설명하는 것은 은근히 스트레스를 주는 일이었다. 하지만 손가락으로 가리키며 확인하는 듯한 느낌으로 할 수 있게 되면서 세부 수정의 주고받기가 훨씬 수월해질 것이다.

사용한 프롬프트를 공유할 수 있는 기능도 새롭게 추가되었습니다. 마음에 드는 생성 결과가 있었을 때, 그 프롬프트를 그대로 다른 사람에게 전달할 수 있습니다. 자신의 사진이나 정보를 대체하여 같은 아이디어를 시도해 보도록 요청하는 등 다양한 활용이 가능하도록 설계되었습니다.

## 개발자용 모델은 “Flare”와 “Sunburst” 두 모델입니다.

이제부터는 개발자들을 위한 이야기에도 조금 더 다루고 싶습니다. API에는 새로 두 가지 모델이 준비되어 있습니다. 하나는 “GPT-Image-2.5 Flare”입니다. 많은 용도로 기본 선택 모델이며, 기존 모델보다 고품질의 이미지를 더 낮은 레이턴시로 생성할 수 있습니다. SNS 게시물이나 크리에이터를 위한, 속도에 중점을 둔 용도에 적합해 보입니다.

또 다른 모델은 “GPT-Image-2.5 Sunburst”입니다. 이 모델은 생성 시간이 오래 걸리는 만큼, 더욱 높은 정확도를 낼 수 있는 모델로 소개되고 있습니다. 세부적인 부분까지 신경 쓰고 꼼꼼하게 작업하고 싶을 때 적합합니다. 가격은 100만 토큰당 텍스트 입력 5달러, 이미지 입력 8달러, 이미지 출력 30달러로, 두 모델 모두 동일하게 설정되어 있습니다. 단가는 자체적으로는 전 모델인 “GPT Image 2”와 동일하지만, 토큰 소비량은 달라질 수 있다는 점은 실제로 사용할 때 유의해야 합니다.

이미 Adobe Firefly나 Manus와 같은 외부 서비스에서도 이 GPT-Image-2.5의 도입이 진행되고 있다는 정보도 있다. ChatGPT의 중간뿐만 아니라, 여러 가지 창작 도구의 뒤편에서도 이 모델이 작동하기 시작할 것으로 보인다. 우리가 평소에 사용하고 있는 도구의 내부가, 우리가 알지 못하는 사이에 업데이트되고 있는 것이다. 그런 시대에, 이제 막 등장한 것이라고 생각한다.

## 무료 플랜으로도 사용 가능하다니, 그것이 꽤 큰 장점이다.

이번 업데이트에서 제가 놀랐던 점은 바로 여기였습니다. GIGAZINE의 실제 리뷰 기사에서는 ChatGPT Images 2.5가 무료 플랜으로도 이용 가능하다는 내용이 있었습니다. 최신 모델이 갑자기 무료로 공개된다는 것은 솔직히 조금 특이한 흐름이라고 생각합니다. 지금까지는 최신 기능이 우선적으로 유료 플랜을 대상으로 출시되는 것이 일반적이었습니다. 이번에는 그게 달랐습니다.

물론, 무료 플랜에는 생성 횟수 제한 등이 있을 거라고 생각합니다. 그래도 처음부터 누구나 다 만져볼 수 있는 형태로 출시하는 점은 OpenAI도 확산을 서둘러야 한다는 의도가 있을지도 모릅니다. 이미지 생성이라는 분야는 이제 Google의 ‘나노 바나나’ 시리즈처럼 경쟁이 상당히 치열합니다. 사용해주면야 그 가치가 있는 것입니다. 무료 개방은 그 경쟁 속에서 명확한 한 수 걸음일 거라고 생각합니다.

## AI가 만든 이미지 구별하는 방법

AI가 만들어낸 이미지는 마치 실제 사진처럼 보일 수 있지만, 몇 가지 특징을 통해 쉽게 구별할 수 있습니다.

**1. 디테일의 부족:** AI가 생성한 이미지는 종종 디테일이 부족하거나 부자연스러운 부분이 나타납니다. 특히, 복잡한 패턴이나 섬세한 표현이 있는 그림에서는 이러한 특징이 더욱 두드러지게 나타날 수 있습니다. 예를 들어, 잎맥이 완벽하게 정렬되지 않거나, 옷감의 주름이 자연스럽게 표현되지 않는 경우를 생각해 볼 수 있습니다.

**2. 이상한 구도:** AI는 때때로 인위적인 구도를 사용하거나, 현실에서는 보기 힘든 시점을 선택하여 이미지를 생성합니다. 사람의 얼굴이 비정상적으로 묘사되거나, 물체의 비율이 부자연스럽게 표현되는 경우도 해당됩니다.

**3. 텍스처의 부재:** AI가 생성한 이미지에는 종종 텍스처가 부족하거나, 텍스처가 부자연스럽게 표현되는 경우가 있습니다. 예를 들어, 나무 껍질의 질감이나 돌의 거칠기를 제대로 표현하지 못하는 경우를 생각해 볼 수 있습니다.

**4. 렌더링 흔적:** AI가 이미지를 생성하는 과정에서 렌더링 흔적이 남아 있을 수 있습니다. 이는 이미지의 특정 부분에서 픽셀이 깨져 보이거나, 색상이 불균일하게 표현되는 형태로 나타날 수 있습니다.

**5. 특정 브랜드의 물결 효과:** 최근 AI 이미지 생성 모델에서 많이 사용되는 ‘물결 효과’는 AI가 만든 이미지에서 자주 발견되는 특징입니다. 특히, ‘스테이블 디퓨전(Stable Diffusion)’과 같은 모델에서 생성된 이미지에는 이러한 물결 효과가 나타날 가능성이 높습니다.

**6. 이미지 품질의 불균일성:** AI가 생성한 이미지의 품질은 모델, 프롬프트, 설정 등에 따라 크게 달라질 수 있습니다. 일부 이미지에서는 매우 높은 품질로 표현되지만, 다른 이미지에서는 품질이 낮거나 왜곡된 형태로 나타날 수 있습니다.

**7. 텍스트의 부재 또는 오류:** AI가 생성한 이미지에는 종종 텍스트가 포함되지 않거나, 텍스트가 부자연스럽게 표현되는 경우가 있습니다. 예를 들어, 이미지 내에 텍스트가 자연스럽게 배치되지 않거나, 텍스트의 글꼴이나 크기가 부자연스럽게 설정되는 경우를 생각해 볼 수 있습니다.

이러한 특징들을 종합적으로 고려하여 이미지를 분석하면 AI가 만든 이미지와 실제 사진을 구별하는 데 도움이 될 것입니다. 특히, 여러 이미지를 비교해 보면서 AI가 생성한 이미지의 특징을 파악하는 것이 중요합니다.

마지막으로, 조금 진지한 이야기를 하고 싶다. OpenAI는 이번 모델에서도 C2PA 메타데이터와 숨겨진 전자 워터를 계속 사용할 것이라고 명시하고 있다. 자체 툴로 만들어진 이미지인지 여부를 기술적으로 식별할 수 있는 상태를 유지하는 것을 의미한다. 눈으로만으로는 AI 생성 여부가 구분되지 않는 현상이 나타나기 때문에 이러한 내부 메커니즘이 중요하다. 발표와 동시에 공개된 시스템 카드에도 이 안전 관련 노력이 요약되어 있다.

이미지가 이렇게 자연스러워지면 실제보다 더 잘 보이게 하는 편집과의 경계도 신경 쓰게 된다. 특히 상품 사진 등에서는 실제와 동떨어진 결과물이 나오면 예상치 못한 문제로 이어질 수 있다. 유용한 기능이 늘어날수록 사용하는 사람의 윤리라고 할 수 있는 선의 경계에 대한 인식도 요구된다. 그 부분은 앞으로 AI 이미지를 업무에 활용해 나갈 사람일수록 주의해야 할 부분이다.

## 창의적인 현상은 앞으로 어떻게 변화해 나갈 것인지

이번 “Images 2.5”는 지난주에 발표된 바로 그 “GPT-6 Astra”에 이은 연속적인 업데이트였다. TechRadar의 리뷰에서도 기능이 너무 많이 추가되어 오히려 “어디를 봐야 할지 알기 어렵다”는 정도로 과장된 내용이 담겨 있었다. 이는 이 분야의 개발 경쟁이 더욱 가속화되고 있다는 것을 의미한다고 생각한다. 6개월도 채 안 되는 기간 안에 다음 버전이 나올 것이다. 그런 속도에 이미 놀라지 않는 나 자신이 있다.

디자이너와 크리에이터에게는 위기이자 기회다. 러프 초안 제작이나 배경 대체와 같은 단순 작업은 점점 더 AI에게 맡겨질 수 있게 될 것이다. 그만큼 인간은 “무엇을 만들고 싶은가”라는 아이디어 부분에 더 많은 시간을 할애할 수 있게 될 것이다. 도구가 더 똑똑해질수록, 사용자의 감각이 그대로 결과에 반영되기 쉽다. 그런 시대가 머지않게 도래한 듯하다.

저도 곧 이 모델로 몇 가지 시제품 이미지를 제작해 보려고 합니다. OpenAI의 소개 영상에는 실제 생성 예시가 몇 가지 소개되어 있으니, 분위기를 느끼고 싶은 분들은 참고해 보시기를 추천합니다. 글로 읽는 것보다 움직이는 모습을 보는 것이 진화된 느낌이 더 잘 드는 것 같습니다.

이미지 생성 AI는 최근 몇 년 동안 장난감에서 비즈니스 툴로 자리매김하는 데 큰 변화를 가져왔다. 이번 “ChatGPT Images 2.5” 발표는 이러한 흐름을 더욱 발전시키는 중요한 발표였다고 생각한다. 앞으로 어떤 업데이트가 나올지 기대하며, 즐비하게 기다리고 있다.

마지막까지 읽어주셔서 감사합니다. 다음 글에서 뵙겠습니다.

**출처:** [note 원문](https://note.com/yarxaria/n/n5560d87970a6)

*번역: Gemma 3(.44) 초벌 + 교정 24청크*

[원문 보기](https://note.com/yarxaria/n/n5560d87970a6) | 출처: note.com