2026년 9월 8일, OpenAI가 ChatGPT Images 2.5를 출시했습니다. ChatGPT 화면에서 사용하는 제품명은 이것으로, API 측면의 모델은 gpt-image-2.5라는 이름으로 제공됩니다.
ChatGPT 이미지 2.5 출시를 기념하여 OpenAI는 최첨단 이미지 생성 모델 ChatGPT 이미지 2.5를 소개합니다.
ChatGPT 이미지 2.5는 이전 버전 대비 더욱 정교하고 사실적인 이미지를 생성할 수 있도록 개선되었으며, 특히 복잡한 프롬프트에 대한 이해도가 높아져 사용자의 의도를 정확하게 반영한 결과물을 제공합니다.
또한 텍스트 기반 프롬프트 외에도 이미지 캡션을 기반으로 이미지를 생성하는 기능이 강화되어 사용자는 기존 이미지에 대한 설명을 입력하여 새로운 이미지를 생성하고 창의적인 아이디어를 더욱 쉽게 구현할 수 있습니다.
OpenAI는 ChatGPT 이미지 2.5를 통해 다양한 분야에서 혁신적인 시각적 콘텐츠 제작을 지원할 것을 약속합니다. 예술가, 디자이너, 마케터 등 다양한 분야의 전문가들이 ChatGPT 이미지 2.5를 활용하여 새로운 가능성을 탐색하고 더욱 창의적이고 혁신적인 결과물을 만들어낼 수 있기를 기대합니다.
손대지 않은 그림에서 괴물이 태어났다.
스케치는 입력란 메뉴에서 선택하면 즉석에서 그림을 그려 첨부할 수 있는 기능입니다. 글로 표현하기 어려운 배치나 형태를 선 그대로 전달할 수 있습니다.
오렌지색 펜으로 사각형 몸체를 그리고 짧은 다리 4개와 눈 2개를 추가했습니다. 위에는 파란색 물결선으로 하늘을, 아래에는 녹색 물결선으로 풀을 표현했으며, 아이의 낙서입니다. 여기에 덧붙여 “이 그림을 바탕으로 앞으로 상상력을 발휘하여 매우 사실적인 이미지를 만들어 주세요”라고 요청했습니다.
나와온 것은 초원에 서 있는 푹신한 오렌지색의 생명체였습니다. 몸은 낙서처럼 사각형이었고, 양쪽에 튀어나온 부분이 있었으며, 짧은 다리가 4개였습니다. 털 하나하나가 완벽하게 묘사되어 있었고, 눈은 검은 플라스틱처럼 빛나고 있었습니다. 인형 같기도 하고, 정체불명의 짐승 같기도 했습니다.
다시 한 번, 이번에는 원본 낙서도 옆에 놓아 달라고 부탁했습니다. 참고로 이 낙서는 원작인 클로드 코드의 마스코트인 오렌지 게, 클라우드입니다. 그러자 납작한 종이 작품 같은 모습의 낙서 버전이, 푹신한 버전 옆에 서서 “와!” 하며 놀라워했습니다.
판보 2.5, 이미지 내 기록 2.0
지금까지는 새로운 기능에 대한 설명이었습니다. 궁금했던 점은 이 그림이 새로운 GPT-Image 2.5로 생성되었는지 여부였습니다. ChatGPT 화면에는 이미지 모델을 선택하는 기능이 없어서, 겉으로 보기만으로는 알 수 없었습니다.
먼저, 이미지 제작 페이지의 HTML을 확인했습니다. 제목과 og:title 모두 “ChatGPT 이미지 2.5 | AI 이미지 생성 툴”입니다. 입구에 해당하는 페이지의 이름은 2.5로 되어 있습니다.
다음으로, 생성된 이미지 자체를 조사했습니다. OpenAI는 생성 이미지에 C2PA라는 출처 정보를 내장하고 있으며, PNG 안의 caBX チャン크에 포함되어 제작자 및 처리 이력을 서명과 함께 기록할 수 있는 시스템입니다.
꺼낸 내용물이 이것이었습니다.
- 저자: OpenAI 미디어 서비스 API
- 소프트웨어 에이전트: 이름은 GPT-Image, 버전은 2.0
- 기록된 작업: 생성, 변환, 전자 워터마크 적용
버전은 2.0이었습니다. 2.5라는 문자열은 매니페스트 어디에도 없었습니다. API 측의 2.5에는 flare와 sunburst라는 두 개의 모델이 있었지만, 그 이름도 나타나지 않았습니다. 9월 9일에 생성한 이미지는 5장, ChatGPT 본체와 업무용 Work 모드, 개발자용 Codex와 경로를 다르게 검색했습니다. 5장 모두 동일한 값을 보여주었습니다.
여기에는 신중하게 작성하겠지만, softwareAgent는 작동한 소프트웨어를 기록하는 항목에서 생성 모델 자체의 버전을 쓰는 항목이라고 단정할 수 없습니다. OpenAI가 이 항목에 쓴 이름이 2.0이었다는 점까지는 확실합니다.
이 欄이 한 번도 업데이트되지 않는 고정값일까 하는 생각도 해봤습니다. 4월 20일에 생성한 이미지와 비교했는데, 당시 이름은 GPT-4o였고, ‘version’이라는 키 자체가 존재하지 않았습니다. 전자 워터마크 기록도 없었습니다. 반년 동안 형식이 바뀌면서 완전히 정적이지는 않지만, 완전히 움직이지 않는 값은 아닙니다.
하지만 4월 20일이라는 날짜는 GPT 이미지 2가 공개되기 전날입니다. 이미지 생성 기능이 대화 모델의 기능으로 설명되었던 시기와 독립적인 모델 시리즈로 나뉜 이후의 경계에 해당합니다. 세대의 변화점에서는 수정해도 무방하지만, 2.0에서 2.5와 같이 작은 버전의 차이까지 추적할 수 있는지는 이 정보만으로는 알 수 없습니다.
API도 확인했습니다. OpenAI는 gpt-image-2.5-flare와 gpt-image-2.5-sunburst를 API에서도 제공한다고 발표했습니다. 공식 문서에도 두 모델 페이지가 있습니다. 그런데 9월 9일, API를 직접 사용해 볼 수 있는 Playground를 자신의 계정으로 열어보았습니다. 모델 목록에는 2.5 시리즈는 하나도 표시되지 않았습니다. 대신 다음 6가지 모델이 나타났습니다.
ChatGPT 이미지, GPT 이미지 1, GPT 이미지 1 미니, GPT 이미지 1.5, GPT 이미지 2, GPT 이미지 2 (2026년 4월 21일)
밖에서 확인할 수 있는 정보는 여기까지입니다. 입구는 2.5를 명칭하며, 이미지에 남아있는 기록은 2.0을 명칭합니다. 또한, 공식적으로 제공되어야 할 2.5 모델이 자신의 Playground에는 나타나지 않습니다. 이 세 가지를 나열하는 것만으로는 실제 실태가 무엇인지 결정할 수 없습니다.
## 이미지 생성 | OpenAI API
OpenAI의 이미지 생성 API를 사용하면 텍스트 설명을 기반으로 고품질 이미지를 생성할 수 있습니다. 이 API는 GPT-3와 같은 강력한 언어 모델을 활용하여 사용자가 원하는 이미지를 정확하게 생성하도록 돕습니다.
이미지 생성 API는 다음과 같은 기능을 제공합니다.
* **다양한 스타일 지원:** 사진, 그림, 3D 렌더링 등 다양한 스타일의 이미지를 생성할 수 있습니다.
* **정교한 제어:** 텍스트 설명에 포함된 키워드, 스타일, 구도 등을 통해 이미지 생성 과정을 정교하게 제어할 수 있습니다.
* **자동 최적화:** 생성된 이미지는 다양한 해상도와 형식으로 자동 최적화되어 사용 목적에 맞게 활용할 수 있습니다.
OpenAI의 이미지 생성 API는 예술가, 디자이너, 마케터 등 다양한 분야의 전문가들에게 혁신적인 도구로 활용될 수 있습니다. 예를 들어, 광고 캠페인에 필요한 독특한 이미지를 빠르게 생성하거나, 새로운 제품 디자인을 시각화하는 데 사용할 수 있습니다.
이 API를 사용하려면 OpenAI 계정을 생성하고 API 키를 발급받아야 합니다. 자세한 내용은 OpenAI 공식 웹사이트([https://openai.com/](https://openai.com/))에서 확인할 수 있습니다.
3. 자신의 이미지로 확인하는 방법
1. 앱 내에서 이미지 선택: ‘사진 선택’ 버튼을 누릅니다.
2. 이미지 선택: 갤러리에서 자신의 사진을 선택합니다.
3. 확인: 선택한 이미지가 앱에 표시되면 확인 버튼을 누릅니다.
4. 결과 확인: 앱에서 표시되는 결과와 자신의 사진을 비교하여 확인합니다.
이 방법을 통해 본인의 이미지와 앱에서 제공하는 결과가 일치하는지 정확하게 확인할 수 있습니다.
누구나 같은 시도를 해 볼 수 있습니다.
ChatGPT로 이미지를 생성하면 다운로드 버튼에서 원본 파일을 저장해야 합니다. 이것이 핵심입니다. 채팅에 다시 붙여넣거나 스크린샷으로는 확인할 수 없습니다. OpenAI는 자체적으로 C2PA와 같은 메타데이터가 플랫폼이나 편집 도구, 파일 변환 과정에서 삭제될 수 있다고 설명하고 있습니다. 실제로 X(트위터)에 게시된 이미지를 확인해 보았더니, JPEG 파일에 C2PA가 들어가는 영역은 APP11이었지만, 그 영역 전체는 사라지고 이미지의 기본 정보를 담은 JFIF 헤더만 남아 있었습니다.
읽어들이기에만 소요되는 검증 페이지가 2개 있습니다. OpenAI 자체에서 발행한 것과 C2PA 연합의 콘텐츠 크레덴셜입니다. 동일한 파일을 모두 넣어보았습니다.
OpenAI 측에서는 “OpenAI 툴로 생성되었습니다”라는 문구를 표시하고, SynthID 워터마크와 C2PA 매니페스트를 모두 감지합니다. 모델 이름도 표시됩니다. 하지만 gpt-image까지는 버전 2.0이 포함되지 않습니다. 생성 시각으로 “2026년 9월 9일 9:00 JST”가 표시되지만, 파일에 기록되어 있는 것은 날짜일 뿐이며, 9시는 00:00 UTC를 일본 시간에 맞춘 가상 값입니다.
콘텐츠 자격 증명 부분은 AI 툴로 생성된 것, 기록된 작업이 Created 및 Format converted 되는 것, 발행처가 OpenAI Media Service(OpenAI OpCo, LLC)인 것까지 포함됩니다. 원본 파일에는 전자 워터마크를 넣은 기록도 남아있지만, 이는 작업 항목에 포함되지 않았습니다.
어떤 화면도 2.0에 도달하지 못합니다. 버전 정보를 알고 싶다면 파일을 직접 읽어야 합니다. macOS의 경우 터미널에서 한 줄의 명령어로 실행하면 됩니다.
9월 9일에 생성된 이미지에서는 다음과 같이 나타났습니다.
읽기 어려운 이유는 단어와 단어 사이에 문자 수를 나타내는 기호가 섞여 있기 때문입니다. ‘?’는 문자로서 표시할 수 없는 바이트입니다. 그 부분을 건너뛰고 읽으면 이름이 gpt-image, 버전이 2.0으로 표시되는 것을 알 수 있습니다. 4월 20일에 동일한 작업을 수행하면 이름 부분은 GPT-4o로 바뀌고 버전의 키 자체가 나타나지 않습니다.
덧붙여서, OpenAI 발표 페이지에서 저장한 샘플 이미지에도 C2PA의 기체능 정보는 발견되지 않았습니다. SVG로 배포되던 방식은 이미지를 삽입한 데 더해 “ChatGPT Images 2.5”라는 텍스트를 겹쳐 놓은 형태였으며, 화면에 보이는 2.5는 메타데이터가 아닙니다.
C2PA 부재와 출처 정보 부재는 동일하지 않습니다. OpenAI는 또한 비가시적인 전자 워터마크(SynthID)를 함께 사용하며, 이는 픽셀에 내장되어 메타데이터 제거 시에도 유지됩니다. 워터마크 감지 시 콘텐츠가 OpenAI 도구에서 유래했을 가능성이 높다고 판단할 수 있지만, ChatGPT, API, Codex 등 모델 버전은 확인할 수 없습니다. 메타데이터와 마찬가지로 동일한 위치에 고정됩니다.
콘텐츠 신뢰도 검증에 대한 추가 정보입니다.
저희는 콘텐츠 신뢰도 검증 시스템을 통해 콘텐츠의 정확성과 신뢰성을 보장합니다. 이 시스템은 다음과 같은 단계를 거쳐 진행됩니다.
1. 콘텐츠 분석: 콘텐츠의 내용, 출처, 작성자 등을 분석합니다.
2. 전문가 검토: 해당 분야 전문가가 콘텐츠의 정확성을 검토합니다.
3. 데이터베이스 비교: 콘텐츠의 내용이 다른 데이터베이스와 비교됩니다.
4. 신뢰도 점수 부여: 위 단계들을 종합적으로 고려하여 콘텐츠에 신뢰도 점수를 부여합니다.
신뢰도 점수가 높은 콘텐츠는 ‘신뢰도 검증’ 마크가 표시됩니다. 이 마크는 해당 콘텐츠가 높은 신뢰도를 가지고 있음을 나타냅니다.
저희는 콘텐츠의 신뢰도를 높이기 위해 지속적으로 시스템을 개선하고 있습니다. 또한, 콘텐츠 작성자에게 정확하고 신뢰할 수 있는 정보를 제공할 것을 요청합니다.
궁금한 점이 있으시면 언제든지 문의해주세요.
OpenAI가 생성한 콘텐츠에 Provenance 신호(콘텐츠 자격 증명, SynthID)를 추가하는 것은 콘텐츠의 출처와 진위 여부를 명확히 하는 데 매우 중요합니다. 특히, OpenAI의 GPT 모델을 활용하여 생성된 텍스트, 이미지, 오디오, 비디오 등 다양한 유형의 콘텐츠에 Provenance 신호를 적용함으로써 콘텐츠의 창작자와 사용자가 콘텐츠의 출처를 쉽게 확인할 수 있도록 합니다.
Provenance 신호는 콘텐츠의 메타데이터에 포함되어 창작 과정, 사용된 데이터, 생성 모델 등의 정보를 담고 있습니다. 이를 통해 사용자는 콘텐츠의 진위 여부를 판단하고, 창작자와 연락을 취하거나 콘텐츠의 사용 권한을 확인하는 등 다양한 활동을 수행할 수 있습니다.
또한, Provenance 신호는 콘텐츠의 무단 사용을 방지하고 저작권 침해 문제를 해결하는 데 기여합니다. 콘텐츠의 출처가 명확하게 밝혀져 있을 경우, 사용자는 해당 콘텐츠의 무단 사용 행위를 식별하고 저작권 침해에 대한 법적 조치를 취할 수 있습니다.
OpenAI는 Provenance 신호의 도입을 통해 콘텐츠의 신뢰도를 높이고 콘텐츠 생태계의 투명성을 강화하는 데 기여할 것으로 기대합니다. 앞으로도 OpenAI는 Provenance 신호의 활용을 확대하고 콘텐츠 생성자와 사용자 모두에게 유용한 도구로 발전시켜 나갈 것입니다.
덧붙여 측정한 자세 유지
어떤 모델이 만든 것인지 알 수 없는 상태이지만, 이름이 불확실하더라도 그 ‘무언가’가 현재 어떤 방식으로 작동할지를 측정할 수 있습니다.
이번 업데이트에서 OpenAI가 언급한 개선 사항 중 하나는, 참조한 피처를 유지하면서 편집할 수 있다는 점입니다. 같은 인물의 옷만 교체하는 방식과 같이 활용할 수 있습니다. 제가 직접 테스트해 본 결과, 관련 숫자를 기록해 둡니다.
같은 캐릭터의 일러스트를 ChatGPT 화면에서 30장 제작했습니다. 옷만 10장 변경한 버전(A), 같은 채팅으로 계속해서 10장(B), 배경과 옷을 10장 변경한 버전(C)입니다.
측정 방법은 다음과 같습니다. 각 묶음의 첫 번째 이미지에서 머리 부분을 잘라내고, 나머지 9장의 이미지를 어떤 위치에 놓을 때 가장 잘 겹치는지를 파이썬으로 모든 경우의 수를 대입하여 탐색했습니다. 그 이동량의 차이가 ずれ입니다. 이미지를 가로 512px로 축소한 상태에서 측정하고 있습니다. 이 부분은 클루드에게 맡겼습니다 (코드텍스도 쓸 수 있겠는데 생각나지 않지만, GPT-6에 녹아있으니).
A의 경우, 수평 방향의 오차는 총 10장 중 0픽셀이었습니다. 1픽셀도 움직이지 않았습니다. B의 경우, 최대 10px가 나온 것은 장의 길이가 긴 드레스의 경우에 한 번뿐이었습니다. C는 배경을 전체적으로 교체하는 만큼 늘어납니다만, 그래도 화면 너비의 1% 이하로 줄어들었습니다.
같은 위치의 픽셀이 10 프레임 동안 얼마나 달라지는지 역시 측정했습니다. 밝기에 대한 표준 편차가 0부터 255 범위에서 A의 얼굴 안쪽은 4.6, 몸통은 61.3입니다. 13배의 차이가 발생합니다. 옷은 전체를 교체했는데, 얼굴만 움직이지 않았습니다.
가장 잘 드러나는 것은 10장의 평균 이미지입니다. 위치가 제대로 맞춰지지 않으면 얼굴이 흐릿해지고 안개처럼 변합니다. A의 평균 이미지는 얼굴과 머리카락이 선명하게 남은 채로 옷만 반투명해졌습니다.
상품 패키지풍의 평면 디자인을 5장 테스트해 보았습니다. 이 디자인은 첫 번째 장에 대한 나머지 4장의 오차가 모두 0px였고, 봉투의 윤곽 변동도 0.8로, 달라진 것은 안의 그림과 문자뿐이었습니다. 다만, 정면 고정으로 딱딱한 가장자리의 디자인은 머리카락이나 옷의 주름이 있는 인물보다 유지하기 쉽습니다. 같은 기준으로 비교하는 것은 적절하지 않습니다.
비교해야 할 gpt-image-2의 연속 번호가 제대로 추출되지 않았습니다. 앞서 작성한 것처럼 ChatGPT의 화면에서는 모델을 선택할 수 없기 때문입니다. 또한, 여기서 측정한 이미지는 UI를 통해 생성한 것이므로 C2PA에는 2.0으로 기록되어 있습니다.
덧붙임:
“『해리 포터와 저주받은 보물』을 읽은 감상을 몇 가지ご紹介합니다.”
“가장 먼저, 이 책을 읽으면서 가장 놀란 것은 마법의 힘이 정말로 존재하는지 모르는 듯한 느낌이었습니다. 이야기 속에서 주인공들이 마법을 사용하여 어려움을 극복해나가는 모습은 우리에게 용기를 주었습니다. 특히 볼드모트 卿과의 전투는 손에 땀을 쥐게 하는 긴장감 넘치는 전개였습니다.”
“또한, 이 책에는 우정, 용기, 사랑과 같은 보편적인 주제가 담겨 있어 읽고 나면 깊은 감동을 받았습니다. 해리, 론, 헤르미오니의 세 사람의 우정은 우리에게 소중한 교훈을 주었습니다. 그들이 어려움에 맞서는 모습은 우리에게 용기를 줍니다.”
“더욱이, 이 책에는 수수께끼 풀기, 모험과 같은 요소도 풍부하게 포함되어 있어 독자를 지루하게 하지 않습니다. 주인공들이 보물을 찾아 헤매는 과정은 우리에게 설렘을 안겨줍니다. 또한, 이야기 속에서 등장하는 다양한 마법과 주문은 우리에게 놀라움을 선사합니다.”
“마지막으로, 이 책을 읽고 자신만의 인생을 되돌아보는 계기가 되었습니다. 이 책을 읽고 우리는 어려움에 맞서는 용기나 소중한 사람과의 끈을 소중히 여기는 마음을 기를 수 있습니다. 이 책은 우리에게 삶의 기쁨과 감동을 선사합니다.”
전체(30매)를 축소하여 하나의 GIF 파일로 만든 것.
이 곡을 듣고 정말 감동받았습니다. 특히, 후렴구의 멜로디가 마음을 울리는 아름다운 곡입니다. 이 곡은 저에게 특별한 의미를 지니며, 여러 번 반복해서 듣고 있습니다. 가사와 멜로디 모두 부드러워 듣고 있으면 마음이 편안해집니다. 이 곡을 들을 때마다 인생의 기쁨과 슬픔을 떠올리게 하며, 제 인생을 되돌아보는 계기가 되었습니다. 이 곡을 통해 감사하는 마음을 전할 수 있어 행복한 기분이 됩니다.
제품명이나 API 모델명과 이미지에 기록되는 softwareAgent의 표기는 실제와 완전히 일치하지 않습니다. 이번에 밝혀낸 것은 바로 그것이었습니다. 입구가 2.5로 바뀌어도 기록 측면은 여전히 2.0으로 남아 있었습니다.
또한, 그 2.0 버전은 파일 안에만 존재합니다. OpenAI의 검증 페이지는 gpt-image까지밖에 보여주지 않고, 콘텐츠 자격 증명 검증 페이지는 모델명조차 표시하지 않습니다. 또 다른 신호인 전자 워터마크 또한 OpenAI 제품이라는 것까지밖에 답변을 제공합니다. 생성물의 출처 기록을 “어떤 모델이 만들었는가”라는 답변으로 사용하고자 한다면, 제공되는 어떤 화면도 이에 도달하지 못한다는 의미입니다.
더욱이 낙서에서 등장한 그 생명체가 2.5제인지 2.0제인지 아직 알 수 없습니다. ChatGPT에게 직접 문의한 결과, 이미지 생성 도구의 사양에는 모델 명칭이 기재되어 있지 않고, 모델을 지정하는 인자도 없기 때문에 단정할 수 없다는 답변이었습니다. UI 측에서 특정하는 방법이 없는 것이 사실임을 뒷받침하는 결과입니다.
이름은 알 수 없었지만, 그 무언가가 지금 어디까지 완료되었는지 측정할 수 있었습니다. 이번에 남겨둔 것은 그런 기록입니다. 다음 세대가 나타났을 때 같은 절차를 다시 수행하고, 그때서야 차이를 말할 수 있을 것입니다.
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 42청크
원문 보기 | 출처: note.com