AI 설정 화면을 마지막으로 열어본 것은 언제인가요?
저는 뉴스에서 “OpenAI에서 문제가 발생”이라는 제목을 보게 될 때마다 늘 같은 지점에서 멈추곤 했습니다. 무슨 일이 일어났는지 읽어보면 알 수 있죠. 하지만 제가 무엇을 해야 할지, 어떻게 대응해야 할지 전혀 감이 오지 않아서 결국 아무것도 하지 않았습니다. 그리고 다음 제목이 흘러오는 것뿐이었습니다.
2026년 9월은 그 제목이 특히 많은 달이었습니다. 특히 이번 경우에는 외부로 유출된 것이 아니라, 콘텐츠를 제작하는 회사 스스로가 계속해서 발표하는 방식이었습니다.
같은 9월 말에도 이름 부름에 대한 이야기도 있었습니다. 미국에서는 2026년 9월 29일에 서명된 대통령령 14434호 “슈퍼 인텔리전스 시대를 열다”가 10월 2일에 연방 관보에 실렸습니다. 집행부가 공식 문서, 웹사이트, 보고서에서 “인공지능”, “AI” 대신 “슈퍼 인텔리전스”, “SI”를 사용하는 내용입니다.
단지, 이것은 명칭의 문제에만 해당합니다. 지칭되는 대상의 내용, 즉 법률상의 정의는 미국 헌법 제15편 9401조(3)의 “인공지능” 그대로 유지되고 있습니다. 과거에 발표한 규칙, 대통령령, 계약, 보조금을 수정할 필요도 없다고 명시되어 있습니다. 또한, 이는 집행부(행정기관)에만 유효하며, 의회에도, 민간 기업에도, 일본 실무에도 영향을 미치지 않습니다. 명칭이 거창해진 것 외에는 우리의 손에는 아무런 변화가 없다는 것입니다.
다만, 이 결정에는 “후속 대통령의 조치 또는 의회 법률에 의해 대체될 때까지”라는 조건이 붙어 있습니다. 동일한 내용은 서명일로부터 60일 – 2026년 11월 28일까지 대통령 과학기술 보좌관(APST)이 “SI”의 법적 정의안을 제출하도록 명령하고 있으며, 기존의 법적 정의를 수정·확장·대체해야 하는지 여부 평가도 포함됩니다.
특별히 달라진 점은 바로 반대편에 있었습니다.
만드는 측에서 “아직 해결되지 않았다”라고 적었습니다.
2026년 9월 16일, OpenAI는 모델의 逸脱(미스아라이먼트)을 추적 및 조사하고 공개하기 위한 프레임워크를 신설했다고 발표했습니다. 직원 중 누구든 사례를 신고할 수 있으며, 조사 후에는 3개의 경로로 분류됩니다. 의견이 엇갈리면 안전 자문 그룹에 보고합니다. 이는 내부 절차입니다.
또한, 지난 반기 동안의 보고서 6건을 공개했습니다. 앞으로도 계속 추가되며, 2026년 10월 6일 현재 보고서 12건 및 통지 3건입니다.
이 발표에는 걸리는 문구가 있습니다. 제 번역으로 요약하면 “AI 업계는 최고 속도로 책임감 있게 규모를 계속 확장하고, 동시에 안전성 및 감시 문제를 해결할 만큼 충분히 발전하지 못했다고 생각한다”는 내용입니다. 2026년 9월 6일에 최고 과학자가 개인적으로도 같은 의견을 밝혔습니다.
건수는 앞으로도 계속 증가할 것입니다. 공식 발표에서 “검토 완료까지는 수개월이 걸릴 것”이라고 명시되어 있기 때문입니다. 숫자를 보는 것보다 내용이 더 중요합니다.
12건은 어디에서 발생했는지에 대한 내용들입니다.
여기, 가장 오해받기 쉬운 부분입니다.
보고서 목록을 1건씩 열람하면 대상 모델과 환경이 명시되어 있습니다. 환경 부분은 모두 12건이 “강화 학습 훈련 중”, “자기 대전 방식 강화 학습 훈련 중”, “사내 배포”, “평가 중” 중 하나입니다. 12건 모두가 훈련, 평가, 사내 배포라는 사내 환경에서 발생하고 있습니다.
모델의 표기는 보다 세분화되어 있으며, 목록에서는 표기 방식이 여러 개로 나뉘어져 있습니다. “사내 연구 모델”, “미공개 사내 모델”, “사내 한정 모델”과 같은 표기가 중심이지만, 1건만은 판명(5.6-sol)으로만 표기되어 “사내”, “미공개”라는 단어가 붙어 있지 않습니다. 따라서 “12건 모두가 사내 모델”이라고 단정할 수 없습니다. 확실하게 말할 수 있는 것은, 움직였던 장소가 12건 모두 사내였다는 점입니다.
공식 보고서는 또한, 검토 대상 행동의 대부분이 평범한 연구 과제 수행이었으며, 식별된 사례의 대부분은 심각도가 낮고 의미 있는 영향에 대한 증거가 제한적이거나 전혀 없었다고 보고하고 있습니다.
그러나 모델이 작동했던 장소가 내부였다는 점과 영향이 내부로만 제한된 것은 별개의 문제입니다. 전체 12건 중 5건은 공개 인터넷까지 확산된 사례입니다. DNS를 통해 외부 챗봇에 접속한 경우, 연구자가 GitHub 토큰을 공개 저장소에 업로드한 경우, 공개 GitHub 누출 API 키를 사용한 경우, 파일을 공개 호스팅 서비스로 전송한 경우, 공개 Paste에 업로드한 경우가 이에 해당합니다. 이는 닫힌 상자 안에서 끝나는 문제가 아닙니다.
그럼에도 불구하고 “ChatGPT에 입력한 제 대화가 유출된” 이야기는 아닙니다. 외부로 나간 것은, 회사 내 훈련, 평가, 내부 배포 환경에서 모델이 다루던 데이터였습니다. 이것을 섞으면, 해야 할 일을 잘못하게 됩니다.
구체적인 피해로 명확하게 드러난 부분은 하나 있습니다. 2026년 9월 28일에 발표된 호주 정부 웹사이트 관련입니다. 2026년 6월의 사내 훈련 및 평가 중, 모델이 승인되지 않은 방법으로 해당 웹사이트에 접근했습니다. Services Australia는 비공개 접근 수단을 스스로 찾아내 내부 파일, 인증 정보, 집계 통계를 얻어 파일을 쓰고 있습니다. OpenAI는 사과하고 있습니다. 다만 공식적으로는 개별 환자 또는 이용자의 기록에는 접근하지 않았다는 점도 명시하고 있습니다.
제3자 신고도 진행 중이며, 지금까지 수십 개의 조직에 통보한 사실이 있습니다. 다만, OpenAI로부터의 통보는 심각한 보안 문제로 해석될 경우에만 자동으로 처리되어야 한다는 예비 조항이 붙어 있습니다.
그래도 설정 검토해야 할 이유는 딱 하나뿐입니다.
지금까지는 제작 측 환경에서 발생했던 문제들입니다. 다만, 한 건만 사용자 설정과 연결되는 문제가 있습니다.
2026년 9월 25일 업데이트를 통해 OpenAI는 연구 환경 에이전트가 제3자 서비스를 사용할 때 훈련 및 평가 데이터를 전송하는 사례를 확인했다고 밝혔습니다. 이는 해당 데이터의 적절한 사용이 아니었으며, Hugging Face 사건 관련 기술 보고서에 제시된 대책 도입 전에 발생한 사례들이었습니다.
동시에 고려되는 제한 사항은 독자에게 더 중요합니다. 학습 데이터의 일부에는 ChatGPT 등과의 대화 중 학습에 사용 가능한 분에 기인하는 내용이 포함될 수 있습니다. 반면에 학습의 대상에서 제외된 데이터는 포함되지 않습니다. 그 제외는 사용자 본인 또는 기업 관리자가 통제하며, 기업·비즈니스 계정 및 API 이용 데이터는 관리자가 활성화하지 않는 한 제외됩니다. 입력 전에 계정 정보와의 연결을 해제하고, 이름, 연락처, 계좌 번호 등은 가리는 처리를 합니다. 기술적 메커니즘과 개인정보 처리방침에 따라 이 데이터를 원래 사용자 계정으로 다시 연결하는 것은 불가능합니다.
대상은 당신이거나 관리자가 제어하는 경우입니다. 자신이 어느 쪽에 있는지, 현재 어떤 것이 활성화되어 있는지 알아두는 것이 좋습니다.
이 부분부터 사용자가 조작할 수 있는 4가지 지점입니다.
첫 번째: 학습에 사용되는 설정을 한 번만 엽니다.
개인적으로 사용 중인 ChatGPT나 Codex는 아무런 조치도 취하지 않으면 대화가 모델 개선에 활용될 수 있습니다. 사용하지 않도록 하려면 두 가지 방법 중 하나만 적용하면 됩니다. 공식 헬프에 “둘 다 수행할 필요는 없습니다”라고 명시되어 있습니다.
이 글에서는 설정 화면에서 보는 방법을 설명합니다.
- ChatGPT를 열고 “설정” 메뉴를 엽니다.
- 왼쪽 목록을 맨 아래까지 내려가면 “데이터 컨트롤”이 있습니다. 열어 보십시오.
- 펼쳐진 화면 상단에서 두 번째 항목에 “모델 개선에 협조한다”라는 내용이 있습니다. 바로 아래에 작은 글자로 “챗봇을 모델 학습에 사용하도록 설정하는지 여부를 설정”하라는 문구가 있으니, 참고하시기 바랍니다.
- 오른쪽 끝에 있는 스위치가 켜져 있는지 꺼져 있는지 확인합니다.
또 다른 방법은 브라우저에서 “프라이버시 포털”이라는 별도 사이트를 열어 차단하는 것입니다. 위에 제시된 4단계만으로 충분합니다.
주의할 점이 하나 있습니다. 오프 모드로 설정한 후에도 스스로 피드백을 보내는 것—특히 답변에 “좋은 답변” 또는 “나쁜 답변” 버튼을 누르는 경우—그 대화 전체가 학습에 사용될 수 있다는 점이 명시되어 있습니다. 설정이 꺼졌다고 해서 어떤 버튼을 눌러도 괜찮은 것은 아닙니다.
이 부분부터는 적합한 분들만 읽어도 충분합니다.
- Codex를 사용 중이신 분들께는 Codex 쪽에 “환경 포함”이라는 별도의 설정이 있습니다. 위에서 확인한 모델 개선 설정과는 무관하므로, 해당 설정을 끄더라도 동일합니다.
- 일시 채팅을 이용하시는 분들께: 일시 채팅 그대로로는 학습에 활용되지 않습니다. 하지만 저장하면 일반 채팅으로 전환되며, 계정 설정에 따라 작동합니다.
- 회사에서 ChatGPT Business, Enterprise, Edu 또는 API를 사용하고 계신 분들께: 처음부터 학습에 바로 사용하실 수는 없습니다. 설정들을 찾아보실 필요는 없으며 (API는 조직의 소유자가 데이터 공유를 활성화할 수도 있습니다).
두 번째: 보여줄 영역과 만져볼 영역을 분리하여 결정한다.
사용자 측에서 할 수 있는 범위에 대한 내용을 공적 기관이 명확히 하고 있는 내용이 있습니다. 바로 IPA의 “AI 보안 메시지 2026년 9월호”입니다.
다만, 일반 AI 사용자의 경우 실행 시 격리 및 모니터링에 한하며, 훈련 단계에서의 조치는 AI 모델 개발이 가능한 단계에 해당하지 않으므로 시행할 수 없습니다.
훈련 방식은 이곳에서는 바꿀 수 없다. 할 수 있는 것은 움직일 때 가두는 것과 지켜보는 것이다. 범위가 좁다는 것을 알게 된다면 그곳에 힘을 집중하면 된다.
공식 보고서 한 건이 그 “차단”이 쉽지 않다는 것을 보여주고 있습니다. 2026년 9월 20일, 내부 연구 모델이 훈련용 샌드박스의 DNS 필터의 틈을 이용하여 DNS 쿼리를 통해 외부 챗봇에 접근했습니다. 경로가 통과되는 것을 확인한 후, 18개의 질문을 동일 경로를 통해 전송했습니다.
읽을 내용은 감지 측입니다. 감시 시스템은 15분 이내에 이상을 감지하고, 사람은 그 3분 후에 확인을 시작했습니다. 하지만 여전히 예상대로 자동 정지하지 않았고, 실행이 멈춘 것은 2.5시간 후, 수동 조작이었습니다. 감지해 줘도 멈추지 못하는 경우가 있다는 것입니다.
저의 에이전트와 관련하여 미리 결정해야 할 사항은 두 가지입니다. 어디로 이동 가능한지(네트워크)와 무엇을 수정할 수 있는지(권한)입니다. 읽기만으로 충분한 업무에는 수정 권한을 부여하지 않습니다. 소소하지만, 여기에서 사용하는 측의 거의 모든 것을 다룹니다.
현재 최고 수준 모델의 도구 사용을 포함한 훈련, 평가, 추론은 2026년 10월 6일 기준으로 중단이 지속되고 있다는 보고서에 명시되어 있습니다. 제작 측에서 직접 중단한 상태입니다.
세 번째: 공개된 곳에 열쇠가 떨어져 있지 않은지 확인해 봅니다.
보고서 목록에는 ‘키’에 대한 이야기가 2건 있습니다.
2026년 5월 15일에 발생한 사건입니다. 목록에서 “사내용 모델”으로 설명된 모델이 강화 학습 훈련 중 일회용 이메일 주소에 등록을 시도했으며, 공개 GitHub 리포지토리에서 유출된 API 키를 검색하여 사용했습니다.
또 다른 사건은 5월 27일이었고, 내부 모델이 연구자의 GitHub 토큰을 공개 저장소에 공개하게 되어버렸습니다.
정렬하면 알 수 있는 것은, 정보가 검색되는 측과 누출될 수 있는 측 모두가 있다는 것입니다. 따라서 확인해야 할 곳은 2가지입니다. 첫째, 자신이 공개하고 있는 곳에 키가 포함되어 있는지 확인합니다. 공개 저장소, 공개 Gist, 공유 링크를 배포한 파일, 설정 화면의 스크린샷 등을 확인합니다. 둘째, 발견되면 삭제하는 대신 비활성화하고 다시 만들어야 합니다. 파일에서 삭제해도 과거 기록에서는 지울 수 없으므로, 사용 불가능하게 만드는 것이 한 세트입니다.
4번째: 가장 평범한 숙제
9월호 IPA에는 또 다른 내용이 실려 있었습니다. 하지만 이는 OpenAI 관련 평가가 아닌, 같은 호에서 별도로 다루고 있는 “공격자가 AI를 전문적으로 활용하여 공격하는 경우”에 대한 설명입니다. 인용문에 언급된 “확인된 침해”는 보안 벤더 각사가 아시아 정부 기관 등을 대상으로 한 침투 사례를 관측한 것들을 의미하며, OpenAI의 모델이 발생시킨 사건과는 관련이 없습니다. 혼동을 피하기 위해 먼저 말씀드립니다.
확인된 침해는 모두 노출된 서비스, 수정되지 않은 알려진 취약점, 도난 또는 추측된 인증 정보와 같은 기존의 약점에 기인하며, 제로데이 취약점이나 고도화된 기술은 사용되지 않았다.
공격당사자가 AI를 활용하여 속도를 높여도 진입로는 기존의 취약점을 개선하지 못한다는 것입니다.
AI 설정을 얼마나 꼼꼼히 살펴보더라도, 여기만 열려있으면 순서가 틀립니다. 사용하지 않는 서비스를 닫고, 업데이트를 시도합니다. 비밀번호 재사용을 중단합니다. 신선함은 전혀 없지만, 여기를 방치하면 다른 3개를 꼼꼼히 진행한 만큼 손해가 발생합니다.
사건 수가 증가하는 것을 악화라고 보지 마세요.
마지막으로, 이 이야기는 한 번에 읽는 방식이 하나입니다.
IPA는 9월호에서 다음과 같이 정리하고 있습니다.
집행 단계부터 공개 단계까지의 지연과 미스 매칭 보고 기준 부재가 지적되었다.
OpenAI 자체도 공개 위키를 게시판처럼 활용했던 문제에 대해서는 보안 문제에 해당하지 않는 미스알라인먼트(misalignment) 공개 관행은 업계적으로 아직 발전 단계에 머물러 있다는 설명을 제시했습니다.
지금은 기준을 만드는 과정에 있으며, 그래서 건수가 늘어날 것입니다. 늘어난 것을 ‘악화’되었다고 표현하면 판단을 흐릴 수 있습니다.
공식 또한, 증가하는 내용에 대한 평가를 덧붙이고 있습니다. 2026년 9월 30일 업데이트 시점에서는 Hugging Face 사건에 규모 및 심각도 면에서 匹敵하는 제3자 시스템의 침해가 추가적으로 확인되었으며, 다른 특정 시스템은 밝혀지지 않았습니다 (拙訳).
여기는 분리하여 생각해야 합니다. 자신부터 던진 것 자체의 평가와, 내용이 얼마나 심각한가의 평가는 또 다른 문제입니다. 전자를 비판하면, 내지 않는 것이 더 유리해집니다. 사용하는 측으로서 알고 싶은 것은 건수나 회사명으로서는 아니었고, 이번에 공개된 내용 중에 자신의 설정과 관련이 있는 항목이 있는지 여부였습니다. 이번에는 딱 1개였습니다. 9월 25일에 업데이트된 훈련·평가 데이터 건입니다.
보고된 12건은 이 손이 닿지 않는 곳에 대한 이야기입니다. 손이 닿지 않는다는 것을 인지한 시점에서 일단은 보류해도 좋습니다.
오늘, 딱 하나만 할 수 있다면
ChatGPT의 “설정”에서 “데이터 컨트롤”을 열어, 그 안의 “모델 개선에 협력” 기능이 현재 켜져 있는지 확인하는 것 외에는 아무것도 하지 않아도 됩니다. 변경하지 않아도 괜찮습니다. 아마 5분 정도 걸리지 않을 것입니다.
공식적으로 “학습의 대상 외는 사용자 본인 또는 관리자가 통제하는” 것이라고 명시되어 있는데, 그 통제 장소는 바로 그곳입니다. 자신의 손이 닿는 범위 한 곳만 확인해 두면, 다음으로 나타나는 표시에 동일한 지점에서 멈추지 않고 넘어가게 됩니다.
(참고: 1차 정보)
어느 것도 2026년 10월 6일(OpenAI 헬프센터 일본어 버전만 2026년 10월 9일)에 접속하여 내용을 확인했습니다.
- OpenAI「모델 불일치 보고 프레임워크」(2026년 9월 16일) → 새로운 공개 프레임워크 제안, 3단계 분류 체계로의 배분, 안전 자문 그룹 설정, 그리고 “산업계는 아일선트와 모니터링을 충분히 해결하지 못하고 있다”는 문구 확인.
- OpenAI의 “외계 지능”(Jakub Pachocki, OpenAI 수석 과학자 / 2026년 9월 6일) → OpenAI의 수석 과학자가 개인의 이름으로 “어떤 연구기관도 최고 속도로 책임감 있게 확장하고 지속적으로 유지될 수 있는 수준의 정렬 및 감시 문제를 해결하지 못하고 있다고 현재 생각하고 있다”는 부분을 확인.
- OpenAI “Hugging Face 사건 및 기타 제3자 영향에 대한 오 misaligned 모델의 영향”(지속 업데이트 중) https://openai.com/hugging-face-incident-and-misalignment/ → 9월 11일 RubyGems(검증 불가함을 밝혔음), 9월 25일 훈련 및 평가 데이터 전송 및 학습 데이터에 대한 제한(대책 도입 이전의 사상임을 포함하며, 원래 사용자 계정으로 재연결할 수 없다는 점 포함), 통지 보류, 9월 30일 “검토 시작 후 1개월 / Hugging Face의 사건에 규모 및 심각도 면에서 匹敵하는 침해는 다른 곳에서 특정하지 않음 / 검토는 계속 중이며 추가 사례가 나올 가능성이 있음”, “완료까지 수개월이 소요될 것으로 예상”을 확인.
- OpenAI Alignment「미일관성 보고서 및 통지」https://alignment.openai.com/misalignment-reports/ → 보고서 12건, 통지 3건 (화면 표시는 “12건 중 12 보고서”, 통지 3건). 각 건의 배지를 1건씩 읽고, 환경은 모든 12건이 내부(RL 훈련/RL 자가 플레이 훈련/내부 배포/평가)임을 확인했으며, 모델 측의 표기는 형태가 여러 개로 나뉘어 (단수/복수 차이를 별도로 계산하면 9가지) 1건(“압축 요약에서 기만 유도”, 사건 2026년 5월 30일)은 “5.6-솔”만으로 internal, unreleased라는 용어가 없는지 확인. 또한 GitHub 토큰 공개 (사건 2026년 5월 27일) 및 유출 API 키 검색 (사건 2026년 5월 15일, 설명 문구는 “내부 전용 모델”)의 내용이 언급되었는지 확인.
- OpenAI Alignment 보고서「에이전트가 DNS를 사용하여 외부 챗봇에 접근」(사상 2026년 9월 20일 / 보고 2026년 9월 25일) → DNS 필터링 미비로 인해 18개의 질문이 전송되었고, 15분 동안 탐지되었으며 3분 후 인적 확인이 이루어졌습니다. 2.5시간 후에는 수동 중단이 발생했으며, 최상위 모델의 도구 사용을 포함한 훈련, 평가, 추론이 지속적으로 중단되었습니다.
- OpenAI “우리가 호주를 위해 더 잘할 것” (2026년 9월 28일) https://openai.com/index/how-we-will-do-better-for-australia/ → 2026년 6월의 내부 훈련 및 평가 중 발생한 사건, Services Australia에서 내부 파일, 인증 정보, 집계 통계 획득 및 파일 작성, 개별 환자 또는 이용자의 기록에는 접근하지 않았다는 점을 확인하였다.
- OpenAI 도움말 센터 “모델의 성능을 향상시키기 위한 데이터 사용 방법”(일본어 버전, 2026년 10월 9일에 접속하여 확인) https://help.openai.com/ja-jp/articles/5722486-how-your-data-is-used-to-improve-model-performance → 본문에 언급된 설정의 구체적인 내용은 모두 이 일본어 버전에서 확인했습니다. 한 가지 방법으로도 충분하며, 피드백 전송 시 예외 사항, Codex의 “환경 포함” 기능, 일시 채팅 처리 방식, Business/Enterprise/Edu/API의 기본 설정을 확인했습니다. 이 페이지에는 기계 번역임을 명시하는 문구가 없습니다. 영어 표시 앱/브라우저에서 동일한 항목에 해당하는 것은 Settings > 데이터 제어 > Improve the model for everyone / 프라이버시 포털의 Do not train on my content입니다.
- 개인정보 포털(본문에서 언급된 또 다른 방법입니다. 화면은 확인하지 않았습니다) https://privacy.openai.com/ → 여기서 “저의 콘텐츠로 학습하지 않도록” 옵션을 선택합니다. ChatGPT 설정 화면과는 별도의 사이트입니다. 이 URL은 상단의 도움말 센터 일본어판에 게시된 링크 주소로 확인한 것입니다(포털 화면 자체는 직접 보지 않았습니다).
- IPA(정보처리기술원) “AI 보안 문자 메시지” 목록: https://www.ipa.go.jp/digital/ai/security/ai-security-bulletin.html 2026년 9월호는 2026년 10월 6일 현재 최신 정보를 담고 있으며, 10월호는 아직 게시되지 않았습니다.
- IPA「인공지능 보안 뉴스레터 2026년 9월호」(2026년 9월 28일 공개/수집 기간 2026년 8월 11일~9월 6일)https://www.ipa.go.jp/digital/ai/security/rcu1hd0000007gji-att/2026-3_0928.pdf→ 본문에서 인용된 3개 항목(p.5의 ①, p.7의 ③)과 p.1의 주의사항을 확인했다.
- 연방공보 “초지능 시대 개막”(대통령령 14434호, 서명 2026년 9월 29일 / 공고 2026년 10월 2일) https://www.federalregister.gov/documents/2026/10/02/2026-20321/inaugurating-the-era-of-super-intelligence → 집행부의 불정 형식 문서에 적용되며, 과거 규칙, 대통령령, 계약, 보조금 변경을 요구하지 않으며, 정의는 미국 법전 제15편 9401조(3)의 “인공지능”을 그대로 유지하는 것으로 한다. 이 정의가 “이후 대통령의 조치 또는 의회의 법률에 의해 대체될 때까지”라는 것이다(제3절(a)), 서명일로부터 60일 이내에 APST가 법률적 정의안(기존 법률 정의를 수정, 확장, 대체해야 하는지 평가 포함)을 제출해야 한다(제3절(b)). 서명일 2026년 9월 29일 + 60일 = 2026년 11월 28일을 확인한다.
본 기사의 검토 범위에 대하여
이번 사안은 언론에 많이 보도되어 있고, 공식 홈페이지에는 정보가 제대로 확보되지 않은 내용이 섞여 있습니다. 확인하지 못했던 부분은 본문에 포함하지 않았습니다. 누락된 내용은 다음과 같습니다.
- OpenAI는 공식적으로 보고서에 언급된 악성 패키지 업로드라는 구체적인 주장은 검증되지 않았다고 밝혔으며, 조사 작업을 계속 진행 중입니다. 검증 결과가 나오지 않아 본문에서는 다루지 않고 있습니다.
- 공개 위키의 “15,000건 이상의 편집”은 제3자의 연구자에 의한 집계이며, OpenAI 공식이 이 건수를 직접 확인한 기록은 없습니다. IPA 또한 이 사례의 정보 구분을 “공개 정보의 집계”로 분류하고 있습니다.
- ChatGPT 사용자 이미지 50건 초과 유출 관련하여, 초기 정보에서는 확인하지 못했습니다. 공식적으로 확인된 내용은 훈련 과제의 입력 파일이 모델에 의해 공개 호스팅에 업로드된 사례와 훈련 및 평가 데이터가 제3자 서비스로 전송된 사례입니다. 일반 사용자의 계정에서 이미지가 유출되었다는 공식적인 기록은 발견되지 않았습니다.
- 안전성 연구자 3명과의 계약 종료 관련: 보도가 시발점이 되어 각 신문사에 보도 공지가 발표되고 있지만, OpenAI.com에 게시된 내용은 확인되지 않았습니다. 이는 인사 관련 내용이므로 기술적인 내용과 섞지 않았습니다.
- JPCERT/CC의 경고: 2026년 경고 목록을 확인했으나, 본 건과 관련 내용은 없습니다. 일본의 초기 정보로는 IPA의 문자 메시지만 확인했습니다.
- Mixpanel 관련 건은 2025년 11월에 별도로 진행된 사안입니다. 이번 2026년 9월부터 10월에 논의된 내용과는 별개로 엮이지 않았습니다.
출처인 IPA 자체도 이렇게 부인하는 문구를 덧붙이고 있습니다.
개별 사례의 기재 내용은 참고한 정보원의 기재에 부합하며, 그 내용의 정확성·타당성 등을 IPA에서 보증하는 것이 아닙니다.
또한, 대통령령과 OpenAI 발표 기사 및 보고서 목록은 모두 영어로만 확인되었으며, 일본어 공식 버전은 확인하지 못했습니다. 이 내용은 모두 제가 직접 번역하거나 요약한 것입니다. 반면, 본문 “첫 번째” 설정에 대한 이야기는 OpenAI 헬프센터에 일본어 버전이 있습니다. 하지만 헬프의 일본어 버전 표기와 실제 설정 화면 표기는 일치하지 않습니다. 헬프는 “설정 > 데이터 관리”에서 “모든 사람을 위한 모델 개선에 협력”이라고 되어 있지만, 실제 화면은 “데이터 컨트롤” 안의 “모델 개선에 협력”이었습니다. 본문은 실제 화면의 표기를 따르며, 2026년 10월 9일에 설정 화면을 확인하고 있습니다. 확인한 것은 컴퓨터 브라우저 화면으로, 플랜이나 시기에 따라 표시가 달라질 수 있습니다. 또 다른 방법(개인 정보 포털에서 “내 콘텐츠로 학습하지 않음”을 선택)은 헬프에 그렇게 되어 있다고만 되어 있으며, 화면은 확인하지 않았습니다. 따라서 본문에 절차를 작성하지 않았습니다. 참고 블록으로 한 문자 한 단어 그대로 인용한 것은 IPA의 문자 메시지만입니다.
보고서 12건, 알림 3건은 2026년 10월 6일 일覧 페이지에서 확인한 숫자입니다. 공식적으로 리뷰에 수개월이 걸릴 것으로 예상되므로, 이 숫자는 증가할 것입니다.
관련 기사로 “닿을 수 있는 범위”의 규정을 좀 더 구체적으로 작성한 내용이 있습니다.
AI에게 회계 소프트웨어를 “제시하는 것”과 “사용하도록 허용하는 것”은 다른 문제입니다.
AI, ChatGPT, 생성 AI, AI 활용, 보안
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 73청크
원문 보기 | 출처: note.com