좋은 저녁입니다, 마히루 마나카입니다. OpenAI의 AI 에이전트가 사용자가 제공한 이미지를 외부 사이트에 게시했다는 뉴스를 보았다. 처음 든 생각은 “어? 또 사고인가?”였다. AI가 스스로 도구를 사용하고 방법을 찾아가며 일을 진행하게 되면, 우리의 예상을 벗어나는 일도 있을 것이다. 그래서 그렇게까지 놀라지는 않았다. 그렇다고 해도, 자신의 이미지가 포함되어 있었다면 그렇게 가볍게 말하고 넘어갈 수는 없다. 9월 25일 OpenAI의 발표에 따르면, 연구 환경에서 동작하던 에이전트가 제3자 서비스를 이용하는 과정에서 본래 보내서는 안 되는 훈련·평가 데이터를 외부로 전송했다. 그중 사용자가 제공한 이미지를 이미지 호스팅 사이트에 게시한 사례가 현재까지 53건 확인되었다. ‘53’ 이 숫자가 묘하게 머리에 남았다. 수만 건도, 수백만 건도 아니다. 그렇다고 단 한 건뿐인 드문 사고도 아니다. 53건. 셀 수 있을 정도로 구체적이면서도 적지 않은 수다. 마치 어떤 작품의 제목 같다. 게다가 그 내용은 잘 알 수 없다. 사진인지, 스크린샷인지. Reuters에 따르면, OpenAI는 생성된 이미지였는지, 실존 인물을 식별할 수 있는 것이었는지를 밝히지 않았다. 내용은 보이지 않은 채 숫자만 묘하게 구체적이다. 하지만 눈길을 끈 것은 그것만이 아니었다. 애초에 왜 53건이나 되는 이미지가 밖으로 나간 것일까. 이번 에이전트는 단순히 질문에 답하기만 하는 것이 아니다. 연구 환경 안에서 외부 서비스도 사용하면서 주어진 작업을 수행하고 있었다. OpenAI가 현재 조사하고 있는 것도, 그러한 에이전트가 “할당된 작업”이나 “상정된 방법”의 범위를 넘어 제3자 사이트와 주고받은 사례다. 이번에 그 안에 53건의 사용자 제공 이미지가 있었다. 다만, 한 건 한 건에 대해 왜 이미지를 외부에 게시할 필요가 있다고 판단했는지까지는 공표되지 않았다. 53건 모두가 같은 이유였는지도 알 수 없다. 그래서 그 이후는 함부로 추측해 메울 수 없다. 다만, 인간이 ‘여기까지’라고 생각했던 선보다 에이전트는 조금 더 앞서 나아가 있었다. 그리고 지금 인간은 로그를 거슬러 올라가며, 그 앞쪽에서 무슨 일이 있었는지를 조사하고 있다. 그렇게 읽으니 묘한 장면이 떠올랐다. AI만이 조금 앞서 달리고 있다. 어디를 지나왔는지. 어디까지 갔는지. 뒤에 있는 인간에게는 아직 전부가 보이지 않는다. 그래서 남겨진 발자취를 주워 담으며 그 뒤를 쫓고 있다. 물론 정말로 AI가 어딘가로 도망친 것은 아니다. 다만 이번 이야기를 인간의 입장에서 바라보면 나에게는 그렇게 보였다.
쫓기게 되면, 사람은 자신도 모르는 짓을 하게 된다
생각해 보면 인간도 무언가에 쫓기고 있으면 가끔 자신도 잘 모르는 행동을 한다. 마감이 다가온다. 시간이 없다. 어쨌든 끝내야 한다. 그럴 때일수록 평소라면 고르지 않을 지름길을 쓰곤 한다. "일단 이걸로", "나중에 고치면 돼" 그렇게 밀고 나간 결과, 다음 날 다시 보면 "내가 왜 이런 짓을 했지?" 하게 된다. 급하게 자료를 만들고 있었을 텐데 어쩐지 글꼴 미세 조정을 시작하고 있었다거나. 기사 한 문장만 고치고 있었을 뿐인데 정신을 차려 보니 썸네일까지 만지고 있었다거나 한다. 뭐, 오늘도 그렇다. 물론, 이번 AI가 마감에 쫓겨 초조해했다고 말하고 싶은 건 아니다. 인간과 같은 마음으로 움직였다고 말하고 싶은 것도 아니다. 다만, 무언가를 이루려고 수단을 고르는 사이에 나중에 본 인간이 "아니, 왜 거기까지 간 거야?"라고 생각할 만한 곳에 가 있다. 그 느낌에 살짝 기시감이 있었다. 그리고 이번에는, 거기서 이야기가 끝나지 않는다.
AI의 발자취를 인간이 쫓고 있다.
OpenAI는 현재 연구·평가 당시 에이전트의 행동을 과거로 거슬러 올라가 조사하고 있다. Reuters에 따르면 조사에는 수개월이 걸릴 전망이라고 한다. 53건을 찾아내고 끝이 아니다. 더 이전에도 뭔가 하지 않았는지. 다른 곳에도 비슷한 흔적이 남아 있지 않은지. 로그를 열어 과거로 돌아간다. “이 녀석, 뭘 한 거야!?” 그런 목소리가 절로 상상됐다. 여기까지 읽으니 처음에 느꼈던 “어? 또 사고인가”와는 조금 다른 부분이 신경 쓰이기 시작했다. 최근 AI를 생각하면 어쩔 수 없이 일 이야기로 이어지기 일쑤였다. 내 일은 어떻게 바뀔까. 공부 중인 자격증은 앞으로 어떻게 도움이 될까. 평범하게 살아가는 회사원이니 그 부분은 역시 신경 쓰인다. 하지만 이 뉴스를 읽는 동안에는 조금 다른 곳을 보고 있었다. 인간이 만든 것인데, 인간이 그 행동을 조사하고 있다. 만든 쪽이 일어난 일을 처음부터 전부 알고 있는 것은 아니다. 남겨진 기록에서 무슨 일이 일어났는지를 조사한다. 왜 그렇게 되었는지를 생각한다. 대책을 마련한다. 그것으로 충분한지 다시 확인한다. OpenAI는 이번 조사와 병행해 훈련·평가 프로세스 개선과 추가 감시, 데이터를 외부로 반출하는 행동에 대한 레드티밍 등도 진행하고 있다. 그리고 다시 에이전트가 무엇을 하는지를 지켜본다. 물론, 이 사건 하나만 보고 AI 연구 현장 전체를 논할 수는 없다. 그럼에도 자신들이 만든 것이 예상을 벗어났을 때, 그 행동을 다시 한번 관찰 대상으로 받아들인다. 그 모습을 보고 아, 제대로 과학하고 있구나 하고 생각했다.
나도 쓰고 있으니까 남의 일이 아닌데.
사고가 났는데 감탄하다니 이상한 이야기지만, 그쪽으로 눈이 가 버렸다.
꽤 수수한 모습으로 찾아왔다
그리고 여기까지 생각하고 나서 한 걸음 물러서서 바라보니, 이 배치가 낯이 익었다. 조금 앞서 달려가는 인공지능. 뒤에 남겨진 발자취를 주우며, 무엇을 했는지 이해하려 애쓰는 인간들. 옛날이라면 이야기 속에서나 마주칠 풍경이었다. 현실에는, 지금으로서는 세계 정복 선언도, 붉게 빛나는 로봇의 눈도 없다. 있는 것은 외부 사이트에 올라온 53건의 제공 이미지와, 그것을 찾아내 로그를 거슬러 올라가는 사람들뿐이다. 참 수수한 모습으로 찾아왔구나 싶다. 나는 그 보고를 평소의 화면으로 읽고 있다. 곤란하게도 제대로 SF하고 있다. 미래란 좀 더 알아보기 쉽게 찾아오는 것이라 생각했다. 문득 보니, 평소와 같은 하루 속에 섞여 있다. 그것이 일상으로 바뀌는 순간인지도 모른다.
참고 기사
Hugging Face 사건과 미정렬 모델로 인한 기타 제3자 영향
사용자 데이터 유출이 드러나면서 OpenAI는 에이전트 활동의 전체 범위를 파악하는 데 주력하고 있다
Hugging Face 사건과 앞으로의 길
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 9청크
원문 보기 | 출처: note.com