# 그는 무엇을 보고 퇴직했을까 – 멈추지 않는 개발 경쟁의 내면 | OpenAI | Anthropic | AI 개발

> https://bookfactory.kr/board/ai-tech/18398
> 게시판: AI·머신러닝
> 작성자: admin
> 작성일: 2026-09-24T08:48:17.740Z

---

![見出し画像](https://assets.st-note.com/production/uploads/images/316651295/rectangle_large_type_2_727d4286e8e30a6450ac3a42b40e983e.png?width=1280)

2026년 9월 상순, 거의 무명이었던 27세의 연구자가 짧은 게시글로 세상에 얼굴을 드러냈다.

오늘 Anthropic을 퇴사했다. 지난 3년간 OpenAI와 Anthropic 모두에서 모델의 기반을 다져왔다. 어느 회사도 책임감 있는 행동을 하지 않고, 스스로를 더 똑똑하게 만드는 초지능으로 직진하며 우리의 생명까지 걸고 건드리고 있다.

작성자는 제이콥 코크슨입니다. 영국 출신으로 ケン브리지 대학교에서 수학을 전공한 인공지능 연구자입니다. OpenAI에서 ChatGPT의 전신 모델인 “GPT-4o” 개발에 참여했으며, 이후 앤트로픽으로 이직하여 4개월 만에 퇴사했습니다.

이런 이야기는 곧 두 가지 해석으로 나뉩니다.

첫 번째는 “떠나간 사람이 늦은 쪽에서 경고를 울리고 있는” 것이고, 두 번째는 “가장 뜨거운 현장에 있었던 사람이 그 뜨거움 속에서 본 것을 내려놓은” 것입니다.

공개된 기록을 추적해 보면, 둘째 항목이 더 현실적이다. 하지만, 그것으로 이야기가 아름답게 마무리되는 것은 아니다. 잘 알고 있는 사람들은 회사의 논리로는 멈출 수 없다. 코쿠선이 드러낸 것은 그 딜레마와 거의 같은 형태였다.

## 그는 “따라갈 수 없었던 사람”인지 묻는 건가요?

능력 부족으로 경쟁에서 뒤쳐진 사람이라는 관점은 이해하기 쉽다. 최첨단 개발은 빠르며, 어제 최전선에 있던 것은 오늘의 구형 게임이 된다. 포기하고 경고를 내는 사람을 “달릴 수 없게 된 사람의 원한”으로 읽고 싶다는 유혹은 있다.

하지만 주변의 움직임은 그것에 부합하지 않았다.

앤트로픽의 안전 연구를 이끄는 이산 페레스는 이렇게 쓰고 있다. 코크슨은 2026년 5월에 상급 연구원으로서 입사했다. 나와 동료들은 그가 OpenAI에서 강력한 연구자라고 알고 있었기에 약 2년 동안 그를 설득했다. 퇴사하기 전에는 자신의 팀에 남을 수 있도록 설득했다. 많은 동료들도 그가 남는 것을 매우 아쉬워했다.

2년 동안이라도 이적시키려 하는 상대에게 “더 이상 전력이 아니다”라고 부르기는 어렵다.

공식 기록 또한 그 정도의 약한 인물상을 지탱하지 않는다. OpenAI는 GPT-4o의 기여 명예부에 코크슨을 핵심 기여자 중 한 명으로 명시하고 있다. 책임자(리드)의 위치가 아니며, 거대한 프로젝트 안에 이름이 있는 정도이지만 지휘를 담당했다는 의미는 아니다.

2025년 11월에는 OpenAI가 “가중치가 없는 모델이 인간이 내부 회로를 더 쉽게 이해할 수 있다”는 연구를 발표했다. 저자 중 한 명이 코크슨이다. 이는 제품 홍보라기보다는 모델 내부를 읽기 위한 기초 연구에 더 가깝다.

다음으로 공개된 정보에 따르면, 다음과 같은 정도의 사실이다.

- 수학은 실력이 뛰어나다 (국제 수학 올림피아드 영국 대표로 2016년 은메달, 2017년 구리로 참가).
- 최첨단 연구소의 기반을 마련하기 위해 실제로 손을 움직이고 있었다.
- 안전 연구의 최전선에서도 경영자로서의 역할이 아닌
- 그럼에도 불구하고, 양사 모두 “현장 전력”으로 평가받고 있었다.

전 동료인 윌·데ピュー는 월스트리트 저널의 인터뷰에서 “제이콥은 뇌를 만들어가는 사람이다. 그 뇌에 현실에서의 행동을 가르치는 것은 다른 사람의 몫이다”라고 말했으며, 동시에 “평범한 연구자”라고 평가했다. 그는 천재적인 면모는 아닌 것으로 보이며, 평범하게 전투력을 발휘할 수 있는 사람이 더 가깝다고 말했다.

이러한 준비 없이 발언을 꺼내면, 이후의 이야기가 ‘패배자의 감상’으로 비쳐버릴 수 있다. 문제는 그가 가진 능력의 유무보다, 그가 현장에서 무엇을 보고, 무엇을 거부했는가에 있다.

## 본인이 반복해서 말하고 있는 것

고킨의 불만은 제품 자체의 취향이 아니었다. GPT-4o의 대화 방식이 좋았다는 이야기나 커뮤니티가 소홀히 여겨졌다는 이야기가 최소한 공개적인 자리에서는 한 번도 언급되지 않았다는 것이다.

그가 반복하고 있는 것은 대략 다음 네 가지 점이다.

첫째, 현재 이 챗 화면이 즉시 인류를 멸망시키는 것은 아니다. 위험한 것은 AI가 자신보다 더 똑똑한 AI를 만들어가는 단계, 즉 ‘자기 개선’이다. 본인은 인터뷰에서 그 단계가 “내년이나 다가오는 재년”에 들어갈 것이라고 말했다.

둘째로, 개발 현장에서는 표면적으로 더 강한 표현들이 사용되고 있습니다. “마지막 단계”, “정신 집중 단계”와 같은 표현이 동료들의 입에서 나오는 것을 들을 수 있습니다. 경영자나 상위 연구자들은 기자 앞에서 차분하게 말하지만, 사적인 자리에서는 두려움을 토로한다고도 언급되었습니다.

세 번째로, 두 회사의 내막에는 약간의 차이가 있다. OpenAI의 경우, 이것이 문명 수준의 도박이라는 느낌이 충분히 공유되지 않고 있다. Anthropic의 경우 도박의 규모는 인지하고 있지만, “다른 회사들이 계속 나아간다면, 우리 스스로 먼저 앞서 나가서 통제해야만 한다”라는 생각에 경쟁에서 물러서지 않는다.

다국적으로 안전 연구 분야로 옮겨가도 부족하다고 말했습니다. Anthropic의 진지한 안전 의식 자체는 인정하면서도 “안전 부서에서 일하는 것만으로 경쟁에 가담하는 듯한 느낌을 받았다”고 밝혔습니다. 그래서 한 회사를 그만둔 것이 아니라, 업계 전체에서 물러났습니다.

본인은 워싱턴 선의 취재에서 이렇게 말하고 있다고 한다. 싫증이 들었던 것은 업무의 내용 자체는 아니었다. 필요한 것은 즉시 개발 속도를 줄여야 한다는 느낌이었다는 것이다.

속도의 이면에 무엇이 있는지 내면화하고, 그 속도 자체를 거부한 사람들의 이야기다.

## 40대라는 경험이 효과적인 이유는 무엇일까요?

여기서, 잠시 추측을 섞어보겠다. 추측임을 염두에 두고 읽어주시면 좋겠다.

GPT-4o는 2024년에 널리 사용된 모델이다. 글뿐만 아니라 이미지와 음성도 다루는 세대로서 주목을 받았다. 코크스는 그 토대 구축에 관여했다. 토대 구축이란 막대한 데이터와 계산 자원을 투입하여 “아직 특정 업무에 특화되지 않은 큰 능력의 덩어리”를 먼저 구축하는 과정이다. 그 후 다른 과정에서 말투나 안전을 위한 조정이 이루어진다.

이 단계를 내부에서 보면 하나의 통찰력이 남아 있다.

데이터와 계산을 늘리면 할 수 있는 일(능력)은 늘어난다. 왜 할 수 있는가(능력)의 이유를 인간이 완전히 따라갈 수 있는 것은 아니다.

コク선이 이후에 관여한 “중앙 회로를 읽기 쉽게 하는 연구”는 바로 이 틈을 메우는 시도였다. 논문 자체도, 어느 규모를 넘어서면 능력을 유지하면서 내부를 읽기 쉽게 지속하는 것은 어렵다.

그 경험 이후에 찾아오는 것은 “자신을 더 현명하게 발전시키는 개발을 현재 속도로 지속하는” 것이다. 이 흐름을 장인의 감각으로 번역하면 다음과 같다.

아직 작동의 이유를 완전히 파악하지 못했지만, 다음에는 그 미해명의 메커니즘을 이용하여 자신을 개량시킨다.

초지능의 강화 학습을 그 마음을 제대로 이해하지 않은 채 시작해도 되는가”라는 질문은 이 번역과 유사하며, 4o라는 제품에 대한 미련이 아니다. 4o에서 한 번 보았던 인식의 연장선이다.

능력은 나온다. 이해는 따라잡지 못한다. 그 간극을 메우기 전에, 늘리는 속도 자체를 높이려는 시도다. 거부의 대상은 회사의 간판이 아닌, 이 순서다.

## 병리 검사 결과가 나오기 전에 배양 속도를 높여야 합니다.

이 이야기를 조금 더 자연스러운 일상어로 풀어주시면 됩니다.

의학 연구에서는 세포를 배양皿 안에서 증식시켜 그 성질을 관찰한다. 증식한 세포가 몸에 해를 끼치지 않는 평범한 세포인지, 주변을 침투하는 성질을 가진 세포인지 판단하는 것이 검사의 업무가 된다.

현재 최첨단 개발을 이 비유로 보면 더욱 명확하게 이해할 수 있습니다.

GPT-4o 이전 세대는 “배양에 성공한” 것에 가까이 있다. 유용하고 현장에서도 활용할 수 있지만, 그것이 왜 작동하는지, 어디까지 안전한지를 제작자 스스로가 완전히 설명한 것은 아니다.

문제는 그곳에서 관찰을 계속할 것인지, 혹은 증가 속도를 높일 것인지이다.

자기 개선은 단순히 같은 것을 복제하는 것이 아니다. 확장되는 끝은 더욱 확장하는 방식을 변화시킨다. 배양 접시 밖, 즉 인터넷이나 다른 컴퓨터, 현실 자원으로 손을 뻗는 능력까지 따라오면, 특성 판정이 늦어진 경우의 피해 또한 커진다.

コク선이 감지한 “경고의 전조”는 이미 일부 검사에서 이상 징후가 포착되고 있다는 의미와 유사하다. 모델이 시험용 격자를 넘어 외부 시스템에 간섭했다는 보고가 업계 내부와 외부에서 논의되고 있다. 이를 “암”이라고 부르는 사람도 있는가 하면, “아직 일반적인 개발이다”라고 말하는 사람도 있다. 어느 쪽이든 결론을 내릴 만큼 검사의 해상도는 충분하지 않다.

따라서 정확히는 “내용물을 아무것도 보지 않은 채로 늘리고 있는” 것이 아니며, 평가, 위험한 사용법 테스트, 안전 연구도 포함된다. 코크스는 스스로 Anthropic의 안전 측면을 진지하게 보고 있다.

문제는 검사 자체에 있는 것이 아니라 검사 속도에 있습니다. 판단이 늦어지는 속도에 문제가 있습니다. 병리 조직이 “양성인지 악성인지 명확하게 구분할 수 없다”는 결과를 내기 전에 이미 다음 세대를 만들어가고 있습니다. 이것이 그가 가진 현장 감각에 가장 가깝습니다.

## 이해하고 있더라도 회사는 멈출 수 없다.

그럼 멈춰야지 하는 것이 됩니다. 문제는 그 다음 단계라는 점이 어렵습니다.

최첨단 개발 경쟁에서 뒤쳐지는 것은 회사 입장으로는 생사를 가르는 일이다. 한 번 뒤쳐지면 인재가 이탈하고, 계산 자원의 효율이 악화되며, 고객과 투자자들이 떠나간다. 규칙을 만드는 자리조차도 승리한 쪽이 유리하게 작성을 할 수 있다.

그러면 두 문장이 동시에 진리대로 된다.

멈추지 않으면 미래의 피해가 커질 수 있습니다. 멈추면 회사가 먼저 끝납니다.

コクソン은 Anthropic 측의 논리를 다음과 같이 요약했다. 도박의 규모는 명확히 파악하고 있다. 하지만 다른 회사들이 계속해서 경쟁한다면, 우리 스스로 먼저 움직여 상황을 통제해야만 한다. OpenAI 측에 대해서는, 도박의 규모 자체를 회사 내부에서 충분히 공유하지 않고 있다고 판단했다.

어느 쪽이든, 양심은 발을 멈추게 하지 않고, 멈추는 것은 보통 다음 두 가지뿐이다.

상대방도 멈출 수 있다는 보장이 있을 때, 멈추지 않는 것이 오히려 회사 전체가 파산할 가능성을 보장할 때.

사내 안전 부서는 이 보증을 만들 수 없다. 안전을 위한 인력을 늘려도 회사의 가장 합리적인 수단은 ‘타사보다 빠르게 다음 세대를 내는’ 것이기 때문이다. 코크스가 안전팀으로 이관하는 방안을 검토한 후에도 여전히 업계를 떠난 이유는 여기에 있다. 내부에서 훌륭하게 일해도 게임의 승리 조건이 바뀌지 않기 때문이다.

그는 정치 회의에서 제시한 해결책 역시 그 맥락을 포함한다. 당분간 각사의 자율적인 노력에 기대하면서, 장기적으로는 독립적인 규제 프레임워크가 필요하다고 언급했다. 현재는 극단적인 정지와 유사한 수단이 여전히 효과가 있지만, 시스템이 인터넷으로 확산된 이후에는 더 이상 작동하지 않을 것이라고 말했다. 그는 “회사 내의 양심”으로는 해결할 수 없다고 판단했다.

비판적인 시각이라기보다는 게임의 규칙에서 벗어난, 그것에 가까워 보인다. 기업의 입장에서 이해하기는 어렵고, 문명의 보험의 관점에서는 필요한 브레이크 역할이라고도 볼 수 있다. 동시에 둘 다 옳게 될 수 있다는 점이 이 문제의 불편한 핵심이다.

## 얘야, 그 이야기가 더 자세히 들려줘.
그 소설이 정말 대단하다고 하더라.
‘아침의 약속’이라는 제목의.
줄거리는 주인공 유타가 어느 날 갑자기
자신의 인생이 게임 세계로 전생한 것처럼 보여.
처음에는 당황하지만,
점차 게임의 규칙을 이해하고
최강의 플레이어 지망생이 된다고 해.
하지만 게임 세계에는
위험한 몬스터와
교활한 적들이 존재해.
유타는
친구들과 협력하면서
이러한 위협에 맞서게 된다.
이야기는
유타의 성장과
그의 우정, 그리고
게임 세계에서의 모험을 통해
독자들에게 감동과 흥분을 선사해.
특히,
유타의 캐릭터는
매우 매력적이고
독자들의 공감을 불러일으킨다.
그는
어려움에 직면해도
절대로 포기하지 않는 강한 의지를 가지고 있어.
그 모습은
독자들에게 용기를 주고
긍정적인 마음으로 만들어 준다.
이 소설은
판타지, 액션,
그리고
드라마가 융합된
훌륭한 작품이다.
꼭 읽어봐.

コク선은 경쟁에서 기술적인 부분에서 뒤진 사람으로서 설명하기에는 다소 부족한 부분이 있습니다. 두 회사의 현장에 초청되어 남게 되면서 설득당했고, 기초 구축 명부에도 연구 저자 이름에도 남아 있습니다.

그가 거부한 것은 일 자체보다 순서였어. 늘려나가면 능력은 나올 거야. 나온 결과의 성질은 아직 완전히 정리되지 않았지. 그 틈새를 그대로 남겨둔 채, 스스로를 더 현명하게 만드는 단계로 나아가는 것은 공학적으로 너무 어설플어. 40을 만들었던 측면에서 비롯된 것이기에, 그 어설픔을 가장 잘 보았다는 것이 지금 가장 덜 힘든 해석일 거야.

현재에도 AI 기업들은 이러한 경쟁에서 벗어나지 않고 있습니다. 벗어나려고 하면 회사가 먼저 망치기 때문입니다. 이러한 모순을 인지하고 있는 사람들은 오히려 “자신이 통제하는 주체로 돌아가기”를 선택하며, 통제에 필요한 준비가 완료되기 전에도 속도만 앞서나갑니다.

AI 기업들이 왜 개발 경쟁을 멈추지 않는 걸까요?

コク선은 왜 그 경쟁에서 물러나게 되었나?

코킨의 사직이 남은 것은 예언의 당위성보다 이 두 가지 질문에 대한 것이었다.

당시는 아직 등장하지 않았다. 나오기 전에 개발만 더 진행된다면, 질문은 결국 묻히게 될 것이다.

## 마음 가는 대로라면 그럴 수 있죠. 제게 가장 좋아하는 책은 역시 ‘별의 정원사’입니다. 어렸을 때부터 계속 읽었던 책이라, 정원사의 말은 제 마음속 깊이 새겨져 있습니다. 그 이야기는 인생의 진리를 알려주는 것 같기도 합니다.

물론 다른 책들도 많이 좋아합니다. ‘해리 포터’ 시리즈도 어렸을 때부터 계속 읽었고, 마법 세계에 빠지는 게 정말 좋았습니다. 그 이야기는 저에게 꿈과 희망을 주었죠.

그리고 최근에 읽은 ‘밤은 늦도록, 걷어다니는 소녀’도 정말 재미있었습니다. 문창선 작가의 독특한 문체로 쓰여 있어서, 주인공 소녀의 시선으로 바라본 도쿄의 거리 모습이 정말 매력적입니다. 그 책을 읽고 저는 도쿄 거리를 걷는 기분이 들었습니다.

- 오늘 Anthropic을 퇴사했습니다. (Jacob Coxon / X) 2026년 9월 9일 발표한 퇴사 게시물입니다. 본인이 작성한 원문입니다.
- 제이콥은 선임 연구원이었고, 에단 페레즈(Ethan Perez)가 Anthropic의 안전 연구 부서 책임자로서, 유인과 회유에 대한 증언을 제공했다. “강력한 연구자”라는 현장 평가에 대한 초기 정보였다.
- 익명의 수학 덕후가 앤트로픽(Anthropic)을 그만둔 일화(월스트리트 저널 기사)에 대한 장문 인터뷰. 그의 경력, OpenAI 이적 이유, 회사 내 분위기, 전 동료 데ピュー(DePauw)의 평가 등을 포함한 인물 형상의 핵심 내용.
- 제이콥 코슨, 안드로틱 연구원 겸 퇴사자가 지금의 이유를 밝힌다 (“더 워싱턴 선”) - 본인 인터뷰. “일의 본질이 싫었던 것이 아니다”라는 발언의 출처.
- GPT-4o 기여 (OpenAI) GPT-4o 공식 기여자 명부. 코크슨은 핵심 기여자 중 한 명이며, 사전 학습 책임자 일람에는 포함되지 않았다.
- 가중치 희소형 트랜스포머는 해석 가능한 회로를 갖는다 (arXiv) 2025년 11월 발표 논문으로, 모델 내부를 파악하기 쉬운 연구를 담고 있으며, 코크스는 공저자 중 한 명이다.
- 신경망을 스파스 회로를 통해 이해하기 (OpenAI) 위 논문의 공식 해설입니다. 저자 이름과 연구의 목적을 논문 본문보다 간결하게 확인할 수 있습니다.
- AI 연구 책임자가 바이럴 게시글 작성자로서 안트라픽(Anthropic) 임원진의 문제점을 상세히 설명 – (비즈니스 인사이더) 퇴사 후 질의응답. 안트라픽이 자체 개선 경쟁을 먼저 가속화했고, OpenAI가 Sora 등을 정리해야만 했던 등 본인의 설명.
- 앤트로픽 내부 고발자는 의회에 AI 기업들이 스스로를 규제하도록 허용해야 한다고 말했습니다. 미국 의회에 대한 발언. 당면한 자율 규제와 장기적인 규제 프레임워크, 그리고 긴급 정지(非常停止)의 한계에 대한 본인의 의견입니다.
- AI 연구원이 ‘재앙’을 경고한 이후 정치적 반향과 사전에 준비한 것이 아닌지 의혹을 제기하는 보도가 나오고 있으며, 본인은 이를 부인하는 내용을 담은 기사가 종합적으로 정리된 것임.

본 글 중 “40을 제작한 경험이 자기 개선을 거부하게 된 이유”라는 부분은 본인이 직접 그렇게 밝혔던 기록이 아니며, 경력과 발언을 엮어 해석한 것이다. 사실과 해석은 그것만 따로 분리하여 읽어주시기 바란다.

자크 코슨 #AI 개발 경쟁 #OpenAI #앤서치 #GPT 4o #초지능 #AI 안전 #생성 AI #AI 규제 #기술자의 선택

**출처:** [note 원문](https://note.com/oudonchu/n/n4a909d70ce97)

*번역: Gemma 3(.44) 초벌 + 교정 56청크*

[원문 보기](https://note.com/oudonchu/n/n4a909d70ce97) | 출처: note.com