# 앤서니(Anthropic)는 인류 멸망을 이유로 젊은 직원들이 퇴사했지만, “10%로 인류는 죽는다”라고 쓴 책임자는 남아 있다.

> https://bookfactory.kr/board/ai-tech/16941
> 게시판: AI·머신러닝
> 작성자: admin
> 작성일: 2026-09-16T22:39:48.280Z

---

![見出し画像](https://assets.st-note.com/production/uploads/images/311926457/rectangle_large_type_2_71f67388f1837bea6e266e322906a9aa.png?width=1280)

2026년 9월 8일 화요일이다. 제이콥 코존이라는 27세 남성이 X에 이렇게 썼다.

> 
> 
> 오늘 앤트로픽(Anthropic)을 퇴사했습니다. 지난 세 년 동안 OpenAI와 앤트로픽에서 모두 사전 훈련(pretraining) 연구를 진행했습니다. 두 회사 모두 책임감 있는 행동을 보이지 않고 있습니다. 스스로 진화하는 초지능으로 무작정 달려가고 있으며, 우리의 생명을 걸고 도박하는 것과 같습니다.
> 

오늘, 저는 Anthropic을 그만뒀습니다. 지난 3년 동안 OpenAI와 Anthropic 모두에서 사전 학습 연구를 진행해 왔습니다. 두 회사 모두 책임감 있는 행동을 취하지 않고 있으며, 스스로 개선하는 초지능이 한눈 blink하지 않고 계속 나아가면서 우리의 생명을 도박으로 만들고 있습니다.

그는 앤트로픽을 그만둔 것뿐만 아니라, AI 산업 그 자체를 떠났다고 주장했다.

이 게시물은 반나절 만에 3천만 뷰를 넘었다. 하지만 이 문제에서 정말 이상한 것은 그가 물러난 남성이 아니었다.

다음 날, 사직하지 않았던 남자가 이렇게 답신을 보냈다.

## 남은 자들의 고백

에반 허빙거가 답변했습니다. 그는 Anthropic의 어울림 과학 책임자입니다. 즉, “AI를 인간의 의도에 맞추는 연구”를 담당하는 현직의 총괄자입니다.

> 
> 
> 제이크의 말이 맞습니다. 우리는 진심으로 AI가 모든 인간을 멸망시킬 수 있다고 믿고 있습니다! 저는 개인적으로 그 확률이 10%를 넘는다고 생각하며, 그 시기는 10년 이내입니다. 앤트로픽이 최선을 다하고 있지만, 우리는 초지능에 대한 정렬 문제를 해결할 계획이 아직 없고, 그에 대한 명확한 진척 상황도 보이지 않고 있습니다.
> 

제이콥 말이 맞다. 우리는 진지하게 AI가 인류를 모두 죽일 것이라고 믿고 있다. 개인적으로는 앞으로 10년 안에 그 확률이 10%를 넘길 것이라고 생각한다. 앤트로픽(Anthropic)은 최선을 다하고 있다고 생각한다. 하지만 초지능과의 정렬 문제는 아직 해결 계획이 없다. 그것이 제대로 진행되고 있는지, 명확하게 말하기는 어렵다.

누군가 오해할 수 있지만, 이것은 단순한 오해이다.

그 문제를 해결할 책임이 있는 당사자가 자신의 이름으로, 누구에게도 물어보지 않았는데 공개적으로 썼다.

본 기고 작성 시점으로는 앤트로픽은 회사로서 어떠한 언급도 하지 않고 있다.

## 코슨이 실제로 말한 것

여기서는 정확하게 전달하고 싶다. 뉴스 제목은 “AI 연구자가 ‘생명을 건드린다’고 고발”으로 멈추어 있지만, 그의 주장은 좀 더 복잡하다.

콕슨은 “안전팀의 일은 거짓말이 아니다”라고 말하고 있지 않다. 오히려 WSJ의 취재에 따르면, 앤트로픽의 안전에 대한 노력은 진솔하다고 답하고 있다.

그는 이렇게 말했습니다.

OpenAI에서는 많은 사람이 사건의 문명적인 중요성을 깊이 내면화하지 못하는 반면, Anthropic에서는 그 중요성이 잘 이해되고 있다. 다만 다른 누구도 책임 있는 행동을 하지 않을 것이라는 생각에, 위험을 감수하고 그들이 가장 먼저 나서는 수밖에 없다고 믿고 있다.

그의 폭로는 “악당이 있다”는 뜻이 아니라, “모든 사람이 위험을 정확히 인지하고도 멈추지 않고 질주하고 있다는 것”이다.

그래서 그는 그만뒀다. 허버저는 같은 이해를 가지고 남아 있었고, 이 두 사람은 적대적이지 않다. 같은 지도를 보면서 다른 결론을 내린 것뿐이다.

WSJ에 대해 코슨은 더욱 깊이 파고들고 있다.

> 
> 
> 내년 말까지 상황이 이미 통제 불능 상태가 될 가능성이 있습니다.
> 

가장 극단적인 시나리오들에 대해 저희는 이미 그 선상에 있습니다. 내년 말쯤에는 이미 통제 불능 상태가 될 가능성이 있습니다.

2027년 겨울. 앞으로 1년 조금 남았다.

## 모래 사막의 벙커가 아닌 SF 영화 매킨토시로.

그리고 이 글을 쓰게 된 계기는 Coxon 씨의 한 말입니다. 이 말은 WSJ 인터뷰에서 나온 것입니다.

> 
> 
> 어떤 면에서 믿기 어려울 정도로, 샌프란시스코에 거주하는 엔지니어들의 맥북에서 일어나는 것처럼, 맨해튼 프로젝트를 진행했던 사막 요새가 아닌 것처럼 말합니다.
> 

맨해튼 계획 때처럼 사막 벙커가 아닌 샌프란시스코에 사는 엔지니어 몇몇의 맥북 위에 이것이 일어나는 것은 조금 미친 척 하는 것이다.

그는 스스로 맨해튼 계획을 제시했다.

그러니 일본인들은 이 이야기에서 빠져나올 수 없다.

## 제작을 중단했어, 단지 나 혼자 남았으니까.

맨해튼 계획에는 전 세계에서 모인 과학자들이 수천 명이나 있었다. 로스앨모스, 오크리지, 시카고.

그 중에는 양심을 이유로 계획을 떠난 과학자가 단 한 명 밖에 없다.

조셉 로트브라트. 폴란드 출신의 물리학자. 1944년 말, “독일은 원폭을 만들 수 없다”는 사실이 거의 확정된 시점에서 그는 로스앨러모스를 떠났다. 독일보다 먼저 만드는 것이라는 명분이 사라졌으니, 계속할 이유가 없었다 – 그것은 그에게는 단순한 논리였다.

남은 모든 사람은 그대로 남아 있었다. 대부분은 Coxon의 동료들과 똑같은 논리로 남아 있었다. 누군가가 먼저 움직여야 하고, 멈추면 지는 것이라는 말이다.

그리고 원폭이 떨어졌다. 히로시마와 나가사키에.

바로 이것이 이 기사의 핵심이다.

로트 브래트는 이후 핵무기 없는 세상 운동에 자신의 인생을 바쳤다. 1955년 7월 9일, 런던에서 바트랑드 러셀과 알베르트 아인슈타인 주도로 11명의 과학자들이 연명으로 “러셀-아인슈타인 선언”을 발표했다. 핵무기 폐지와 과학의 평화적 이용을 촉구한 이 선언은 핵무기 없는 세상 운동의 중요한 기반이 되었다.

서명한 11명의 이름을 나열한다.

맥스 볼른, P.W. 브리드먼, 알베르트 아인슈타인, 레오폴트 인펠트, 프리드리크 자리오-퀴리, H.J. 말라, 라이나스 폴링, C.F. 파웰, 조셉 로트브라트, 버트랑트 라셀

그리고—유카와 히데키.

인페르트를 제외한 10명이 노벨상 수상자이다. 또한 아인슈타인은 이 선언이 발표되는 3개월쯤 전에 사망했다. 그는 인류에게 남긴 유언, 즉 그 이유이다.

만들어내기를 그만둔 단 한 명의 남자가 시작한 운동에 일본인들이 이름을 올렸다.

로트브라트 경은 이러한 흐름에 발맞춰 ‘파그 워시 회의’를 설립하고 1995년 노벨 평화상을 수상했다. 이로써 51년의 시간이 흘렀다.

## 2026년 9월 8일에 그 재연 공연이 열렸다.

구도가 완전히 겹치는 것은 아니다. 당연하다. 원자폭탄이 떨어졌지만, 초지능은 아직 존재하지 않는다. 10%라는 숫자는 실제로 사람이 죽은 수가 아니라, 한 연구자의 주관적인 추정치다.

하지만, 인간의 배치는 놀라울 정도로 동일하다.

- 위험을 정확하게 이해하고 있는 당사자들이 있습니다.
- 모두가 “멈추면 더 무책임한 사람이 먼저 도착할 것”이라고 생각하고 있다.
- 그래서 아무도 멈추지 않는다.
- 그 중에는 한 명만 내렸어요.

차이점은 하나다. 이번에는 내려간 쪽과 남은 쪽이 같은 날, 같은 말로 “이것은 위험하다”라고 말하고 있다는 것이다.

1945년에는 그것이 존재하지 않았다. 남은 쪽들은 침묵했다. 혹은, 전쟁 뒤になってから 이야기를 시작했다. 오펜하이머가 “나는 죽음의 신이니, 세계를 파괴하는 자이니”라고 말한 것은 모든 것이 끝난 뒤였다.

허빙거는 끝나기 직전까지 그렇게 말했다. 게다가 자신의 업무를 “아직 해결되지 않은” 상태로 명확하게 지목했다.

솔직히 잘 모르겠지만, 기록상으로는 이전 전례가 없는 사례입니다.

## 그리고, 이것은 상장 3주 전에 일어난 일이다.

기회를 봐주세요.

앤서니(Anthropic)는 2026년 6월 1일에 비공개 상장(IPO) 신청을 완료했으며, 티커는 ANTH입니다. 언론 보도에 따르면, 10월경 거래를 시작할 예정이며, 예상 시가총액은 2조 달러 규모입니다.

자금 조달 추이 또한 비상하다. 2월에 300억 달러를 3,800억 달러의 평가액으로, 5월에 650억 달러를 9,650억 달러의 평가액으로 조달하고 있으며, 연환산 매출액은 470억 달러이다. 4개월 동안 회사의 가치가 두 배로 상승한 셈이다.

상장 직전, 그 회사의 현 알인 정 책임을 맡은 사람이 “인류가 10% 확률로 멸망할 가능성이 있고, 그러한 계획은 내가 세우지 않았다”라고 자신의 이름으로 작성했다.

평범한 기업의 홍보팀이라면 경악할 것이다. 하지만 Anthropic은 침묵하고 있다. 멈추지 않았나, 멈출 수 없었나, 멈추는 필요가 없다고 판단했나. 현재 시점에서는 누구도 알 수 없다.

또한 올해, 이 회사를 떠난 것은 Coxon이 처음이 아니다.

2026년 2월, 안전対策연구팀을 이끌고 있던 민란크 샤르마가 사임했다. 그의 사표에는 이렇게 쓰여 있었다. “세계는 위기에 직면해 있다.” 그는 AI뿐만 아니라 생물 무기까지 포함한 여러 위기가 동시에 진행 중이라고 쓰고, 그리고 — 영국으로 시 학위를 받기 위해 돌아가겠다는 뜻을 밝혔다. “잠시 동안, 눈에 보이지 않는 존재가 될 것이다.”

한 사람은 시를 썼다. 한 사람은 업계에서 물러났다. 한 사람은 남아서 확률을 썼다.

## 반대측의 입장도 함께 고려한다.

여기서부터 필을 멈추지 않으면, 이 글은 단순한 혐오 선동에 그칠 것이다.

허빙거가 제시한 10%는 회사의 예측이 아닌 개인의 주관적인 확률이다. 또한 전례 없는 사건에 대한 주관적인 확률은 측정값이 아니다. 그는 10이라고 말하고 다른 연구자가 0.1라고 말하더라도, 둘 다 관찰에 근거하지 않았다.

실제로 이 수치를 훨씬 낮게 보는 진지한 연구자는 많다. “애초에 상정된 능력의 비약 자체가 지금 업계가 실제로 나아가고 있는 방향과는 다르다”는 이유로 사실상 제로라고 생각하는 사람도 있다.

그래서 이 숫자가 정확하기 때문에 뉴스가 되는 것이다.

그 문제를 해결하기 위해 고용된 당사자가, 그 일을 만들고 있는 회사 안에서 자신의 이름을 내뱉은 사실이 뉴스라는 것이다. 게다가, 같은 우려로 동료가 사직서를 제출한 다음 날이었다.

## 그렇다면 이것은 누구의 일일까

마지막으로, 가장 하고 싶은 말을 적는다.

2025년 10월, Anthropic은 아시아 태평양 지역에서 첫 오피스를 도쿄에 개설했다. CEO 다리오 아모디가 일본에 방문하여 고위 작황 수상과 디지털 장관을 만나 일본 AI 안전 연구소와 협력 합의를 체결했다.

그때 해당 회사가 공개한 사실이 있었다.

일본은 Anthropic의 아시아 태평양 지역 최대 사용자 기반을 보유하고 있다.

클루드 코드를 조기에 채택한 국가이며, 지역별 매출이 1년 만에 10배를 넘었다. 렉센, 야노무라소우고우긴쇼, パナソニック에서도 사용하고 있다. 이 기사를 읽고 있는 당신도 아마 오늘 클루드를 열었을 것이다. 나와도 마찬가지다.

정리한다.

아시아에서 가장 큰 고객이 바로 우리다.

1955년, 유카와 히데키가 서명한 종이는 일본인이 “만든 쪽”이 아니라 “피해를 본 쪽”이었기에 무거웠다.

2026년에는 저희가 가장 많이 사용하게 될 측입니다.

사막의 벙커가 아닌 샌프란시스코의 MacBook 위에. 그리고 그 MacBook에서 나온 것을 세계에서 가장 열심하게 다운로드하는 나라이다.

코슨이 업계를 떠나 무엇을 할지는 아직 아무도 모른다. 샤르마는 시에 관심을 보였다. 다음 수순이 밝혀지는 순간, 이 이야기의 결말이 결정될 것이다.

그동안 우리는 오늘도 클로이드를 엽니다.

### 마침내 그것은 좋은 일이 될 수도 있었다고 생각합니다. 하지만 분명히, 그 당시 그 상황은 다시는 반복되어서는 안 된다고 생각합니다. 그때 우리가 하지 못했던 일은 정말 후회스럽습니다.

하지만 그것을 염두에 두고 앞으로 어떻게 할지, 어떻게 나아갈지 고민할 때에는, 당연히 그 당시의 실패를 교훈 삼아 더 나은 미래를 만들어 나가고 싶습니다.

물론 그것은 쉬운 일이 아니라고 생각합니다. 하지만 우리는 그 당시의 경험을 바탕으로 반드시 더 나은 미래를 만들어갈 수 있다고 믿습니다.

또한, 그 때 우리를 지지해주고 격려해주었던 사람들에게 감사하는 마음을 전하는 것도 매우 중요하다고 생각합니다.

정말로, 그 때 우리는 큰 좌절을 겪었습니다. 하지만 그 좌절을 극복하고 성장할 수 있었던 것은 그 당시 우리를 지지해주고 격려해주었던 사람들의 덕분입니다.

- Jacob Coxon 사임 발표 (2026년 9월 8일)
- 제보자 추가 보도: 자크 코슨의 추가 정보
- The Next Web「인간 연구원, AI 연구소들이 우리의 삶을 도박하는 것 같아 이직 - 앤트로픽(Anthropic)의 코슨(Coxon) 연구원 사임, 허버넬(Hubinger) 정렬 문제」 (2026년 9월 9일) : https://thenextweb.com/news/anthropic-coxon-resignation-hubinger-alignment
- Forbes “앤트로픽 정렬 책임자, AI가 인류를 모두 죽일 수 있다고 경고 – 연구원 이탈로 촉발” (2026년 9월 9일)
- WSJ “앤트로픽 연구원, ‘통제 불능’ AI에 대한 우려 때문에 사직” 기사
- 머니와이즈(맨해튼 계획 발언 및 IPO 관련): https://moneywise.com/news/top-stories/jacob coxon openai anthropic ai safety concerns
- 미란크 샤르마의 사임 발표 (2026/2): https://x.com/MrinankSharma/status/2020881722003583421
- Anthropic「도쿄 오피스 개설」
- Anthropic는 지역 판매가 “10배” 급증한 것을 계기로 도쿄에 아시아 첫 오피스를 개설했습니다.
- 파그워시 일본 그룹 “러셀-아인슈타인 선언 (1955)”
- 조셉 로블라트는 1909년 11월 17일 오스트리아 빈에서 태어난 물리학자로, 1962년 노벨 물리학상을 수상했습니다. 그는 1950년대 후반부터 1970년대 초반까지 Pugwash Conferences of Scientists for Nuclear Disarmament에 참여하여 핵무기 문제에 대한 과학자들의 역할을 수행했으며, 핵무기 개발의 위험성을 경고하고 핵무기 없는 세상을 만들기 위한 노력을 지지했습니다. 로블라트는 1977년 1월 12일 뉴욕에서 사망했으며, 그의 업적은 핵무기 없는 세상을 위한 과학자들의 노력에 큰 영향을 미쳤습니다.
- 노벨상 수상자 요세프 로블라트의 “스피드 리드: 요세프 로블라트”

1995년 노벨 평화상 수상자, 물리학자 요세프 로블라트의 삶과 업적을 요약한 간략한 소개서입니다.

로블라트는 2차 세계 대전 중 핵무기 개발의 위험성을 인지하고 핵무기 반대 운동에 적극적으로 참여했습니다. 그는 핵무기 개발의 과학적, 윤리적 문제점을 지적하며 국제 사회에 핵무기 폐기를 촉구했습니다.

로블라트는 핵무기 반대 운동뿐만 아니라, 핵무기 문제 해결을 위한 과학 기술의 활용 방안을 모색하고 국제 협력의 중요성을 강조했습니다. 그는 과학자들의 역할에 대한 비전을 제시했습니다.

핵무기 반대 운동 참여, 핵무기 개발의 과학적, 윤리적 문제점 지적, 국제 사회에 핵무기 폐기 촉구, 핵무기 문제 해결을 위한 과학 기술 활용 제안, 국제 협력의 중요성 강조가 주요 활동입니다.

이 자료는 1995년 노벨상 웹사이트에서 제공된 요세프 로블라트의 “스피드 리드”를 기반으로 작성되었습니다.

**출처:** [note 원문](https://note.com/akikito/n/ne51261b1a9a6)

*번역: Gemma 3(.44) 초벌 + 교정 55청크*

[원문 보기](https://note.com/akikito/n/ne51261b1a9a6) | 출처: note.com