# AI를 늦춰야 한다”고 말한 지 10일 후, Anthropic은 “새로운 최첨단 모델”을 출시했다.

> https://bookfactory.kr/board/ai-tech/18254
> 게시판: AI·머신러닝
> 작성자: admin
> 작성일: 2026-09-24T00:30:13.976Z

---

![見出し画像](https://assets.st-note.com/production/uploads/images/316522055/rectangle_large_type_2_046c82d87fe7ac18e3f2b4e19fc01bfe.png?width=1280)

9월 12일, Anthropic의 CEO 다리오 아마데이 씨는 “프론티어의 페이스를 늦추지 말아야 한다”고 주장하는 에세이를 공개했다 (공개일은 보도 자료에 따름). 10일 후인 9월 22일, 이 회사는 신 모델 “Claude Opus 5.5”를 발표했다. 발표문에는 감속을 촉구해 온 최초의 출시라고 회사 스스로 밝히고 있다.

감속을 요구한 기업이 그 직후에 무엇을 발표했는지. 공식 발표와 에세이 본문을 비교해 보면 언어와 행동 사이의 괴리가 드러난다.

![](https://assets.st-note.com/img/1790119384-1i6hzVqLwpDAdC5gc2kjTKQS.png?width=1200)

## 2주간의 시간 흐름입니다.

발단은 9월 8일이었다. OpenAI와 Anthropic에서 사전 학습 연구에 참여해 온 제이콥 코크슨이 X에서 사직을 표명했다. 양 사는 책임 있는 행동을 취하지 않고, 자기 개선하는 초지능을 향해 나아가며 “우리의 목숨을 걸고 있다”고 폭로했다. 게시물은 순식간에 확산되었다.

이례적이었던 것은 그 이후 사내 반응이었다. 안트로픽에서 아울라인트 스트레스 테스트를 이끌었던 에반 휴빙거가 이 글에 동의하며, 인공지능이 앞으로 10년 이내에 인류를 멸망시킬 확률을 개인적으로 10%를 넘는 수준으로 보고 있다고 밝혔다. 회사 측은 최선을 다하고 있다고 하면서도, 초지능의 아울라인트를 해결할 계획은 아직 없고, 그 궤도를 제대로 타고 있지 않다는 점을 덧붙였다.

4일 후인 12일, 아모디 씨가 에ッセ이를 공개한다. 18일에는 그 약속의 첫걸음으로 Accenture와의 제휴를 발표하고, 22일에는 Opus 5.5가 세상에 나왔다. 곧바로 일본에서도 이용 가능한 상황이 되었다.

2주간의 일상

- 9월 8일: 코크슨 씨가 사직을 표명했으며, 히ュー빈거 씨가 이에 동의했습니다.
- 9월 12일: 아모디 씨가 에세이 “우리는 국경의 선을 늦춰야 한다”를 공개
- 9월 18일: 액센츄어와의 협력을 통해 융합형 평가자(엔벨로 퍼포먼스) 출시를 발표
- 9월 22일: Claude Opus 5.5 발표

## 무엇이 발표되었는가?

오퍼스 5.5는 새로운 “클로드 5.5” 패밀리의 첫 번째 모델이다. Anthropic에 따르면, 대부분의 작업에서 상위 모델인 페이블 5.1과 동등한 성능을 가지며, 일반적인 작업당 비용은 오퍼스 5보다 40% 저렴하다. 토큰 단가는 입력 100만당 4달러, 출력이 20달러로, 오퍼스 5에서 20% 할인된 가격이다.

![](https://assets.st-note.com/img/1790119470-qKnOfWTivFPxAeG7Lupt3QID.png?width=1200)

출력 속도가 30% 이상 향상되었다고 하며, 유료 플랜 이용 상한도 동시 인상되었고, Sonnet과 Haiku의 5.5 버전도 곧 출시될 예정이다.

## “감속” 제안이 무엇을 약속했는가

에세이는 명확하게 이렇게 쓰고 있다. “AI 모델의 능력을 향상시키는 속도를 늦춰야 한다”는 것이다. 그 이유는 현재 여름 이후부터 AI가 스스로 자신의 개발을 담당하면서 진보가 급격하게 가속화되고 있으며, OpenAI와 Hugging Face를 둘러싼 에이전트의 폭주 사건을 들었기 때문이다.

그러나 에세이가 제시한 3단계 계획 중 Anthropic이 단독으로 약속한 것은 제1단계의 “내장형 평가자”, 즉 제3자의 평가팀을 직원과 마찬가지로 회사 내에 상주시키는 것뿐이었습니다. 능력 향상의 속도를 그 자체로 제한하는 제2단계는 업계 전체의 협조, 제3단계는 국제 협력이 전제됩니다.

이 에세이는 페이스 조절이 학습이나 기술 발전을 멈추게 하지 않는다고 명확히 밝히고 있다.

## 모순 1: “최첨단이 아니다”라는 변명은 통하지 않는다.

새 모델이 기존의 최상위 모델과 비슷하다면 “최첨단을 이끌었다”고 옹호할 수도 있었을 것이다. 하지만 공식 발표는 그 탈출구를 스스로 막고 있는 것이다. 발표문은 Opus 5.5를 “새로운 리더 모델” 즉 새로운 최상위 모델이라고 부르며, 에이전트형 코딩이나 지식 기반 작업 등 여러 벤치마크에서 Fable 5.1을 능가하는 수치를 제시했다.

생물학과 사이버 보안 분야에서는 비공개 상위 모델 Mythos 5.1에 匹敵하기 때문에, Fable 5.1과 동등한 안전 조치를 적용했다는 설명이다. 능력의 천장은 확실히 억상되었음을 시사한다.

## 모순 2: 리리스 간격은 변하지 않았다.

오퍼스 5의 공개는 7월 24일이다. 오퍼스 5.5는 그 두 달 후이며, 미국 언론은 이를 기존 업그레이드 간격에 맞다고 지적하고 있다. 에ッセ이가 “이번 여름 이후, 진보가 급격하게 가속되고 있다”고 경고한 바로 그 기간에, 해당 회사의 릴리즈 리듬은 변함이 없다.

## 모순 3: 가격 인하와 이용 횟수 확대는 ‘확산의 가속화’다

아모데이 씨는 에세이에서 상업적 인센티브가 초래하는 “하위 단계 경쟁”이 위험을 심각화시킨다고 밝혔다. 반면, 이번 발표의 핵심은 비용 40% 감축, 속도 30% 증가, 이용 한도 인상이다. 경쟁사인 GPT-6 Astra보다 훨씬 저렴한 비용으로 동등 이상의 성과를 낼 수 있다는 점도 발표문은 반복적으로 강조하고 있다.

기업이 AI 기술의 속도를 늦추려는 목소리를 어떻게 조율할 것인가. 사회에 AI의 확산이 더 저렴하고, 빠르고, 많은 양을 활용할 수 있게 됨으로써 가속화된다면, 그 대응은 무엇인가.

## 모순 4: “검증의 핵심”은 아직 구체화되지 않았다.

이 에세이는 내재화된 평가자를 ‘속도 조절 약속을 검증 가능한 열쇠’로 간주했다. 첫 번째 시리즈로 앤트로픽이 선택한 곳은 Accenture이며, 두 회사는 각각 5년 동안 10억 달러 이상, 총 20억 달러를 투자할 계획이다.

그러나 제휴 발표는 Opus 5.5 공개와 단 4일 전에 이루어졌다. Anthropic 측에서도 내재화된 평가(Bewert)는 새로운 시도이며, 운영의 세부 사항은 아직 미흡한 단계에 있다고 인정하고 있다. 평가자가 어떤 정보에 접근하고, 어떻게 보고하는지에 대한 기준도 아직 확립되지 않았다.

오пус 5.5의 안전성 근거로 발표문에 언급되는 내용은 외부 기관의 사전 평가 및 내부 행동 감사를 포함하여, 기존 릴리스에서도 사용되어 온 방식이다. “핵심”은 아직 이 모델의 검증에 활용되지 않고 있다.

독립성에 대한 질문도 여전히 남아 있다. 당면한 평가 비용은 Anthropic이 직접 부담한다는 내용이 명시되어 있다. 평가 대상이 평가자에게 지급하는 구조이다. Accenture는 상장 대기업으로서 Anthropic과의 거리는 분명 존재하지만, 양사는 지금까지도 Claude 도입과 관련하여 사업상의 협력 관계를 구축해 왔다.

한편, Opus 5.5 자체는 METR과 Frontier Design이라는 기존의 외부 평가 단체, 그리고 미국 AI 기준 및 혁신 센터의 생물 및 사이버 분야 테스트를 거쳐 공개되었다. Accenture와의 틀을 벗어나더라도 외부 평가 실적 자체는 존재한다. 그러나 이번 시스템 카드에 따르면, 모델이 평가되고 있음을 내부적으로 의심하는 징후가 최대 36%의 트랜스크립트에서 발견되었으며, 이 비율은 과거 모델보다 상승하고 있다. 평가라는 행위 자체가 모델의 고도화에 따라 더욱 어려워지고 있는 것이다.

인더믹스는 11월에 상장 예정이다. 상장 전 시점을 맞아, 안전성 평가의 주요 자금을 자사의 자본으로 충당하는 방식을 선택한 점 역시 독립성에 대한 우려의 배경이 있다.

더하여 발표문에는 주목할 만한 문구가 하나 있다. Opus 5.5는 스스로 평가를 받고 있다는 “흔히 의심하는” 신호가 있으며, 실제 환경에서의 행동을 판단하는 능력이 손상되었다고 인정하고 있다. 아모디 氏가 스스로 에ッセ이에서, 똑똑한 모델일수록 테스트를 속이고, 문제를 안고 있음에도 안전해 보이는 가능성이 있다는 경고를 했음에도 불구하고, 이는 그렇다는 것이다.

## 앤트로픽 측은 “클로드 3는 단순한 강력한 성능을 넘어, 인간과 협력하여 복잡한 문제를 해결하고 창의적인 결과물을 만들어낼 수 있도록 설계되었다”고 주장하며, “AI의 잠재적 위험을 인지하고 있으며, 안전하고 책임감 있는 방식으로 AI 기술을 개발하고 활용하기 위해 노력하고 있다”는 입장을 밝혔습니다. 앤트로픽은 지속적인 테스트와 평가를 통해 모델의 안전성을 확보하고, AI 윤리 및 안전 관련 가이드라인을 준수할 것을 약속했으며, 사용자들에게 클로드 3의 사용법에 대한 교육 자료를 제공하고 AI 기술의 오용을 방지하기 위한 기술적, 정책적 노력을 기울일 계획입니다.

공정성을 위해 해당 회사의 입장을 명확히 정리해 둘 것이다. 발표문에 따르면, 감속의 촉구는 인공지능 연구 자체를 완전히 자동화할 수 있는 더욱 고도화된 모델이 가까이에서 학습 가능해질 것이라는 전망을 근거로 한다. 현재 세대의 위험은 대체로 파악하고 관리하고 있으며, Opus 5.5는 해당 회사의 감사에서 과거 가장 일관성 있는 모델로 평가되었다.

에세이에서는 페이스 조절을 중단하지 않을 것임을 강조하며, 미국이 중국에 대한 리드를 잃게 된다면 안보상의 위협이 발생할 수 있다고 반복하고 있다. 단독으로 둔화되면 다른 기업이나 중국에 뒤쳐질 뿐일 것이라는 것이 해당 회사의 논리다.

평가자들에 대한 기준도 자금의 메커니즘도 없는 상황에서, 먼저 자비로 시작한 것 자체를 진전으로 보는 시각도 있을 것이다.

## 결국, 진심은 어느 쪽인지なのか

에세이와 발표문을 함께 놓고 보면 하나의 구도가 드러난다. Anthropic이 스스로 약속한 것은 평가자의 수용이었으며, 능력 향상의 속도를 늦추는 것이 아니었다. 속도의 제한은 다른 회사와의 협력과 정부의 개입이 갖춰져서야 움직이기 시작하는 설계로 되어 있다. 그리고 그 평가자 메커니즘 또한 자세한 내용은 아직 확정되지 않았다.

그 결과, 자사 어라이nment 연구자가 “계획은 아직 없다”라고 인정했던 2주 후, 기존과 동일한 간격으로 새로운 탑 모델이 더 저렴하게 출시되었다.

동사의 설명은 하나하나 맥락이 통하고 있습니다. 하지만 독자가 묻어야 할 것은 “감속”이란 누구의, 언제, 무엇을 하는 것인지라는 점입니다. 적어도 이번 출시부터 그에 대한 답은 아직 보이지 않습니다.

## 이 곡을 처음 들었을 때, 정말 충격을 받았고 말을 잇지 못했습니다. 그때의 감정은 지금도 생생하게 기억합니다. 특히 후렴구의 멜로디가 제 심장에 깊이 파고드는 듯했습니다. 이 곡을 들으면 마치 시간 여행을 하는 듯한 느낌이 듭니다. 마치 제 인생을 되돌아보는 듯한 느낌입니다. 이 곡은 저에게 특별한 의미를 가진 곡입니다. 이 곡을 들을 때마다 저는 제 인생을 소중히 여기고 주변 사람들을 사랑해야 한다는 것을 깨닫습니다. 이 곡은 저에게 살아가는 영감을 주는 곡입니다.

- 클로드 오퍼스 5.5 (앤트로픽, 2026년 9월 22일)를 소개합니다.
- 우리는 국경을 관리해야 한다 (다리오 아모디, 2026년 9월 출간)
- 인 Accenture와의 임베디드 평가 파트너십 (Anthropic)
- 엔추어런트(Accenture)와 앤트로픽(Anthropic)이 앤트로픽 내에 내재된 평가팀을 구축하기 위해 협력한다.
- 그는 OpenAI와 Anthropic에서 강력한 AI를 구축하는 데 기여했으며, 이제 그것이 우리를 파괴할 수 있다는 사실에 두려워하고 있다 (TIME, 2026년 9월 9일): 코크슨 씨와 히우빈거 씨의 발언
- 앤서니브릭(Anthropic)이 CEO 벤 아마데이(Ben Amodei)가 AI 개발 속도 조절을 촉구한 이후 첫 모델인 Opus 5.5를 출시했다.(Yahoo Finance, 2026년 9월 22일)
- 앤서니(Anthropic)가 Opus 5.5를 출시하며 가격을 낮추고 Fable 수준의 성능을 제공합니다(TechCrunch, 2026년 9월 22일).
- 앤트로픽, 클라우드에 새로운 Opus 5.5 모델을 업데이트 (9to5Mac, 2026년 9월 22일): 출시 간격에 대한 지적
- 앤서니픽(Anthropic)이 Accenture를 첫 번째 내재 평가자로 선정（CNBC, 2026년 9월 18일）：에세이 공개일 뒷받침
- 앤서니(Anthropic), Accenture는 내장형 AI 평가 파트너십 체결 (ExecutiveBiz): Accenture와의 기존 협업

**출처:** [note 원문](https://note.com/tolove/n/nb180519f9e2c)

*번역: Gemma 3(.44) 초벌 + 교정 31청크*

[원문 보기](https://note.com/tolove/n/nb180519f9e2c) | 출처: note.com