# 클로드 페이블 5.1 가격이 인하되었는가? 공식 발표의 45%와 제3자 평가의 20% 인상분을 비교

> https://bookfactory.kr/c/news/12267
> 게시판: 뉴스
> 작성자: admin
> 작성일: 2026-09-14T16:55:30.106Z

---

![見出し画像](https://assets.st-note.com/production/uploads/images/309520986/rectangle_large_type_2_1081eb556369ceea8d353452db594635.png?width=1280)

아침 기차 안에서, 옆 사람이 스마트폰으로 ‘파벨 5.1’ 요약 영상을 1.5배 속도로 보고 있었다. 내려야 할 역에서, 그 사람이 동행에게 “그래서 무엇이 달라졌어?” 하고 물어보고 있었다. 영상을 한 편만 봐도 답은 딱 한 마디가 나오지 않는다. 이런 종류의 뉴스는 늘 그랬다.

## 먼저 3행으로

## 목차

죄송합니다. 제공해주신 정보만으로는 3/56번 note.com 게시글의 본문 청크를 번역할 수 없습니다. 게시글 내용을 제공해주시면, 일본어 출판·문화 콘텐츠 전문 한국어 번역가로서 자연스럽고 정확한 한국어 번역문을 100% 출력해 드리겠습니다.

- 이는 제가 지금까지 읽은 작품 중 가장 큰 충격을 준 작품일지도 모릅니다.
이야기의 전개가 예상외로 많이 뒤바뀌어져 있어서, 끝까지 지루할 틈이 없었습니다.
등장인물들의 심리 묘사 또한 매우 섬세하고, 공감할 수 있는 부분이 많았습니다.

특히, 주인공인 히노 스타 렌의 갈등에 깊이 공감했습니다.
그는 자신의 신념을 따르는 길을 가기 얼마나 어려운지, 주변의 반대에 직면하는 고통을 현실적으로 잘 표현했습니다.
그의 결정은 독자들에게 큰 질문을 던지는 것이었습니다.

또한, 이야기가 펼쳐진 배경인 교토의 묘사 또한 아름답고, 이야기의 세계관에 깊이 빠져들었습니다.
고도의 풍경과 현대인의 삶이 조화롭게 어우러진 모습이 매우 인상적이었습니다.
이 작품을 통해 일본의 전통 문화에 다시 한번 관심을 갖게 되었습니다.

이 작품은 단순한 오락 작품이 아닌, 인간의 존재 의미와 삶에 대해 깊이 생각하게 만드는 작품입니다.
읽은 후에에도 그 여운이 오랫동안 남아있을 것입니다.
반드시 당신의 마음에도 깊이 울림을 주는 작품이 될 것입니다.
- 무엇이 나왔는지.
- “할인”의 기원은 캐시 읽기
- 점수는 올랐다. 다만 측정 대상은 본인이다.
- 제3자가 측정했다면 어떻게 되었을까
- 회사에서 무엇이 달라지는가
- 덧붙임. 오늘 해야 할 일
- 일본 시간 9월 2일, Anthropic에서 Claude Fable 5.1과 Claude Mythos 5.1을 출시했다. 내용은 동일한 모델이며, 차이점은 안전 장치의 강도에만 있다.
- API 가격은 그대로 유지됩니다. 다만 “캐시 읽기”의 단가가 75% 하락하여, 일반적인 사용법으로는 약 25%, AI 에이전트를 오래 돌리는 방식으로는 약 45% 저렴해집니다.
- 점수는 자사 발표에 따라 전세대보다 모든 항목이 상회했습니다. 과학 연구용 벤치마크는 24.7%에서 52.6%로 상승했습니다.

전철 이용객에 대한 답변으로 충분합니다. 이 지점부터는 “정말로 그렇게 하는 건가요?”를 숫자로 확인하고 싶어하는 분들을 위한 것입니다.

## 무엇이 나왔는지

지난 Fable 5는 6월 9일에 출시되었습니다. 3개월 동안 세대가 바뀌면서 공식 페이지에서는 Fable 5가 더 이상 최신 버전으로 취급되지 않고 있습니다.

나온 것은 두 명의 이름과 하나의 모델이었다.

- 클로드 페이블 5.1은 누구나 사용할 수 있는 버전입니다.
- 클로이드 미토스 5.1은 심사를 통과한 미국 조직만 사용할 수 있는 버전입니다. 사이버 보안 및 생명 과학 분야의 업무를 위해 안전 장치를 의도적으로 완화하도록 설계되었습니다.

사양은 작동하지 않습니다. 문맥의 길이는 100만 토큰, 최대 출력은 12만 8천 토큰이며, 입력은 100만 토큰당 10달러, 출력은 50달러입니다. Claude 앱, API, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry, Claude Code를 사용할 수 있습니다. 또 다른 설명 영상에 따르면 Cursor를 통해서도 사용할 수 있게 되었습니다.

앤트로픽(Anthropic)의 설명은 “코딩과 지식 노동 분야에서 세계 최고 성능”이라고 발표했다. 자사 발표이므로, 숫자를 확인한 후에 신뢰하면 된다.

## 할인의 기원은 현금 인식이다.

입력 및 출력의 단가는 1원도 움직이지 않고 있다. 그럼에도 불구하고 “25% 저렴하다”, “45% 저렴하다”라고 말할 수 있는 것은 비용이 1가지 측면에서만 크게 하락했다는 점 때문이다.

캐시 읽기. 이미 읽어들인 자료나 대화의 내용을 다음 턴에서 다시 읽어보는 데 드는 비용이다. 100만 토큰당 1달러에서 0.25달러로 책정되었으며, 75% 할인된 가격이다.

![画像](https://assets.st-note.com/img/1788331192-O1aYNRkFiotHrwIvBhQE3plq.png?width=1200)

왜 에이전트 용도만 하락 폭이 거의 두 배나 되는 걸까? 장시간 실행하는 방식으로 진행할 경우 동일한 맥락을 수십 번이나 반복해서 읽어야 한다. 공식 그래프에서 가져온 해설 영상에 따르면 이 비용이 전체 비용의 3분의 2에 가까이 차지하고 있었다고 한다. 여기서 4분의 1로 줄어들면 전체가 45% 감소하는 계산이 된다. 감축률의 숫자는 실제 실험 결과이며, 2026년 8월 4주 동안 Claude Enterprise, Claude Code, API를 실제로 사용하면서 도출한 것이다.

또 다른 설명 영상에서는 그림에서 읽어낸 내용이 흥미로웠다. Fable 5.1의 가장 낮은 노력 수준이 Fable 5의 전력을 점수로 능가하며, 비용은 4분의 1로 줄어든다. Fable 5는 노력을 올리더라도 중간부터 점수가 더 이상 늘어나지 않았던 반면, 5.1은 끝까지 오른쪽으로 치솟는 형태였다. 같은 점수를 내는 데 드는 비용이, 상황에 따라 25%보다 훨씬 줄어들거나 심지어 1/수 분의 수준이 되는 것을 읽어냈다.

그러나 반대되는 측정 방식도 존재한다. 제3자 벤치마크 회사인 Artificial Analysis는 “최대한 노력한 결과 토큰 출력량이 1.7배 증가하고, 1 작업당 비용은 전세대보다 20% 높아졌다”고 측정했다. 즉, 저렴해지는 것은 “같은 맥락을 반복적으로 읽는” 방식과 “노력을 낮춰도 점수가 떨어지지 않는” 방식뿐이다. 전력을 다해 1회성 질문을 던지는 방식은 오히려 더 높다. 제3자의 숫자는 다음 장에서 종합적으로 살펴보겠다.

## 점수는 올랐다. 다만 측정 대상은 본인이다.

공식에서 발표한 비교표를 요약하면, 상대방은 Fable 5, Opus 5, OpenAI의 GPT-5.6 Sol입니다.

![画像](https://assets.st-note.com/img/1788331232-IdY7OoypQfx3LtMHlPvVCzWe.png?width=1200)

가장 높은 점수를 기록한 것은 과학 연구 결과로 2배 이상이었다. Mythos 5.1의 경우 터미널 작업은 60.9%까지 나왔다. 동일 모델에서 안전 장치를 완화했을 경우 점수가 더 높은 이유에 대해 공식에서는 PC 운영체제 벤치마크(OSWorld 2.0)만으로 구체적으로 설명하고 있으며, 안전 장치가 중단한 작업을 0점으로 계산하기 때문이라는 것이다. 표에 있는 다른 항목들의 차이에 대해서는 공식이 이유를 설명하지 않았다.

여기에는 조금 특이한 점이 있습니다. 공식 페이지는 공개 리더보드의 숫자와 자체 환경에서 재측정한 숫자가 다르고 (Opus 5는 30.0%와 29.0%, Fable 5는 21.4%와 24.7%) 이를 먼저 제시하며, 둘 다 오차 범위 내에 있다고 인정하고 있습니다. 자신의 측정 방식이 외부와 다르게 벗어나지 않았는지 미리 보여주는 회사는 흔하지 않습니다.

그럼에도 불구하고, 모든 숫자를 제시한 것은 판매자 측이다. 외부 재수험이 나올 때까지 그 정도로만 생각하면 된다.

## 제3자가 측정했을 경우 결과는 어떠했는지

판매자 측 숫자만으로 끝나지 않도록, 독립 계열 평가 회사인 Artificial Analysis의 측정치를 검토한다. 각 회사의 모델을 동일한 문제, 동일한 조건에서 실행시켜 점수와 1 작업당 비용 및 속도를 비교하는 사이트이다. 참고로 이 회사는 출시 전 평가에서 Anthropic과 협력한 사실이 명시되어 있으므로, 완전한 외부자가 아니라는 점을 알 수 있다.

결론부터 말씀드리자면, 지능은 1위이며, 가계부탁은 상위권 중 가장 부정적인 부분입니다.

- 지능 종합 지수는 66점으로, 192 모델 중 1위를 차지했습니다. Opus 5는 63점, Fable 5는 62점, GPT-5.6 Sol은 61점입니다. 다만, Opus 5와의 차이는 오차의 범위 내일 수도 있다는 평가 회사 자체의 언급이 있습니다.
- 1 작업당 비용은 최대 노력으로 3.76달러입니다. Fable 5의 3.14달러보다 20% 높습니다. 이는 출력 토큰이 약 1.7배 증가했기 때문입니다. 캐시 읽기 가격 인하가 없었다면 5.16달러였을 것이므로, 인하폭은 “증가분을 감추는” 효과를 낳았습니다.
- 노력을 줄이면 상황이 달라진다. 가장 낮은 노력으로는 1개 작업 0.77달러이며, 비교 대상 중에서 가장 저렴한 가격이다. 중간 정도의 노력으로도 60점으로 10위 안에 든다. “노력을 낮춰도 점수가 떨어지지 않는다”는 공식의 주장은 제3자의 측정 방식에서도 거의 확인되었다.

![画像](https://assets.st-note.com/img/1788333214-akUA7eF0KYzNpmD2ivJ4Gwgq.png?width=1200)

이 목록을 훑어보면서 제가 가장 먼저 떠올린 건 아이폰 프로 모델이었다. 틀림없이 최고다. 하지만 5점 차이 때문에 4배나 비싸게 돈을 내야 한다고 하면 망설여질 것이다.

- GPT-5.6 솔은 61점에서 1 작업당 0.95달러입니다. Fable 5.1의 1/4 가격으로 점수 차이가 5점밖에 차이 없으므로, 종합적으로 보면 이쪽이 더 합리적입니다.
- Gemini 3.7 Flash는 56점으로 0.40달러입니다. 속도는 초당 285 토큰으로, Fable 5.1의 4배 이상입니다. 회사 내에서 ‘단순히 모두 처리’ 용도라면 이쪽이 더 적합합니다.
- GPT-5.6 루나는 52점으로 0.21달러입니다. 점수는 하락하지만, 비용은 Fable 5.1의 1/18입니다. 상당한 양의 정형 처리를 여기서 수행할 수 있습니다.

속도는 Fable 5.1이 초당 66 토큰으로 전 세대와 다를 바 없이 동일하다. 첫 번째 문자가 반환되는 데 걸리는 시간은 최대 노력 시 약 5분으로 길고, 적정 노력으로는 7초대로 줄어든다.

즉, 공식적인 ‘가격 인하’는 Pro 모델 내에서 작년의 Pro 모델과 비교한 이야기입니다. 다른 회사와 나란히 놓고 비교하는 순간, Anthropic의 강함이 ‘가장 현명하다’는 한 점에 좁혀집니다. 가장 현명한 것에 대해 월いくら払우かは, 회사마다 다른 회계 문제에 해당합니다.

## 회사에서 무엇이 달라지는가

회사원에게 있어 변화의 핵심은 지능이나 단가와 같지 않고, 다음 두 가지라고 생각한다.

막아지는 횟수가 줄어들었다. Claude Code에서 사이버 보안 관련 개입이 Fable 5와 비교했을 때 1 세션당 평균 60% 감소했다. 소프트웨어의 취약점을 “발견”하는 데 활용될 수 있게 되었으며 (공격 코드를 만드는 용도는 계속 중단된다). 생물학에서도 기본적인 질문에 대한 탐지가 85% 감소했다. “안전 장치에 갇혀 일할 수 없는” 상황이 줄어드는 것은 실무에서는 점수보다 효과가 있기 때문이다.

역으로 꼼꼼하게 다듬어진 부분도 있다. 새로운 API 계정에서는 과거 대화를 수정하는 동시에 Claude의 사고 과정을 보존하는 기능이 더 이상 사용 불가능하게 되었다. 이는 다른 회사가 Claude의 출력을 흡수하여 자신의 모델을 훈련시키는 ‘증류’를 막기 위한 것이다. 게다가, EU의 AI 법 대응에 따라 8월 2일 이후에 나온 모델의 출력에는 보이지 않는 디지털 워터마크가 삽입되며, 텍스트의 의미를 파악하기 어려운 기술적인 방어 수단으로 활용될 것이다. 탐지용 API는 제한적으로 공개되며, 규정 준수 부서가 신경 쓰는 것은 점수보다 오히려 이것일 것이다. Claude Code나 앱을 통해 사용하는 경우에는 무관하다.

사전에 사용된 회사 측의 의견도 공개되어 있다. 투자 회사인 밀레니엄은 100만 분의 1회에 해당하는 극히 드문 현상으로 4~5년 동안 아무도 설명하지 못했던 급락의 원인을 Fable 5.1이 외부 라이브러리의 버그까지 파고들어 특정했다고 밝혔다. 楽天메디컬은 다른 최첨단 모델 3가지는 놓쳤지만 임상 연구의 취약점을 발견하고 새로운 가설을 제시했다. 코그니션은 데빈에서 사용하던 Opus 5의 처리를 공개 첫 날에 5.1로 이전한다고 발표했다. Every의 표현이 가장 간결하다. “Fable의 머리, Opus의 가격, Sonnet의 속도”라는 모든 내용은 Anthropic이 게시한 의견이며, 유리한 내용이 선택되었을 가능성을 염두에 두어야 한다.

과학 이야기도 하나 있습니다. Mythos 5.1에 단백질 설계 도구를 전달하여 만든 설계를 외부 2개 조직에 실제로 제작을 맡긴 결과, 3개의 목표물에 결합 강도가 현재 최고 수준의 10배, 정확도는 약 50%였습니다. 이 분야의 시세는 10~15%입니다. 또한, 30년 이상 전의 레이더 이미지에서 금성의 고도도를 재구성하거나, 공개된 코드만으로 7개의 딥러닝 모델을 최대 2.5배까지 빠르게 하는 이야기도 있습니다. 연구실이 예산 문제로 포기했던 최적화에 손이 닿는 상황입니다.

## 부록. 오늘 해야 할 일

- 신 모델 공개에 맞춰 전 사용자의 5시간 및 주간 이용 제한이 리셋되었습니다.
- 프로 플랜에서 제공되는 크레딧에도 유효 기간이 있습니다. 다른 설명 영상에서는 9월 19일까지라고 안내되었습니다. 아직 사용하지 않은 사람은 5.1을 시도하는 빌미를 활용하면 됩니다.

새 모델이 똑똑해졌다는 이야기는 반년에 한 번 정도 듣는 이야기다. 이번에는 실제로 사용자의 지갑과 손을 움직이는 것이 “재검토 단가”와 “중단 횟수” 두 가지뿐이다. 그것이 회사를 어떻게 변화시키는지 아직 아무도 측정하지 않았다.

전철 승객께서는 다음과 같이 답변하시면 됩니다. 같은 가격으로 인해 거부 가능성이 줄어들고, 재독이 쉬워졌습니다. 이상입니다.

Anthropic는 “클로드 페이블 5.1”과 “클로드 미스 5.1”을 출시했다. The Decoder는 Anthropic의 클로드 페이블 5.1이 코딩 및 연구 분야에서 최대 45%까지 비용을 절감할 수 있다고 보도했다.

**출처:** [note 원문](https://note.com/toricon/n/nb26fa2f8a840)

*번역: Gemma 3(.44) 초벌 + 교정 36청크*

[원문 보기](https://note.com/toricon/n/nb26fa2f8a840) | 출처: note.com