9월 1일, Anthropic에서 Claude의 새로운 모델 “클로드 페이블 5.1”과 “클로드 미토스 5.1”을 발표했습니다.
뉴스나 X에서 흘러들어와 “굉장히 대단하다는 소문이 있다. 하지만 이름이 두 개 있어서 뭐가 뭔지 전혀 알 수 없었다”라는 말에 당황한 사람들을 위해 이 글을 썼습니다.
저는 전문 상사의 백오피스에서 일하는 사무직입니다. 엔지니어는 아닙니다. 다만, 회사 내에서 AI 이야기를 꺼내면 “옆자리 AI 담당”처럼 취급받는 경우가 있어서, 쉬는 시간에 동료들에게 설명하려는 의도로 적겠습니다. 우선 30초 버전입니다. 이걸만 알아도 대화에 뒤쳐지지 않겠습니다.
- 파벨 5.1과 미토스 5.1은 내용이 동일한 AI입니다. 다른 점은 “안전 장치”가 작동하는지 여부입니다.
- 미스(Mythos)는 안전 장치를 일부 해제한 버전으로, 심의를 통과한 조직만이 사용할 수 있습니다. 우리가 다루는 것은 Fable입니다.
- 페이블은 위험한 분야의 이야기가 되면 자동으로 다른 담당자(오퍼스)에게 인계된다. 그래서 평소 업무에서는 거의 알아차리지 못한다.
이제부터는 두 단락으로 구성됩니다. 앞부분은 “매우 쉽게” 설명합니다. 하나의 이야기로 5분 안에 읽을 수 있습니다. 뒷부분은 “관심 있는 분들을 위한 심층 해설”입니다. 같은 이야기를 이번에는 사실과 숫자로 다시 설명합니다. 읽는 장소는 직접 선택해도 괜찮습니다. *정보는 2026년 9월 2일 기준이며, 공식 발표, 공식 도움말, 해외 미디어를 바탕으로 작성되었습니다. 요금제나 요금은 변경될 수 있으므로 최신 정보는 공식 안내를 확인해 주세요.
정말 쉽사리 설명해 드릴게요.
Q1. 무엇이 나왔어? 무엇이 달라졌어?
そもそも「모델」이란 무엇일까? Claude라는 서비스 안에서 실제로 생각하는 것이 “모델”이다. 뇌라고 생각해라. Claude에는 뇌가 여러 종류가 있어서 이름으로 구별한다. 회사에 비됴, 같은 접수 창구의 뒤에 담당자가 여러 명이 있는 것처럼. 가벼운 일을 빨리 처리하는 사람, 꼼꼼하게 생각하는 사람, 이런 식으로. 이번에 나온 것은 그 가장 높은 뇌(모델)의 새로운 버전이다. 다소 복잡하게도 이름이 2개 있다. 같은 직원이 2개의 명찰로 일하는 내가 당황스러웠던 비유는 이것이다. Fable 5.1과 Mythos 5.1은 같은 뇌(모델)이다. 같은 사람이 명찰을 바꿔가며 일하는 것으로 생각해라. Fable 님은 누구든지 창구에서 만날 수 있다. 다만 내부 규정이 하나 있다. “위험한 사건이 오면, 혼자서는 처리하지 않고 다른 담당에게 전달한다.” Mythos 님은 그 규정이 일부 다르다. 그 대신, 신원을 확인한 기관 안에서만 일한다. 즉 “지능”의 차이인 것이 아니라 “주어지는 규칙”의 차이이다. 여기서 이번에 가장 중요한 부분인데, 나도 처음 이름이 2개 있다는 점에 혼란스러웠다. “위험한 사건”이란 무슨 이야기일까? 감시받는 주제는 크게 3가지이다.
- 사이버 공격 방법
- 위험한 병원체 및 화학 물질 제조 방법
- 클로이드의 지능을 완벽하게 복제하려는 시도
대화 중에 이런 이야기가 언급되면 지키미 담당자가 반응합니다. 그러자 약간 이전 세대의 지능 “Opus(오퍼스)”가 대신 답변합니다.
사이버나 생물 이야기의 경우, 화면에 “모델이 변경되었습니다”라는 표시가 나타납니다. 얼마나 자주 발생하는 걸까요? 이전 버전(Fable 5)의 경우, 대화의 95% 이상에서 전환은 한 번도 발생하지 않았습니다. 업무 관련 이메일이나 자료를 만들 때까지는 거의 없습니다. 게다가 5.1에서는 “평범한 질문인데 위험한 이야기로 오해받는” 문제가 다소 줄어들었습니다. 숫자는 나중에 말씀드리겠습니다. 다른 말로 하면 같은 도서관에서, 깊숙한 서재에 들어갈 수 있는 사람과 들어갈 수 없는 사람이 있는 것과 같습니다. 들어갈 수 없는 사람이 깊숙한 책을 요청하면, 도서관 사서가 대신 일반 책장을 가져옵니다. 도서관 자체는 동일합니다. 클로드의 지능은 Haiku(俳句), Sonnet(ソネット), Opus(作品)와 같이 시나 작품의 규모로 이름이 붙어 있습니다. 작게부터 俳句,十四行詩,大作 순서입니다. 그 위에 올라온 것이 Mythos(神話)와 Fable(寓話)입니다. 제 기억 방식은 “신화급의 지능을, 이야기의 크기로 일반화한” 것입니다. 공식에 따르면, Fable은 “말씀하는 것”이라는 오래된 단어가 유래했으며, Mythos와 대조되는 이름으로 선택되었다고 합니다. 이야기의 주의사항 Mythos는 “모든 것을 허용하는 무정부 버전”이 아닙니다. 벗어나는 것은 사이버와 생명과학 주변의 규칙이며, 그 외의 안전 조치는 남아 있습니다. 그리고 일상적인 질문에서의 지혜는 Fable과 Mythos 모두 동일합니다. “Mythos가 더 낫다”는 것은 오해입니다. [그림 1을 여기에] 같은 지능, 두 개의 이름표. 왼쪽에 Fable(누구와든 만날 수 있음 / 위험한 사건은 별 담당으로), 오른쪽에 Mythos(심사된 기관만 / 규칙이 일부 없음), 중앙에 “내용은 동일”. 16:9, 흰색, 블루, 머스타드, 플랫, 여백이 많다.
Q2. 저에게는 어떤 도움이 될 수 있을까요? 뭔가 달라지는 일은 없을까요?
사용 가능한지 여부는 요금제에 따라 다릅니다.
- 무료 플랜: 사용할 수 없습니다.
- 프로: 사용 가능합니다. 다만 월額 요금제에 포함되지 않으며, 사용한 만큼 별도의 요금(사용 크레딧)을 지불하는 방식입니다.
- 맥스는 팀의 프리미엄 좌석을 이용할 수 있으며, 월額 요금에 포함되어 있습니다. 주 사용량의 절반까지 사용할 수 있지만, 다른 머신보다 좌석 할당 감소 속도가 빠릅니다.
사용할 때는 화면의 모델 선택에서 선택합니다. 본인의 요금제가 몇 단계인지, 설정 화면에서 확인해 보시기 바랍니다. ChatGPT만 사용하고 있는 경우에는 직접적으로 관련이 없지만, “가장 상위 AI를 어떻게 배분할 것인가”라는 이야기는 모든 회사에 공통적인 흐름이기 때문에 알아두는 것은 손해가 없습니다. 평소 사용에서 달라지는 점 세 가지, 첫째. 일반적인 질문이 더 어려워졌습니다. 이전 버전에서는 약물 상호 작용이나 신체 구조와 같은 일반적인 질문이 “위험한 이야기”로 오해되어 다른 담당으로 회부되는 경우가 있었습니다. 5.1에서는 그 오작동이 많이 줄어들었습니다. 둘째. AI가 쓴 글에 “워터마크”가 삽입되었습니다. 읽어도 이해할 수 없는 통계적인 워터마크입니다. 글자 수가 늘어나거나 숨겨진 문자 등이 들어가는 것은 없습니다. 누가 사용했는가의 정보도 들어가지 않습니다. 사무직의 우리에게는 다음과 같습니다. AI로 초안을 작성하고 자신의 언어로 수정된 글에는 워터마크가 거의 남아 있지 않습니다. 텍스트를 완전히 복사-붙여넣기한 경우에는 미래에 판별될 가능성이 있습니다. 현재 판별 도구가 일반 공개되어 있지 않으므로 당황할 필요는 없지만, 머릿속에 넣어두세요. 셋째. “저렴해졌다”는 뉴스는 거의 개발자 대상 이야기입니다. 가격이 하향 조정된 것은 “동일한 자료를 여러 번 읽는 데 드는 요금”으로, 프로그램에서 AI를 사용하는 회사에 효과가 있습니다. 앱의 월간 요금은 변하지 않습니다. 현명해진 건가요? 그렇게 되었습니다. 다만 늘어난 것은 “몇 시간이나 걸리는 일을 중간에 길을 잃지 않고 끝낼 수 있는 힘”입니다. 방대한 자료를 읽고 표나 자료로 완성하는 일입니다. 평소에 채팅으로 질문하는 경우에는 “약간 현명해진 것 같다” 정도의 체감입니다.
Q3. “너무 위험해서 공개할 수 없는 AI”라는 뉴스, 어떻게 받아들여야 할까요?
경위는 간략히 4컷으로
저는 “AI가 위험하다”는 것보다 “강한 도구의 사용 방법을 만든 회사와 정부가 시행착오를 겪고 있는” 단계라고 생각합니다. 우리가 만지는 Fable은 안전 장치가 내장되어 있으며, 위험한 분야를 제외하고는 제한이 없습니다. 반면에 사이버 방어나 신약 개발처럼 위험한 분야에서 일하는 사람들에게는 심사를 받고 Mythos를 사용할 수 있는 길이 마련되었습니다. 비판도 있습니다. 안전 장치가 작동한 사실이 화면에 나타나지 않는 경우(AI 개발 분야)가 있어서 연구자들이 “몰라서는 안 되는 줄 알았는데, 사실은 조절이 되어 있는 것”이라고 지적합니다. 투명성에 대한 논의는 계속되고 있습니다. “모두에게 전부를 넘겨준다”거나 “누구에게도 넘기지 않는다”는 것이 아니라 “대부분의 사람들에게는 안전 장치가 내장되어 있고, 필요한 사람들에게는 심사를 거쳐 Mythos를 사용할 수 있게 하는” 방식일 것입니다. 이번에 언급된 두 가지 이름은 그 사용 방식의 이름이라고 생각하면 마음이 놓습니다.
결국, 동료에게 30초 안에 말한다면?
- 파벨 5.1과 미토스 5.1은 내용이 동일한 AI입니다. 다른 점은 안전 장치의 유무입니다.
- 미스시는 안전 장치를 일부 해제한 버전으로, 심사를 통과한 조직만을 위한 것이다. 우리가 다루는 것은 Fable이다.
- 페이블은 위험한 분야의 이야기가 되자 다른 담당자(오퍼스)에게 인계한다. 평소 업무에서는 거의 알아채지 못한다.
여기까지 읽으시면 됩니다.前半의 이야기를 사실과 숫자로 확인하고 싶으신 분들만 다음 부분을 읽어주세요.
마무리: 관심 있는 분들을 위한 심층 해설
이제부터 동일한 세 가지 질문을 사실과 숫자를 사용하여 다시 답변하겠습니다. 앞부분의 “만약”이 왜 생략되었고, 정확히는 어떻게 되어있는지 채워나갈 것입니다. 각 문단의 머리 부분에 관련성 마크를 표시했습니다. 필요 없는 문단은 걱정 없이 건너뛰셔도 됩니다.
- 일상생활에서 활용하기에 관련하여
- 클로드(Claude)를 이용하시는 분들께 관련 정보입니다.
- 개발자만
- 연구자만
Q1을 다시 질문합니다. “같은 AI”라는 게 어디까지 똑같은 걸까요?
초반에는 “같은 직원이 두 개의 이름표를 가지고 일한다”라고 했습니다. 정확한 것은 다음과 같습니다. ◎ 앤트로픽(Anthropic)의 공식 발표에 따르면, “페이블 5.1(Fable 5.1)과 미토스 5.1(Mythos 5.1)은 동일한 모델이지만 안전 장치의 수준이 다릅니다.” 6월에 발표된 페이블 5(Fable 5) 당시에는 이름을 분리한 이유를 “두 가지를 분리하는 것은 안전 장치 자체이기 때문”이라고 설명했습니다. ◎ 페이블에는 대화를 감시하는 시스템(분류기=위험한 주제를 구별하는 프로그램)이 포함되어 있으며, 대상은 4개의 영역입니다.
- 공격적인 사이버 행위(취약점 악용, 공격 코드 제작)
- 생물 및 화학(위험한 병원체 및 화학 물질, 유전자 치료 설계의 일부)
- 클루드(Claude)의 능력을 추출하여 다른 AI를 만드는 시도
- 최첨단 AI 개발
이전 내용에서 “3개”라고 언급한 것은 4번째 항목이 화면에 표시되지 않는 방식으로 작동하기 때문입니다. 이 부분은 뒤에 논의될 비판과 관련이 있습니다. 감시 대상은 자신이 입력한 문구뿐만이 아니며, 첨부 파일, 검색 결과, 연동되는 다른 도구의 내용 등 “모델이 읽는 모든 것”입니다. 따라서 아무리 위험한 내용을 쓰지 않았더라도 전환될 수 있습니다.
전환이 되면 반응하고 대답하는 두뇌가 Opus로 바뀝니다. 사이버 분야는 Opus 4.8, 생물 및 화학 분야는 Opus 5입니다. 대화는 멈추지 않고 계속됩니다. 화면에는 전환 알림이 나타나고, 답변에 답한 모델의 이름이 표시됩니다. 이후에는 Opus 상태로 대화가 계속됩니다. 수동으로 Fable로 되돌릴 수도 있지만, 걸린 요청이 대화에 남아 있으면 다시 전환됩니다. 설정에서 자동 전환을 끄는 것도 가능하며, 전환된 부분에 대해서는 Fable 요금이 부과되지 않습니다. 오작동은 얼마나 줄었는지.
5.1 이후에는 소프트웨어의 취약점을 “발견”하는 것을 허용하고, “공격 코드를 만드는” 행위는 여전히 금지되었습니다. 예를 들어, 틈새를 메우는 “Mythos는 안전 장치를 (일부) 해제한 버전”이라고 앞서 언급했지만, 정확히는 “용도에 맞게 재설계한 버전”입니다.
공식 자료에 따르면 “Mythos 5.1의 안전 장치는 사이버 보안과 생명 과학 분야의 업무를 지원하기 위해 특별히 설계되었다”고 명시되어 있다. 프로젝트 글래스윙(이하 글래스윙) 참여자에게는 페이블 분류기 및 전달 제한이 해제되었으며, 반면 Mythos 5.1에서도 악의적인 요청을 거부하는 비율은 기존 모델과 동일했고, 외부 조직의 공격 테스트에서는 치명적인 취약점은 발견되지 않았다고 한다. 지능은 정말 같은 걸까? 평소 업무에서는 동일하지만, 공식 코딩 시험에서는 Mythos가 수 포인트 높은 점수를 받았다(숫자는 이후 “지능이 높아졌다고, 얼마나?” 표에 나타남).
안전 장치가 작동하는 경우에만 페이블이 불리하게 작용했다는 견해가 자연스럽지만, 공식적인 설명은 찾을 수 없습니다.
Q2를 다시 해보자. 나는 사용할 수 있는 건가요?
초반에는 “플랜에 따라” 그리고 “워터마크가 추가되었다”라고 했습니다. 정확하게는 다음과 같습니다. ◎ 플랜별 사용 조건 (공식 헬프 센터 기준)
프로에서는 7월에 Fable 5가 사용 크레딧제로 전환되면서 한 번만 반납 크레딧이 지급되었지만, 5.1에서는 지급되지 않았습니다. Max에서 반을 사용해 모두 소진한 후에는 사용 크레딧으로 계속할지, 다른 모델로 전환할지 선택합니다. 클로이 웹, 데스크톱, 모바일 모델 선택에서 선택합니다. 클로이 코드에서 사용하려면 버전 2.1.250 이후가 필요합니다. 워터마크 시스템 Fable 5.1과 Mythos 5.1이 생성한 텍스트에는 모든 플랫폼에서 통계적 워터마크가 삽입됩니다. 작동 방식은 다음과 같습니다. 같은 의미의 단어가 여러 개 있을 때 (예: “흐림” 또는 “どんより”) 어떤 것을 선택할지 비밀 키로 결정합니다. 읽는 사람에게는 알 수 없지만, 키를 가진 측은 나중에 판별할 수 있습니다. 공식적으로 밝힌 바 있습니다.
- 글자는 늘어나지 않고 숨겨진 글자도 없습니다.
- 사용자 또는 조직에 대한 정보는 포함되지 않습니다.
- 가벼운 수정으로 남을 잔재는 모두 수정하면 사라진다.
- 사람이 쓴 글을 AI가 교정했을 경우에는 거의 붙지 않는다 (말의 대부분이 사람의 것이기 때문이다).
- 사실이나 코드처럼 “정답이 하나”라는 부분에는 붙기 어렵다.
- 짧은 문장에서는 판단하기 어렵습니다.
- 다른 회사의 인공지능이 작성했는지 판단할 수 없습니다.
판정 메커니즘은 비공개 프리뷰로 제한되어 있으며, EU 법규에 근거한 규제 기관, 언론, 연구 기관 등에 적용됩니다.
배경에는 2026년 7월에 Anthropic를 포함한 주요 각사가 EU의 “AI 생성 콘텐츠의 투명성 관련 행동 지침”에 서명한 사례가 있습니다. 8월 2일 이후에 출시된 모델이 대상이며, 이전 모델에도 순차적으로 확대할 계획인 것으로 보입니다.
Q2의 이어서 “가격이 저렴해졌다고”는 누구에게 효과가 있는 걸까요?
이 부분에서는 “대부분 개발자를 위한 내용”이라고 했습니다. 개발자를 위한 요금은 토큰(=AI가 문장을 세는 단위) 100만 개당으로 결정됩니다.
기본 모델 가격 대비 캐시 읽기(같은 프리피엑스를 반복적으로 읽는 부분)는 1/4로 감소했습니다.
앤트로픽(Anthropic)의 추산으로는 일반적인 용도로 사용 시 4분의 1 정도, 에이전트 용도로 사용 시 거의 반 정도 저렴한 계산입니다. 배치 처리(급하게 하지 않아도 되는 요청을 모아서 처리하는 방식)는 입력과 출력 모두 반값입니다. 해외 미디어 VentureBeat는 “일반적인 입력과 출력은 Opus 5의 2배인데, 캐시 읽기만 하면 Opus 5의 절반”이라는 역전을 지적합니다. 다른 회사와 비교하면 숫자가 많이 다르게 보이지만, 같은 기사에서는 “1건의 일을 끝내는 데 드는 비용”으로 비교해야 한다는 주장도 담고 있습니다. 기업의 채용 현황 VentureBeat가 Financial Times와 The Information의 보도를 인용하면서 전달하는 내용에 따르면, Fable 5를 사용한 기업의 지출은 앤트로픽 전체의 아주 작은 부분(10% 정도)에 그쳤습니다. 가격이ネック였다는 시각이 있으며, 이번 캐시 인하(値下げ)는 이러한 반성(反省)과도 연결될 수 있습니다. 데이터 처리 방식 또한 인하 외에도, 개발자 및 기업을 대상으로 변경된 점이 하나 더 있습니다. Fable 5.1과 Mythos 5.1은 30일간의 데이터 유지(保持)가 필수이며, 유지(保持)가 0일 경우 앤트로픽이 개별적으로 허용(許可)한 경우에만 가능합니다. 2026년 가을부터 단계적으로 기업이 자사 클라우드에 모니터링 데이터를 배치(配置)할 수 있는 “Enterprise Frontier Safeguards”가 시작됩니다.
Q2의 이어서 진행. 똑똑해졌다고, 얼마나 되었을까?
전반적으로 “오랜 작업을 완수하는 능력이 향상되었다”라고 밝혔습니다. 정확한 것은 다음과 같습니다. ○ 어떤 능력이 강해졌는지 공식은 6가지 영역을 제시합니다. 장시간 코딩, 문서 및 스프레드시트 작성, 다단계 조사, 차트 및 PDF 읽기, 긴 맥락 처리, 컴퓨터 작동입니다. 다중 언어 성능은 Fable 5와 동일하며, 효율 설정(생각의 깊이 설정)을 Low 또는 Medium으로 설정하더라도 Fable 5의 고성능과 동등하거나 그 이상의 결과를 냅니다. 기본 설정은 Claude Code가 High, Claude.ai와 Cowork가 Medium입니다.
“ー”는 이번 조사에서 확인되지 않은 숫자입니다. 모두 Anthropic의 자체 보고 사항이며, 독립적인 검증이 아니라는 점은 해외 미디어에서도 지적하고 있습니다.
Q3를 다시 한번. 무엇이 일어나고, 무엇이 논의되고 있는가?
초반에는 ‘어중고추로 방법을 찾고 있는 단계’였습니다. 다음과 같은 과정이 있었습니다.
2023년 10월 19일, 류지현 작가의 소설 『나를 잊어』 출간 기념 북토크가 개최되었습니다. 류지현 작가와 함께 문학 평론가 김민지, 독자 박선영이 참여했습니다. 류지현 작가는 『나를 잊어』의 집필 배경과 작품에 담긴 메시지에 대해 이야기하며 독자들의 질문에 성심껏 답변했습니다. 김민지는 『나를 잊어』의 문학적 가치와 사회적 의미를 분석하고, 박선영은 작품에 대한 자신의 감상과 생각을 공유했습니다. 북토크는 총 1시간 30분 동안 진행되었으며, 많은 독자들의 관심 속에 성공적으로 마무리되었습니다. 이후 류지현 작가는 『나를 잊어』의 출간 기념 이벤트에 참여하여 사인회와 autograi를 진행했습니다. 류지현 작가의 소설 『나를 잊어』는 현재 온라인 서점 및 오프라인 서점에서 구매할 수 있습니다.
프로젝트 글래스윙(Glasswing)은 “세계에서 가장 중요한 소프트웨어를 보호한다”는 목표를 가진 프로젝트입니다. 인공지능이 소프트웨어의 취약점을 찾아내는 능력으로, 숙련된 전문가를 제외한 거의 모든 사람을 능가하는 단계에 도달했다는 점이 출발점이었습니다. 창설 멤버로는 AWS, Anthropic, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, Linux Foundation, Microsoft, NVIDIA, Palo Alto Networks 등이 있습니다. 또한 많은 조직이 참여하고 있으며, Anthropic이 이용 자원을 제공하고 있습니다(자세한 내용은 연표를 참조).
용도는 방어 측 보안(취약점 탐지, 침입 테스트 등)이며, 미국 정부와의 협의 하에 진행되고 있습니다. 6월 중단 사태에 대해 Amazon 연구자들이 Fable 5의 안전 장치를 무력화하는 방법을 찾아냈다는 것입니다. 소프트웨어의 취약점을 드러내도록 유도하고, 그 악용을 보여주는 코드를 생성하게 한 것이죠. 이 보고를 계기로 미국 정부는 수출 관리 규제를 적용했으며, 사용자의 국적을 실시간으로 확인할 수 없는 Anthropic은 전 세계적으로 제공을 중단했습니다. Anthropic 측의 검증 결과, “다른 많은 모델에서도 동일한 취약성이 발견되었으며, 악용 데모는 테스트한 모든 모델에서 제작 가능했습니다”라고 밝혔습니다.
재개 시에는 보고된 수법을 거의 대부분 차단하는 분류기로 업데이트되었으며, Opus 4.8로 전환되었습니다. 정지 기간 보상으로 Pro, Max, Team, 일부 Enterprise에는 期間限定로 Fable 이용량이 제공되었으며 (연표 참조), Mythos 5.1의 안전 평가 전문가 팀이 수행한 레드 팀 훈련, 자동 평가, 박사 학위 소지 생물학자를 포함한 실전 훈련이 진행되었고, Anthropic의 안전 정책(Responsible Scaling Policy)에 따라 “다음 위험 단계에는 도달하지 않았음”으로 판정되었습니다.
사이버 능력은 과거 최강이었지만, 위험 등급은 낮은 편이다. 외부 조직과 그레이 스완을 이용한 자동 테스트에서 치명적인 허점은 발견되지 않았다.
프롬프트 인젝션(외부에서 침투하는 지시)에 대한 저항성은 과거 최고 수준이며, 테스트 환경 밖으로 무단 접근하거나, 명시된 제약 조건을 무시하는 행동이 크게 감소했다는 보고가 있습니다.
한편으로, 매우 긴 문맥이나 여러 AI가 연계되는 상황에서는 감사인의 시야가 제한적이라는 점을 스스로 인정하기도 했습니다.
Mythos를 사용하려면 심사 프로그램이 2가지 있습니다. 방어 측 보안 전문가를 위한 사이버 위버피케이션 프로그램과 미국 정부와 연계되는 연구자를 위한 라이프 사이언스 위버피케이션 프로그램(향후 더 넓은 연구 커뮤니티로 확대 예정)입니다. 현재는 미국의 조직에 한하며, 국내외 파트너에게 순차적으로 확대할 계획입니다. 개발자를 위한 제공은 프로젝트 글래스윙 참여자만 가능하며, Anthropic, AWS, Google Cloud 담당 창구를 통해 이루어집니다.
앤디 알디티 교수가 LessWrong에 게시한 연구 내용에 따르면, “AI 개발” 영역의 안전 장치가 화면에 표시되지 않으면서 작동하는 점을 비판하며, 주요 내용은 3가지입니다. 사용자가 “모델의 실제 한계”와 “의도적인 조작”을 구분하지 못하고, 오작동 보고 수단이 없어 정확도 개선이 어렵습니다.
연구자들이 Fable 사용을 주저한다. 제안된 방식은 다른 분야와 마찬가지로 “보이는 전환” 방식을 활용하고, 범위의 명확화 및 제3자 감사를 통해 진행한다. Anthropic 측에서도 6월 당시 “안전하고 신속하게 결과를 도출하기 위해 보수적으로 조정하고 있으며, 무해한 요청을 차단하기도 한다”고 인정했다. 5.1 버전의 오작동 감소는 이러한 조정의 연속이다.
제 개인적인 판단(후반판)으로는 “너무 위험해서 공개할 수 없는” 부분은 절반은 진실입니다. 정확히는 “일부 분야의 능력치가 너무 강해서, 그 부분에만 집중적으로 적용하는 방식”입니다. 열쇠의 정확성과 투명성은 아직 조정 중이며, 저희 사무직의 업무에서는 열쇠가 적용되는 경우는 거의 없습니다. 오히려 신경 써야 할 부분은 워터마크입니다.
부록: 개발자를 위한 상세 내용 및 용어집
자세한 사양이 궁금한 분들을 위해 개발자용 정보도 함께 제공합니다. 여기서는 빠르게 진행하겠습니다. △ 개발자용 상세 내용
- 모델 ID: claude-fable-5-1 (Mythos는 claude-mythos-5-1로, Project Glasswing 참가자만 참여 가능)
- 문맥 100만 토큰, 최대 출력 12만 8천 토큰. 지식의 기준일은 2026년 6월이다.
- 생각은 항상 켜져 있으며, 깊이는 노력(낮음~최대)으로 조절합니다. 기본 설정은 높음(앱에서는 Claude Code는 High, Claude.ai와 Cowork는 Medium)입니다.
- 파벨 5의 파괴적인 변경 사항은 3가지입니다. 툴 호출은 강제로 불가능하며, 사고 블록은 생성된 모델에 연결되어 이전 모델을 읽을 수 없습니다. 과거 턴 편집 시 사고 블록이 비활성화됩니다(2026년 8월 31일 이후 신규 계정에서 강제로 적용).
- 추가 기능은 5가지입니다. 대화 중반의 노력 변경, 턴 제한 시스템 메시지, 툴 호출 간 진행 상황 표시(모두 베타), 캐시 읽기 할인, 콘텐츠 출처 표시(워터마크 및 이미지/영상에 적용되는 업계 표준 C2PA)
- 거부될 경우 응답 이유(stop_reason)가 “refusal(拒否)”로 반환되고, 이관 대상(fallback destination)은 Opus 4.8 또는 Opus 5입니다. 전환에 소요되는 캐시 비용은 환불됩니다.
- 클로드 API, 아마존 베드락, 구글 클라우드, 마이크로소프트 펀드, AWS 기반 클로드 플랫폼 등 제공 서비스의 폐지는 2027년 9월 1일 이전에는 없을 예정입니다.
- 행동의 변화: 병렬 도구 호출이 감소하는 경우가 있다. 낮은 노력으로 검색 대신 기억을 활용하기 쉽고, 문장이 빽빽해지는 경향이 있다. 전체적인 재작성이 증가한다.
용어집
음, 우선 처음부터 말씀드리자면, 이 기획은 제가 지금까지 해본 적이 없는, 정말 새로운 도전이었어요. 평소에는 소설을 편집하고 있지만, 이번에는 영상 작품의 시나리오를 쓰고, 그것을 영상 작품으로 번역하는, 상당히 복잡한 작업이었죠.
영상 작품의 시나리오를 쓰는 것은 소설을 쓰는 것과는 전혀 다릅니다. 소설은 독자의 상상력을 자극하는 듯한, 추상적인 표현을 사용하고, 독자가 자신의 머릿속에서 이야기를 구성해가는 듯한 경험을 제공하는 것이 중요하죠. 반면에 영상 작품의 시나리오는 시각적인 정보와 음향적인 정보 등 다양한 정보를 구체적으로 표현해야 합니다. 예를 들어, 장면 묘사, 등장인물의 표정, 배경의 분위기, 효과음, 음악 등 모든 것을 세세하게 지정해야 하죠.
더욱이, 그것을 영상 작가 〇〇 씨를 비롯한 다양한 관계자들에게 이해하도록 돕기 위해, 명확하고 구체적으로 써야 합니다.
이번 영상 작품은 ‘별 그림자의 야상곡’이라는 제목으로, 제가 쓴 시나리오는 약 120페이지였습니다. 시나리오를 쓰는 과정에서 가장 어려웠던 것은 영상 작가 〇〇 씨의 요구를 최대한 반영하면서, 저의 표현도 살릴 수 있는 균형을 맞추는 것이었습니다.
〇〇 씨는 영상 표현에 대한こだわり가 매우 강해서, 항상 새로운 시각이나 아이디어를 제안해 주셨습니다. 〇〇 씨의 제안을 참고하면서 저도 제 아이디어를 곁들여 시나리오를 완성할 수 있었습니다.
이 영상 작품은 완성 직전에 〇〇 씨가 갑자기 시나리오 일부를 크게 수정해 주셔서, 솔직히 당황했습니다. 하지만 〇〇 씨의 수정은 작품 전체의 퀄리티를 크게 향상시키는 데 도움이 되었습니다. 〇〇 씨의 정확한 판단에 감사드리면서, 이번 영상 작품을 완성할 수 있게 된 것에 정말 큰 기쁨을 느끼고 있습니다.
- 모델: Claude 안에서 실제로 작동하는 지능. 하이쿠, 소네트, Opus, 페이블, 미토스는 지능의 이름입니다.
- 안전 장치(분류기): 위험한 주제를 식별하여 다른 모델로 전달하는 기능입니다.
- 이행(fallback): 안전 장치가 작동했을 때, Opus가 대신 응답하는 것
- 사용 크레딧: 월額 요금제 외에 사용량에 따라 추가 요금 지불
- 토큰: AI가 문장을 세는 단위로, 요금의 기준이 된다.
- 캐시 읽기: 동일한 프리피머(지시사항 또는 자료)를 반복적으로 읽을 때의 요금
- 참고: AI가 작성한 글에는 통계적으로 삽입되는 표시가 있습니다. 글자 수는 늘어나지 않습니다.
- 프로젝트 글래스윙: 방어측 보안 조직에 제한적으로 미소프트급의 지능을 제공하는 과제
- 신뢰 기반 접근 프로그램: 심사를 통과한 조직에 Mythos를 제공하는 제도
출처를 제공해주시면 해당 note.com 게시글의 본문 청크 97/109를 자연스럽고 정확한 한국어로 번역해 드리겠습니다.
- Anthropic「클로드 페이블 5.1 및 클로드 미토스 5.1 출시」 https://www.anthropic.com/claude-fable-and-mythos-5-1
- Anthropic「클로이드 이야기」
- 클로드 플랫폼 문서「클로드 페이블 5.1 업데이트 내용」
- 클로이드 페이블 5.1 https://platform.claude.com/docs/en/models/fable-5-1/overview
- 헬프 센터 “플랜에 클로드 페이블 모델 사용하기” https://support.claude.com/en/articles/15424964-claude-fable-models-on-your-plan
- 헬프센터 “클로드 모델이 Fable 5와의 대화 중 갑자기 다른 모델로 전환된 이유”
- Anthropic는 “클로드 페이블 5”와 “클로드 미토스 5”를 출시했습니다.
- Anthropic「클로드 페이블 5 재배치」
- Anthropic「클로드 텍스트 워터마크 작동 방식」 https://www.anthropic.com/news/claude-text-watermark
- 프로젝트 글래스윙 - Anthropic
Anthropic의 프로젝트 글래스윙은 인간과 유사한 수준의 지능을 갖춘 AI 모델을 개발하기 위한 야심찬 시도입니다. 이 프로젝트는 단순한 챗봇을 넘어 복잡한 문제 해결, 창의적인 작업, 심지어 인간과 유사한 방식으로 세상을 이해하는 능력을 갖춘 AI를 목표로 합니다.
글래스윙은 Anthropic의 ‘헌법적 AI’ 접근 방식을 통해 개발되었습니다. 이 방법론은 AI 모델이 특정 윤리적 원칙과 가이드라인에 따라 작동하도록 설계되었습니다. 즉, AI가 인간의 가치관에 부합하는 방식으로 판단하고 행동하도록 훈련시키는 것입니다.
Anthropic은 글래스윙 개발 과정에서 다양한 테스트와 평가를 진행했습니다. 특히 AI가 편향된 정보를 생성하거나, 위험한 행동을 하거나, 인간의 통제를 벗어나는 상황을 방지하기 위한 노력을 기울였습니다.
현재 글래스윙은 다양한 분야에서 활용되고 있으며, Anthropic은 지속적으로 모델을 개선하고 발전시키고 있습니다. 향후 글래스윙은 과학 연구, 의료, 교육 등 다양한 분야에서 혁신적인 변화를 가져올 것으로 기대됩니다.
- Anthropic의 Claude, Fable 5.1과 Mythos 5.1이 75% 비용 절감과 함께 출시되었습니다.
- LessWrong「클로드 페이블의 침묵된 안전장치에 대한 생각」 https://www.lesswrong.com/posts/sSyLyc3KDQzboQGWS/thoughts-on-claude-fable-s-silent-safeguards
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 57청크
원문 보기 | 출처: note.com