# 2026년 7월 최신: Claude Opus 5의 1M 컨텍스트란 무엇인가? (엔지니어링 지식 없이) 요금부터 Fast Mode까지 모두 번역

> https://bookfactory.kr/c/news/8281
> 게시판: 뉴스
> 작성자: 운영자
> 작성일: 2026-07-27T09:35:53.720Z

---

2026년 7월 24일, Anthropic에서 Claude Opus 5가 출시되었습니다. Claude Code에서도 새로운 표준 Opus 모델이 되었으며, 실행하면 모델 선택 화면에 “Opus (1M context)”라는 생소한 항목이 나열됩니다.
뉴스 기사나 SNS에서는 “파벨 5급의 성능이 절반 가격으로”와 같은 벤치마크 이야기가 중심이지만, 비엔지니어들이 실제로 사용할 때 효과를 미치는 것은 성능 점수보다 “1M 컨텍스트”와 “속도 과금”이라는 두 가지 변화입니다. 특히 1M 컨텍스트는 이름만으로는 무엇을 의미하는지 모른 채 지나치는 사람들이 많습니다.
이 기사에서는 Opus 5로 무엇이 달라졌는지 정리한 후, 1M 컨텍스트가 무엇을 의미하는지, 자신의 플랜에서 그것이 사용 가능한지, 그리고 새로 늘어난 고속 모드로 인해 우연히 과금되지 않도록 하는 방법을 공식 문서의 내용을 바탕으로 차례대로 설명합니다.
Opus 5로 바뀐 것을 3줄로 요약합니다.
세부 사항에 들어가기 전에 전체적인 그림을 먼저 확인해 보겠습니다.
첫째, Claude Code 내에서 Opus 5가 새로운 표준 Opus 모델이 되었습니다.

두 번째는 요금이 고정되었던 것입니다. 입력 100만 토큰당 5달러, 출력 100만 토큰당 25달러로, 이는 이전 Opus 4.8과 완전히 동일한 가격입니다. 성능이 향상되었는데 가격은 그대로 유지되었다는 것이 이번의 실질적인 내용입니다.

세 번째는 이 글의 주인공인 1M 컨텍스트입니다. 한 번에 처리할 수 있는 정보량의 한도가 100만 토큰으로 확대되었고, Claude Code의 모델 선택 화면에도 “Opus (1M context)”라고 표시되는ようになりました.

성능 면의 숫자도 일단 언급하면, Anthropic의 공표치에 따르면, 코딩 능력을 측정하는 Frontier-Bench v0.1에서 Opus 4.8의 2배 이상의 점수, CursorBench 3.2에서는 최상위 모델인 Fable 5의 피크 성능의 0.5퍼센트 이내에, 반의 반 가격으로 도달했다고 합니다. 하지만 비엔지니어의 일상 업무에서는 이 차이를 체감하는 경우는 그렇게 많지 않습니다. 오히려 다음에 설명하는 1M 컨텍스트가, 사용하기 더 편리합니다.

이는 크게 변화시킵니다.
そもそも「コンテキスト」とは何なのか

これが 가장 본題입니다. 전문 용어를 일단 잊고 생각해 보겠습니다.
컨텍스트는 AI가 “지금 이 순간에 보고 있는 정보의 전부”라는 뜻입니다. 당신이 보낸 지시문, 이전 대화의 교환, 읽어준 파일의 내용, AI가 스스로 조사한 결과, 모든 것이 컨텍스트에 쌓여 갑니다.
상상해 보세요. 작업대에 놓을 수 있는 문서의 양과 비슷합니다. 책상이 넓으면 많은 자료를 펼쳐놓고 작업할 수 있습니다. 책상이 좁으면 새로운 자료를 놓기 위해 오래된 자료를 치워야 합니다. AI도 같습니다. 이 책상에서 넘쳐나는 정보는 “보이지 않게” 됩니다.
Claude Code를 사용하면서 “전에 말한 것을 잊었다”는 느낌을 받은 사람은 바로 이 책상에 넘쳐나는 상태를 경험하는 것입니다. 대화가 길어지면 Claude Code는 자동으로 과거의 교환을 요약하고 압축하지만, 요약이므로 세부 사항은 줄어듭니다. 지시한 세부 조건이 빠져나가는 것은 이 때문입니다.
컨텍스트의 크기는 “토큰”이라는 단위로 표현됩니다. 토큰은 기계가 문장을 처리할 때의 작은 단위입니다.

공식적인 기준으로 영문은 1 토큰이 약 4자, 단어로 약 0.75語 정도입니다. 일본어는 문자당 토큰 수가 영어보다 많아지는 경향이 있으며, 특히 Claude 4.7 이후 모델은 새로운 방식으로 적용된 결과, 동일한 문장이라도 기존보다 약 30% 더 많은 토큰을 소비합니다.

1M 컨텍스트는 얼마나 되는가?

그러면 100만 토큰이란 것은 실제적으로 어느 정도의 양일까요?

정확한 환산은 문서의 내용에 따라 달라지므로, 엄밀히 말하면 대략적인 수치로 표현하겠습니다. 일본어 문서의 경우 A4 사이즈 문서로 약 400장에서 600장 정도, 오디오북 형식으로 5권에서 7권 분량 정도가 됩니다.

이전의 기준은 20만 토큰이었습니다. 따라서 단순 계산상으로는 5배에 해당합니다. A4로 80장에서 120장이었던 것이 400장에서 600장으로 늘어난 것을 생각하면 이해하기 쉬울 것입니다.

비엔지니어 실무에 적용하면 다음과 같은 일들을 한 번에 수행할 수 있게 됩니다.

1시간 회의를 기록한 회의록이라면, 수십 회 분량을まとめて渡して「この半年で繰り返し出ている論点を洗い出して」라고 요청할 수 있습니다. 사내 규정집이나 업무 마

두꺼운 자료와 같은 것들도, 챕터별로 분할하지 않고 덩어리로 읽게 한 후 “이 규정에 따라 이번 사례는 어떻게 처리해야 하는가”라고 질문할 수 있습니다. 자신이 과거에 썼던 블로그 글을 전부 읽게 해서 “자주 사용하는 표현의 습관”을 분석하게 하는 방식도 현실적입니다.

지금까지는こうした 작업을 하기 위해 자료를 분할하고, 요약하게 하고, 그 요약을 다시 넘겨주는 등 상당한 노력이 필요했습니다. 분할하면 당연히 “자료 전체를 조망한 판단”은 할 수 없게 됩니다. 1M 컨텍스트의 진정한 가치는 바로 이 분할 작업이 불필요해지는 지점에 있습니다.

또 하나 놓치지 말아야 할 점은 요금 처리 방식입니다. 공식 문서에는 1M 토큰의 컨텍스트는 표준 요금으로 제공되며, 20만 토큰을 초과한 분에는 추가 요금이 부과되지 않는다고 명시되어 있습니다. 90만 토큰의 교환도 9천 토큰의 교환도, 1 토큰당 단가가 동일하다는 의미입니다. 긴 자료를 다루면서 단가가 폭등할까 하는 걱정은 필요 없습니다.

자신의 플랜에서 1M 컨텍스트가 사용 가능한지 확인하는
이 부분이 가장 중요하고, 또 간과하기 쉬운 부분입니다. 1M 컨텍스트는, 계약하고 있는 플랜에 따라 세 가지 방식으로 처리됩니다.

Max 플랜, Team 플랜, Enterprise 플랜에서는 Opus가 자동으로 1M 컨텍스트로 업그레이드됩니다. 추가 설정이나 추가 비용이 필요 없으며, 구독 범위에 포함됩니다. Team 플랜은 표준 좌석과 프리미엄 좌석 모두 대상입니다.

Pro 플랜의 경우에는 상황이 다릅니다. Opus의 1M 컨텍스트를 사용하려면 구독과는 별도의 유량 크레딧, 공식 용어로는 “usage credits”를 활성화해 두어야 합니다. 월별 요금만으로는 자동으로 사용되지 않는다는 점을 명심해 두십시오.

API나 유량 결제로 사용하고 있다면 제한 없이 완전히 이용할 수 있습니다.

자신의 환경에서 사용 가능한지 확인하는 가장 쉬운 방법은 Claude Code에서 `/model`을 입력하고 모델 선택 화면을 여는 것입니다. 1M 컨텍스트가 이용 가능한 계정이라면, 그곳에 1M 컨텍스트의 선택 옵션이 표시됩니다. 표시되지 않는다면 Claude Code를 한 번 종료하고 다시 시작해 보십시오. 명시적으로 지정하려면 모델 이름 뒤에 대괄호 안에 1m를 붙여 쓰는 방식도 제공됩니다.

한편, 의도적으로

1M 컨텍스트를 사용하지 않는 설정으로 변경할 수도 있습니다. 환경 변수에서 CLAUDE_CODE_DISABLE_1M_CONTEXT을 1로 설정하면, 모델 선택 화면에서 1M 버전이 사라집니다. 예상치 못한 크레딧 소비를 확실히 피하고 싶을 경우 선택하는 옵션으로 기억해 두시면 좋습니다.

참고로 Sonnet 5는 취급이 훨씬 간단하며, 기본적으로 1M 컨텍스트가 적용됩니다. 200K 버전과 같은 구분 없이, 어떤 플랜에서도 추가 크레딧이 필요하지 않습니다.

Sonnet 5에 대해서는 이전에 자세히 설명한 기사가
있으므로, 참고하시기 바랍니다.

속도를 사는 “fast mode”라는 새로운 선택지
Opus 5에서도 알아두면 좋은 것이 바로 fast mode입니다.

fast mode는 Opus의 응답 속도를 최대 2.5배까지 끌어올리는 설정입니다. 중요한 점은 이것이 다른 모델이 아니라는 것입니다. 내용은 동일한 Opus를 사용하며, 속도를 우선하는 구성으로 전환한 것뿐이므로 품질이나 능력은 변하지 않습니다. 속도만 사는 시스템이라고 생각하시면 됩니다.

사용하는 방법은 간단하며, Claude Code에서 /fast를 입력하여 전환합니다. 활성화되려면

그리고 화면에 작은 번개와 같은 아이콘이 표시됩니다. 지원되는 것은 Opus 5와 Opus 4.8뿐이며, Sonnet이나 Haiku에서는 사용할 수 없습니다. 이전에 지원되었던 Opus 4.7은 7월 24일, 바로 이번 시점에 대상에서 제외되었습니다. 또한 명령줄 버전의 Claude Code는 전용으로 제공되며, VS Code 확장 기능으로는 사용할 수 없습니다.

그리고 여기서부터 주의해야 할 점입니다.

fast mode의 이용 요금은 “플랜 외”에 있습니다.
fast mode의 요금은 입력 100만 토큰당 10달러, 출력 100만 토큰당 50달러입니다. 일반적인 Opus 5는 각각 5달러와 25달러이므로, 정확히 2배의 단가가 됩니다.
문제는 단가 자체보다, 그 이용 요금이 어디에서 공제되는가입니다. 공식 문서에는, 구독 플랜을 사용하고 있는 경우 fast mode는 소액 결제 방식(크레딧)을 통해서만 이용 가능하며, 플랜에 포함된 이용 쿼라의 대상이 아니라고 명시되어 있습니다. 더불어, 플랜의 이용 쿼라가 아직 남아있더라도 fast mode의 소비는 크레딧에서 직접 공제되며, 첫 번째 토큰부터 고속 요금으로 청구된다고도 쓰여 있습니다.

즉, “월額 요금을 지불하고 있으니 추가 비용이 발생하지 않겠지”라는 생각으로 사용하면 예상치 못한 청구가 발생합니다.そもそも従量クレジット를 유효하게 설정하지 않은 계정에서는 fast mode 자체가 사용될 수 없습니다.

또 다른 한 가지, 비용에 직접 연관된 기능이 있습니다. 대화 도중 fast mode를 켜면, 그 시점까지 누적된 대화 전체 내용에 대해 고속 모드 입력 요금이 한 번에 청구됩니다. 대화가 길어져서 늦게 켜는 경우 더 비싸다는 점입니다. 이 비용은 1개의 대화에 대해 한 번만 부과되므로, 중간에 끄고 다시 켜도 중복으로 청구되지는 않지만, 사용을 결정했다면 대화의 처음부터 켜 두는 것이 저렴합니다.

한편, 크레딧을 모두 소진하거나 요금 제한에 도달한 경우에는 자동으로 일반 속도로 전환되어 작업이 계속됩니다. 갑자기 멈추는 것이 아니므로 안심해 주세요.

속도를 변경하는 방법은 또 하나 있습니다.

속도에 대해서는, fast mode 외에 “effort”라는 설정이 있습니다. 이는 AI에게 얼마나 깊이 생각하게 할 것인가의 수준으로, low, medium, high, x

고급(high), 최대(max)와 같은 단계가 준비되어 있습니다. 현재 기본값은 노력이 반영되는 모델에서는 high입니다.

두 가지 차이점을 정리하면, fast 모드는 품질은 그대로 유지하면서 응답 속도를 빠르게 하지만 단가가 올라가는 방식이고, 노력을 줄이는 것은 생각하는 시간을 줄여 빠르게 하지만 복잡한 작업으로 품질이 저하될 가능성이 있다는 방식입니다. 요금을 늘리지 않고 체감 속도를 높이고 싶다면, 먼저 노력을 줄이는 방식을 먼저 시도하는 것이 순조롭습니다. 두 가지를 조합하는 것도 가능합니다.

Opus 5에 대해서는 미세하지만 유용한 변경 사항도 있습니다. 이전 모델에서는 새로운 모델을 처음 사용할 때 해당 모델의 기본 노력이 강제로 적용되고, 명시적으로 선택하지 않는 한 유지되는 방식이 있었습니다. Opus 5에서는 이 제약이 없어, 자신이 이전에 설정한 레벨이 그대로 이어집니다. 매번 설정하는 번거로움이 줄어든다는 의미입니다.

명령어 사용법이나, 그 외의 유용한 설정에 대해서는 이전에 정리한
신(神) 명령어·설정 7선
도 함께 읽어보세요.

오늘 해두어야 할 3가지:

위 내용을 바탕으로 실제로 손으로 하는 부분을 정리합니다.

1. 모델 선택

현재 상태 확인하기
Claude Code에서 `/model`과 입력하고, Opus 5가 선택 가능한지, 그리고 1M 컨텍스트가 표시되는지 확인합니다. 표시되지 않는다면 세션을 재시작해 보세요. 이것만 보더라도 본인의 계정에서 무엇이 가능한지 명확하게 알 수 있습니다.
2 플랜에 따라 1M 컨텍스트 사용 여부 결정하기
Max, Team, Enterprise 각 플랜은 추가 비용 없이 1M 컨텍스트를 사용할 수 있으므로, 긴 자료를 다루는 작업에서는 적극적으로 활용하는 것이 좋습니다. Pro 플랜은 사용량에 따라 크레딧이 필요하므로, 활성화할지 여부를 의식적으로 판단해야 합니다. 예상치 못한 소비를 확실하게 피하고 싶다면, 환경 변수에서 1M 컨텍스트를 비활성화하는 것도 방법입니다.
3 fast mode는 사용하기 전에 자리 정하기
fast mode는 그 자리에서 여러 번 교환하면서 해결해 나가는 작업이나, 마감 기한이 촉박하여 대기 시간을 줄여야 할 때에 적합합니다. 반대로, 장시간 방치하는 작업이나, 비용을 줄여야 할 작업에서는 일반 모드가 더 적합합니다. 사용하기로 결정했다면 대화의 처음부터 켜는 것이 낭비를 줄이는 데 도움이 됩니다.

자주 묻는 질문

Q. 1M 컨텍스트로 하면 요금이 더 비어 있나요?
A. 토큰당 단가는 변하지 않습니다. 공식적으로도 20만 토큰을 초과한 분에 대한 추가 요금은 없다고 명시되어 있습니다. 하지만 긴 자료를 읽게 하면 토큰 총량 자체는 늘어나므로, 결과적으로 소비량은 늘어납니다. 단가가 아닌 총량을 기준으로 생각해주세요.

Q. Pro 플랜으로도 1M 컨텍스트를 사용할 수 있나요?
A. 정량 크레딧을 활성화하면 사용할 수 있습니다. 월별 요금 혜택으로는 자동으로 활성화되지 않습니다.

Q. Fast 모드를 사용하면 답변의 질이 향상되나요?
A. 향상되지 않습니다. 내용은 동일한 Opus를 사용하며, 속도만 달라집니다. 품질을 높이고 싶다면 effort 레벨을 높이는 방안을 고려해 보세요.

Q. 어떤 모델을 선택해야 할지 결국 알 수 없네요.
A. 헷갈릴 때는 표준 모델을 사용하는 것이 안전합니다. 그 위에 복잡한 판단이나 긴 자료를 다루는 경우에는 Opus 5, 일상적인 작업에는 Sonnet 5를 선택하는 방식으로 시작해 보세요. 모델별 적합성은
모델 사용 가이드
記事에서 자세히 정리되어 있습니다.

요약
Claude Opus 5로 꿰뚫는다

해야 할 변화는 3가지입니다. Claude Code의 새로운 표준 Opus로 변경된 것, 요금이 동결된 채 유지된 것, 그리고 한 번에 처리할 수 있는 정보량이 100만 토큰으로 확대된 것입니다.

1M 컨텍스트는 AI의 작업대가 5배 확장된 것과 같습니다. 두꺼운 자료를 분할하지 않고 그대로 전달할 수 있게 되어 자료 전체를 파악한 판단을 내릴 수 있습니다. 다만 사용 가능 여부는 플랜에 따라 달라지며, Max, Team, Enterprise는 추가 비용이 발생하지 않지만, Pro는 사용량에 따라 크레딧이 차감됩니다.

새롭게 추가된 fast mode는 품질이 아닌 속도를 구매하는 방식입니다. 단가는 2배이며, 구독 플랜의 이용 횟수에는 포함되지 않고 사용량 크레딧에서 차감됩니다. 분명히 유용하게 사용할 수 있는 상황이 있지만, 시스템에 대해 잘 모른 채로 사용하면 예상치 못한 청구로 이어질 수 있습니다.

새로운 모델이 나올 때마다 전부를 쫓아갈 필요는 없습니다. 자신의 플랜으로 무엇이 사용 가능한지, 그리고 어디에서 추가 비용이 발생하는지 이 두 가지 사항만 확인해 두면 충분합니다.

함께 읽어보기 관련 기사:
AI의 최신 정보를 실시간으로 발신 중
X(@ai_hack_dx)
AI가 만든 것을 공유하는 멤버십을 시작했습니다

매주 제가 만드는 것을 공유하고, 참여해주신 분들의 작품도 소개합니다. 월 500엔에 무료이며, 코드를 작성하지 못해도 괜찮습니다.

![見出し画像](https://assets.st-note.com/production/uploads/images/297945113/rectangle_large_type_2_1fe0470e10e6f56ab911ff7bb2ae2625.png?width=1280)

![画像](https://assets.st-note.com/img/1785121271-UgLB8IPHGrJ629KFi4cWDMsS.png?width=1200)

![画像](https://assets.st-note.com/img/1785121310-F5rIURGlmZbDvMLC7Pk1E4YJ.png?width=1200)

![画像](https://assets.st-note.com/img/1785121345-CifhlRWSQjwY8Dp7UdVcOgHx.png?width=1200)

**출처:** [note 원문](https://note.com/ai_hack_dx/n/nbafe159e74d6)

*번역: Gemma 3(.44) 문단 청크 번역*

\n\n[원문 보기: https://note.com/ai_hack_dx/n/nbafe159e74d6] note.com