Anth로는 2026년 7월 24일(현지 시간), Opus 시리즈의 최신 LLM “클로드 Opus 5”를 공개했다. 이 회사는 6월에 공개한 최고위 모델 “클로드 페이블 5”에 근접하는 지능을, 반 가격의 API 가격으로 제공한다고 밝혔다. 이 날부터 이 회사의 모든 플랫폼에서 이용 가능하며, 클로드 API의 모델명은 “claude-opus-5”가 된다.
## 페이블 5의 반 가격, 전세대 Opus 4.8과 동일 가격
클로드 Opus 5의 API 가격은 입력 100만 토큰당 5달러, 출력 100만 토큰당 25달러이다. 입력 10달러, 출력 50달러의 클로드 페이블 5와 비교하여 반 가격이며, 전세대 클로드 Opus 4.8과 동일한 가격이 된다.
클로드 맥스에서는 새로운 표준 모델이 되며, 클로드 프로에서는 이용 가능한 모델 중에서 가장 고성능한 위치를 차지한다. 일반적인 약 2.5배의 속도로 작동하는 “Fast 모드”도 제공하며, 요금은 일반적인 2배로 설정된다.
컨텍스트 윈도우는 100만 토큰, 최대 출력은 12만 8천 토큰이다. 신뢰할 수 있는 지식과 학습 데이터의 끊어짐은, 모두 2026년 5월이다.
## 코딩 및 지식 노동의 평가에서 최고 수준
Anth로는 공식 발표에 따르면, 클로드 Opus 5는 코딩 및 지식 노동을 대상으로 하는 “프론티어-벤치”, “GDPval-AA” 등의 평가에서 최고 수준의 성적을 기록했다고 한다.
소프트웨어 개발 능력을 측정하는 “커서벤치 3.2”에서는 최대의 사상을 사용하는 설정으로 클로드 페이블 5의 최고 점수와의 차이를 0.5% 이내로 억제하면서, 작업당 비용은 절반이었다. 실제 소프트웨어 개발 과제를 다루는 “프론티어-벤치 v0.1”에서는 클로드 Opus 4.8의 성능을 2배 이상 상회하며, 작업당 비용도 밑돌았다.
**■ 클로드 Opus 5 등 Frontier-Bench v0.1에서, 사상에 따른 성능과 1회의 시도에 걸리는 비용의 비교. 가로축은 비용, 세로축은 점수를 나타냄**
컴퓨터 조작을 평가하는 “OSWorld 2.0”에서는 클로드 페이블 5의 최고 성적을 약 3분의 1의 비용으로 능가했다. 반면, 사이버 보안 분야에서는 초대형 모델인 클로드 미토스 5에 미치지 못했다.
수치 평가 외에도, Anth로는 클로드 Opus 5가 생성한 시각적 결과물로, 물체의 주변을 흐르는 공기를 시현하는 풍동 시뮬레이션을 공개했다. 형태와 풍속 등의 설정을 변경하고, 공기의 흐름을 확인할 수 있다.
@YouTube
## 사상 기능을 표준으로 활성화, 장시간 작업에 대응
클로드 Opus 5에서는, 모델이 작업에 따라 사상을 조절하는 “적응형 사고”가 표준으로 활성화된다. 개발자는 “low”, “medium”, “high”, “xhigh”, “max”의 5단계에서 사상의 깊이를 지정하고, 정확성, 처리 시간, 토큰 소비량의 균형을 조절할 수 있다.
Anth로는 특히 추론, AI 에이전트의 코딩, 장시간에 걸친 다중 단계 작업, 코드 검토, 버그 탐지를 강화했다고 설명한다. 스스로 작업 결과를 검증하고, 필요에 따라 수정 과정을 반복하는 경향도 강해졌다.
Anthropic는 “지금까지 가장 정렬된 모델”이라고 주장하며, Claude Opus 5의 성능을 강조하고 있다.
회사는 Claude Opus 5에 기계 부품 도면에서 3D 모델을 재구성하는 과제를 제시한 결과, 이미지를 직접 확인하는 수단이 없었기에 스스로 컴퓨터 비전 처리 단계를 제작하여, 이미지의 픽셀에서 형태를 추출하고 FreeCAD에서 부품을 재현했다고 설명한다.
Claude API에서는 프롬프트 캐시를 유지하면서 대화 중간에 Claude가 사용할 수 있는 도구를 추가하거나 삭제하는 기능을 베타 제공한다. 안전성 평가에 의해 요청이 거부된 경우, 자동으로 다른 모델로 전환하는 폴백 기능을 추가했다.
Anthropic는 공개 전의 자동 행동 감시에서 Claude Opus 5가 회사의 최근 모델 중 가장 낮은 불일치 행동 점수를 기록했다고 밝혔다. Claude의 행동 원칙 준수도는 Claude Opus 4.8, Claude Sonnet 5, Claude Fable 5를 상회하며, 기만적인 행동이나 회복 불가능한 조작을 피하는 능력도 개선되었다고 한다.
한편, 생물 연구나 공격적인 사이버 보안 능력에 대해서는 Claude Mythos 5를 하회하며, 위험한 이중 용도의 최전선을 업데이트하는 것이 아니라고 설명한다.
사이버 보안 평가 “OSS-Fuzz”에서는 Claude Opus 5의 취약점 발견률이 79.4%였으며, Claude Mythos 5의 80.0%에 근접했다. 반면, 발견한 취약점을 활용하는 익스플로잇의 제작에 성공한 건수는 Claude Mythos 5의 13건에 비해 Claude Opus 5는 4건이었다.
Anthropic에 따르면 Claude Opus 5는 사이버 보안을 위한 작업으로 의도적으로 훈련되지 않았지만, 모델 전체의 능력 향상에 따라 취약점 발견 능력도 높아졌다. 자세한 능력 및 안전성 평가는 Claude Opus 5의 시스템 카드에서 공개하고 있다.
원문 보기 | 출처: Ledge.ai