Anthropic에서 AI 모델 “Claude Sonnet 5.5”를 출시했습니다. 전 세대 모델인 Claude Sonnet 5에 비해 성능이 향상되었을 뿐만 아니라 30%의 속도 향상도 달성했다고 합니다. 벤치마크 테스트에서는 GPT-6 Sol의 점수를 상회합니다. Introducing Claude Sonnet 5.5 [Anthropic](https://www.anthropic.com/claude-sonnet-5-5) Claude 시리즈는 플래그십 모델인 “Fable/Mythos”, 고성능 모델인 “Opus”, 균형 모델인 “Sonnet”, 저가 모델인 “Haiku”로 나뉘어 제공됩니다. 이번에 등장한 Claude Sonnet 5.5는 2026년 6월 말에 등장한 Claude Sonnet 5의 업데이트 버전이라는 위치를 차지합니다. “Claude Sonnet 5.5”, “Claude Sonnet 5”, “Claude Opus 5.5”, “GPT-6 Sol”의 각종 벤치마크 결과를 나열한 표는 다음과 같습니다. Claude Sonnet 5.5는 모든 테스트에서 전 세대 모델인 Claude Sonnet 5를 능가하며, 지식 노동 및 차트 이해 성능에서는 GPT-6 Sol를 초과하는 점수를 기록했습니다.
다음 그래프는 “Claude Sonnet 5.5”, “Claude Opus 5.5”, “Claude Sonnet 5”, “GPT-5.6 Sol”에서 에이전트 성능 벤치마크 “Terminal-Bench 4.0”를 실행한 결과를 보여주며, X축은 작업별 비용, Y축은 점수를 나타냅니다. Claude Sonnet 5.5는 GPT-5.6 Sol을 능가했을 뿐만 아니라 상위 모델인 Claude Opus 5.5와 동등한 성능을 보였습니다.
Claude Sonnet 5.5는 Claude Sonnet 5에 비해 30% 가속화되었으며, 대부분의 작업에서 30% 저 비용으로 처리된다고 합니다. 다음 퍼즐 큐브를 푸는 영상에서는 Claude Sonnet 5.5가 더 빠르고 저렴하게 처리를 완료합니다.
Sonnet 5.5는 더욱 지능적이고 효율적이며 30% 더 빠릅니다. 대부분의 작업에 대해 비용이 최대 30%까지 절감되므로 Claude Code 사용량도 더 효과적으로 활용할 수 있습니다. 버그 수정과 같은 잘 정의된 일상적인 작업이나 기능에 대한 빠른 반복 작업에 사용하세요. https://t.co/8eFe0YuAJWpic.twitter.com/hSlp8eClQS
Anthropic는 선행 체험 사용자 기반의 Claude Sonnet 5.5 활용 사례를 다음 스레드에서 공개하고 있으며, “낙엽 시뮬레이터”, “3D 모델 설계”, “JavaScript를 이용한 애니메이션 제작”과 같은 실제 사례를 확인할 수 있습니다.
Claude Sonnet 5.5 초기 실험 스레드. @_re_pete가 만든 낙엽 시뮬레이터 (Sonnet 5 vs Sonnet 5.5) pic.twitter.com/bVbUmS7tSw
제3자 기관인 Artificial Analysis 또한 Claude Sonnet 5.5의 테스트 결과를 공개하고 있습니다. 여러 테스트 결과를 바탕으로 모델의 종합적인 성능 지표를 산출하는 Artificial Analysis Intelligence Index v4.3.2의 점수는 “56”이며, 플래그십 모델인 Claude Fable 5.1을 3 포인트 상회했습니다.
한편, 추론 레벨을 Max로 설정했을 때의 토큰 사용량의 많음도 지적되고 있습니다. 아래 그래프는 Artificial Analysis에 의한 테스트 중의 작업 당 토큰 사용량을 나타내며, Claude Sonnet 5.5가 Claude Opus 5.5보다 더 많은 토큰을 사용하고 있음을 알 수 있습니다.
아래 그래프는 X축이 작업 당 비용, Y축이 성능 점수를 나타내며, Claude Sonnet 5.5가 Claude Opus 5.5에 비해 “저 성능 및 고가”라는 것을 알 수 있습니다. 동일 토큰 당의 요금은 Claude Opus 5.5보다 Claude Sonnet 5.5가 더 저렴하지만, 추론 레벨 Max에서는 토큰 사용량의 많음으로 인해 비용이 역전된 형태입니다.
Anthropic는 “대규모 프로젝트에서는 Opus를 사용하고, 품질, 속도, 비용의 균형을 추구하는 경우 Sonnet을 사용하도록 권장합니다.”라고 안내하고 있습니다. “Sonnet의 추론 레벨을 Max로 설정하면 균형이 깨질 수 있으므로, 그 경우에는 Opus 사용을 고려하도록 권장합니다.”
Opus로 시작하여 품질과 속도 및 비용의 균형을 맞추는 작업에는 Sonnet을 사용하십시오. Claude 앱은 기본적으로 중간 노력을 사용하며, Platform은 높게 설정됩니다. Sonnet을 Max로 설정하면 일부 균형이 손실될 수 있으며 (Opus를 고려하는 것이 좋습니다).
Claude Sonnet 5.5는 이미 Anthropic의 다양한 서비스에서 사용 가능하며, 무료 플랜의 기본 모델도 Claude Sonnet 5.5로 전환되었습니다.
API 요금은 Claude Sonnet 5와 동일합니다. 100만 토큰 당 요금은 캐시 읽기(캐시 읽기)가 0.2달러(약 31.5원), 캐시 쓰기(캐시 쓰기)가 2.5달러(약 393원), 입력이 2달러(약 315원), 출력 10달러(약 1574원)입니다. Claude Sonnet 5.5에는 Fable 시리즈 및 Opus 시리즈와 동일한 안전 장치가 적용되어 있으며, 사이버 공격 등과 관련된 위험한 내용으로 판단된 대화는 처리 중단되고 다른 모델로 폴백됩니다.
자동화된 행동 심사에서 Sonnet 5.5는 대부분의 정렬 및 진실성 측정 항목에서 Sonnet 5와 개선되거나 동일한 성능을 보입니다. 또한 사이버 보안 장치 및 최상위 모델과 유사한 폴백 기능이 탑재된 첫 번째 Sonnet 모델입니다. 일반적인 소프트웨어 개발에는 영향을 미치지 않습니다.
덧붙여, Claude Haiku 5.5가 앞으로 몇 주 이내에 출시될 예정임을 알 수 있습니다.
원문 보기 | 출처: Gigazine