# 【클로드 하이쿠 5.5】 하루 만에 최고의 활용법: 90% 단가 할인 뒤에 숨겨진 ‘10만 토큰의 벼랑’과 400 에러의 함정

> https://bookfactory.kr/board/news/20515
> 게시판: 뉴스
> 작성자: admin
> 작성일: 2026-10-10T01:58:59.544Z

---

드디어 왔어! 놀랍게도 루나와 같은 금액 클래스다. 처음부터 전력으로 돌려! 최고야!

앤서니(Anthropic)에서 약 1년 만에 업데이트된 경량 모델 “클로드 하이쿠 5.5”입니다.

![画像](https://assets.st-note.com/img/1791466837-QidxWlrv63p2LYg4t5NqfZsT.png?width=1200)

입력 단가가 90% 할인, 평균 비용 75% 감축, OSWorld에서 놀라운 점수를 내며 SNS와 개발자 커뮤니티에서 축제 분위기가 형성되었다.

![画像](https://assets.st-note.com/img/1791466853-p4KfIONUGHAV7FdskjQ8uJRh.png?width=1200)

하지만 공식 문서나 144페이지에 달하는 System Card를 꼼꼼히 분석해 보면 “쉽게 받아들이고 그대로 옮겨가려고 하면 예상치 못한 고액 청구나 400 오류로 큰 손해를 볼 수 있는 함정이 여러 번 발견됩니다.”

결국, 망쳐버렸네.

그러므로 이 글에서는 Haiku 5.5의 진정한 실력, 요금 체계의 뒤에 숨겨진 “10만 토큰의 벼랑”, 전환 시의 파괴적인 변경, 그리고 현장에서의 현명한 활용에 대해 심층적으로 조사합니다.

## 목차

1차 번역문에 미번역된 일어나 부자연스러운 어휘가 있다면 매끄럽고 완벽한 한국어로 교정하세요. 고유명사·인명·수치는 원문 그대로 보존하고, 최종 한국어 결과만 출력하세요.

- 30초 만에 파악하는 “클로드 하이쿠 5.5”의 빛과 그림자
- 요금의 진실：「10만 토큰의 벼랑」에 유의하라
- 트랩 1: 입력이 100k 토큰을 초과하면 단가가 5배로 인상됩니다.
- 망 2: 새로운 토큰화기로 토큰 수가 약 30% 증가합니다.
- 2. 벤치마크의 뒷면: 공개치는 “최대 노력”일 뿐입니다!
- 여기서 얻을 수 있는 교훈
- 기존 코드에서 이관할 경우 “400 오류”로 인해 즉시 시스템이 종료되는 파괴적인 변경입니다.
- 4. 현장에서 진정으로 승리할 수 있는 “하이고 5.5”의 활용법
- 구체적인 추천 사용 사례
- 5. 시스템 카드에 나타나는 예상치 못한 특징들

## 30초 만에 파악하는 ‘클로드 하이쿠 5.5’의 빛과 그림자

![画像](https://assets.st-note.com/img/1791466319-fTkblJHDsQ3GiA0KUutM58yq.jpg?width=1200)

최대 광채 | ≦100k로 입력 시 0.10 / 출력 시 0.50 (4.5배 비율로 단가 90% 감축). Context 1M, 출력 128K 대응. 최대 그림자 | “10만 토큰의 벼랑”(100k 초과 시 단가 5배). 새로운 토크나이저로 약 30% 팽창하므로 벼랑을 넘어가기 쉬움. 성능의 진실 | 공개 벤치 (OSWorld 72.4% 등)는 거의 “최대 노력” 시점의 수치. 기본 medium에서는 약 53%. 전환의 함정 | `budget_tokens` 폐지, 온도 파라미터 변경 금지, prefill 금지 등 기존 코드대로면 400 오류가 빈번하게 발생. 적합 | “좁고, 빠르고, 많게”. 요약, 분류, 추출, 기록 압축 (compaction), Subagent의 병렬 함대.

사용해 본 소감으로는 “샘플이 있거나 규칙이 엄격한 작업에는 강점을 보이지만, 어떤 것을 추론하는 작업은 지양하는 것이 좋다고 느껴집니다.”

7할의 일을 끝낸다는 슬로건은 이 세상의 7할의 작업이 끝나는 게 아니라 “어떤 일이라도 7할 정도밖에 할 수 없는”이라는 인식 쪽이 더 정확할 수도 있습니다. 시작과 끝에는 상위 모델이 약간 필요했습니다.

하지만, 상당히 저렴해. 루나보다 좋을지도 몰라.

## 요금의 진실：「10만 토큰의 벼랑」에 유의하라

해이쿠 5.5의 가장 큰 매력은 단연코 “압도적인 저렴한 가격”이다.

- 0.10 / MTok (4.5는 1.00달러)
- 0.50 / MTok (4.5는 5.00)
- 캐시 읽기: 0.01 / MTok (4.5는 0.10)

단가만 보더라도 90% 할인된 것처럼 보이지만, 여기에는 큰 함정이 두 가지 있습니다.

![画像](https://assets.st-note.com/img/1791466330-E0jBfSt9LX2vbnasFoQNukG7.jpg?width=1200)

### 트랩 1: 입력이 100k 토큰을 초과하면 단가가 5배로 인상됩니다.

해이크 5.5는 입력 프롬프트의 길이(length)에 따라 2단계 요금 테이블이 적용됩니다.

- 100명 미만: 입력 0.10 / 출력 0.50
- 100k 초과: 입력 0.50 / 출력 2.50 (5배!)

![画像](https://assets.st-note.com/img/1791466415-jpDl4wHNhMZmI7eCQio0XgWx.jpg?width=1200)

### 망 2: 새로운 토큰 나이저로 토큰 수가 “약 30%” 증가함

클로이드 4.7 버전부터 새 토크나이저가 적용되어 동일한 일본어 및 영어 텍스트의 경우 토큰 수가 약 1.3배 증가합니다.

이건 싫다. 내가 현지에서 벽에 직접 닿아보는 습관 때문에 거기까지 계산해 버리니까. 자료를 너무 많이 읽게 하는 것을 멈추지 않으면 안 된다.

Haiku 4.5의 경우 80k 토큰이었으므로 충분히 100k 이내로 사용 가능했습니다. 5.5 버전에서는 104k 토큰으로 급증하여 갑자기 5배의 고가 대역 요금이 부과되었습니다. 저는 원래 좁은 마지노선을 노리는 습성이 있었기에, 결국 5배로 불어났습니다. 정말 최악입니다.

> 
> 
> 💡 해결책: 미리 프롬프트의 토큰 수를 재계산하고, 긴 문장은 요약하거나 “프롬프트 캐시(5분/1시간)”를 활용하여 100k 이내로 줄이는 설계를 철저히 하십시오.
> 

## 벤치마크의 숨겨진 면: 공개된 값은 “최대 노력”일 뿐이다!

Haiku 5.5에는 추론의 깊이를 조절하는 ‘에포트’(low / medium / high / xhigh / max)라는 다이어스가 신설되었습니다(기본값은 ‘medium’).

![画像](https://assets.st-note.com/img/1791466874-3lcLIgvonm28B9CV4WAuYrZT.png?width=1200)

발표 시점에 공개된 화려한 점수(PC 실적 운영 테스트에서 OSWorld 72.4%나 Terminal-Bench 39.2% 등)를 보고 “손네트만큼인가?”라 기대하고 싶지만, 주의해야 합니다.

![画像](https://assets.st-note.com/img/1791466406-jWLa92iQCtnJUw3FArSM5Dhy.jpg?width=1200)

노력 | OSWorld (성공률/비용) | Terminal-Bench (성공률/비용) 낮음 | 42.0% ($0.07) | 12.7% ($0.42) 보통 (기본값) | 53.3% ($0.13) | 20.3% ($0.68) 높음 | 61.3% ($0.18) | 24.8% ($1.04) 최대 (공개치) | 72.4% ($0.61) | 39.2% ($2.64) (참조) Sonnet 5.5 보통 | 66.0% ($0.93) | 28.8% ($0.68)

### 여기서 얻을 수 있는 교훈

- 기본 설정인 ‘미디엄’의 경우, 성능은 공식 발표치보다 다소 낮게 나타납니다(OSWorld는 53.3%, TB는 20.3%). 전문가 의견과도 일치합니다.
- Terminal-Bench에서는 Haiku의 max(2.64 / 39.2%)를 사용하는 것보다 Sonnet 5.5의 high(1.46 / 43.0%)를 사용하는 것이 더 저렴하고 현명합니다.
- 한편, OSWorld와 같은 정형 PC 운영에서는 0.13달러(약 17원)의 저렴한 비용으로 53%라는 놀라운 효율을 보이는 Haiku가 뛰어난 가성비를 발휘한다. 정말 대단하다!

![画像](https://assets.st-note.com/img/1791466507-eisLzMqArPQWUl5823CNOG16.jpg?width=1200)

모든 것을 다 쏟아부어 최대 노력을 해야 하는 것은 아니에요. 기본적으로 중간 모델을 먼저 사용해보고, 심도 깊은 사고가 필요하면 상위 모델(Sonnet 5.5)로 전환하는 것이 가장 적절합니다. 저는 기본적으로 Sonnet 5.5나 Opus 5.5를 활용할 수 있다고 판단하면 Haiku 5.5에는 가지 않도록 노력했어요. 실제로 꽤 많이 활용해 주거든요.

![画像](https://assets.st-note.com/img/1791466894-f0PHtpvUkWsAB6rlcaOynuYK.png?width=1200)

## 기존 코드에서 이관할 경우 “400 오류”로 즉시 종료되는 파괴적인 변경입니다.

Haiku 4.5로의 마이그레이션으로 가장 많은 엔지니어들을 당황하게 만드는 것은 엄격해진 API 사양입니다. 기존 코드를 그대로 사용하면 거의 확실히 `400 Bad Request`가 반환됩니다. 다행이군요, 예전에 Haiku는 일단 한 번 퇴출시킨 적이 있었습니다.

![画像](https://assets.st-note.com/img/1791466495-D4dJiKI8BT0UGvoQmS2AYpZr.jpg?width=1200)

4.5의 작성 방법 | 5.5에서의 결과 | 올바른 수정 방법 `budget_tokens: N` | 400 오류 | `thinking: {type: "adaptive"}` + `output_config.effort`를 변경, `temperature`를 변경 (1 이상) | 400 오류 | 모든 파라미터를 삭제 (프롬프트 측에서 제어) `top_p`, `top_k`를 지정 | 400 오류 | 상동. 파라미터를 삭제하고 마지막 메시지를 assistant로 설정 (prefill) | 400 오류 | prefill 폐지. 사용자 종료 + 구조화 출력 (JSON 등)으로 대체, 기존 Computer tool (`computer_20250124`) | 400 오류 | 새로운 `computer_toolset_20260801`로 전환, 너무 작게 설정된 `max_tokens` | 생각만으로 중단 | 생각 토큰도 소비하므로 상한을 크게 늘린다

![画像](https://assets.st-note.com/img/1791466520-DeCQPy1Npnv0MrJc2Ysu4ThK.jpg?width=1200)

![画像](https://assets.st-note.com/img/1791466918-UyTexfnqZ4i5IuwdhJWLKrCP.png?width=1200)

![画像](https://assets.st-note.com/img/1791466764-zUgNKeDjbShofAXcq1rkwP0M.jpg?width=1200)

## ## 4. 현장에서 진정으로 승리할 수 있는 “俳句 5.5” 활용법

최근 제가 쓴 “俳句 5.5”에 대한 여러분의 반응이 놀라웠습니다. 특히 현장에서 실제로 활용해 주신 분들이 많아, 덕분에 제가 더욱 열심히 이 작품을 발전시킬 수 있었습니다. 

“俳句 5.5”는 단순한 이론적 내용을 담은 것이 아니라, 실제 시 창작에 도움이 될 수 있도록 설계되었습니다. 특히 여러분의 피드백을 반영하여 더욱 다듬었습니다. 

가장 중요한 것은 “俳句 5.5”를 통해 여러분이 현장에서 진정으로 승리할 수 있다는 점입니다. 이 도구를 통해 여러분의 창작 활동을 더욱 풍요롭게 만들고, 더욱 멋진 작품을 만들어낼 수 있을 것입니다. 

다음에는 “俳句 5.5”의 활용법에 대해 좀 더 자세히 설명드리겠습니다. 여러분의 많은 관심과 참여 부탁드립니다.

성능과 비용의 특성을 고려할 때, Haiku 5.5의 적합성은 “좁고, 빠르고, 대량으로 처리하는 작업”에 집중됩니다.

![画像](https://assets.st-note.com/img/1791466980-fr9NGw2EBeHn7yPvA0R4tLau.png?width=1200)

### 구체적인 추천 사용 사례

- 클루드 코드의 요약 및 초기 조사 인력: 소네트라는 친밀 에이전트로부터 호출되는 탐색 역할(Explore)이나 세션 확장 시 히스토리 압축(compaction) 역할로 최적입니다. 루나를 사용한다는 기분을 느낄 수 있어서 최고입니다!
- 고빈도 CRM/문서 감사: 1일에도 수만 건이 발생하는 “문의 분류”, “불만 판별”, “정례 로그 감사”
- 컴퓨터/브라우저 사용의 정형 처리: 신규 지원된 `browser_toolset_20260801`과 함께 포털 사이트 순회 및 영수증 입력을 저렴하고 빠르게 자동화합니다.

![画像](https://assets.st-note.com/img/1791466755-Xht9A1ceSNU3qzxZQwELdF0k.jpg?width=1200)

## 시스템 카드에서 보이는 예상치 못한 경향들

144페이지의 시스템 카드에는 실제 운영에서 알아두어야 할 두 가지 습관이 보고되었습니다.

![画像](https://assets.st-note.com/img/1791466541-kVI0uhOsodcxDZQW7gX1YwMa.jpg?width=1200)

- 과잉 거부(False Refusal)가 전체 모델 중에서도 최고 수준으로 높은 무해한 기술 질문이나 비즈니스 상담에 대해 지나치게 민감하게 반응하여 “대답할 수 없습니다”라고 거부하는 사례가 다른 모델보다 더 많이 관찰됩니다. 운영 시에는 “대안 프롬프트”나 “fallback 경로”를 준비해두면 안심할 수 있습니다. 저는 로컬 LLM을 그 뒤에 두고 있습니다.
- 정보 공개 답변의 무단 이용률이 17% (4.5는 2%)입니다. 프롬프트나 맥락 내에 포함된 답변을 출처를 밝히지 않고 그대로 출력하는 경향이 강하게 나타나고 있습니다. 정확한 인용과 사실 확인이 필수적인 현장에서는 검증 단계를 거쳐야 합니다. 저는 출처를 반드시 명시합니다.

![画像](https://assets.st-note.com/img/1791466954-9lNYuPMwHWp10bB4goe3ysRh.png?width=1200)

한편, 프롬프트 주입 공격(Jailbreak)에 대한 저항력은 Haiku 역사상 최강 수준이며, 최종 사용자에게 직접 노출되는 챗봇 등의 방어력은 크게 향상되었습니다. 끔찍합니다.

## 요약: 어떻게 활용하는 것이 정답인가?

![画像](https://assets.st-note.com/img/1791466725-NrsDOo8vzJ76XVUh1ibMgBwj.jpg?width=1200)

- 모든 작업을 Haiku 5.5에 맡기는 것은 적절하지 않습니다. 복잡한 코딩이나 난해한 추론은 Sonnet 5.5를 직접 사용하는 것이 효율적입니다. Haiku의 최대 성능을 과도하게 활용하면 오히려 비용이 증가할 수 있습니다.
- 10만 토큰의 함정을 감시하세요: 토크나이저 30%를 고려하고 캐시를 활용하여 저대역($0.10)을 유지하는 것이 좋습니다.
- 기존 코드의 “400 에러 해결”을 최우선으로 하고, `budget_tokens` 및 `temperature` 지정 제거 수정부터 시작하시기 바랍니다.

넓고 깊은 사고는 소네트/오퍼스에 맡기고, 좁고 많은 반복 업무는 하이쿠 5.5의 거대한 함대와 압도적인 저렴한 가격으로 일격에 처리한다.

이 업무 분담 체계를 구성했을 때, Haiku 5.5는 개발팀에게 있어 최고의 비용 효율 솔루션이 될 것입니다!

## 물건이든, 일이든, 이미 끝난 일이다.

- Anthropic「클로드 하이쿠 5.5 출시」(2026년 10월 7일) — 요금제 8종, 노력, 고객 피드백, 부록(75% 시산 정의, 빠른 모드 부록, 토크나이저 부록)
- 플랫폼 문서: Haiku 5.5 개요 / 마이그레이션 안내 / 새로운 기능 / Haiku 5.5 프롬프트 / 가격 정책 / 모델 개요 / 릴리스 노트 / 컴퓨터 사용 / 프롬프트 캐싱 / SDK v1.12.0
- 시스템 카드(144p·PDF) + ZharfAI 해설 — RSP/cyber/무해성/에이전트적/정렬/복지/능력 전 장. 과잉 거부, 무단 이용(17%)·주입 내성·조건 차이 정독에 사용
- ReconScribe／LLM-Stats／AICoder — 모든 벤치 수치화, 노력별 $, 시행 계획, 미검증 노트 제공. 조건(오프라인 82문제, 66문제 × 10회 시행, 대체 없음 등) 포함.
- IT Post (10월 7일) — 부분 점수 vs 완전 성공/최대 vs 중간/+30%/기존 방식 비호환/앱 제공 수정에 대한 비판적 정리
- 창문의 동, 브릿지, SB 비트, 인포시크 (2007년 8월 10일) — 제공처, 동시 할인, 신용 카드 일본어 확인
- 인공 분석 – 지능 38(10), 136.6 토스, 0.10/0.50, TTFT 주의
- 클로이드 코드 문서 / 앤트로픽 블로그 (캐싱 레슨) — 프리픽스 이론, 4개의 브레이크포인트, 20블록, TTL, 포크, 팬아웃 및 컴팩트 구조

※ 공식 정보는 시각화 자료이며 실제 측정값이 아닙니다. 단가 USD/MTok, 환율 및 지역 요금은 별도. 조사일 2026년 10월 8일, v2.0. 다음 단계: 자체 평가(낮음/중간/높음) → 10만 건 실측 → 브랜치 이관 테스트

**출처:** [note 원문](https://note.com/humble_bobcat51/n/nb2e95d330d4e)

*번역: Gemma 3(.44) 초벌 + 교정 57청크*

[원문 보기](https://note.com/humble_bobcat51/n/nb2e95d330d4e) | 출처: note.com