# Claude Haiku 5.5、登場。単価は前モデルの10分の1、狙いは「脇役」の仕事

> https://bookfactory.kr/board/news/20452
> 게시판: 뉴스
> 작성자: admin
> 작성일: 2026-10-09T22:49:02.549Z

---

2026年10月7日、#Anthropic からClaude Haiku 5.5が出たんだよね🚀公式の触れ込みは「これまでで最も安く、最も速く、最も高性能な小型モデル」なんだ。

9月に書いたOpus 5.5の記事で、Sonnet 5.5とHaiku 5.5も「数週間以内」に続くと伝えたよね。Opus 5.5が9月22日、Sonnet 5.5が9月28日、そして今回のHaiku 5.5が10月7日で、15日で3モデルが出そろったよ。

ただ、小型モデルの発表って、だいたい「安く、速く、賢く」って書いてあるじゃん。前のHaiku 4.5から実際に何が変わったのか気になって、公式の発表と移行ガイドを読んでみたよ🤔この記事では、値段・性能・使い方の制約の3つを順に見て、どんな仕事を任せると得なのかを一緒に確かめていくね。

## 🚀 Claude Haiku 5.5は、15日で出そろった5.5ファミリーの3モデル目

![画像](https://assets.st-note.com/img/1791441858-hI42nulfPbeaYx0MKzEgqm1c.png?width=1200)

Claude Haiku 5.5は、Claude 5.5ファミリーの3モデル目だよ。位置づけは、大量処理とコストが気になる仕事向けの小型モデルなんだ。

公式が得意分野に挙げてるのは、要約、コンテキストの圧縮、データベースへの問い合わせ、分類といった、短くて繰り返しの多い仕事だよ。速さが活きる場面として、ライブのカスタマーサポートとブラウザ操作も挙げられてるんだ✨もうひとつ大事なのが、OpusやSonnetと組んで使う想定で、コーディング作業の #サブエージェント を任せる使い方が書かれてることだね。

提供先は、Claude Platform（API）とAmazon Web Services、Google Cloud、Microsoft Azureで、発表の当日から使えるよ。Claude Platformでのモデル名は claude-haiku-5-5 なんだ。アプリ側での提供については、発表ページを読んだ範囲では記載が見当たらなかったよ🤔

だから僕は、Haiku 5.5を「主役の代わり」じゃなく「主役の隣に置く小型モデル」として見るのがいいと思うんだ。

## 🔧 単価は前モデルの10分の1、実質でも約75%安くなる

![画像](https://assets.st-note.com/img/1791441874-HNlqGvsU9FrDAxu2Ccio0kMj.png?width=1200)

#API の料金は、100万トークンあたりでこう変わったよ（2026年10月時点）。並べるのは、プロンプトが10万トークン以下のときの値段なんだ。

- 入力：1ドル → 0.10ドル（Sonnet 5.5は2ドル）
- 出力：5ドル → 0.50ドル（Sonnet 5.5は10ドル）
- キャッシュ読み込み：0.10ドル → 0.01ドル
- キャッシュ書き込み：1.25ドル → 0.125ドル

![画像](https://assets.st-note.com/img/1791441989-L8ZdE1CfzUo3PWM6NrOsHieh.png?width=1200)

入力も出力も、きれいに10分の1になってるよ✨10万トークンを超えるプロンプトは入力0.50ドル・出力2.50ドルで、それでもHaiku 4.5の半額なんだ。Haiku 4.5ではリクエストの約9割が10万トークン以下だったそうで、いちばん安い帯に大半の仕事が収まるのがポイントだよ。

じゃあ請求も10分の1になるのかというと、そうは言い切れないんだ💡Haiku 5.5は新しいトークナイザーを使ってて、同じ文章でもトークン数が約3割増えるんだよね。トークナイザーは、文章をトークンという単位に区切るしくみのことだよ。たとえば10万トークン以下の仕事なら、単価10分の1にトークン1.3倍をかけて、ざっくり前モデルの1割ちょっとの費用になる計算だね。一方で公式は、トークンの増加分も織り込んだうえで、平均すると約75%安いと説明してるんだ。10万トークン以下の計算より控えめな数字なのは、長いプロンプトの分が平均を引き上げてるのかもしれないね。

同じ日に、Sonnet 5.5のキャッシュ読み込みも、100万トークンあたり0.20ドルから0.10ドルへ半額になったよ。キャッシュ読み込みはエージェント作業のトークン消費で大きな割合を占めるから、公式は「ほとんどの作業で約2割安くなる」と説明してるんだ🚀

## ✨ 性能はHaiku 4.5から大きく伸びたけど、Sonnet 5.5との差ははっきり残ってる

![画像](https://assets.st-note.com/img/1791441891-ewZSmo1tk0AQP4RFiEuafq7d.png?width=1200)

公式の比較表から、主な項目を拾うね。並べ方は「Haiku 5.5｜Haiku 4.5｜GPT-6 Luna｜Sonnet 5.5（参考）」の順だよ。

- GDPval-AA v2.1（実務に近い知識労働）：1620｜735｜1437｜1840
- AA-Briefcase v1.1（長い知識労働）：1578｜614｜1336｜1824
- OSWorld 2.1（パソコン操作・オフライン版）：72.4%｜15.7%｜48.9%｜83.9%
- Humanity's Last Exam（ツールなし）：45.9%｜10.2%｜記載なし｜56.9%
- Terminal-Bench 4.0（ターミナルでのコーディング）：39.2%｜0.0%｜16.4%｜70.6%
- FrontierCode 1.1（コード変更が採用されるか）：46.4%｜記載なし｜42.4%｜52.1%（SonnetはXhigh設定）
- Chartography（グラフの読み取り・ツールなし）：46.4%｜6.4%｜29.1%｜61.6%

![画像](https://assets.st-note.com/img/1791442006-vohsEVjB60kU2uCHyW9LAT1q.png?width=1200)

伸びが目立つのは、パソコン操作とターミナル操作の2つなんだ。OSWorld 2.1は15.7%から72.4%、Terminal-Bench 4.0は0.0%から39.2%になってるよ。ただ、Haiku 4.5が0.0%ってことは、このテストにほぼ歯が立たなかったってことなんだよね。倍率に驚くより、「いまどこまで届いたか」を見るほうが大事かな🤔

差が残る場所もはっきりしてるよ。Terminal-Bench 4.0では、Sonnet 5.5の70.6%に対してHaiku 5.5は39.2%なんだ。公式も、複雑なエージェント型のコーディングはSonnet 5.5やOpus 5.5のほうが向いてると書いてるよ。Haiku 5.5が向くのは、前のモデルだと費用が高すぎて見送ってた、範囲の狭い仕事という位置づけなんだ。

比較相手のGPT-6 Lunaに勝ってる項目が並んでるけど、これは公式の発表ページに載った数字なんだよね。どのテストを載せるかは公式が選べるから、自分の仕事に近い題材で試して確かめたほうがいいと思う✅

もうひとつ新しいのが、Haikuとして初めて、考える深さを選べるeffort設定が付いたことだよ。コストを取るか知能を取るかを、使う側が選べるようになったんだ。

出る前は、「Haikuは5.5世代でなくなる」とか「HaikuがOpusを超える」といった噂も流れてたよね。実際は、Haikuは続いたし、Sonnet 5.5にも届いてないから、どちらも外れだったみたいだよ。

### 🔍 先行利用の声は「速さ」と「大量処理」に集まってる

発表ページには、先行利用した企業のコメントも載ってたよ。その中から、数字が出ているものを拾うね。

- Asana：今使ってるモデルと比べて、タスク完了までの遅延が30%超減、エージェントの1ターンあたりの推論は最大2.5倍速
- AlphaSense：週に約800万回呼ぶ機能で、400件の質問を試して0.76から0.84へ
- Box：Haiku 4.5より11ポイント高いスコアを、約半分の遅延で記録
- HubSpot：CRMの評価で3回平均92.8%、この評価でこれまで見た中で最高のスコア
- Cognition：Devin Fusionで、Opus 5.5を司令塔にHaiku 5.5を補佐役にして、FrontierCode 66.2を保ちながら費用と遅延を削減

どれも公式が選んだ事例だから、割り引いて読む必要はあるよ。それでも共通点は「速さ」「大量」「脇役」で、公式が書いた位置づけとぴったり重なってるんだ💡

## 🎯 任せていいのは「短くて数が多い仕事」、移行前に押さえる制約も多い

![画像](https://assets.st-note.com/img/1791441910-1hmDRquylEIUwe4H6LTMXSoO.png?width=1200)

ここまでの内容から、向き・不向きを整理するね。任せていいのは、こんな仕事だよ。

- 要約、コンテキストの圧縮、分類
- データベースへの問い合わせ
- ライブのカスタマーサポート、ブラウザ操作
- Opus 5.5やSonnet 5.5を司令塔にした、下請けの仕事

避けたほうがいいのは、Terminal-Benchのような、複雑で長いエージェント型コーディングだね。そこはSonnet 5.5かOpus 5.5に残すのが、公式の整理なんだ✨

### 🔧 Haiku 4.5からの移行で引っかかりそうな点

移行ガイドには、前のモデルから挙動が変わる点がいくつも挙がってるよ。APIでHaiku 4.5を使ってる人は、モデル名を置き換える前に目を通したほうがいいと思う。

- モデル名：claude-haiku-5-5（日付なし、別名なし）
- トークン数：同じ文章で約3割増えるから、max_tokensと費用の見積もりを再計算
- 思考：アダプティブ思考が前提で、思考のトークン予算を指定する従来の書き方は400エラー。考える量はeffortで調整
- サンプリング：temperature・top_p・top_kは外すのが基本
- プレフィル：最後をアシスタントの発話で終える書き方は400エラー
- コンピュータ操作：Claude APIとGoogle Cloudでは新しいツールセットcomputer_toolset_20260801へ移行
- 優先枠：Priority TierはHaiku 5.5では非対応

### 💡 MaxとTeamの人に関わる、毎月のAPIクレジット

同じ発表で、今週中にMaxとTeamの契約者へ、Claude Platformで使える月ごとのAPIクレジットが配られると書かれてたよ。Max 5xは月100ドル、Max 20xは月200ドル、Teamは最大500ドルで、チーム内でプールされるんだ。どのモデルにも使えるから、Haiku 5.5でエージェント作りを試す入口にもなりそうだね🤝

## 🧩 Haikuの値下げは、小型モデルより「作る人」への先行投資に見える

![画像](https://assets.st-note.com/img/1791441926-REOxj7b4kinoCltyrT2JhFcz.png?width=1200)

今回の発表で、僕がいちばん気になったのは、Haiku 5.5の値下げ単体じゃないんだ。同じ日に、3つの動きが重なってるんだよね🤔

- Haiku 5.5の単価を、10万トークン以下で前モデルの10分の1に
- Sonnet 5.5のキャッシュ読み込みを半額に
- MaxとTeamの契約者に、毎月のAPIクレジットを配布

3つに共通するのは、Claude Platformでエージェントやアプリを作って動かす側の負担を軽くしてることだね。ここからは僕の推測なんだけど、Anthropicは、動かすほど重くなるエージェントの運用費を先に下げて、作る人を増やしにいってるんじゃないかな。Cognitionの事例も、大きいモデルが司令塔、Haiku 5.5が補佐役という役割分担で、費用と遅延を下げる形だったよね。大きいモデルに考えさせて、小さいモデルに数をこなさせる。この組み方が標準になっていくなら、Haikuは単体で採点するモデルじゃなく、組み合わせの部品として評価するモデルになると思うよ✨

### 🔍 Anthropicの外でも使えるけど、機能は同じじゃない

Haiku 5.5はAWS、Google Cloud、Azureでも当日から使えるから、AnthropicのAPIに閉じてはいないよ。ただ、移行ガイドを読むと、プラットフォームごとにモデル名の形も、使える機能も少しずつ違うんだ。たとえば新しいコンピュータ操作のツールセットは、Claude APIとGoogle Cloudが対象で、ほかの環境は別の互換性ページを見る形になってるよ。同じモデルでも、どこで動かすかで書き方が変わるから、環境を決めてから設計したほうが安全だと思う💡

### 📌 数字の見え方と、止まる可能性のリスク

気をつけたいのは、次の3つだね。

- 見かけの値下げ幅と、請求額は別物。トークンが約3割増えるぶん、単価の10分の1がそのまま請求の10分の1にはならない
- 安全装置で断られる可能性がある。Haiku 5.5は安全分類器が働くことがあって、サーバー側の代替モデルへのフォールバックがない。refusalで返ってきたときの処理は自分で書く必要がある
- 会話の持ち回しに制約がある。思考ブロックは生成したアカウントでしか有効じゃなくて、前のやりとりを書き換えた状態で送り返すと400エラーになる

サイバー分野の安全装置も、Haiku 4.5より厳しくなってて、ペネトレーションテストのような攻撃側が使いやすい手法はブロックされるよ。防御用途の範囲は、Sonnet 5.5の装置より広めに許可されてるそうなんだ。Priority Tierが使えないことも合わせると、大量・低遅延で回す運用ほど、事前に確認しておきたいかな🤔

## ✅ Haiku 5.5は、主役の代わりじゃなく、主役の隣に置くモデル

![画像](https://assets.st-note.com/img/1791441941-nHvoqT4wtVKImEO51bNQzDu3.png?width=1200)

最初に立てた問い、「前のHaiku 4.5から何が変わったのか」に答えるね。

- 値段：10万トークン以下で単価は10分の1。トークン増を含めても、公式の試算では平均約75%安い
- 性能：パソコン操作や知識労働は大きく伸びたけど、複雑なコーディングはSonnet 5.5が上
- 使い方：アダプティブ思考が前提、プレフィルは不可、Priority Tierは非対応など、移行で直す点がある

任せて得なのは、要約・分類・圧縮、ライブ対応、ブラウザ操作、そして大きいモデルの下請けだよ。最強の1つを探すより、どこにどのモデルを置くかを決めるほうが、いまは効きそうだね✨

次にやることは、SonnetやHaiku 4.5で動かしてる処理のうち、短くて数が多い部分をひとつ選ぶことだよ。そこだけをHaiku 5.5に差し替えて、品質とトークン数と費用を並べて見てみてほしいな✅

Miccell - 主役の隣に置く脇役が10分の1の値段になった

#Claude #生成AI #AI #AIニュース #AIエージェント #ClaudeHaiku #Haiku55 #ClaudeHaiku55

**출처:** [note 원문](https://note.com/miccell/n/n9e58f7485351)

*번역: Gemma 3(.44) 초벌 + 교정 검수*

[원문 보기](https://note.com/miccell/n/n9e58f7485351) | 출처: note.com