# AnthropicがClaude Haiku 5.5を公開 ─ 100Kトークン以下で入力100万トークンあたり0.10ドル、Haiku 4.5比90%値下げで100万トークン文脈に対応

> https://bookfactory.kr/board/news/20453
> 게시판: 뉴스
> 작성자: admin
> 작성일: 2026-10-09T22:49:04.904Z

---

Anthropicは2026年10月7日、小型モデルClaude Haiku 5.5を公開した。同社は「これまでで最も安く、最も速く、最も高性能なsmall model」と位置づけている。コンテキスト長はHaiku 4.5の20万から100万トークンに、最大出力は6万4,000から12万8,000トークンに拡大。料金はプロンプトが100Kトークン以下の場合、入力0.10ドル／出力0.50ドル（100万トークンあたり）と、Haiku 4.5の1.00ドル／5.00ドルから90%下がった。

Claude.ai（Free／Pro／Max／Team／Enterprise）、Claude API、Claude Code、Amazon Bedrock、Google Cloud、Microsoft Foundryで提供中。モデルIDはclaude-haiku-5-5、知識カットオフは2026年6月。

## ■仕様：Haiku初のAdaptive Thinkingとeffort5段階

Haikuとして初めて、モデルが推論量を自ら決めるAdaptive Thinkingに対応した。effortはlow〜maxの5段階で、API標準はmedium。入力はテキストと画像、出力はテキスト。Message Batches APIでは専用のベータヘッダーを指定すると最大30万トークンの出力に対応する。2026年10月8日時点のArtificial Analysisの掲載値では、Intelligence IndexがMedium 34、High 38、XHigh 41、Max 43だった。同社は「通常速度のClaudeとして最速」としている（OpusのFast Modeとの比較ではない）。

## ■性能：OSWorld 2.1（offline subset）で15.7%から72.4%に

![画像](https://assets.st-note.com/img/1791413581-mBu9n3xSH7GkdYwtUEIp2Jqb.png?width=1200)

同社の評価では、PCを操作して複数ステップの作業を完了させる能力を測るOSWorld 2.1のoffline subsetで72.4%（Haiku 4.5は15.7%、Sonnet 5.5は83.9%）、ターミナル上のエージェント型コーディングを測るTerminal-Bench 4.0で39.2%（同0.0%、70.6%）。44職種の実務タスクを評価するGDPval-AA v2.1は1620と、Haiku 4.5の735から倍以上になった。Anthropicが公開した比較表では、GPT-6 Lunaの数値が掲載された全項目でHaiku 5.5が上回るが、公開直後で第三者評価はまだ限定的だ。

![画像](https://assets.st-note.com/img/1791413654-EVZpqmcOrSb6FgvIPnGdyj1u.png?width=1200)

同社は複雑なエージェント型コーディングにはSonnet 5.5／Opus 5.5を推奨し、Haiku 5.5はbrowser use、computer use、サブエージェント向けとしている。

## ■価格：100Kトークン超で単価は5倍

- 入力：0.10ドル（100K超は0.50ドル）
- 出力：0.50ドル（同2.50ドル）
- キャッシュ読み込み：0.01ドル（同0.05ドル）／書き込み（5分）：0.125ドル（同0.625ドル）

新tokenizerで同じテキストがHaiku 4.5比約30%多くカウントされる場合があるが、4.5の実リクエストの約90%が100K以下だったため、同社は平均コストを約75%減としている。同価格帯のGPT-6 Lunaは標準料金が入力272Kトークンまで適用され、100K〜272Kでは標準トークン単価がLunaの方が低い。

## ■移行時の注意：budget_tokensとtemperature指定は400エラー

Haiku 4.5（claude-haiku-4-5-20251001）からAPIで移行する開発者は、次の対応が必要になる。

- 旧形式のthinking（type: enabled＋budget_tokens）指定は400エラー。Adaptive Thinking＋effortで指定する
- temperature／top_p／top_kの非デフォルト値も400エラー
- 応答の先頭がthinkingブロックになる場合があり、content[0]ではなくtypeで判定する
- tokenizer変更に合わせ、max_tokensと課金試算を再計算する

公式ページの企業事例では、Asanaがタスク完了レイテンシ30%以上減、AlphaSenseが文書Q&A 400問で0.76から0.84、Boxが4.5比11ポイント向上・レイテンシ約半分と報告している。

## ■まとめ：100万トークン文脈と推論に対応し100K以下は入力0.10ドル、移行時はAPI変更に注意

Haiku 5.5は10月7日から主要プラットフォームで使え、100K以下で入力0.10ドル／出力0.50ドル、超過時は5倍という料金も公表済みだ。ベンチマークはAnthropic自身の評価で、Artificial Analysisなど外部の測定はリリース直後の段階にあり、GPT-6 Lunaとの差は第三者評価が出そろってから判断できる。Haiku 4.5のAPI利用者は、budget_tokensをAdaptive Thinking＋effortに置き換え、非デフォルトのサンプリングパラメータ指定を外し、tokenizer変更を踏まえてコストを試算し直す必要がある。

## ■主な参照リンク

- Anthropic公式発表：Introducing Claude Haiku 5.5
- Claude Platform Docs：What's new in Claude Haiku 5.5
- Claude Platform Docs：Claude Haiku 5.5 overview
- Claude Platform Docs：Pricing
- Anthropic：Claude Haiku 5.5 System Card

## ■kintonavi

kintoneの導入支援、業務改善、運用設計、プラグイン活用まで、実務に沿ってサポートしています。「自社でもkintoneをうまく活用したい」「紙・Excel運用から脱却したい」という方は、ぜひご覧ください。

→ kintonaviはこちら

## ■devpediacode

AI活用、開発ノウハウ、業務自動化、ツール検証などを発信しています。生成AIや開発の実践知をキャッチアップしたい方は、こちらもぜひチェックしてください。

→ devpediacodeはこちら

**출처:** [note 원문](https://note.com/cool_bee1567/n/n684305e41fc0)

*번역: Gemma 3(.44) 초벌 + 교정 검수*

[원문 보기](https://note.com/cool_bee1567/n/n684305e41fc0) | 출처: note.com