Anthropicは2026年10月7日、小型モデルClaude Haiku 5.5を公開した。同社は「これまでで最も安く、最も速く、最も高性能なsmall model」と位置づけている。コンテキスト長はHaiku 4.5の20万から100万トークンに、最大出力は6万4,000から12万8,000トークンに拡大。料金はプロンプトが100Kトークン以下の場合、入力0.10ドル/出力0.50ドル(100万トークンあたり)と、Haiku 4.5の1.00ドル/5.00ドルから90%下がった。
Claude.ai(Free/Pro/Max/Team/Enterprise)、Claude API、Claude Code、Amazon Bedrock、Google Cloud、Microsoft Foundryで提供中。モデルIDはclaude-haiku-5-5、知識カットオフは2026年6月。
■仕様:Haiku初のAdaptive Thinkingとeffort5段階
Haikuとして初めて、モデルが推論量を自ら決めるAdaptive Thinkingに対応した。effortはlow〜maxの5段階で、API標準はmedium。入力はテキストと画像、出力はテキスト。Message Batches APIでは専用のベータヘッダーを指定すると最大30万トークンの出力に対応する。2026年10月8日時点のArtificial Analysisの掲載値では、Intelligence IndexがMedium 34、High 38、XHigh 41、Max 43だった。同社は「通常速度のClaudeとして最速」としている(OpusのFast Modeとの比較ではない)。
■性能:OSWorld 2.1(offline subset)で15.7%から72.4%に
同社の評価では、PCを操作して複数ステップの作業を完了させる能力を測るOSWorld 2.1のoffline subsetで72.4%(Haiku 4.5は15.7%、Sonnet 5.5は83.9%)、ターミナル上のエージェント型コーディングを測るTerminal-Bench 4.0で39.2%(同0.0%、70.6%)。44職種の実務タスクを評価するGDPval-AA v2.1は1620と、Haiku 4.5の735から倍以上になった。Anthropicが公開した比較表では、GPT-6 Lunaの数値が掲載された全項目でHaiku 5.5が上回るが、公開直後で第三者評価はまだ限定的だ。
同社は複雑なエージェント型コーディングにはSonnet 5.5/Opus 5.5を推奨し、Haiku 5.5はbrowser use、computer use、サブエージェント向けとしている。
■価格:100Kトークン超で単価は5倍
- 入力:0.10ドル(100K超は0.50ドル)
- 出力:0.50ドル(同2.50ドル)
- キャッシュ読み込み:0.01ドル(同0.05ドル)/書き込み(5分):0.125ドル(同0.625ドル)
新tokenizerで同じテキストがHaiku 4.5比約30%多くカウントされる場合があるが、4.5の実リクエストの約90%が100K以下だったため、同社は平均コストを約75%減としている。同価格帯のGPT-6 Lunaは標準料金が入力272Kトークンまで適用され、100K〜272Kでは標準トークン単価がLunaの方が低い。
■移行時の注意:budget_tokensとtemperature指定は400エラー
Haiku 4.5(claude-haiku-4-5-20251001)からAPIで移行する開発者は、次の対応が必要になる。
- 旧形式のthinking(type: enabled+budget_tokens)指定は400エラー。Adaptive Thinking+effortで指定する
- temperature/top_p/top_kの非デフォルト値も400エラー
- 応答の先頭がthinkingブロックになる場合があり、content[0]ではなくtypeで判定する
- tokenizer変更に合わせ、max_tokensと課金試算を再計算する
公式ページの企業事例では、Asanaがタスク完了レイテンシ30%以上減、AlphaSenseが文書Q&A 400問で0.76から0.84、Boxが4.5比11ポイント向上・レイテンシ約半分と報告している。
■まとめ:100万トークン文脈と推論に対応し100K以下は入力0.10ドル、移行時はAPI変更に注意
Haiku 5.5は10月7日から主要プラットフォームで使え、100K以下で入力0.10ドル/出力0.50ドル、超過時は5倍という料金も公表済みだ。ベンチマークはAnthropic自身の評価で、Artificial Analysisなど外部の測定はリリース直後の段階にあり、GPT-6 Lunaとの差は第三者評価が出そろってから判断できる。Haiku 4.5のAPI利用者は、budget_tokensをAdaptive Thinking+effortに置き換え、非デフォルトのサンプリングパラメータ指定を外し、tokenizer変更を踏まえてコストを試算し直す必要がある。
■主な参照リンク
- Anthropic公式発表:Introducing Claude Haiku 5.5
- Claude Platform Docs:What's new in Claude Haiku 5.5
- Claude Platform Docs:Claude Haiku 5.5 overview
- Claude Platform Docs:Pricing
- Anthropic:Claude Haiku 5.5 System Card
■kintonavi
kintoneの導入支援、業務改善、運用設計、プラグイン活用まで、実務に沿ってサポートしています。「自社でもkintoneをうまく活用したい」「紙・Excel運用から脱却したい」という方は、ぜひご覧ください。
→ kintonaviはこちら
■devpediacode
AI活用、開発ノウハウ、業務自動化、ツール検証などを発信しています。生成AIや開発の実践知をキャッチアップしたい方は、こちらもぜひチェックしてください。
→ devpediacodeはこちら
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 검수
원문 보기 | 출처: note.com