AIモデルを開発するAnthropic(アンソロピック)は2026年10月7日、同モデルを発表し、Claude Platform(開発者向けの提供基盤)などで提供を開始しました。プロンプトが100,000トークン以下の場合、入力・出力の単価をHaiku 4.5から引き下げています。同社が公開した性能評価も改善していますが、数値は自己申告です。一言で言うと、Claude Haiku 5.5は、すべての仕事をひとつのAIに任せず、料金と得意分野に応じて役割を分けるための選択肢です。AiCutyのLLM担当、Elena Bloomがお送りします。
本人の言葉:導入先が語る応答時間の変化
まずは、業務管理サービスAsanaのスタッフソフトウェアエンジニア、アーロン・ヴィン(Aaron Vinh)の言葉です。
“We're very impressed with Claude Haiku 5.5... over a 30% reduction in latency for task completions and up to 2.5x faster inference per agent turn.”「Claude Haiku 5.5にはとても感心しています……タスク完了までの待ち時間は30%超短縮され、エージェントの各ターンの推論は最大2.5倍高速になりました。」
これは導入先が報告した結果であり、あらゆる仕事で同じ速度向上が得られるという意味ではありません。「タスク全体の待ち時間」と「各ターンの推論速度」も、分けて読むことが大切です。
中身の分解:料金、性能、使い方を順番に確認
1. 料金はプロンプトの長さで分かれる
トークンとは、AIが文章などを処理するときの単位です。文字数とそのまま一致するわけではありません。Haiku 5.5の料金は、プロンプトのトークン数によって分かれます。以下はすべて、100万トークンあたりの米ドル建て料金です。キャッシュは、再利用する入力を保存しておく仕組みを指します。
Haiku 5.5は100,000トークン以下と100,000トークン超、そしてキャッシュヒットで値段が変わります。Anthropicの説明では、Haiku 4.5に対して、100,000トークン以下のリクエストは約90%、それを超えるものは約50%安くなります。また、Haiku 4.5のリクエストの約90%が、100,000トークン以下の区分に入っていたとしています。
ここで私が確認したいのは、自分の仕事がどちらの料金区分に入るかです。短い依頼を繰り返す場合と、長い資料をまとめて渡す場合では、見積もりを分けたほうがよさそうですね。
2. 評価値は向上。ただし「どの仕事でも上」とは読まない
ベンチマークとは、モデルの性能を一定の課題で測る評価です。以下はAnthropicが公開した自己申告値であり、独立した検証結果として扱うものではありません。
Haiku 4.5からの改善は読み取れますが、掲載されたSonnet 5.5の値はHaiku 5.5より高くなっています。評価の種類や実行条件を無視して「もう大きなモデルは不要」と結論づけるのは早いかな、と思います。
3. サブエージェントとして仕事を分担する
私が特に注目したのは、サブエージェント(全体の作業のうち、一部を受け持つAI)の使い方です。発表で紹介された例では、大きなモデルが提案全体を組み立てる間に、Haiku 5.5のサブエージェントが米国の年次報告書から特定の売上データを取り出すといった例があげられています。
ポイントは、仕事を丸ごと置き換えるのではなく、担当範囲を切り分けること。「データの抽出と、その意味を判断して提案にまとめる作業を分ける考え方」として受け止めました。もちろん、実用上はどうなるかは総合的な評価が必要です…!
4. 提供基盤と開発用の機能も広がる
Haiku 5.5は発表時点で、Claude Platform、AWS(Amazonのクラウドサービス)、Google Cloud(Googleのクラウドサービス)、Microsoft Azure(Microsoftのクラウドサービス)で利用できます。モデルIDは 「claude-haiku-5-5」 です。
また、PythonとTypeScript向けのSDKでは、computer use(コンピューター操作)とbrowser use(ブラウザー操作)のベータ対応が示されています。
現在、世界中で猛烈なセキュリティ攻撃が報告されています。日本でも大企業をはじめとして深刻な被害が報告されています。全てがAIコーディングを原因とするわけではないですが、セキュリティを高めるのも低めるのも、要になります。実務に入れる前に、操作範囲と機能、人が確認する地点や責任分解点を決めておきたいですね。
5. Sonnetの料金と利用クレジットも変更
Sonnet 5.5では、キャッシュ読み出し料金が100万トークンあたり$0.20から$0.10へ、50%引き下げられました。Anthropicは、多くのエージェント型処理(AIが複数の手順を進める処理)で約20%安くなると説明しています。これは同社の見積もりで、個々の請求額を保証するものではありません。
Claude Platformで使えるクレジットは、Max 5xが月$100、Max 20xが月$200、Teamが共有枠として月最大$500です。これらはどのモデルにも利用できるとされています。個人向けプランの契約料金だけではなく、企業等での実際のトークン消費は利用クレジットの金額やccusage等のツールやAPIを使って確認しましょう。
6. 安全対策にも違いがある
Anthropicは、アラインメント評価(意図に沿わない振る舞いや悪用への協力などを調べる評価)で、Haiku 5.5がHaiku 4.5から改善したと説明しています。
サイバーセキュリティの安全対策は、Haiku 4.5より制限が強く、Sonnet 5.5よりは弱い位置づけです。より広い範囲の防御的作業を認める一方、侵入テストなどはブロックするとされています。生物学分野の安全対策は、Sonnet 5、Sonnet 5.5、Opus 5と同じとされています。
性能だけでなく、依頼したい作業が許容されるかも、導入前の確認項目です。
Haiku 4.5との比較から見える変更点
Haiku 5.5は、Haiku 4.5との比較で料金引き下げと評価値向上を打ち出しました。Sonnet 5.5のキャッシュ料金変更も含め、モデルを組み合わせる費用を見直す発表と受け止めています。
2026年10月7日にClaude Haiku 5.5を発表したアンソロピックですが、料金表・評価値の公開以外とClaude Platform、AWS、Google Cloud、Microsoft Azureでの提供を発表しました。同日にPython/TypeScript SDKのコンピューター操作・ブラウザー操作のベータ対応を、Sonnet 5.5のキャッシュ読み出し料金引き下げと、Max・Team向けのClaude Platform利用クレジットを案内というリリースを行なっています。
つくる人にとって:私が試したいことは2点
1. Claude Codeでのコンテンツ制作は工程を分け、Opus5.5だけでなく、Haikuの活用も注目したいですね。価格だけでなく速度も向上します。2. 社内教育や展開では、AIの回答と原資料を照合する過程を残す。数字を取り出す課題でも、出典の該当箇所とccusage、APIでのトークン消費を確認する流れを組み込みたいですね。
以上、AiCutyのLLM担当、エレナ・ブルームがお送りしました!
一次資料
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 검수
원문 보기 | 출처: note.com