blog
AIブログ
Claude Haiku 5.5 料金とAPI コスト削減——企業導入判断のための実務試算ガイド
文:クリスタルメソッド編集部 監修:河合 継(代表取締役)

関連記事VOICEVOX 使い方|インストールから音声生成まで【2026】 / Grokとは?できること・料金・始め方をやさしく解説【2026年版】 / ディープフェイクとは?仕組み・悪用リスク・見分け方と対策を専門家監修で解説【2026年版】
Claude Haiku 5.5とは——2026年10月7日に公開されたAnthropicの新しい小型モデル
2026年10月7日、AnthropicはClaude Haiku 5.5(モデルID:claude-haiku-5-5)を公開した。Opus 5.5・Sonnet 5.5と同じ5.5世代の小型モデルで、Anthropicは「これまでで最も安く、最も速く、最も高性能な小型モデル」と位置づけている。Haikuとして初めてeffort(推論の深さ)の段階指定に対応した点も新しい(出典: Introducing Claude Haiku 5.5、Anthropic)。
結論から言うと、変化の中心は価格だ。入力$0.10/出力$0.50(100万トークンあたり、プロンプト10万トークン以下)で、前世代Haiku 4.5(入力$1/出力$5)の10分の1になった。一方で、10万トークンを超えるプロンプトは単価が5倍に上がる段階制で、トークンの数え方も変わっている。報道で目にする「75%安い」「90%安い」はどちらも公式の数字だが、前提が違う。以下で整理する。
Claude Haiku 5.5の料金——10万トークンを境にした段階制
| 項目 | プロンプト10万トークン以下 | プロンプト10万トークン超 | 参考:Haiku 4.5 |
|---|---|---|---|
| 入力 | $0.10 | $0.50 | $1.00 |
| 出力 | $0.50 | $2.50 | $5.00 |
| キャッシュ書き込み(5分) | $0.125 | $0.625 | $1.25 |
| キャッシュ書き込み(1時間) | $0.20 | $1.00 | $2.00 |
| キャッシュ読み込み | $0.01 | $0.05 | $0.10 |
| Batch API(入力/出力) | $0.05/$0.25 | $0.25/$1.25 | $0.50/$2.50 |
出典: Pricing、Claude Platform Docs
注意したいのは段階の判定方法だ。公式の料金ページによると、10万トークンを超えたかどうかはリクエストごとに、キャッシュ読み込み・書き込み分も含めた入力トークン全体で判定される。キャッシュが効いていても、プロンプト全体が10万トークンを超えればそのリクエストは高い方の単価になる。Sonnet 5.5やOpus 5.5は1Mトークンまで単価が一定なので、Haiku 5.5だけがこの例外になる。
「75%」と「90%」の違い
Anthropicの発表ページ本文は「平均で約75%安く動かせる」とし、脚注で「10万トークン以下のリクエストではHaiku 4.5より90%安く、10万トークン超では50%安い」と説明している。脚注によれば、Haiku 4.5のリクエストの90%は10万トークン以下だった。単価だけを比べれば90%減、長いプロンプトも含めた平均が約75%減、という関係だ。
トークン数は約30%増える
Haiku 5.5はClaude 4.7以降と同じ新しいトークナイザーを使う。移行ガイドによると、同じ文章でもHaiku 4.5より約30%多いトークン数として数えられる(増え方は内容によって異なる)。Haiku 4.5で測ったトークン数をそのまま使って費用を見積もると、ずれが出る(出典: Claude Haiku 5.5 migration guide)。
Haiku 4.5からいくら下がるか——試算例
月100万回、1回あたり入力2,000トークン・出力300トークン(Haiku 4.5での計測値)の分類・要約処理を想定し、Haiku 5.5ではトークン数が30%増えると仮定して計算した。
| Haiku 4.5 | Haiku 5.5(トークン30%増で計算) | |
|---|---|---|
| 入力 | 20億トークン × $1.00 = $2,000 | 26億トークン × $0.10 = $260 |
| 出力 | 3億トークン × $5.00 = $1,500 | 3.9億トークン × $0.50 = $195 |
| 合計 | $3,500 | $455(約87%減) |
同じ考え方で、プロンプトが10万トークンを超える長文処理を計算すると、入力単価は$1.00→$0.50だが、トークン数が1.3倍になるため実質の削減は約35%にとどまる。短いリクエストを大量に処理する用途ほど効果が大きく、長文を丸ごと読ませる用途では差が小さい。
性能——公式ベンチマークの数値
| ベンチマーク | Haiku 5.5 | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| OSWorld 2.1(オフライン版・コンピューター操作) | 72.4% | 15.7% | 83.9% |
| Terminal-Bench 4.0 | 39.2% | 0.0% | 70.6% |
| Humanity’s Last Exam(ツールなし) | 45.9% | 10.2% | 56.9% |
| Humanity’s Last Exam(ツールあり) | 57.4% | 18.7% | 64.5% |
| GDPval-AA v2.1(Elo) | 1620 | 735 | 1840 |
出典: Introducing Claude Haiku 5.5、Anthropic
Haiku 4.5からは大きく伸びたが、Sonnet 5.5との差は残る。Anthropic自身も、複雑なエージェント型のコーディングにはSonnet 5.5・Opus 5.5が適しているとし、Haiku 5.5の用途として要約・分類・データベース検索・会話の圧縮・サブエージェントを挙げている。
主な仕様と提供先
- コンテキスト:100万トークン。最大出力:12.8万トークン(Batch APIはベータで30万トークン)
- 入力:テキストと画像。知識のカットオフ:2026年6月
- 思考:Adaptive thinking(既定でオン)。深さはeffortで指定し、既定値は
medium - 提供先:Claude API、Amazon Bedrock(
anthropic.claude-haiku-5-5)、Google Cloud、Microsoft Foundry、Claude Platform on AWS - 提供期間:2027年10月7日より前には廃止しないと明記
出典: Claude Haiku 5.5 overview、Claude Platform Docs
Haiku 4.5から切り替えるときの注意点
モデル名を書き換えるだけでは動かないケースがある。移行ガイドに書かれた主な変更点は次のとおり。
- 思考の予算指定が使えない:
thinking: {"type":"enabled","budget_tokens":N}は400エラーになる。{"type":"adaptive"}に変え、effortで深さを調整する。 - temperature・top_p・top_kは原則外す:既定以外の値を送ると400エラーになる。
- アシスタントのプリフィルが使えない:最後をassistantのターンにしたリクエストは400エラー。出力形式の固定はstructured outputsやツールで行う。
- 応答の先頭が答えとは限らない:思考ブロックが先に来ることがあるため、内容ブロックは位置でなく
typeで選ぶ。max_tokensが小さいと思考だけで止まることもある。 - 安全分類器による拒否:
stop_reason: "refusal"で断ることがあり、サーバー側で別モデルに切り替える仕組みはない。発表ページによると、サイバーセキュリティではペネトレーションテスト等が、生物学では有害と判断された依頼が制限される。 - コンピューター操作:Claude APIとGoogle Cloudでは
computer_toolset_20260801への移行が必要。ブラウザ操作ツール(browser_toolset_20260801)にも新たに対応した。 - Priority Tier非対応:Haiku 4.5でPriority Tierを契約している場合は、容量計画を別に立てる必要がある。
Claude Codeでは/claude-api migrateで、モデルIDやパラメーターの書き換えをまとめて行える(出典: migration guide)。
どの業務に向くか——上位モデルとの使い分け
- Haiku 5.5が向く:問い合わせの一次振り分け、文書の分類・タグ付け、定型的な要約、データ抽出、画面操作の自動化、エージェントのサブタスク。短いリクエストを大量に処理するほど、単価差がそのまま効く。
- 上位モデルを残す:契約書の精査、多段階の推論、複雑なコーディング。ベンチマークでもSonnet 5.5との差が大きい領域だ。
- 長文を丸ごと読ませる処理:10万トークン超は単価が5倍になるうえ、トークン数も増える。文書を分割する、必要な部分だけ渡すといった設計で10万トークン以下に収められるかを先に検討したい。
実務では「一次処理はHaiku 5.5、判断が必要なものだけ上位モデルへ回す」構成が現実的だ。切り替え前に、自社の実データでトークン数を数え直し、精度を小さく比較してから本番へ移すとよい。
同じ日に発表されたその他の変更
- Sonnet 5.5のキャッシュ読み込みを半額に:$0.20→$0.10(100万トークンあたり)。Anthropicはエージェント型タスクの多くで約20%安くなるとしている。
- MaxプランとTeamプランに月額APIクレジット:Max 5xは月$100、Max 20xは月$200、Teamは最大$500(ユーザー間で共有)。どのモデルにも使え、今週から順次提供される。
- SDKでコンピューター操作・ブラウザ操作に対応(ベータ):PythonとTypeScriptのSDKから、これらのエージェントを自社のコードで動かせるようになった。
出典: Introducing Claude Haiku 5.5、Anthropic
Claudeの各モデルの位置づけはClaude Sonnet 5.5の料金・使い方・移行時の注意点も参照されたい。
参考文献
- Anthropic「Introducing Claude Haiku 5.5」: https://www.anthropic.com/claude-haiku-5-5
- Claude Platform Docs「Claude Haiku 5.5」: https://platform.claude.com/docs/en/models/haiku-5-5/overview
- Claude Platform Docs「Claude Haiku 5.5 migration guide」: https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide
- Claude Platform Docs「Pricing」: https://platform.claude.com/docs/en/about-claude/pricing
監修
河合 継(クリスタルメソッド株式会社 代表取締役)
AI・ディープラーニングに関する特許16件の発明者。過去、国立がん研究センターとの共同研究や、テレビ番組でのAI解説実績を持つAI研究者として、AIの研究開発を主導している。
運営会社について | 編集方針
Read next
あわせて読みたい
-
VOICEVOX 使い方|インストールから音声生成まで【2026】
VOICEVOXは無料?商用利用・クレジット表記の結論 VOICEVOXは、商用・非商用を問わず無料で使える音声合成ソフトです。ただし「VOICEVOXを利用し...
-
Grokとは?できること・料金・始め方をやさしく解説【2026年版】
「Grokって最近よく聞くけど、何ができるAIなの?」「ChatGPTと何が違うの?」——そんな方に向けて、このページではGrokのできること・料金・始め方を、...
-
ディープフェイクとは?仕組み・悪用リスク・見分け方と対策を専門家監修で解説【2026年版】
ディープフェイクは、深層学習で実在する人物の顔・声・動作を精密に合成・改変する技術です。映画制作や広告、バーチャルヒューマンといった正当な活用が広がる一方、なり...
