blog

Claude Haiku 5.5 料金とAPI コスト削減——企業導入判断のための実務試算ガイド

Claude Haiku 5.5 料金とAPI コスト削減——企業導入判断のための実務試算ガイド

関連記事VOICEVOX 使い方|インストールから音声生成まで【2026】 / Grokとは?できること・料金・始め方をやさしく解説【2026年版】 / ディープフェイクとは?仕組み・悪用リスク・見分け方と対策を専門家監修で解説【2026年版】

Claude Haiku 5.5とは——2026年10月7日に公開されたAnthropicの新しい小型モデル

2026年10月7日、AnthropicはClaude Haiku 5.5(モデルID:claude-haiku-5-5)を公開した。Opus 5.5・Sonnet 5.5と同じ5.5世代の小型モデルで、Anthropicは「これまでで最も安く、最も速く、最も高性能な小型モデル」と位置づけている。Haikuとして初めてeffort(推論の深さ)の段階指定に対応した点も新しい(出典: Introducing Claude Haiku 5.5、Anthropic)。

結論から言うと、変化の中心は価格だ。入力$0.10/出力$0.50(100万トークンあたり、プロンプト10万トークン以下)で、前世代Haiku 4.5(入力$1/出力$5)の10分の1になった。一方で、10万トークンを超えるプロンプトは単価が5倍に上がる段階制で、トークンの数え方も変わっている。報道で目にする「75%安い」「90%安い」はどちらも公式の数字だが、前提が違う。以下で整理する。

Claude Haiku 5.5の料金——10万トークンを境にした段階制

Claude Haiku 5.5の料金(100万トークンあたり・米ドル、Anthropic公式)
項目 プロンプト10万トークン以下 プロンプト10万トークン超 参考:Haiku 4.5
入力 $0.10 $0.50 $1.00
出力 $0.50 $2.50 $5.00
キャッシュ書き込み(5分) $0.125 $0.625 $1.25
キャッシュ書き込み(1時間) $0.20 $1.00 $2.00
キャッシュ読み込み $0.01 $0.05 $0.10
Batch API(入力/出力) $0.05/$0.25 $0.25/$1.25 $0.50/$2.50

出典: Pricing、Claude Platform Docs

注意したいのは段階の判定方法だ。公式の料金ページによると、10万トークンを超えたかどうかはリクエストごとに、キャッシュ読み込み・書き込み分も含めた入力トークン全体で判定される。キャッシュが効いていても、プロンプト全体が10万トークンを超えればそのリクエストは高い方の単価になる。Sonnet 5.5やOpus 5.5は1Mトークンまで単価が一定なので、Haiku 5.5だけがこの例外になる。

「75%」と「90%」の違い

Anthropicの発表ページ本文は「平均で約75%安く動かせる」とし、脚注で「10万トークン以下のリクエストではHaiku 4.5より90%安く、10万トークン超では50%安い」と説明している。脚注によれば、Haiku 4.5のリクエストの90%は10万トークン以下だった。単価だけを比べれば90%減、長いプロンプトも含めた平均が約75%減、という関係だ。

トークン数は約30%増える

Haiku 5.5はClaude 4.7以降と同じ新しいトークナイザーを使う。移行ガイドによると、同じ文章でもHaiku 4.5より約30%多いトークン数として数えられる(増え方は内容によって異なる)。Haiku 4.5で測ったトークン数をそのまま使って費用を見積もると、ずれが出る(出典: Claude Haiku 5.5 migration guide)。

Haiku 4.5からいくら下がるか——試算例

月100万回、1回あたり入力2,000トークン・出力300トークン(Haiku 4.5での計測値)の分類・要約処理を想定し、Haiku 5.5ではトークン数が30%増えると仮定して計算した。

月間コストの試算(仮定:100万リクエスト/月、通常API、キャッシュなし)
Haiku 4.5 Haiku 5.5(トークン30%増で計算)
入力 20億トークン × $1.00 = $2,000 26億トークン × $0.10 = $260
出力 3億トークン × $5.00 = $1,500 3.9億トークン × $0.50 = $195
合計 $3,500 $455(約87%減)

同じ考え方で、プロンプトが10万トークンを超える長文処理を計算すると、入力単価は$1.00→$0.50だが、トークン数が1.3倍になるため実質の削減は約35%にとどまる。短いリクエストを大量に処理する用途ほど効果が大きく、長文を丸ごと読ませる用途では差が小さい。

性能——公式ベンチマークの数値

主なベンチマーク(Anthropic発表ページより)
ベンチマーク Haiku 5.5 Haiku 4.5 Sonnet 5.5
OSWorld 2.1(オフライン版・コンピューター操作) 72.4% 15.7% 83.9%
Terminal-Bench 4.0 39.2% 0.0% 70.6%
Humanity’s Last Exam(ツールなし) 45.9% 10.2% 56.9%
Humanity’s Last Exam(ツールあり) 57.4% 18.7% 64.5%
GDPval-AA v2.1(Elo) 1620 735 1840

出典: Introducing Claude Haiku 5.5、Anthropic

Haiku 4.5からは大きく伸びたが、Sonnet 5.5との差は残る。Anthropic自身も、複雑なエージェント型のコーディングにはSonnet 5.5・Opus 5.5が適しているとし、Haiku 5.5の用途として要約・分類・データベース検索・会話の圧縮・サブエージェントを挙げている。

主な仕様と提供先

  • コンテキスト:100万トークン。最大出力:12.8万トークン(Batch APIはベータで30万トークン)
  • 入力:テキストと画像。知識のカットオフ:2026年6月
  • 思考:Adaptive thinking(既定でオン)。深さはeffortで指定し、既定値はmedium
  • 提供先:Claude API、Amazon Bedrock(anthropic.claude-haiku-5-5)、Google Cloud、Microsoft Foundry、Claude Platform on AWS
  • 提供期間:2027年10月7日より前には廃止しないと明記

出典: Claude Haiku 5.5 overview、Claude Platform Docs

Haiku 4.5から切り替えるときの注意点

モデル名を書き換えるだけでは動かないケースがある。移行ガイドに書かれた主な変更点は次のとおり。

  1. 思考の予算指定が使えない:thinking: {"type":"enabled","budget_tokens":N}は400エラーになる。{"type":"adaptive"}に変え、effortで深さを調整する。
  2. temperature・top_p・top_kは原則外す:既定以外の値を送ると400エラーになる。
  3. アシスタントのプリフィルが使えない:最後をassistantのターンにしたリクエストは400エラー。出力形式の固定はstructured outputsやツールで行う。
  4. 応答の先頭が答えとは限らない:思考ブロックが先に来ることがあるため、内容ブロックは位置でなくtypeで選ぶ。max_tokensが小さいと思考だけで止まることもある。
  5. 安全分類器による拒否:stop_reason: "refusal"で断ることがあり、サーバー側で別モデルに切り替える仕組みはない。発表ページによると、サイバーセキュリティではペネトレーションテスト等が、生物学では有害と判断された依頼が制限される。
  6. コンピューター操作:Claude APIとGoogle Cloudではcomputer_toolset_20260801への移行が必要。ブラウザ操作ツール(browser_toolset_20260801)にも新たに対応した。
  7. Priority Tier非対応:Haiku 4.5でPriority Tierを契約している場合は、容量計画を別に立てる必要がある。

Claude Codeでは/claude-api migrateで、モデルIDやパラメーターの書き換えをまとめて行える(出典: migration guide)。

どの業務に向くか——上位モデルとの使い分け

業務インプットチャットボット応答ドキュメント分類メール自動仕分け短文コンテンツ生成FAQ自動応答データ抽出・変換一次フィルタリングルーティング判断定型・高頻度・短文複雑推論・長文Claude Haiku 5.5入力$0.10/出力$0.50最速・大量呼出でコスト圧縮キャッシュ活用でさらに削減Opus 5.5 / Sonnet 5.5契約書精査・多段階推論高精度が必要なタスクのみAPIコスト削減のモデルルーティング戦略
図: 定型・高頻度・短文のタスクはHaiku 5.5(10万トークン以下で入力$0.10/出力$0.50)で処理し、複雑な推論や長文の精査だけを上位モデルへ振り分ける構成。
  • Haiku 5.5が向く:問い合わせの一次振り分け、文書の分類・タグ付け、定型的な要約、データ抽出、画面操作の自動化、エージェントのサブタスク。短いリクエストを大量に処理するほど、単価差がそのまま効く。
  • 上位モデルを残す:契約書の精査、多段階の推論、複雑なコーディング。ベンチマークでもSonnet 5.5との差が大きい領域だ。
  • 長文を丸ごと読ませる処理:10万トークン超は単価が5倍になるうえ、トークン数も増える。文書を分割する、必要な部分だけ渡すといった設計で10万トークン以下に収められるかを先に検討したい。

実務では「一次処理はHaiku 5.5、判断が必要なものだけ上位モデルへ回す」構成が現実的だ。切り替え前に、自社の実データでトークン数を数え直し、精度を小さく比較してから本番へ移すとよい。

同じ日に発表されたその他の変更

  • Sonnet 5.5のキャッシュ読み込みを半額に:$0.20→$0.10(100万トークンあたり)。Anthropicはエージェント型タスクの多くで約20%安くなるとしている。
  • MaxプランとTeamプランに月額APIクレジット:Max 5xは月$100、Max 20xは月$200、Teamは最大$500(ユーザー間で共有)。どのモデルにも使え、今週から順次提供される。
  • SDKでコンピューター操作・ブラウザ操作に対応(ベータ):PythonとTypeScriptのSDKから、これらのエージェントを自社のコードで動かせるようになった。

出典: Introducing Claude Haiku 5.5、Anthropic

Claudeの各モデルの位置づけはClaude Sonnet 5.5の料金・使い方・移行時の注意点も参照されたい。


参考文献

監修

河合 継(クリスタルメソッド株式会社 代表取締役)

AI・ディープラーニングに関する特許16件の発明者。過去、国立がん研究センターとの共同研究や、テレビ番組でのAI解説実績を持つAI研究者として、AIの研究開発を主導している。
運営会社について | 編集方針

AIブログ購読

 
クリスタルメソッドがお届けする
AIブログの更新通知を受け取る

Read next

あわせて読みたい

  • 音声・音楽AIのイメージ

    VOICEVOX 使い方|インストールから音声生成まで【2026】

    VOICEVOXは無料?商用利用・クレジット表記の結論 VOICEVOXは、商用・非商用を問わず無料で使える音声合成ソフトです。ただし「VOICEVOXを利用し...

  • ローカル・OSS LLMのイメージ

    Grokとは?できること・料金・始め方をやさしく解説【2026年版】

    「Grokって最近よく聞くけど、何ができるAIなの?」「ChatGPTと何が違うの?」——そんな方に向けて、このページではGrokのできること・料金・始め方を、...

  • アバター・デジタルヒューマンのイメージ

    ディープフェイクとは?仕組み・悪用リスク・見分け方と対策を専門家監修で解説【2026年版】

    ディープフェイクは、深層学習で実在する人物の顔・声・動作を精密に合成・改変する技術です。映画制作や広告、バーチャルヒューマンといった正当な活用が広がる一方、なり...

View more