サービスと料金 事例 会社概要 ブログ 30分の無料相談 LINEで相談受付中
ホーム›ブログ›ツール選定
ツール選定

Claude Haiku 5.5の料金|10万トークンの壁と自社の月額試算

栗田 啓介株式会社MUKIAI 約13分で読めます
Claude Haiku 5.5の料金|10万トークンの壁と自社の月額試算
目次(26項目)

「Claude Haiku 5.5に乗り換えれば、AI費用は大きく減るんですよね」こう聞かれることが増えました。Anthropicが2026年10月7日に発表した新モデルは、単価表を見る限りたしかに破格です。

結論から言います。Claude Haiku 5.5は「軽くて件数が多い仕事」に移したときだけ費用が下がり、そうでない仕事では効果が薄いか、ほぼ出ません。

ただし、単価が下がったからといって、今動いているシステムのモデル名を書き換えるだけで済むわけではありません。

この記事では、Claude Haiku 5.5の料金の仕組みと「10万トークンの壁」を説明します。そのうえで、自社の月額の試算方法、乗り換えで壊れる項目、どの仕事をどのモデルに乗せるべきかまで、順番に見ていきます。

Claude Haiku 5.5とは|結論は「軽い仕事だけ移せば安くなる」

Anthropicは2026年10月7日、新しいモデル「Claude Haiku 5.5」(モデルID:claude-haiku-5-5)を公式に発表しました。単価は大きく下がりましたが、下がり方は一律ではありません。

公式が示す値下げ幅は二段構えです。10万トークンまでのリクエストでHaiku 4.5比90%安く、10万トークン超で50%安いという言い方になっています。1つの割引率にまとめられるものではありません。

ポイント:(1)単価そのものは確かに下がりました。(2)ただし下がるのはプロンプトが10万トークン以下のときだけです。(3)モデルを乗り換えるには実装の見直しが必要なので、効果が出るのは「件数が多く、1件が軽い処理」に限られます。

この記事は単価の話だけで終わりません。自社の中小企業のAI導入費用の相場という全体像の中で、API従量課金がどの位置を占めるかを踏まえたうえで、Claude Haiku 5.5が効く場面を具体的に見ていきます。

AI導入、自己流で進めて大丈夫ですか?

情報漏えい・社内ルール・法規制のリスクを整理し、全社で“使える状態”まで伴走します。まずは無料相談で、御社の状況に合わせた最初の一歩をお伝えします。

公式LINEで無料相談する相談はまだ早い方へ:まず3分AI活用力診断 →

料金はいくらか|4モデルの単価を1枚のグラフで比べる

以下の料金は2026年10月9日時点のものです。入力100万トークンあたりの単価を並べると、Claude Haiku 5.5だけが一桁違う安さだと分かります。

入力100万トークンあたりの料金の比較。Haiku 5.5は0.10ドルで、Haiku 4.5の1.00ドル、Sonnet 5.5の2.00ドル、Opus 5.5の4.00ドルより1桁安い
入力100万トークンあたりの料金(出典:Anthropic公式の料金ページ・2026年10月9日時点)

出力側も同じ並びです。100万トークンあたり、Haiku 5.5は0.50ドル、Haiku 4.5は5ドル、Sonnet 5.5は10ドル、Opus 5.5は20ドルになります。

ただしHaiku 5.5には、1回に渡すプロンプトの長さで単価が切り替わる条件が付いています。この条件は次の章で詳しく見ます。

短いプロンプトでの入力単価を1とすると、Haiku 4.5は10倍、Sonnet 5.5は20倍、Opus 5.5は40倍です。倍率で覚えておくと、どのモデルに何を乗せるべきかの判断が速くなります。

即時応答が不要な処理なら、Batch APIという手もあります。入力・出力とも50%オフで、どのモデルでも夜間バッチなら効きます。

払い方の比較対象として、ChatGPT法人プランの実額と選択条件も合わせて見ておくと取りこぼしがありません。

見落とすと高くつく「10万トークンの壁」|日本語の長文業務が危ない

Claude 4.6以降のモデルは、100万トークンのコンテキスト全体が標準料金で使えます。長い資料を渡しても単価は変わりません。ところがClaude Haiku 5.5だけは例外です。

なぜHaiku 5.5だけが例外なのか

Haiku 5.5は、プロンプトが10万トークン以下なら入力$0.10・出力$0.50(100万トークンあたり)です。10万トークンを超えると入力は$0.50、出力は$2.50に切り替わり、どちらも単価が5倍になります(出典:platform.claude.comのLong context pricing)。

この判定は1リクエストごとに行われます。キャッシュの読み書きを含めた入力トークン全体で数えるので、会話が長くなるほど壁に近づきます。

壁に当たる使い方・当たらない使い方

壁に当たりやすいのは、就業規則やマニュアルを毎回まるごと貼る実装です。長い会話履歴を全部渡すチャットボットも同じです。反対に、分類・抽出・振り分け・一次要約のように1件の入力が短い仕事なら、壁には届きません。

日本語の業務文書は、同じ内容でも英語よりトークン数が多くなりやすい傾向があります。議事録や契約書を全文そのまま渡す使い方ほど、値下げの恩恵から外れやすいと考えてください(倍率は原典で確認できていないため、数字は出しません)。

ポイント:壁に当たるかどうかは、1リクエストで渡しているプロンプトの文字数を数えれば分かります。10万トークンに収まるなら安く済み、超えるなら渡す範囲を絞るか、別モデルに乗せるかを決めます。

自社の月額はいくらになるか|問い合わせ分類3万件で試算する

具体的な件数を当てはめます。前提は1日1,000件の問い合わせ分類を30日間、1件あたり入力500トークン・出力50トークンという仮定です。1件あたりの数字は推定です。自社の件数に置き換えてください。

単価だけで計算した月額

月間の入力は、1,000件×30日×500トークンで1,500万トークン(15MTok)です。出力は同じ考え方で150万トークン(1.5MTok)になります。

Haiku 5.5の単価(入力$0.10・出力$0.50/MTok)なら、(15×$0.10)+(1.5×$0.50)=$2.25/月です。同じ条件をHaiku 4.5の単価(入力$1・出力$5)で計算すると$22.5/月になります。単価だけを比べると90%減です。

トークナイザの30%増を入れ直した月額

ただしHaiku 5.5は新しいトークナイザを使っていて、同じ文章でもトークン数がHaiku 4.5比で約30%増えます。旧基準の「入力500・出力50トークン」は、実際には入力650・出力65トークン前後になります。

入れ直すと月間入力は19.5MTok、月間出力は1.95MTokです。費用は(19.5×$0.10)+(1.95×$0.50)=$2.93/月で、旧基準の$22.5と比べると実質87%減です。単価上の90%より数ポイント小さくなります。

この$2.25・$2.93・87%は、platform.claude.comの料金ページの単価をもとに私たちが計算した試算で、仮定を含みます。

モデル・条件月間入力トークン月間出力トークン月額旧基準比
Haiku 4.5(旧基準)15MTok1.5MTok$22.5基準
Haiku 5.5(単価だけ)15MTok1.5MTok$2.2590%減
Haiku 5.5(30%増を反映)19.5MTok1.95MTok$2.9387%減

月額数ドルの従量課金と、1人あたり定額のプランのどちらが合うかは並べないと分かりません。定額側はClaude Code料金の全体像とプラン別の月額で確認できます。

モデル名を変えるだけでは済まない|乗り換えで壊れる5つ

ここまでは費用の話でした。乗り換えはモデルIDの文字列を書き換えるだけでは済みません。

エラーになる変更(直さないと動かない)

次の5つは、既存の実装がそのまま使っているとエラーになる変更です(出典:whats-new-haiku-5-5)。

  • 「考える時間」を手動で指定する設定(budget_tokens)は止まります。自動調整の仕組み(adaptive thinking)に置き換えます。
  • 回答のランダムさを調整する設定(temperature・top_p・top_k)を既定値以外にすると止まります。この設定は外します。
  • 回答の冒頭を先に書き込む「prefill」は使えません。依頼は必ずユーザー側の発言で終える形に直します。
  • 画面操作の機能(computer use)は、古いツール指定のままだと動きません。新しい指定に差し替えます。
  • AIが考えた過程(thinkingブロック)を履歴に含める場合、過去のターンを書き換えてはいけません。追記だけにします。

黙って挙動が変わる変更(気づかないと事故につながる)

次の4つはエラーにならずに挙動だけ変わる変更です。気づかないまま運用を続ける危険があります。

  • 回答が「考えた過程」から始まることがあります。先頭だけを読むコードは種類で選び直します。
  • 同じ文章のトークン数が約3割増えます。処理件数と回答の上限(max_tokens)を数え直します。
  • 「考えた過程」の本文は既定で返りません。見たいなら表示設定(thinking.display)を要約表示にします。
  • 「考えた過程」は、それを生成したアカウントか連携したアカウントでしか再生できません。保存した会話を別アカウントで流し直す作りだと動きません。
情シス担当からよく聞くのは、「何がどれだけ壊れるのか分からないまま乗り換えるのが一番怖い」という声です。書き換える前に数えておけば、怖さはかなり減ります。

エラーで止まる5つのうち、自社の実装がいくつに当たるかを数えてください。0個ならモデルIDの差し替えとテストで済みます。1個以上あるなら、コード修正と回帰テストの工数が出ます。

削減額が月数ドル規模なら、改修費を何か月で回収できるかを先に計算しておきます。既定のeffort(考える深さ)はmediumです(出典:models/overview)。

仕事の重さでモデルを分ける|どこまでHaiku 5.5で足りるか

点検する箇所が分かったら、次はどの仕事をどのモデルに置くかです。大事なのは「安いモデルに全部寄せる」ことではなく、1件あたりの重さで置き場所を変えることです。

仕事の重さでモデルを分ける関係図。分類・振り分けと要約・抽出はHaiku 5.5、文章の作成はSonnet 5.5、難しい判断・設計はOpus 5.5
仕事の重さでモデルを分ける

Haiku 5.5の仕様も押さえておきます。コンテキストは100万トークン(Haiku 4.5は20万トークン)、最大出力は12.8万トークン(Haiku 4.5は6.4万トークン)、知識のカットオフは2026年6月です。

提供はClaude API・Amazon Bedrock・Google Cloud・Microsoft Foundryで、すでに使っているクラウドがあれば既存の請求にまとめられます。

この分け方を決める理由は単価差です。軽い処理をSonnet 5.5に置いたままだと、入力単価で20倍を払い続けます。Opus 5.5に置いたままなら40倍です。

ポイント:モデル選びの軸は「安いモデルに寄せる」ではなく「仕事の重さに合わせる」です。件数が多く1件が軽い処理はHaiku 5.5、文章を作る仕事はSonnet 5.5、正確さ最優先の判断はOpus 5.5に置くと覚えてください。

そもそもClaude系に寄せるべきかという比較は、ChatGPTとClaudeの用途別選び分けも合わせて確認すると判断しやすくなります。

自社で決める5ステップ|どのモデルに何を乗せるか

ここまでの内容を、順番に進められる形にします。次の5ステップで、どの処理をどのモデルに乗せるかを決めます。

ステップ1:今の処理を「1件あたりの重さ」で棚分けする

今AIに任せている処理を書き出し、「件数が多く1件が軽いか」「文章を作る仕事か」「正確さ最優先の判断か」で分けて、下の表に当てはめます。

モデル向いている仕事の重さ入力$/MTok出力$/MTok具体例注意点
Claude Haiku 5.5件数は多いが1件が軽い(分類・抽出・振り分け・一次要約)$0.10$0.50問い合わせの自動振り分け、注文メールの項目抽出、FAQ一次回答10万トークン超で単価が5倍。新トークナイザでトークン数が約30%増
Claude Sonnet 5.5速さと精度のバランスが要る通常業務全般$2$10社内文書の要約・下書き、顧客対応の返信案入力単価はHaiku 5.5の20倍
Claude Opus 5.5正確さ最優先の複雑な推論・長時間のコーディング$4$20契約書レビュー、複雑な設計判断入力単価はHaiku 5.5の40倍

ステップ2:Haiku 5.5に乗せる候補のプロンプト長を数える

候補に挙げた処理について、1リクエストのプロンプトが10万トークンを超えないかを確認します。超えるものは、渡す範囲を絞るか別モデルに乗せます。

ステップ3:月額を自社の件数で試算する

次の式に自社の数字を入れます。月額=(月間入力MTok×入力単価)+(月間出力MTok×出力単価)。件数と1件あたりのトークン数を変えるだけです。

ステップ4:壊れる項目に自社が当たるかを数える

エラーで止まる5つと、黙って挙動が変わる4つを自社の実装と照らします。1つでも当たるなら、改修とテストの工数を見込みます。

ステップ5:1業務だけで2週間試して請求額を見る

最後は実測です。即時応答が不要なら、50%オフのBatch APIで夜間バッチにするのも手です。

まず1つの業務だけをHaiku 5.5に移し、2週間分の請求額を見てから本格導入を決めてください。回収にかかる期間はAI導入のROI計算式と費用回収目安で確認できます。

よくある質問

Q. Claude Haiku 5.5とHaiku 4.5の違いは何ですか

A. 違うのは4点です。単価は入力$0.10・出力$0.50(10万トークン以下のとき)で、Haiku 4.5は入力$1・出力$5です。コンテキストは100万トークン(Haiku 4.5は20万)、最大出力は12.8万トークン(同6.4万)です。

Q. 料金は本当に90%安くなるのですか

A. 単価としては、10万トークンまでのリクエストでHaiku 4.5比90%安いというのが公式の表現です。ただし請求額の下げ幅はこれより小さくなります。トークン数そのものが約30%増えるためで、本文の試算では実質87%減でした。

Q. 10万トークンを超えるとどうなりますか

A. 入力が$0.10から$0.50、出力が$0.50から$2.50へ、どちらも5倍になります。判定はリクエストごとで、キャッシュの読み書きを含む入力トークン全体で数えます。他のモデルは標準料金のままなので、Haiku 5.5だけの例外です。

Q. Haiku 5.5とSonnet 5.5はどちらを使うべきですか

A. 仕事の重さで分けます。分類・振り分け・抽出・一次要約のように件数が多く1件が軽い処理はHaiku 5.5、文章を作る仕事や通常業務全般はSonnet 5.5です。入力単価はSonnet 5.5が20倍なので、差がそのまま費用に出ます。

Q. 乗り換えると何が壊れますか

A. エラーになる変更が5つあります。budget_tokensによる手動のextended thinking、既定以外のtemperature・top_p・top_k、prefill、computer useの古いツール指定、thinkingブロックを送り返すときの前ターンの書き換えです。

Q. Haiku 4.5はいつ廃止されますか

A. 2026年10月9日時点で Claude Haiku 4.5 は Active(現役)です。廃止予定としての告知は出ていません。公式のModel deprecationsには、廃止の目安として「2026年10月15日より前にはならない」とあります。

これは確定日ではなく、これより早くはならないという意味です。実際に廃止するときは、公開モデルなら少なくとも60日前に通知されると同じページに明記されています。

まとめ|Claude Haiku 5.5は単価ではなく「仕事の棚分け」で効く

最後に要点を3つに絞ります。

  • Claude Haiku 5.5の単価は、プロンプトが10万トークン以下のときだけ最大90%安くなります。
  • 10万トークンを超えると単価が5倍になるため、日本語の長文業務は値下げの対象から外れやすくなります。
  • 乗り換えにはエラーになる5つと挙動が変わる4つの点検が必要で、モデル名を書き換えるだけでは済みません。

Claude Haiku 5.5は、値下げのニュースというより、自社のモデル構成を見直すきっかけです。単価表だけを見て全部を安いモデルに寄せると、品質が落ちた理由も、費用が下がらない理由も分からなくなります。

やることは順番どおりです。自社の処理を重さで棚分けし、1件が軽くて件数の多い業務を1つだけHaiku 5.5に移し、2週間分の請求額を見て判断します。

私たちのAI伴走支援でも、どの業務をどのモデルに乗せるかの棚分けから一緒に進めています。自社の場合はどこから移せばよいか相談したい方は、お気軽にどうぞ。

(本記事の料金・仕様は2026年10月9日時点の公表情報に基づきます。最新の条件は各社公式ページでご確認ください。)

#Claude Haiku 5.5#Claude料金#モデル比較#ツール選定
AI導入の不安、ひとりで抱えていませんか?

「何から始めればいいか分からない」段階こそ相談どき。御社の状況に合わせた最初の一歩を、無料でお伝えします。

LINEで相談受付中 相談はまだ早い…という方は、まず3分の自己診断で自社の状態を確かめる →
栗田 啓介
株式会社MUKIAI/ 栗田 啓介
「AI導入の不安を、先回りして取り除く」をミッションに、セキュリティに強いAI伴走支援を提供。情報漏えい・社内ルール・法規制のリスクを整理しながら、全社で“使える状態”まで伴走します。会社概要を見る →