Claude Haiku 5.5を選ぶ条件|料金の分岐と移行前の5項目
代表取締役 上坂大地郎

要約や分類を何度も呼び出すなら、Claude Haiku 5.5は置き換えを試す候補です。ただし、新料金はプロンプトの長さで変わり、Haiku 4.5の設定をそのまま使えない箇所もあります。
今回押さえたい点は次の3つです。
- Anthropicは2026年10月7日にHaiku 5.5を公開しました。短い反復処理や、大きな仕事の一部分を任せる用途を想定しています。
- Claude Platformの通常API料金は、プロンプト10万トークン以下なら100万トークン当たり入力0.10ドル・出力0.50ドル。10万を超えると入力0.50ドル・出力2.50ドルです。
- 考える量を調節するeffortに対応しました。安さを比べるときは、単価だけでなく出力の品質、トークン量、やり直しも確認します。
対象は、Claudeで文書処理や小さな開発作業を自動化している方、Haiku 4.5からの変更点を知りたい方です。読み終えたら、移行前に直す設定と、最初に比較する仕事を選べます。
本稿は2026年10月8日時点の公式発表・資料に基づくニュース解説です。モデルを動かした性能レビューではありません。発表と価格の根拠はAnthropicの発表と公式料金表です。
Haiku更新で分けやすくなった小さな処理
まとめ役と部分作業役の分担
Haiku 5.5の公式な用途には、分類、情報の抽出、要約、依頼の振り分け、サブエージェントが挙がっています。サブエージェントとは、全体を担当するAIから一部の作業を受け取る別のAIです。資料作成にたとえるなら、構成を考える担当と、指定された資料から必要な数値を探す担当を分けるイメージです。
今回の更新を「すべての仕事をHaikuへ変える話」と読むと、使いどころを見失います。まず候補になるのは、入力と正解の形を決めやすい部分です。問い合わせをカテゴリへ分ける、議事録から期限の記述だけを取り出す、指定したファイル群から関数名を探す、といった仕事が考えられます。これらは用途を説明する想定例で、成功率を測った結果ではありません。
文脈は1M、通常の最大出力は128Kへ
公式の変更点一覧では、扱える文脈がHaiku 4.5の200Kから1Mトークン、通常の最大出力が64Kから128Kトークンへ増えたと説明されています。トークンはAIが文章を処理する単位で、日本語の文字数と一対一ではありません。
大きな資料を扱える上限と、その資料を毎回送るべきかは別の判断です。必要な章が分かっているなら、そこだけを渡す比較も残してください。文脈を広げたときに答えの根拠が増えるのか、関係のない情報まで混ざるのかを確かめるためです。今回の価格には、容量の上限とは別に10万トークンの境目があります。
10万トークン前後で分かれるAPI料金
入力に連動する出力単価
Claude Platformの通常料金は次のとおりです。単位はすべて100万トークン当たりの米ドルで、月額プランの料金表ではありません。
課金対象 | プロンプト10万以下 | プロンプト10万超 |
|---|---|---|
通常入力 | $0.10 | $0.50 |
出力 | $0.50 | $2.50 |
5分キャッシュ書き込み | $0.125 | $0.625 |
1時間キャッシュ書き込み | $0.20 | $1.00 |
キャッシュ読み取り | $0.01 | $0.05 |
キャッシュ書き込みは、対象部分を初めて保存するときにかかる料金です。有効期間(TTL)が5分なら基本入力単価の1.25倍、1時間なら2倍で、表の具体額になります。キャッシュ読み取りは、保存済みの入力部分を再利用するときの料金です。上表を読むときは、入力を長くした場合に、出力側の単価も変わる点を先に確認すると見積もりを間違えにくくなります。出典:公式料金表
「平均75%低コスト」と請求額の違い
AnthropicはHaiku 4.5に比べ、平均で約75%低い実行費用になると説明しています。計算に使われた要素は、単価の引き下げ率と、新しい文章の分割方式によるトークン量の変化です。利用者ごとの請求額は、実際の入出力、キャッシュ、再試行によって決まります。
想定シナリオとして、キャッシュを使わず、通常入力が2万トークン、課金対象の出力が2,000トークンだったリクエストを考えます。Haiku 5.5の短いプロンプト側の単価なら、入力0.002ドル+出力0.001ドルで、合計0.003ドルです。
比較対象のHaiku 4.5は入力1ドル・出力5ドル/100万トークンなので、同じトークン数なら合計0.03ドルになります。これは単価差だけを見る計算例です。モデル間では、同じ日本語でもトークン数が変わり得ます。ツール料金、再試行、キャッシュ作成も計算の対象外です。
仕事の見積もりには、モデル別に計測した使用量を入れ直します。過去のHaiku 4.5の使用量へ、新単価だけを掛けた数字をそのまま予算にするのは避けたいところです。
Sonnet代替前に比べる仕事の範囲
公式評価に表れた仕事ごとの違い
Anthropicが公開したTerminal-Bench 4.0の評価では、Haiku 5.5は39.2%、参考比較のSonnet 5.5は70.6%です。これはコマンドラインで複数段階の作業を行う評価で、Anthropicの評価条件による値です。普段の開発で何割の修正が成功するかを示す数字ではありません。
発表元も、複雑なエージェント型コーディングではSonnet 5.5やOpus 5.5がより適していると説明しています。Haikuの費用が下がったことと、長い実装を最後まで同じ品質で任せられることを混同しない読み方が必要です。出典:発表のPerformance/Further updates
受け渡す成果物を狭める分担
以下は編集上の提案です。設計方針を決める、複数ファイルの整合性を確認する、といった全体の判断は既存のモデル側に残し、抽出や要約だけをHaikuへ渡す構成から比較します。

Haikuへ渡す範囲と、結果を戻す前の確認を分けた構成案です。小さな処理で品質と費用を比べ、採用できた部分から範囲を広げます。
たとえば「資料を調べて提案書を完成させて」では、どこで間違えたかの確認も広くなります。「この資料から製品名と該当ページを取り出して。記載がなければ未記載と返して」なら、元資料との照合を先に設計できます。Haikuを選ぶ理由を価格だけにせず、出力を確かめられる形に仕事を切れるかで考えます。
上位モデル側の移行条件は、公開済みのClaude Sonnet 5.5移行ガイドも参照してください。今回の新モデルを追加しても、既存の比較基準まで一度に変える必要はありません。
effortは、速さと確認の丁寧さを調節する設定
mediumから始める比較基準
effortの公式資料によると、Haiku 5.5はlow、medium、high、xhigh、maxに対応し、Claude APIとClaude Codeの既定値はmediumです。effortは、モデルが考える量を調節する設定です。実際のトークン数は入力と処理内容に応じて変動します。
公式は短い会話や単純な大量処理にlowを選択肢として挙げています。長いエージェント向けの指示では、検索や確認を省いたり、早く作業を終えたりしやすいとの説明です。速度と必要な手順の実行状況を一緒に確認してください。
最初は同じ入力をmediumで試し、必要な項目が返る基準を作ります。その後lowに下げ、欠落や再試行が増えないか比べる順番が扱いやすい方法です。これは本稿の比較手順の提案です。入力が変わるたびにeffortも変えると、結果の差をどちらの影響か説明しにくくなります。
出力上限へ含まれる思考分
Haiku 5.5の既定はadaptive thinkingです。モデルが考えるために使ったトークンもmax_tokensに含まれます。上限が小さいと、回答テキストを返す前に処理が終わる可能性が公式の注意点です。出典:変更点一覧
「回答が短いから出力上限も小さくてよい」と決める前に、終了理由とテキストの有無を見てください。結果が空だった処理を成功として次工程へ渡さないよう、アプリ側の判定もセットで確認します。
Claude・Claude Code・APIごとの確認先
公式製品ページのAvailabilityでは、Free、Pro、Max、Team、Enterpriseの利用者がClaude.aiでHaiku 5.5を選べると案内されています。Web、iOS、Androidに加え、Claude Codeも提供先です。実際の利用上限はプランや画面に表示される条件へ従います。
開発者向けの提供先は、Claude Platform、Amazon Web Services、Google Cloud、Microsoft Foundryです。クラウドごとの地域や契約条件までは本稿では検証していません。すでに組織の接続先が決まっている場合は、その接続先で表示されるモデルと利用条件を確認してください。
Claude Codeでは、公式CHANGELOGの2.1.293にHaiku 5.5追加と、Anthropic API接続時の既定Haiku変更が記載されています。第三者クラウドも同時に同じ既定値へ変わる、と広げて解釈しないようにします。出典:Claude Code CHANGELOG
また、Claudeの画面で選ぶモデルと、自作アプリのAPIリクエストで指定するモデルは確認場所が異なります。画面でHaiku 5.5を使えたことだけでは、自作アプリの移行確認は済みません。アプリでは送信したモデルIDと返ってきた使用量を記録し、想定した経路で動いているかを確認するのが先です。
Haiku 4.5から移る前に確認する5項目
APIの移行では、モデルIDの置き換えに加えて互換性の確認が必要です。ここでは公式移行ガイドから、通常の文章処理で先に見る項目を絞ります。computer useや会話履歴の再利用などを含む完全な移行手順ではありません。
1. モデルIDと文章トークン数の再計測
Claude APIのIDはclaude-haiku-5-5です。新しいtokenizerでは、同じ入力文でもHaiku 4.5よりトークン数が概ね30%増えると公式は説明しています。増加率は内容で変わります。
tokenizerは文章を処理単位へ区切る仕組みです。同じ箱へ荷物を詰めても、区切り方が変わると箱の数え方が変わるイメージです。文字数だけで10万トークンの料金区分を推測せず、対象モデルを指定して数え直します。
2. 古いthinking設定の削除
thinkingにenabledとbudget_tokensを指定する旧設定は、Haiku 5.5では400エラーになります。adaptiveへ変更し、考える量はeffortで調節するのが移行ガイドの案内です。モデル名の変更と同時に、共通設定ファイルから古い指定が足されていないかも確認します。
3. サンプリング設定の削除
公式の案内は、temperature、top_p、top_kをリクエストから省くことです。古い実装でよくあるtemperature: 0を残すと400エラーになります。該当する設定を削除してから再実行してください。
4. assistant prefillの置き換え
最後のassistantメッセージに回答の書き出しを置き、続きを生成させる方式は拒否されます。出力形式を指定したい場合は、その目的に合う別の指定へ移す必要があります。JSONの形を整えるために書き出しだけを固定していた実装も、確認対象です。
5. 応答ブロックのtype判定
応答の先頭にthinkingブロックが来る場合があります。content[0]を回答として扱う実装は、ブロックのtypeで取り出す形へ見直します。終了理由が上限到達や拒否だった場合の扱いも点検してください。「HTTPで応答が返った」と「必要な成果物が得られた」を別々に判定するためです。
これらを直しても、業務で使える品質になったとはまだ言えません。移行ガイドが支えるのはAPIの変更点です。返された内容が正しいかは、次の比較で確かめます。
完了条件から始める最初の比較
同じ資料と正解の準備
試す仕事は、結果を照合できるものを一つ選びます。以下は想定シナリオです。架空の問い合わせ20件を、「請求」「障害」「操作質問」「判断保留」のどれかへ分類する処理を想定します。この件数は初期試験の例です。
まず人が期待する分類を決め、曖昧な文を判断保留へ送る条件も先に定義してください。両モデルへ同じ資料と基準を渡し、Haiku 5.5のeffortを固定した状態が比較条件です。正解を先に決めると、出力を見た後で採点基準を緩める問題を防げます。
記録するもの | 見たいこと |
|---|---|
モデルID、effort、入力 | 比較条件を後から再現できるか |
正解と出力、判断保留の件数 | 誤分類を断定で返していないか |
入力・出力・キャッシュの使用量 | 新しい数え方と料金区分でいくらか |
応答時間、再試行、手直し | 待ち時間と人の負担が増えていないか |
終了理由と必要項目の有無 | 未完了の応答を成功へ数えていないか |
合格1件当たりの費用
比較に使う費用には、採用した回答と、失敗してやり直した分を含めます。処理単価を揃える式は、モデルの呼び出し総額を合格件数で割った値です。合格が0件なら費用効率を比べず、入力や完了条件を見直してください。人の確認時間は別の項目へ記録します。
手直しが増えた仕事は移行を見送ります。必要な項目を保ちながら費用や待ち時間が下がった処理は、切り替える根拠です。この順番なら、「安いから全部変える」と「高性能モデルだけ使い続ける」の間で、仕事ごとに選べます。
なお、同時発表でSonnet 5.5のキャッシュ読み取りも100万トークン当たり0.20ドルから0.10ドルへ下がりました。比較相手の費用も動いているため、過去の請求額と新モデルの単価だけを比べないようにします。出典:同時発表
費用の記録方法を広げるなら、Claude APIコスト最適化の手順も参考になります。Haiku 5.5の採用を決める前に、まず一つの処理で、設定を直した後の出力と使用量を残してください。
参考・出典
- Introducing Claude Haiku 5.5 — Anthropic(発表日: 2026-10-07、参照日: 2026-10-08)。<https://www.anthropic.com/claude-haiku-5-5>
- Claude Haiku: Availability and pricing/Use cases — Anthropic(参照日: 2026-10-08)。<https://www.anthropic.com/claude/haiku>
- Claude Haiku 5.5 overview — Claude Platform Docs(参照日: 2026-10-08)。<https://platform.claude.com/docs/en/models/haiku-5-5/overview>
- What's new in Claude Haiku 5.5 — Claude Platform Docs(参照日: 2026-10-08)。<https://platform.claude.com/docs/en/models/haiku-5-5/whats-new-haiku-5-5>
- Pricing — Claude Platform Docs(参照日: 2026-10-08)。<https://platform.claude.com/docs/en/about-claude/pricing>
- Effort — Claude Platform Docs(参照日: 2026-10-08)。<https://platform.claude.com/docs/en/build-with-claude/effort>
- Claude Haiku 5.5 migration guide — Claude Platform Docs(参照日: 2026-10-08)。<https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide>
- Token counting — Claude Platform Docs(参照日: 2026-10-08)。<https://platform.claude.com/docs/en/build-with-claude/token-counting>
- Claude Code CHANGELOG v2.1.293 — Anthropic公式リポジトリ(参照日: 2026-10-08)。<https://raw.githubusercontent.com/anthropics/claude-code/main/CHANGELOG.md>


