Anthropicが2026年10月7日にリリースしたClaude Haiku 5.5は、Claude 5.5ファミリーの中で最も小型かつ最速・最安のAIモデルです。入力10万トークン以下では前世代Haiku 4.5比で最大90%のコスト削減を実現しながら、知的作業や開発タスクのベンチマークスコアを大幅に引き上げています。
しかし、Claude Haiku 5.5とはそもそもどのようなモデルなのか、料金体系はどう変わったのか、Sonnet 5.5やOpus 5.5とはどう使い分ければよいのか、といった疑問を持つ方も多いのではないでしょうか。
本記事では、Claude Haiku 5.5の定義や主な機能から、料金体系・ベンチマーク結果・effort設定・Sonnet/Opusとの使い分け、そして具体的な使い方や移行方法まで、JAPAN AIが網羅的に解説します。
\ ChatGPTもClaudeもGeminiも使える! /
Claude Haiku 5.5とは
Claude Haiku 5.5は、AI安全性研究企業Anthropicが2026年10月7日にリリースした小型AIモデルです。Claude 5.5ファミリーはOpus 5.5・Sonnet 5.5・Haiku 5.5の3モデルで構成されており、Haiku 5.5は最速・最安のポジションで大量処理やコスト重視のタスクに特化しています。
前世代のHaiku 4.5から約1年ぶりのアップデートであり、コンテキストウィンドウは20万トークンから100万トークンへ5倍に拡張されました。最大出力も128Kトークンに対応し、長文の処理能力が飛躍的に向上しています。さらに、Adaptive Thinking(適応型思考)を標準搭載しており、タスクの複雑さに応じて自動的に推論の深さを調整します。知識カットオフは2026年6月で、その時点までの情報をもとに回答を生成できます。
Haiku 5.5はAPI経由での大量リクエスト処理に最適化されているため、問い合わせの自動分類やデータ抽出、リアルタイム要約など、速度とコストの両方が求められる業務で特に力を発揮します。
Claudeの各モデルの違いや選び方については、「主要LLMを比較!GPT・Claude・Geminiの違いを徹底解説【2026年最新】」の記事で詳しく解説しています。
Claude Haiku 5.5の主な機能
Claude Haiku 5.5は、高速処理と低コストを両立しながら多様なタスクに対応できる小型モデルです。特にAPI経由での大量リクエスト処理に強みを持ち、以下の4つの領域で実用的な機能を発揮します。
- 短い要約や、長くなった会話の整理
- 問い合わせの分類や情報の抽出
- PCやブラウザを操作
- 安価なサブエージェントとして機能
短い要約や、長くなった会話の整理
Claude Haiku 5.5は、大量のテキストを短時間で要約する処理に適しています。100万トークンのコンテキストウィンドウを活かし、長大な会話履歴や文書をまとめて受け取り、要点を抽出できます。
チャットボットや社内ナレッジ基盤では、やり取りが長くなるほど文脈を保持するコストが膨らみます。Haiku 5.5を使えば、一定のターン数に達した会話履歴を圧縮(コンパクション)し、重要な情報だけを残して次のやり取りに引き継げます。この処理を低レイテンシで実行できるため、ユーザーが待ち時間を感じることなく自然な対話体験を維持できます。
議事録の要約やレポートの要点整理など、繰り返し発生する定型的な要約タスクをHaiku 5.5に任せることで、処理速度を維持しながらAPI利用コストを抑えられます。
問い合わせの分類や情報の抽出
カスタマーサポートの問い合わせを自動分類し、適切な担当部署へ振り分ける処理は、Claude Haiku 5.5が得意とする領域です。テキストの意図を素早く判定し、カテゴリやラベルを付与する分類タスクでは、高速な応答が求められます。
具体的には、メールや問い合わせフォームから届くテキストを受け取り、「返品」「技術サポート」「請求」といったカテゴリに即座に振り分けます。同様に、自由記述のアンケート回答や契約書などの非構造データから特定の情報(金額・日付・条件)を抽出する作業にも適しています。構造化された出力をJSON形式で返すよう指示すれば、後続のシステムと連携しやすい形でデータを整形できます。
1件あたりの処理コストが極めて低いため、日に数千件規模の問い合わせ処理でもコストを抑えながら安定した分類精度を維持できます。
PCやブラウザを操作
Claude Haiku 5.5は、コンピューター操作(computer use)機能に対応しており、デスクトップアプリケーションやWebブラウザをプログラム的に操作できます。画面のスクリーンショットを視覚的に解析し、クリックやキーボード入力といったアクションを実行する仕組みです。
この機能の強みは、APIが提供されていないレガシーシステムや社内Webアプリケーションとの連携にあります。たとえば、社内の勤怠管理システムにログインしてデータを取得したり、Webフォームに自動入力したりする作業を、Haiku 5.5がGUI操作として代行します。Haiku 4.5でもcomputer use機能は搭載されていましたが、Haiku 5.5ではブラウザ自動操作やGUIベースのワークフロー実行の精度と完了率が大幅に改善されています。
GUI操作の自動化をHaiku 5.5の低コストで実行できるため、従来はRPAツールに頼っていた定型作業を、より柔軟なAI駆動の自動化へ置き換える選択肢が広がります。
安価なサブエージェントとして機能
Opus 5.5やSonnet 5.5をメインのAIエージェントとして使い、Haiku 5.5をサブエージェントとして組み合わせるマルチエージェント構成は、コストと性能のバランスを最適化する実践的な手法です。
マルチエージェント構成では、上位モデルが全体のタスクを分割し、個々のサブタスクをHaiku 5.5に委任します。たとえば、Opus 5.5が複雑な分析レポートの構成を設計し、個別セクションの下書き・データ検証・フォーマット整形といった作業をHaiku 5.5が並列で処理する流れです。サブタスク1件あたりのコストが低いため、数十のサブタスクを同時に実行しても全体のAPI利用料を抑えられます。
1回の呼び出しコストが極めて低いHaiku 5.5をサブエージェントに配置することで、処理の並列化とコスト削減を同時に実現でき、エージェントシステム全体の費用対効果を高められます。
AIエージェントの業務活用なら「JAPAN AI AGENT」
企業の業務効率化にAIエージェントを活用するなら、JAPAN AI AGENTが最適です。JAPAN AI AGENTは、議事録作成・リサーチ・資料作成・問い合わせ対応など、約100種類のAIエージェントをすぐに利用でき、自社独自のエージェントもノーコードで作成可能です。ISMS認証・Pマーク取得済みの上場グループ企業が運営しており、入力データがLLMの学習に利用されることはありません。専任カスタマーサクセスが導入から定着まで伴走するため、AI活用の全社展開を安心して進められます。
Claude Haiku 5.5の料金
Claude Haiku 5.5のAPI料金は、1リクエストあたりの入力トークン数が10万トークンを境に2段階で変動する構造です。10万トークン以下では前世代Haiku 4.5の10分の1という低価格を実現しながら、10万トークンを超えると入力・出力ともに5倍に上昇します。以下のH3でそれぞれの料金帯と、実コストに影響するトークナイザーの変更点を解説します。
10万トークン以下のプロンプト
1リクエストの入力トークン数が10万トークン以下の場合、Claude Haiku 5.5の料金は以下のとおりです。
| 項目 | Haiku 5.5(10万トークン以下) | Haiku 4.5 |
|---|---|---|
| 入力 | $0.10 / 100万トークン | $1.00 / 100万トークン |
| 出力 | $0.50 / 100万トークン | $5.00 / 100万トークン |
入力・出力ともにHaiku 4.5の10分の1の単価であり、90%のコスト削減を意味します。短いプロンプトで大量のリクエストを処理するユースケース、たとえば問い合わせ分類やテキスト抽出では、この基本料金帯が適用されるためコストメリットが最大化されます。
入力10万トークン以下のリクエストに限れば、Haiku 5.5のコストはHaiku 4.5比で90%安い計算です。短文処理を大量に行うワークロードほど、この価格差が費用対効果に直結します。
10万トークンを超えるプロンプト
1リクエストの入力トークン数が10万トークンを超えると、入力・出力ともに料金が基本料金の5倍に跳ね上がります。
| 項目 | Haiku 5.5(10万トークン超) | Haiku 4.5 |
|---|---|---|
| 入力 | $0.50 / 100万トークン | $1.00 / 100万トークン |
| 出力 | $2.50 / 100万トークン | $5.00 / 100万トークン |
10万トークンを超えても、Haiku 4.5と比べると入力は50%安、出力も50%安で利用できます。ただし、基本料金帯と比較すると一気に5倍の単価が適用されるため、100万トークンのコンテキストウィンドウをフル活用する場合はコスト設計に注意が必要です。
長文プロンプトを扱う場合は、入力を10万トークン以下に抑える工夫、具体的には不要な文脈の削除や要約済みテキストの利用、プロンプトキャッシュの活用などを取り入れて、基本料金帯で処理できるよう設計しましょう。なお、10万トークンの判定にはプロンプトキャッシュの読み取り・書き込み分も含めた全入力トークンが算入されるため、キャッシュを使っても料金帯そのものは下がりません。
新しいトークナイザーが実コストを押し上げる理由
Claude 5.5世代ではトークナイザーが刷新されており、同じテキストを処理してもHaiku 4.5とはトークン数が異なる場合があります。特に日本語テキストでは、新トークナイザーによって同じテキストでもトークン数が増加する傾向が報告されています。
トークナイザーとは、テキストをモデルが処理できる最小単位(トークン)に分割する仕組みです。同じ文章でも分割ルールが変わればトークン数は変化し、同じテキストでもHaiku 4.5とはトークン数が異なる場合があります。見かけの単価が下がっても、トークン数が増えれば実効的な処理コストは単価の下落幅ほどには安くならない点に注意が必要です。
Anthropicは「Haiku 4.5比で実行コストが平均約75%低下」と発表していますが、これは実際のワークロードに基づく平均値であり、算定方法の内訳は公開されていません。単価の下げ幅(10万トークン以下で90%減)より控えめな数字になっているのは、段階料金とトークン数の増加が影響していると考えられます。移行前に、実際の業務データでトークン数の変化を計測してから費用を見積もりましょう。
Claude Haiku 5.5のベンチマーク結果
Claude Haiku 5.5は、Haiku 4.5から知的作業・コンピューター操作・開発タスクの3領域でベンチマークスコアを大幅に向上させています。Artificial Analysis(AA)のIntelligence Indexでは、Haiku 5.5のデフォルト設定(effort: medium)で34.5を記録しており、Haiku 4.5の16.9から約2倍の伸びを示しています。以下のH3では、各ベンチマーク領域ごとの結果を紹介します。
コンピューター操作:OSWorld 2.1
OSWorld 2.1は、AIモデルがデスクトップOS上で実際のアプリケーションを操作し、指示されたタスクを完了できるかを評価するベンチマークです。Webブラウザ操作やファイル管理、複数アプリケーション間の連携など、現実の業務に近い操作シナリオが出題されます。
Haiku 5.5は、computer use機能の精度と完了率を大幅に向上させ、OSWorldのスコアを押し上げています。Haiku 4.5でも同機能は搭載されていましたが、スコアは15.7%にとどまっていました。Haiku 5.5はOSWorld 2.1のオフラインサブセットで72.4%まで向上しており、Haiku 4.5の15.7%から約4.6倍の改善を達成しています。ブラウザの自動操作やGUIベースのワークフロー実行において、小型モデルとしては突出した完了率です。
OSWorldのスコアがHaiku 4.5の15.7%から72.4%へ飛躍したことは、コンピューター操作タスクにおいて小型モデルでも実用水準に達したことを示しており、computer use用途を検討する際の判断材料の一つといえます。
出典:Anthropic「Claude Haiku 5.5」公式発表(OSWorld 2.1 オフラインサブセット)
知的作業:GDPval-AA v2.1
GDPval-AA v2.1は、実在する多様な職業で専門家が作成する成果物をAIがどこまで再現できるかを評価する、実務志向のベンチマークです。Artificial Analysisが独自に再構成した版で、AA Intelligence Indexの構成要素にもなっています。
Haiku 5.5はGDPval-AA v2.1で1,620を記録し、Haiku 4.5の735から2倍以上に伸びました。知的作業全体の総合力は、同ベンチマークを含む10種の評価を統合したAA Intelligence Indexで把握できます。
effort設定をmaxに引き上げると43.4、デフォルトのmediumでも34.5を記録しており、Haiku 4.5(16.9)の2倍以上のスコアです。effort設定によって推論の深さを段階的に調整できるため、タスクの複雑さに応じて性能とコストのバランスを最適化できます。
| effort設定 | Haiku 5.5(AA Intelligence Index) |
|---|---|
| max | 43.4 |
| xhigh | 41.2 |
| high | 37.8 |
| medium(デフォルト) | 34.5 |
| low | 29.4 |
effort設定をmediumからmaxに変更するだけで約26%のスコア向上が得られるため、品質が求められるタスクではeffortを引き上げることで、回答品質を調整できるでしょう。
出典:Artificial Analysis「Intelligence Index」
開発作業:Terminal-Bench 4.0
Terminal-Bench 4.0は、エージェント型コーディングタスクにおけるAIモデルの実力を評価するベンチマークです。ターミナル上でのコマンド実行、コード生成・修正、テスト実行の一連のワークフローが評価対象です。
Haiku 5.5はTerminal-Bench 4.0で39.2%を記録し、0.0%だったHaiku 4.5から大きく改善しました。Claude Codeをはじめとするエージェント型コーディングツールのバックエンドとして利用できる水準に達しています。サブエージェントとしてコードレビューやテスト実行を低コストで並列処理する使い方が想定されており、開発ワークフロー全体のスループットを高めます。
ただし同ベンチマークのSonnet 5.5(70.6%)とは依然として差があるため、実装の中核はSonnet以上に任せ、Haiku 5.5はコードレビューやテスト実行といったサブタスクの並列処理に割り当てる構成が現実的です。
考える量を変えて、コストと性能を調整できる
Claude Haiku 5.5には、推論の深さを5段階で調整するeffort設定が搭載されています。effort設定はlow・medium・high・xhigh・maxの5段階で、デフォルトはmediumです。effortを上げるほどモデルがより多くの思考トークンを消費して回答精度を高め、effortを下げるほど思考トークンが減ってコストと応答速度が改善されます。
この仕組みのポイントは、同じモデルを使いながらタスクの性質に応じてコストと性能を柔軟に切り替えられる点です。たとえば、問い合わせの分類やテキスト抽出のような定型タスクはeffortをlowに設定して高速・低コストで処理し、複雑な分析や判断が必要なタスクではeffortをhighやmaxに引き上げて精度を確保する、といった使い分けが可能です。
effort設定はAPIリクエストのパラメータとして指定できるため、1つのアプリケーション内でタスクごとに異なるeffort値を動的に切り替える実装も容易です。コスト最適化を進めるうえで、まずはmediumで試し、精度が不足する場合にhigh以上へ段階的に引き上げていくアプローチを試してください。
Sonnet 5.5・Opus 5.5との違いと使い分け
Claude 5.5ファミリーの3モデルは、性能・速度・コストのバランスが明確に異なります。タスクの複雑さに応じて適切なモデルを選択することで、品質を維持しながらAPI利用コストを最適化できます。
| 項目 | Haiku 5.5 | Sonnet 5.5 | Opus 5.5 |
|---|---|---|---|
| 入力料金(100万トークン) | $0.10〜 | $2.00 | $4.00 |
| 出力料金(100万トークン) | $0.50〜 | $10.00 | $20.00 |
| コンテキストウィンドウ | 100万トークン | 100万トークン | 100万トークン |
| 速度 | 最速 | 中速 | 低速 |
| 推奨タスク | 分類・抽出・要約・サブエージェント | 汎用タスク・コーディング・文書作成 | 高度な推論・創造的タスク・複雑な分析 |
使い分けの基本方針は「答え合わせができる仕事はHaiku、判断が必要な仕事はSonnet以上」です。問い合わせ分類やデータ抽出のように正解が明確なタスクでは、Haiku 5.5の低コスト・高速処理が適しています。一方、戦略立案やクリエイティブな文章生成のように正解が一意に定まらないタスクでは、SonnetやOpusの高い推論力が品質の差として表れます。
マルチエージェント構成を採用する場合は、Opusを全体設計と最終判断に、Sonnetを中核的なタスク処理に、Haiku 5.5をサブタスクの並列実行にそれぞれ割り当てることで、品質と費用のバランスを最適化できます。
ChatGPTとClaudeの機能・料金の違いについて詳しく知りたい方は、「ChatGPTとClaudeの違いを徹底比較!機能・料金・用途別の使い分けガイド」の記事もあわせてご覧ください。
Claude Haiku 5.5の使い方
Claude Haiku 5.5は、Webブラウザからの直接利用とAPI経由の2つの方法で利用できます。用途に応じて最適な利用方法を選びましょう。
画面からHaiku 5.5を選ぶ

Claude Haiku 5.5は、Anthropicが提供する公式Webインターフェース(claude.ai)から利用できます。無料プランでもHaiku 5.5を利用可能です。利用手順は以下のとおりです。
- claude.aiにアクセスしてログインする
- チャット画面のモデル選択メニューをクリックする
- 表示されるモデル一覧から「Claude Haiku 5.5」を選択する
- メッセージを入力して送信する
モデル選択メニューには、Fable 5.1・Opus 5.5・Sonnet 5.5・Haiku 5.5が並んで表示されます。会話の途中でもモデルを切り替えられるため、回答の速度や深さを見ながら柔軟に使い分けてください。
APIから使う場合
API経由でHaiku 5.5を利用する場合は、モデルIDとして「claude-haiku-5-5」を指定します。このIDはHaiku 5.5を指定する固定モデルIDです。
Python SDKでの基本的な呼び出し例は以下のとおりです。
import anthropic
client = anthropic.Anthropic()
message = client.messages.create(
model="claude-haiku-5-5",
max_tokens=1024,
messages=[
{"role": "user", "content": "Claude Haiku 5.5の特徴を教えてください"}
]
)
print(message.content)
Amazon Bedrockでは「anthropic.claude-haiku-5-5」というモデルIDで利用できます。Google CloudやMicrosoft Foundryでも「claude-haiku-5-5」で指定可能です。effortはoutput_config.effortで指定し、値はeffortレベル(low / medium / high / xhigh / max)を追加してください。
Haiku 4.5からの移行方法
Haiku 4.5から5.5へ移行する際には、モデルID・思考機能・effort設定・トークナイザー・サンプリングパラメータ・プレフィル/budget_tokens・computer useツールセットの7つの変更点を確認してください。移行時に確認すべきポイントは以下のとおりです。
- モデルIDの変更: Haiku 4.5のモデルIDを「claude-haiku-5-5」に書き換える
- 思考機能がデフォルトでオン: Haiku 5.5ではAdaptive Thinkingが常時有効で、思考トークンが自動生成される。思考トークンは出力トークンとして課金され、オフにはできないため、コストを抑えたい場合はeffortをlowに下げて対応する(Haiku 4.5で使えたbudget_tokensによる手動指定も利用できない)
- effortの既定値の違い: Haiku 5.5のデフォルトeffortはmediumであり、Haiku 4.5にはなかった設定項目のため、レスポンス品質やトークン消費量が変わる可能性がある
- トークナイザーの変更: 新しいトークナイザーにより、同じテキストでもトークン数が変わる場合がある。移行前に実データでトークン数を比較測定する
- temperature・top_p・top_kが非対応: Haiku 5.5ではこれらのサンプリングパラメータが廃止されている。既存コードでこれらを指定している場合はパラメータを削除する必要がある
- assistantプレフィルとbudget_tokensが非対応: Haiku 5.5はassistantメッセージによる出力プレフィルと、thinking.budget_tokensの手動指定を受け付けない。該当する実装は削除し、思考量の制御はeffort設定に置き換える
- computer useのツールセット更新: コンピューター操作機能を使う場合はcomputer_toolset_20260801を指定する。旧ツールセットのままではリクエストが失敗する
移行の推奨手順としては、まず代表的なタスクを20〜30件選び、同じプロンプトでHaiku 4.5とHaiku 5.5の出力を並べて比較する方法が効果的です。出力形式やトーンの違いで後続処理が壊れないかを確認したうえで、段階的にトラフィックを移行しましょう。
Claude Haiku 5.5に関してよくある質問
トークン単価が90%下がったのに、平均75%安いにとどまるのはなぜですか?
10万トークン以下のリクエストでは確かに90%安いですが、10万トークンを超えると入力・出力ともに5倍の割増料金が適用されます。さらに、新トークナイザーの影響で同じテキストのトークン数が増える場合があるため、見かけの単価以上にトークンを消費します。これらを総合すると、実効ベースでの平均コスト削減は約75%です。
Claude Haiku 5.5はClaude Sonnet 5.5より優れていますか?
速度とコストではHaiku 5.5が大幅に優れていますが、複雑な推論・長文生成・創造的タスクではSonnet 5.5の方が高い品質を発揮します。タスクの複雑さに応じた使い分けが最適であり、定型処理にはHaiku 5.5、判断を伴う業務にはSonnet 5.5を選択しましょう。
Claude Haiku 5.5のモデルIDは何ですか?
Claude APIで指定するモデルIDは「claude-haiku-5-5」です。Amazon Bedrockでは「anthropic.claude-haiku-5-5」、Google CloudやMicrosoft Foundryでは「claude-haiku-5-5」で指定してください。
Claude Haiku 5.5の総評
Claude Haiku 5.5は、大量処理×コスト削減を両立させる小型AIモデルの最適解です。入力10万トークン以下ではHaiku 4.5比で90%安、10万トークンを超えても50%安で利用でき、コンテキストウィンドウは100万トークン、effort設定で性能を5段階に調整できます。
分類・抽出・要約などの定型処理を大量にこなすワークロードでは、Haiku 5.5のコストパフォーマンスが際立ちます。マルチエージェント構成のサブエージェントとしても有力な選択肢であり、Opus 5.5やSonnet 5.5と組み合わせることで、品質とコストのバランスを柔軟に調整できます。
次のステップとして、Haiku 5.5を試す際にはeffort設定をmediumから始め、タスクに応じてeffort値を調整しながら最適な設定を見つけてください。既にHaiku 4.5を利用している場合は、代表タスクでの並行テストを実施し、出力品質とトークン数の変化を確認したうえで段階的に移行を進めましょう。
JAPAN AIとは
JAPAN AIは、法人向けの国産生成AIプラットフォームです。AIチャット・議事録・エージェントなどのすぐ使える標準機能から、自社専用AIアプリのノーコード開発まで、全部門のAI活用をひとつの基盤で支えます。ジーニーグループのこれまでのDX・AX支援実績をもとに、ツールの提供にとどまらず、活用テーマの設計から現場での定着・成果創出まで専門チームが伴走します。
JAPAN AIの機能・活用事例・料金体系がわかるサービス紹介資料を無料でお送りします。
▼資料イメージ
- JAPAN AIでできること(AIチャット/議事録/エージェント/アプリ開発 ほか)
- ChatGPTなど汎用AIツールとの違い
- 業種・部門別の活用シーンと導入事例
- 導入から定着までの支援体制
- 料金体系とセキュリティ・ガバナンス対応
▼簡単1分!JAPAN AIの資料請求




