Claude Haiku 5.5が登場、API料金はHaiku 4.5の10分の1に
Anthropicは10月7日にClaude Haiku 5.5を発表。API料金は10万トークン以下でHaiku 4.5の10分の1、effort設定にも対応。公式ページと報道から整理します。
公的機関・公式資料などの一次情報と照合して作成しています。このサイトについて
ニュースの概要
米Anthropicは2026年10月7日(現地時間)、小型モデル「Claude Haiku 5.5」を発表しました。同社は、これまでに公開した小型モデルのなかで最も安く、最も速く、最も高性能なモデルだと説明しています。API料金は前世代の「Claude Haiku 4.5」より大きく下がり、同日にはSonnet 5.5のキャッシュ読み取り料金も半額になりました。
先に取り上げたOpus 5.5・Sonnet 5.5の発表(Claude Opus 5.5とSonnet 5.5が登場、価格と使い分けを整理)に続いて、Claude 5.5ファミリーの小型モデルが加わった形です。ここでは、公式の発表ページと、ITmediaの報道で確認できた範囲を整理します。
何が発表されたのか
公式の発表ページに書かれている主な内容は次のとおりです。
- モデルIDは「claude-haiku-5-5」です。
- 料金は100万トークンあたり、プロンプトが10万トークン以下のとき入力0.10ドル・出力0.50ドル、10万トークンを超えるとき入力0.50ドル・出力2.50ドルです。Haiku 4.5は入力1ドル・出力5ドルでした。
- 同社は、平均的な利用コストがHaiku 4.5より約75%低いと説明しています。脚注では、10万トークン以下は90%安、それを超える分は50%安とされています。
- 新しいトークナイザーにより、同じ作業でもトークン数がわずかに増えるとの注記があります。
- Sonnet 5.5のキャッシュ読み取り料金は、100万トークンあたり0.20ドルから0.10ドルに半額になりました。
- Haikuクラスで初めて、調整できる「effort」設定に対応しました。Low、Med、High、Xhigh、Maxの段階から、推論の深さを調整して、コストと精度のどちらを優先するかを選べます。
- Claude Platformのほか、Amazon Web Services、Google Cloud、Microsoft Azureを含む全プラットフォームで利用できるとされています。
性能について、公式ページは複数のベンチマークでHaiku 4.5を大きく上回ったとしています。たとえばコンピュータ操作を測る「OSWorld 2.1」(オフラインサブセット)では、Haiku 5.5が72.4%、Haiku 4.5が15.7%と示されています。一方、エージェント型コーディングを測る「Terminal-Bench 4.0」では、Haiku 5.5が39.2%で、Sonnet 5.5の70.6%には届きません。これらの数値は、Anthropicが自社の発表ページで公表したものです。
どんな用途に向くとされているか
Anthropicは、要約、会話履歴の圧縮、データベース照会、分類のような、繰り返しの多い大量処理や、コストを重視する用途を想定しています。Opus 5.5やSonnet 5.5の下で動くサブエージェントとして、コーディング作業に使うことも挙げています。通常速度では同社モデルのなかで最も速いとされ、ライブのカスタマーサポートやブラウザ操作のような、応答の速さが大切な用途にも向くとしています。
制限として、複雑なエージェント型コーディングにはSonnet 5.5やOpus 5.5のほうが向くと明記されています。また、Opusモデルの「Fast Mode」よりは遅いとされています。安全面では、アラインメント評価の多くでHaiku 4.5から改善したとされる一方、サイバーセキュリティと生物学の一部の用途には制限があり、より広い用途は、同社の検証プログラムへの申請で対応するとされています。
読者への影響
AIを仕事や学習で使う人のうち、とくにAPIで自分のツールやアプリを動かしている人に関係します。大量の文章を要約・分類する処理や、社内の問い合わせ対応のように、1回あたりの精度よりコストと速さが効く場面では、料金の差が大きく出る可能性があります。
一方、Claudeのアプリを画面から使うだけの人にとっては、モデルの選択肢が増える、という変化が中心です。ITmedia NEWSは、無料プランを含むClaudeアプリで選べると報じています。どのモデルがどのプランで、どの画面から選べるかは、利用中の画面で確認してください。
確認すること
- 自分の用途で使っているモデルと、1か月のトークン量を把握する。料金の差は、トークン量が多いほど大きくなります。
- 料金は「10万トークン以下」と「超える場合」で単価が異なる。長い資料を一度に読ませる使い方では、後者の単価が当たります。
- トークナイザーが新しくなっており、同じ文章でもトークン数が変わる可能性がある。実際の請求は、切り替え後に確認します(日本語のトークンの考え方は日本語とトークン数|日本語が英語よりトークンを多く使う理由と費用・上限への影響も参考になります)。
- 置き換える前に、自分のデータで精度を試す。ベンチマークの数値は、あくまで発表側が示した条件でのものです。
- 移行手順は、Anthropicのマイグレーションガイドに載っているとされています。
筆者の見解
私見では、今回の発表で注目したいのは、単価の安さよりも、「小型モデルを部品として組み込む」使い方が前提になっている点だと考えます。公式ページは、Haiku 5.5をOpus 5.5やSonnet 5.5のサブエージェントとして想定しています。大きなモデルが計画を立て、小さなモデルが大量の下請け作業をこなす構成では、全体のコストはモデル単価だけでは決まらず、どこまでを小型モデルに任せるかの設計で変わります。
また、effort設定が加わったことで、「モデルを替える」以外にも、同じモデルの中でコストと精度を調整する手段が増えました。ベンチマークの差が大きい項目ほど、実際の業務でどこまで当てはまるかは、手元のデータで確かめるのが確実だと思います。料金が下がったからという理由だけで、精度の確認を省くのは避けたいところです。
出典(一次情報)
- Claude Haiku 5.5(Anthropic、2026年10月7日)
- Anthropic、「Claude Haiku 5.5」のAPI料金を「Haiku 4.5」の10分の1に(ITmedia AI+、2026年10月8日)
- Anthropic、「Claude Haiku 5.5」公開(ITmedia NEWS、2026年10月8日)
2026年10月8日時点の情報です。
本記事は一般的な情報の提供を目的としています。AIのサービス・機能・料金・仕様は頻繁に更新されるため、最新の内容は各社の公式ドキュメントでご確認ください。「筆者の見解」は一つの考え方です。