2026 年 10 月 7 日リリース——ベンダー公表値を 2026 年 10 月 8 日に確認

Claude Haiku 5.5 のベンチマークと料金

Anthropic 最小・最速ティアの全面刷新:100万トークンあたり $0.10/$0.50、1M コンテキスト、Haiku 初の可変 effort パラメータ——そして 10万トークン超で費用が逆転する段階課金。

Haiku 5.5 早見表

Claude Haiku 5.5(claude-haiku-5-5)は 2026 年 10 月 7 日リリース。入力 100万トークンあたり $0.10、出力 $0.50 で、GPT-6 Luna の基本料金と同額、Anthropic は Haiku 4.5 より実行コストが約 75% 低いとしています。Haiku で初めて可変 effort パラメータに対応し(adaptive 思考、既定は medium)、公表された全ベンチマークで Haiku 4.5 を大きく上回ります:GDPval-AA v2.1 は 1620 対 735、Terminal-Bench 4.0 は 39.2% 対 0.0%。注意点はプロンプト長で、10万トークンを超えると料率が 5 倍($0.50/$2.50)に跳ね上がり、超長文では GPT-6 Luna より安くなくなります。1M コンテキスト、最大出力 128K、知識カットオフは 2026 年 6 月。

Claude Haiku 5.5 の仕様と料金表

基本料率と仕様は Anthropic の料金ページとモデルドキュメントから取得(2026 年 10 月 8 日確認)。10万トークン超のプロンプトは次節の上位段階で課金されます。

項目Claude Haiku 5.5
リリース2026-10-07
API モデル IDclaude-haiku-5-5
入力(100万トークンあたり、プロンプト 10万以下)$0.10
出力(100万トークンあたり、プロンプト 10万以下)$0.50
キャッシュヒット$0.01
キャッシュ書き込み(5分)$0.125
キャッシュ書き込み(1時間)$0.20
Batch(入力 / 出力)$0.05 / $0.25
コンテキスト窓1M
最大出力(Batch ベータは最大 300K)128K
知識カットオフ2026 年 6 月
思考adaptive 思考(effort で制御)
既定 efforteffort パラメータ、既定は medium
提供先Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry、Claude Platform on AWS
トークナイザー新しいトークナイザー(Claude 4.7 以降):同じテキストが Haiku 4.5 より約 30% 多くのトークンに
データ保持料金ページに記載なし

上表の料率はすべて当サイトの MODEL_REGISTRY から読み出し、2026-10-08 に Anthropic 料金ページと照合しています(100万トークンあたり USD)。Batch API は入力・出力とも 50% で、Anthropic の Batch ベータは 1 リクエスト最大 30万出力トークンに対応します。

10万トークン超の崖:基本料率の 5 倍

Haiku 5.5 は当サイトで段階課金を公表した初の Anthropic モデルです。プロンプト 10万トークンまでは基本段階、それを超えるとキャッシュ読み取りを含む全料率が 5 倍になります。

料率プロンプト 10万トークン以下プロンプト 10万トークン超
基本段階に対する倍率1x5x
入力(100万トークンあたり)$0.10$0.50
出力(100万トークンあたり)$0.50$2.50
キャッシュヒット$0.01$0.05
キャッシュ書き込み(5分)$0.125$0.625
キャッシュ書き込み(1時間)$0.20$1.00

プロンプトが 100K トークンまでなら基本料率、超えると入力料率が 5 倍の 100万トークンあたり $0.50 に跳ね上がります。一方 GPT-6 Luna は 272K プロンプトトークンまで $0.10 を維持します。つまり 100K〜272K では Haiku 5.5 の入力コストは Luna の約 5 倍、272K を超えると Luna が $0.20 に倍増する一方で Haiku は 5 倍段階のままなので、超長文では Luna のほうが安くなります。Haiku 4.5 へのリクエストの約 90% は 10万トークン未満とされ、多くの用途は上位段階に届きません。

Haiku 5.5 のベンチマーク:Haiku 4.5・GPT-6 Luna・Sonnet 5.5 との比較

2026 年 10 月 7 日の Anthropic リリース記事に掲載された 7 評価。ベンダー公表で複数のスイートをまとめたもので、各行の手法は Haiku 5.5 システムカードに記載されています。Anthropic の数値として扱い、独立検証の結果とは考えないでください。

ベンチマークClaude Haiku 5.5Claude Haiku 4.5GPT-6 LunaClaude Sonnet 5.5
GDPval-AA v2.1(ナレッジワーク)162073514371840
AA-Briefcase v1.1157861413361824
OSWorld 2.1 オフラインサブセット(コンピュータ操作)72.4%15.7%48.9%83.9%
Humanity’s Last Exam(ツールなし / あり)45.9% / 57.4%10.2% / 18.7%未公表56.9% / 64.5%
Terminal-Bench 4.0(エージェント型コーディング)39.2%0.0%16.4%70.6%
FrontierCode 1.1 Main46.4%未公表42.4%52.1% (Xhigh)
Chartography(視覚推論、ツールなし)46.4%6.4%29.1%61.6%

出典:Anthropic「Claude Haiku 5.5」リリース記事、2026-10-07(ベンダー公表、独立検証なし)。Haiku 5.5 は公表された全項目で Haiku 4.5 を上回り、差が最も大きいのは Terminal-Bench 4.0(39.2% 対 0.0%)と OSWorld 2.1(72.4% 対 15.7%)です。両方の数値がある項目では Sonnet 5.5 が依然トップ、GPT-6 Luna はその中間です。

Claude Haiku 5.5 と Haiku 4.5 の違い:何が変わったか

同じ仕事をはるかに速く——ただし表示価格の割引が請求額のすべてではありません。

  • 基本料金は $1/$5 から $0.10/$0.50 へ

    Haiku 4.5 は 100万トークンあたり入力 $1・出力 $5、Haiku 5.5 は $0.10/$0.50 で、入力は 10 分の 1 です。キャッシュヒットは $0.10 から $0.01、5分キャッシュ書き込みは $1.25 から $0.125 に下がり、Batch は半額の $0.05/$0.25 です。

  • 同じテキストが約 30% 増のトークンに

    Claude 4.7 以降と共通の新しいトークナイザーにより、同じテキストは Haiku 4.5 の約 30% 増のトークンになります。大量処理のパイプラインを移す前に、表示価格だけでなくこの係数で予算を試算してください。

  • ベンチマークは小さな一歩ではない

    ベンダー公表の伸びは GDPval-AA v2.1 の 1620 対 735 から Terminal-Bench 4.0 の 39.2% 対 0.0% まで及びます。図表能力の差が最も際立つのは Chartography の 46.4% 対 6.4% です。

  • コンテキストは 200K から 1M へ

    Haiku 4.5 の窓は 200K、Haiku 5.5 は 1M に拡大し、最大出力は 128K のままです。長文ドキュメントやエージェントの会話ログも分割せずに収まりますが、10万トークン超のプロンプトは 5 倍段階で課金されます。

Anthropic は Haiku 5.5 の実行コストが Haiku 4.5 より約 75% 低いとしています。ベンチマークの差もそれを裏付けます。ただしトークナイザーに注意が必要です。Haiku 5.5 は Claude 4.7 以降と同じ新しいトークナイザーを使うため、同じテキストが Haiku 4.5 より約 30% 多くのトークンとして数えられます。つまり「約 75% 安い」という表示価格は、請求額が 75% 安いことを意味しません。2026-10-08 時点の基本料率は 100万トークンあたり $0.10/$0.50 で、多くの用途では依然 Haiku 4.5 を大きく下回ります。

可変 effort:Haiku で初

adaptive 思考と effort パラメータ、既定は medium——Haiku 4.5 にはなかった制御です。

  • 可変 effort に対応した初の Haiku

    従来の Haiku に effort 制御はありませんでした。Haiku 5.5 では利用でき、同じモデルで安価な分類とエージェント処理を兼ねる場合に特に効きます。

  • 既定 effort:medium

    パラメータを明示しない限り、リクエストは medium で実行されます。Anthropic のドキュメントは effort を、品質と遅延・コストを天秤にかける公式の手段として挙げています。

  • adaptive 思考

    思考は常時オンではなく adaptive です。モデルがリクエストごとに推論量を決め、effort がその予算の上限を定めます。

  • つまみを動かす場面

    大量・低遅延の処理(分類、ルーティング、抽出、コンテキスト圧縮)は low effort、多段階のコーディングや調査は high effort に。実際に選んだ effort で再計測し、リリース記事の数値がそのまま当てはまると考えないでください。

Anthropic は Haiku 5.5 を「可変 effort パラメータを備えた初の Haiku」としています。adaptive 思考と組み合わせることで、固定コストの分類器が調整つまみになります。ルーティング・抽出・圧縮は low effort、本格的な推論が必要なタスクは high effort。既定は medium です。

Haiku 5.5 の提供先

モデル ID とプラットフォーム、2026 年 10 月 8 日確認。

  • Claude API

    モデル ID は claude-haiku-5-5。基本料率は 100万トークンあたり入力 $0.10/出力 $0.50、キャッシュヒット $0.01、キャッシュ書き込み $0.125(5分)/$0.20(1時間)、Batch $0.05/$0.25。

  • Amazon Bedrock

    anthropic.claude-haiku-5-5 として提供され、段階料率も同じです。

  • Google Cloud、Microsoft Foundry、Claude Platform on AWS

    Anthropic は自社 API と Bedrock に加え、この 3 つでも提供するとしています。正確な識別子は各プラットフォームのモデル一覧で確認してください。

  • Batch API

    Batch は入力・出力とも 50% で、Anthropic のベータでは 1 リクエスト最大 30万出力トークンに対応します。

このページの最終確認は 2026-10-08 です。モデル料率・段階のしきい値・提供先は動きが速いため、Anthropic の料金ページと Haiku 5.5 のモデルドキュメントを正としてください。

Haiku 5.5 の請求額を試算

Haiku 5.5 は安価ですが、プロンプトが 10万トークンを超えると料率が 5 倍になります。実際のプロンプト長とキャッシュヒット率をコスト計算ツールで試算してから移行を判断してください。

よくある質問