2026 年 10 月 7 日リリース——ベンダー公表値を 2026 年 10 月 8 日に確認
Claude Haiku 5.5 のベンチマークと料金
Anthropic 最小・最速ティアの全面刷新:100万トークンあたり $0.10/$0.50、1M コンテキスト、Haiku 初の可変 effort パラメータ——そして 10万トークン超で費用が逆転する段階課金。
Haiku 5.5 早見表
Claude Haiku 5.5(claude-haiku-5-5)は 2026 年 10 月 7 日リリース。入力 100万トークンあたり $0.10、出力 $0.50 で、GPT-6 Luna の基本料金と同額、Anthropic は Haiku 4.5 より実行コストが約 75% 低いとしています。Haiku で初めて可変 effort パラメータに対応し(adaptive 思考、既定は medium)、公表された全ベンチマークで Haiku 4.5 を大きく上回ります:GDPval-AA v2.1 は 1620 対 735、Terminal-Bench 4.0 は 39.2% 対 0.0%。注意点はプロンプト長で、10万トークンを超えると料率が 5 倍($0.50/$2.50)に跳ね上がり、超長文では GPT-6 Luna より安くなくなります。1M コンテキスト、最大出力 128K、知識カットオフは 2026 年 6 月。
Claude Haiku 5.5 の仕様と料金表
基本料率と仕様は Anthropic の料金ページとモデルドキュメントから取得(2026 年 10 月 8 日確認)。10万トークン超のプロンプトは次節の上位段階で課金されます。
| 項目 | Claude Haiku 5.5 |
|---|---|
| リリース | 2026-10-07 |
| API モデル ID | claude-haiku-5-5 |
| 入力(100万トークンあたり、プロンプト 10万以下) | $0.10 |
| 出力(100万トークンあたり、プロンプト 10万以下) | $0.50 |
| キャッシュヒット | $0.01 |
| キャッシュ書き込み(5分) | $0.125 |
| キャッシュ書き込み(1時間) | $0.20 |
| Batch(入力 / 出力) | $0.05 / $0.25 |
| コンテキスト窓 | 1M |
| 最大出力(Batch ベータは最大 300K) | 128K |
| 知識カットオフ | 2026 年 6 月 |
| 思考 | adaptive 思考(effort で制御) |
| 既定 effort | effort パラメータ、既定は medium |
| 提供先 | Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry、Claude Platform on AWS |
| トークナイザー | 新しいトークナイザー(Claude 4.7 以降):同じテキストが Haiku 4.5 より約 30% 多くのトークンに |
| データ保持 | 料金ページに記載なし |
上表の料率はすべて当サイトの MODEL_REGISTRY から読み出し、2026-10-08 に Anthropic 料金ページと照合しています(100万トークンあたり USD)。Batch API は入力・出力とも 50% で、Anthropic の Batch ベータは 1 リクエスト最大 30万出力トークンに対応します。
10万トークン超の崖:基本料率の 5 倍
Haiku 5.5 は当サイトで段階課金を公表した初の Anthropic モデルです。プロンプト 10万トークンまでは基本段階、それを超えるとキャッシュ読み取りを含む全料率が 5 倍になります。
| 料率 | プロンプト 10万トークン以下 | プロンプト 10万トークン超 |
|---|---|---|
| 基本段階に対する倍率 | 1x | 5x |
| 入力(100万トークンあたり) | $0.10 | $0.50 |
| 出力(100万トークンあたり) | $0.50 | $2.50 |
| キャッシュヒット | $0.01 | $0.05 |
| キャッシュ書き込み(5分) | $0.125 | $0.625 |
| キャッシュ書き込み(1時間) | $0.20 | $1.00 |
プロンプトが 100K トークンまでなら基本料率、超えると入力料率が 5 倍の 100万トークンあたり $0.50 に跳ね上がります。一方 GPT-6 Luna は 272K プロンプトトークンまで $0.10 を維持します。つまり 100K〜272K では Haiku 5.5 の入力コストは Luna の約 5 倍、272K を超えると Luna が $0.20 に倍増する一方で Haiku は 5 倍段階のままなので、超長文では Luna のほうが安くなります。Haiku 4.5 へのリクエストの約 90% は 10万トークン未満とされ、多くの用途は上位段階に届きません。
Haiku 5.5 のベンチマーク:Haiku 4.5・GPT-6 Luna・Sonnet 5.5 との比較
2026 年 10 月 7 日の Anthropic リリース記事に掲載された 7 評価。ベンダー公表で複数のスイートをまとめたもので、各行の手法は Haiku 5.5 システムカードに記載されています。Anthropic の数値として扱い、独立検証の結果とは考えないでください。
| ベンチマーク | Claude Haiku 5.5 | Claude Haiku 4.5 | GPT-6 Luna | Claude Sonnet 5.5 |
|---|---|---|---|---|
| GDPval-AA v2.1(ナレッジワーク) | 1620 | 735 | 1437 | 1840 |
| AA-Briefcase v1.1 | 1578 | 614 | 1336 | 1824 |
| OSWorld 2.1 オフラインサブセット(コンピュータ操作) | 72.4% | 15.7% | 48.9% | 83.9% |
| Humanity’s Last Exam(ツールなし / あり) | 45.9% / 57.4% | 10.2% / 18.7% | 未公表 | 56.9% / 64.5% |
| Terminal-Bench 4.0(エージェント型コーディング) | 39.2% | 0.0% | 16.4% | 70.6% |
| FrontierCode 1.1 Main | 46.4% | 未公表 | 42.4% | 52.1% (Xhigh) |
| Chartography(視覚推論、ツールなし) | 46.4% | 6.4% | 29.1% | 61.6% |
出典:Anthropic「Claude Haiku 5.5」リリース記事、2026-10-07(ベンダー公表、独立検証なし)。Haiku 5.5 は公表された全項目で Haiku 4.5 を上回り、差が最も大きいのは Terminal-Bench 4.0(39.2% 対 0.0%)と OSWorld 2.1(72.4% 対 15.7%)です。両方の数値がある項目では Sonnet 5.5 が依然トップ、GPT-6 Luna はその中間です。
Claude Haiku 5.5 と Haiku 4.5 の違い:何が変わったか
同じ仕事をはるかに速く——ただし表示価格の割引が請求額のすべてではありません。
基本料金は $1/$5 から $0.10/$0.50 へ
Haiku 4.5 は 100万トークンあたり入力 $1・出力 $5、Haiku 5.5 は $0.10/$0.50 で、入力は 10 分の 1 です。キャッシュヒットは $0.10 から $0.01、5分キャッシュ書き込みは $1.25 から $0.125 に下がり、Batch は半額の $0.05/$0.25 です。
同じテキストが約 30% 増のトークンに
Claude 4.7 以降と共通の新しいトークナイザーにより、同じテキストは Haiku 4.5 の約 30% 増のトークンになります。大量処理のパイプラインを移す前に、表示価格だけでなくこの係数で予算を試算してください。
ベンチマークは小さな一歩ではない
ベンダー公表の伸びは GDPval-AA v2.1 の 1620 対 735 から Terminal-Bench 4.0 の 39.2% 対 0.0% まで及びます。図表能力の差が最も際立つのは Chartography の 46.4% 対 6.4% です。
コンテキストは 200K から 1M へ
Haiku 4.5 の窓は 200K、Haiku 5.5 は 1M に拡大し、最大出力は 128K のままです。長文ドキュメントやエージェントの会話ログも分割せずに収まりますが、10万トークン超のプロンプトは 5 倍段階で課金されます。
Anthropic は Haiku 5.5 の実行コストが Haiku 4.5 より約 75% 低いとしています。ベンチマークの差もそれを裏付けます。ただしトークナイザーに注意が必要です。Haiku 5.5 は Claude 4.7 以降と同じ新しいトークナイザーを使うため、同じテキストが Haiku 4.5 より約 30% 多くのトークンとして数えられます。つまり「約 75% 安い」という表示価格は、請求額が 75% 安いことを意味しません。2026-10-08 時点の基本料率は 100万トークンあたり $0.10/$0.50 で、多くの用途では依然 Haiku 4.5 を大きく下回ります。
可変 effort:Haiku で初
adaptive 思考と effort パラメータ、既定は medium——Haiku 4.5 にはなかった制御です。
可変 effort に対応した初の Haiku
従来の Haiku に effort 制御はありませんでした。Haiku 5.5 では利用でき、同じモデルで安価な分類とエージェント処理を兼ねる場合に特に効きます。
既定 effort:medium
パラメータを明示しない限り、リクエストは medium で実行されます。Anthropic のドキュメントは effort を、品質と遅延・コストを天秤にかける公式の手段として挙げています。
adaptive 思考
思考は常時オンではなく adaptive です。モデルがリクエストごとに推論量を決め、effort がその予算の上限を定めます。
つまみを動かす場面
大量・低遅延の処理(分類、ルーティング、抽出、コンテキスト圧縮)は low effort、多段階のコーディングや調査は high effort に。実際に選んだ effort で再計測し、リリース記事の数値がそのまま当てはまると考えないでください。
Anthropic は Haiku 5.5 を「可変 effort パラメータを備えた初の Haiku」としています。adaptive 思考と組み合わせることで、固定コストの分類器が調整つまみになります。ルーティング・抽出・圧縮は low effort、本格的な推論が必要なタスクは high effort。既定は medium です。
Haiku 5.5 の提供先
モデル ID とプラットフォーム、2026 年 10 月 8 日確認。
Claude API
モデル ID は claude-haiku-5-5。基本料率は 100万トークンあたり入力 $0.10/出力 $0.50、キャッシュヒット $0.01、キャッシュ書き込み $0.125(5分)/$0.20(1時間)、Batch $0.05/$0.25。
Amazon Bedrock
anthropic.claude-haiku-5-5 として提供され、段階料率も同じです。
Google Cloud、Microsoft Foundry、Claude Platform on AWS
Anthropic は自社 API と Bedrock に加え、この 3 つでも提供するとしています。正確な識別子は各プラットフォームのモデル一覧で確認してください。
Batch API
Batch は入力・出力とも 50% で、Anthropic のベータでは 1 リクエスト最大 30万出力トークンに対応します。
このページの最終確認は 2026-10-08 です。モデル料率・段階のしきい値・提供先は動きが速いため、Anthropic の料金ページと Haiku 5.5 のモデルドキュメントを正としてください。
Haiku 5.5 の請求額を試算
Haiku 5.5 は安価ですが、プロンプトが 10万トークンを超えると料率が 5 倍になります。実際のプロンプト長とキャッシュヒット率をコスト計算ツールで試算してから移行を判断してください。