2026 年 10 月 7 日发布——厂商数据核对于 2026 年 10 月 8 日

Claude Haiku 5.5 基准测试与价格

Anthropic 最便宜、最快的一档全面换代:每百万 token $0.10/$0.50、1M 上下文,首个支持可调 effort 的 Haiku——以及 10 万 token 提示分档带来的成本反转。

Haiku 5.5 速览

Claude Haiku 5.5(claude-haiku-5-5)于 2026 年 10 月 7 日发布,每百万输入 token $0.10、输出 $0.50——与 GPT-6 Luna 的基础价相同,官方称运行成本比 Haiku 4.5 低约 75%。它是首个支持可调 effort 参数的 Haiku(adaptive 思考,默认 medium),在官方公布的每一项基准上都远超 Haiku 4.5:GDPval-AA v2.1 为 1620 对 735,Terminal-Bench 4.0 为 39.2% 对 0.0%。代价在提示长度上:超过 10 万 token 后费率跳到 5 倍($0.50/$2.50),在超长提示上不再便宜于 GPT-6 Luna。1M 上下文、128K 最大输出、知识截止 2026 年 6 月。

Claude Haiku 5.5 规格与价格表

基础档费率与规格取自 Anthropic 定价页与模型文档,2026 年 10 月 8 日核对。提示超过 10 万 token 时按下一节的高档计费。

项目Claude Haiku 5.5
发布时间2026-10-07
API 模型 IDclaude-haiku-5-5
输入(每百万 token,提示 ≤10 万)$0.10
输出(每百万 token,提示 ≤10 万)$0.50
缓存命中$0.01
缓存写入(5 分钟)$0.125
缓存写入(1 小时)$0.20
Batch(输入 / 输出)$0.05 / $0.25
上下文窗口1M
最大输出(Batch 测试版最高 300K)128K
知识截止2026 年 6 月
思考模式adaptive 思考(由 effort 控制)
默认 efforteffort 参数,默认 medium
可用平台Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry、Claude Platform on AWS
分词器新分词器(Claude 4.7 及以后):相同文本比 Haiku 4.5 多约 30% token
数据保留定价页未说明

上表所有费率均读取自本站 MODEL_REGISTRY,并于 2026-10-08 对照 Anthropic 定价页核实(美元/百万 token)。Batch API 按输入输出 5 折计费,Anthropic 的 Batch 测试版单次最多支持 30 万输出 token。

超过 10 万 token 的分档悬崖:基础费率的 5 倍

Haiku 5.5 是本站首个公布分档定价的 Anthropic 模型。提示不超过 10 万 token 时适用基础档;超过后所有费率(含缓存读取)一律涨到 5 倍。

费率提示 ≤10 万 token提示 >10 万 token
相对基础档倍数1x5x
输入(每百万 token)$0.10$0.50
输出(每百万 token)$0.50$2.50
缓存命中$0.01$0.05
缓存写入(5 分钟)$0.125$0.625
缓存写入(1 小时)$0.20$1.00

提示不超过 100K token 时按基础价计费;超过后输入费率跳到 5 倍,达到每百万 $0.50——而 GPT-6 Luna 在 272K 提示 token 以内始终保持 $0.10。因此在 100K 至 272K 之间,Haiku 5.5 的输入成本约为 Luna 的 5 倍;超过 272K 后 Luna 翻倍到 $0.20,Haiku 仍停留在 5 倍档,Luna 反而成为超长提示下更便宜的一方。约 90% 的 Haiku 4.5 请求都在 10 万 token 以内,多数业务不会触及高档。

Haiku 5.5 基准测试:对比 Haiku 4.5、GPT-6 Luna 与 Sonnet 5.5

七项评测来自 Anthropic 2026 年 10 月 7 日的发布文章。厂商自报,且汇编自多个评测套件——各行方法论见 Haiku 5.5 系统卡。请把这些当作 Anthropic 的数据,而非独立结果。

评测项目Claude Haiku 5.5Claude Haiku 4.5GPT-6 LunaClaude Sonnet 5.5
GDPval-AA v2.1(知识工作)162073514371840
AA-Briefcase v1.1157861413361824
OSWorld 2.1 离线子集(电脑操作)72.4%15.7%48.9%83.9%
Humanity’s Last Exam(无工具 / 有工具)45.9% / 57.4%10.2% / 18.7%未公布56.9% / 64.5%
Terminal-Bench 4.0(agentic 编码)39.2%0.0%16.4%70.6%
FrontierCode 1.1 Main46.4%未公布42.4%52.1% (Xhigh)
Chartography(视觉推理,无工具)46.4%6.4%29.1%61.6%

来源:Anthropic Claude Haiku 5.5 发布文章,2026-10-07(厂商自报,未经独立验证)。Haiku 5.5 在公布的所有项目上都优于 Haiku 4.5,差距最大的是 Terminal-Bench 4.0(39.2% 对 0.0%)与 OSWorld 2.1(72.4% 对 15.7%)。两者均有数据的项目里 Sonnet 5.5 仍全面领先,GPT-6 Luna 居中。

Claude Haiku 5.5 对比 Haiku 4.5:换代改了什么

同样的活,快得多——但挂牌折扣不等于整张账单。

  • 基础价从 $1/$5 降到 $0.10/$0.50

    Haiku 4.5 挂牌为每百万 token $1 输入 / $5 输出,Haiku 5.5 为 $0.10/$0.50,输入价直降 10 倍。缓存命中从 $0.10 降到 $0.01,5 分钟缓存写入从 $1.25 降到 $0.125;Batch 半价为 $0.05/$0.25。

  • 同样的文本,多约 30% token

    与 Claude 4.7 及以后共用的新分词器,会把相同文本切成比 Haiku 4.5 多约 30% 的 token。把高并发流程迁过来之前,先按这个系数重算预算,别只看挂牌价。

  • 基准提升不是小步

    厂商自报的提升从 GDPval-AA v2.1 的 1620 对 735,到 Terminal-Bench 4.0 的 39.2% 对 0.0%。图表能力差距最突出:Chartography 46.4% 对 6.4%。

  • 上下文从 200K 升到 1M

    Haiku 4.5 的窗口是 200K,Haiku 5.5 提升到 1M,最大输出仍为 128K,长文档与 agent 会话无需分块——不过提示超过 10 万 token 会按 5 倍档计费。

Anthropic 称 Haiku 5.5 的运行成本比 Haiku 4.5 低约 75%,基准差距也能佐证。但要注意分词器:Haiku 5.5 使用与 Claude 4.7 及以后相同的新分词器,相同文本会多出约 30% 的 token,因此「便宜约 75%」的挂牌价并不等于账单便宜 75%。截至 2026-10-08,基础费率为每百万 token $0.10/$0.50,多数业务的成本仍明显低于 Haiku 4.5。

可调 effort:Haiku 首次支持

adaptive 思考配合 effort 参数,默认 medium——这是 Haiku 4.5 从未提供的控制项。

  • 首个支持可调 effort 的 Haiku

    此前的 Haiku 没有 effort 控制。Haiku 5.5 有了,这在同一个模型既做廉价分类又做 agentic 任务时最有价值。

  • 默认 effort:medium

    不显式设置参数时,请求以 medium 运行。Anthropic 文档把 effort 列为在质量与延迟、成本之间权衡的官方方式。

  • adaptive 思考

    思考是 adaptive 而非常驻:模型按请求决定推理多少,effort 则限定这部分预算。

  • 什么时候调这个旋钮

    高并发、延迟敏感的任务(分类、路由、抽取、上下文压缩)用 low effort;多步编码或调研用 high effort。请在你实际选定的 effort 上重新测基准,不要假设发布文章的数字直接适用。

Anthropic 称 Haiku 5.5 是首个支持可调 effort 参数的 Haiku。配合 adaptive 思考,它把固定成本的分类器变成一个旋钮:路由、抽取、压缩用 low effort;需要真正推理的任务用 high effort。默认 medium。

Haiku 5.5 的可用渠道

模型 ID 与平台,2026 年 10 月 8 日核对。

  • Claude API

    模型 ID 为 claude-haiku-5-5。基础费率每百万 token 输入 $0.10 / 输出 $0.50,缓存命中 $0.01,缓存写入 $0.125(5 分钟)/ $0.20(1 小时),Batch $0.05/$0.25。

  • Amazon Bedrock

    以 anthropic.claude-haiku-5-5 提供,分档费率与官方一致。

  • Google Cloud、Microsoft Foundry、Claude Platform on AWS

    Anthropic 在自有 API 与 Bedrock 之外,还列出了这三个平台;具体标识符以各平台模型列表为准。

  • Batch API

    Batch 按输入输出的 5 折计费,在 Anthropic 测试版中单次最多接受 30 万输出 token。

本页最近复核于 2026-10-08。模型费率、分档门槛与平台可用性变化很快——请以 Anthropic 定价页与 Haiku 5.5 模型文档为准。

估算你的 Haiku 5.5 账单

Haiku 5.5 很便宜,但提示一旦超过 10 万 token,费率就跳到 5 倍。先把你真实的提示长度与缓存命中率放进成本计算器,再决定是否迁移。

常见问题