2026 年 10 月 7 日发布——厂商数据核对于 2026 年 10 月 8 日
Claude Haiku 5.5 基准测试与价格
Anthropic 最便宜、最快的一档全面换代:每百万 token $0.10/$0.50、1M 上下文,首个支持可调 effort 的 Haiku——以及 10 万 token 提示分档带来的成本反转。
Haiku 5.5 速览
Claude Haiku 5.5(claude-haiku-5-5)于 2026 年 10 月 7 日发布,每百万输入 token $0.10、输出 $0.50——与 GPT-6 Luna 的基础价相同,官方称运行成本比 Haiku 4.5 低约 75%。它是首个支持可调 effort 参数的 Haiku(adaptive 思考,默认 medium),在官方公布的每一项基准上都远超 Haiku 4.5:GDPval-AA v2.1 为 1620 对 735,Terminal-Bench 4.0 为 39.2% 对 0.0%。代价在提示长度上:超过 10 万 token 后费率跳到 5 倍($0.50/$2.50),在超长提示上不再便宜于 GPT-6 Luna。1M 上下文、128K 最大输出、知识截止 2026 年 6 月。
Claude Haiku 5.5 规格与价格表
基础档费率与规格取自 Anthropic 定价页与模型文档,2026 年 10 月 8 日核对。提示超过 10 万 token 时按下一节的高档计费。
| 项目 | Claude Haiku 5.5 |
|---|---|
| 发布时间 | 2026-10-07 |
| API 模型 ID | claude-haiku-5-5 |
| 输入(每百万 token,提示 ≤10 万) | $0.10 |
| 输出(每百万 token,提示 ≤10 万) | $0.50 |
| 缓存命中 | $0.01 |
| 缓存写入(5 分钟) | $0.125 |
| 缓存写入(1 小时) | $0.20 |
| Batch(输入 / 输出) | $0.05 / $0.25 |
| 上下文窗口 | 1M |
| 最大输出(Batch 测试版最高 300K) | 128K |
| 知识截止 | 2026 年 6 月 |
| 思考模式 | adaptive 思考(由 effort 控制) |
| 默认 effort | effort 参数,默认 medium |
| 可用平台 | Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry、Claude Platform on AWS |
| 分词器 | 新分词器(Claude 4.7 及以后):相同文本比 Haiku 4.5 多约 30% token |
| 数据保留 | 定价页未说明 |
上表所有费率均读取自本站 MODEL_REGISTRY,并于 2026-10-08 对照 Anthropic 定价页核实(美元/百万 token)。Batch API 按输入输出 5 折计费,Anthropic 的 Batch 测试版单次最多支持 30 万输出 token。
超过 10 万 token 的分档悬崖:基础费率的 5 倍
Haiku 5.5 是本站首个公布分档定价的 Anthropic 模型。提示不超过 10 万 token 时适用基础档;超过后所有费率(含缓存读取)一律涨到 5 倍。
| 费率 | 提示 ≤10 万 token | 提示 >10 万 token |
|---|---|---|
| 相对基础档倍数 | 1x | 5x |
| 输入(每百万 token) | $0.10 | $0.50 |
| 输出(每百万 token) | $0.50 | $2.50 |
| 缓存命中 | $0.01 | $0.05 |
| 缓存写入(5 分钟) | $0.125 | $0.625 |
| 缓存写入(1 小时) | $0.20 | $1.00 |
提示不超过 100K token 时按基础价计费;超过后输入费率跳到 5 倍,达到每百万 $0.50——而 GPT-6 Luna 在 272K 提示 token 以内始终保持 $0.10。因此在 100K 至 272K 之间,Haiku 5.5 的输入成本约为 Luna 的 5 倍;超过 272K 后 Luna 翻倍到 $0.20,Haiku 仍停留在 5 倍档,Luna 反而成为超长提示下更便宜的一方。约 90% 的 Haiku 4.5 请求都在 10 万 token 以内,多数业务不会触及高档。
Haiku 5.5 基准测试:对比 Haiku 4.5、GPT-6 Luna 与 Sonnet 5.5
七项评测来自 Anthropic 2026 年 10 月 7 日的发布文章。厂商自报,且汇编自多个评测套件——各行方法论见 Haiku 5.5 系统卡。请把这些当作 Anthropic 的数据,而非独立结果。
| 评测项目 | Claude Haiku 5.5 | Claude Haiku 4.5 | GPT-6 Luna | Claude Sonnet 5.5 |
|---|---|---|---|---|
| GDPval-AA v2.1(知识工作) | 1620 | 735 | 1437 | 1840 |
| AA-Briefcase v1.1 | 1578 | 614 | 1336 | 1824 |
| OSWorld 2.1 离线子集(电脑操作) | 72.4% | 15.7% | 48.9% | 83.9% |
| Humanity’s Last Exam(无工具 / 有工具) | 45.9% / 57.4% | 10.2% / 18.7% | 未公布 | 56.9% / 64.5% |
| Terminal-Bench 4.0(agentic 编码) | 39.2% | 0.0% | 16.4% | 70.6% |
| FrontierCode 1.1 Main | 46.4% | 未公布 | 42.4% | 52.1% (Xhigh) |
| Chartography(视觉推理,无工具) | 46.4% | 6.4% | 29.1% | 61.6% |
来源:Anthropic Claude Haiku 5.5 发布文章,2026-10-07(厂商自报,未经独立验证)。Haiku 5.5 在公布的所有项目上都优于 Haiku 4.5,差距最大的是 Terminal-Bench 4.0(39.2% 对 0.0%)与 OSWorld 2.1(72.4% 对 15.7%)。两者均有数据的项目里 Sonnet 5.5 仍全面领先,GPT-6 Luna 居中。
Claude Haiku 5.5 对比 Haiku 4.5:换代改了什么
同样的活,快得多——但挂牌折扣不等于整张账单。
基础价从 $1/$5 降到 $0.10/$0.50
Haiku 4.5 挂牌为每百万 token $1 输入 / $5 输出,Haiku 5.5 为 $0.10/$0.50,输入价直降 10 倍。缓存命中从 $0.10 降到 $0.01,5 分钟缓存写入从 $1.25 降到 $0.125;Batch 半价为 $0.05/$0.25。
同样的文本,多约 30% token
与 Claude 4.7 及以后共用的新分词器,会把相同文本切成比 Haiku 4.5 多约 30% 的 token。把高并发流程迁过来之前,先按这个系数重算预算,别只看挂牌价。
基准提升不是小步
厂商自报的提升从 GDPval-AA v2.1 的 1620 对 735,到 Terminal-Bench 4.0 的 39.2% 对 0.0%。图表能力差距最突出:Chartography 46.4% 对 6.4%。
上下文从 200K 升到 1M
Haiku 4.5 的窗口是 200K,Haiku 5.5 提升到 1M,最大输出仍为 128K,长文档与 agent 会话无需分块——不过提示超过 10 万 token 会按 5 倍档计费。
Anthropic 称 Haiku 5.5 的运行成本比 Haiku 4.5 低约 75%,基准差距也能佐证。但要注意分词器:Haiku 5.5 使用与 Claude 4.7 及以后相同的新分词器,相同文本会多出约 30% 的 token,因此「便宜约 75%」的挂牌价并不等于账单便宜 75%。截至 2026-10-08,基础费率为每百万 token $0.10/$0.50,多数业务的成本仍明显低于 Haiku 4.5。
可调 effort:Haiku 首次支持
adaptive 思考配合 effort 参数,默认 medium——这是 Haiku 4.5 从未提供的控制项。
首个支持可调 effort 的 Haiku
此前的 Haiku 没有 effort 控制。Haiku 5.5 有了,这在同一个模型既做廉价分类又做 agentic 任务时最有价值。
默认 effort:medium
不显式设置参数时,请求以 medium 运行。Anthropic 文档把 effort 列为在质量与延迟、成本之间权衡的官方方式。
adaptive 思考
思考是 adaptive 而非常驻:模型按请求决定推理多少,effort 则限定这部分预算。
什么时候调这个旋钮
高并发、延迟敏感的任务(分类、路由、抽取、上下文压缩)用 low effort;多步编码或调研用 high effort。请在你实际选定的 effort 上重新测基准,不要假设发布文章的数字直接适用。
Anthropic 称 Haiku 5.5 是首个支持可调 effort 参数的 Haiku。配合 adaptive 思考,它把固定成本的分类器变成一个旋钮:路由、抽取、压缩用 low effort;需要真正推理的任务用 high effort。默认 medium。
Haiku 5.5 的可用渠道
模型 ID 与平台,2026 年 10 月 8 日核对。
Claude API
模型 ID 为 claude-haiku-5-5。基础费率每百万 token 输入 $0.10 / 输出 $0.50,缓存命中 $0.01,缓存写入 $0.125(5 分钟)/ $0.20(1 小时),Batch $0.05/$0.25。
Amazon Bedrock
以 anthropic.claude-haiku-5-5 提供,分档费率与官方一致。
Google Cloud、Microsoft Foundry、Claude Platform on AWS
Anthropic 在自有 API 与 Bedrock 之外,还列出了这三个平台;具体标识符以各平台模型列表为准。
Batch API
Batch 按输入输出的 5 折计费,在 Anthropic 测试版中单次最多接受 30 万输出 token。
本页最近复核于 2026-10-08。模型费率、分档门槛与平台可用性变化很快——请以 Anthropic 定价页与 Haiku 5.5 模型文档为准。