Haiku 5.5 于 2026 年 10 月 7 日发布

本页于 2026 年 10 月 8 日依据 Anthropic Haiku 5.5 发布稿与平台定价文档、以及 OpenAI GPT-6 Luna 文档完成核对。价格与分档会变,正式计费前请再核对厂商页面。

Claude Haiku 5.5 规格与价格

核对于 2026 年 10 月 8 日

Claude Haiku 5.5 与 GPT-6 Luna 对比

两款便宜小模型标价相同,却在 10 万 token 之后彻底分道扬镳。Haiku 5.5 在 Anthropic 自家正面对比中全面领先;Luna 在长提示上更便宜,并且完全长在 OpenAI 生态里。下面按场景给出结论,每个数字都标注来源与日期。

一句话结论:该选哪个

提示在 10 万 token 以内时两者同价,按生态选:已在 Claude API / Bedrock 体系或更看重分数,选 Haiku 5.5;已在 OpenAI Responses API 上,选 GPT-6 Luna。一旦提示超过 10 万 token,价格立刻反转:Haiku 5.5 升至 $0.50 输入 / $2.50 输出,而 Luna 到 27.2 万仍保持 $0.10/$0.50——20 万 token 的请求在 Haiku 5.5 上是 $0.1250,在 Luna 上只要 $0.0250。超过 27.2 万后两者都加价,Luna 依旧更便宜。下方基准均出自 Anthropic 官方发布,属于厂商自测数据。

规格与价格逐项对照

两款模型的起步价完全一样,差别在于提示变长之后这个价格怎么算。

项目Claude Haiku 5.5GPT-6 Luna
模型 IDclaude-haiku-5-5gpt-6-luna
发布日期2026 年 10 月 7 日2026 年 9 月 22 日
输入价,基准档(每百万 token)$0.10$0.10
输出价,基准档(每百万 token)$0.50$0.50
超出基准档后提示超过 100K token 后为 $0.50 输入 / $2.50 输出,是基准档的 5 倍;未超过时不加价。提示在 272K token 以内维持 $0.10 输入 / $0.50 输出;超过后输入与缓存 2 倍、输出 1.5 倍。
缓存读取,基准档$0.01$0.01
缓存写入 5 分钟,基准档$0.125$0.125
缓存写入 1 小时$0.20厂商未公布
Batch API(每百万 token)$0.05 / $0.25$0.05 / $0.25
上下文窗口1M1.05M
最大输出128K128K
知识截止2026 年 6 月2026 年 5 月 18 日
思考 / effort 控制adaptive 思考,默认 effort 为 medium——首个带 effort 旋钮的 Haiku推理模型,可选 effort;Fast 模式为 2 倍价
可调用平台Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry、Claude Platform on AWSOpenAI Responses API

Haiku 5.5 采用 Anthropic 2026 年 10 月 7 日发布稿与平台文档的标价:10 万提示 token 以内为基准档,超过后按 5 倍计费。GPT-6 Luna 采用 OpenAI 公开标价(核对于 2026-09-25):$0.10/$0.50 平价,提示超过 27.2 万 token 后输入与缓存 2 倍、输出 1.5 倍。两家的缓存读取、5 分钟缓存写入与 Batch 费率在基准档上完全一致,只有 Haiku 5.5 公布了 1 小时缓存写入价。以上均为厂商标价,单位为美元/百万 token。

关键分歧:长提示让成本结论反转

两款模型标价都是 $0.10 输入 / $0.50 输出(每百万 token)。Haiku 5.5 的基准档止于 10 万提示 token,Luna 的平价一直撑到 27.2 万。同一个请求跑两边,便宜的那一方在 10 万处易主。

项目Claude Haiku 5.5GPT-6 Luna
9 万提示 + 1 万输出$0.0140$0.0140
20 万提示 + 1 万输出$0.1250$0.0250
30 万提示 + 1 万输出$0.1750$0.0675
30 万缓存提示 + 1 万输出$0.0400$0.0135
  • 10 万 token 以内:打平

    两边都是 $0.10 输入 / $0.50 输出,9 万提示加 1 万输出在两家都是 $0.0140。这一段按生态和基准选,不必比价。

  • 10 万–27.2 万:Luna 便宜 5 倍

    Haiku 5.5 在 10 万提示 token 处跳入高价档,Luna 仍是平价,因此 20 万输入 + 1 万输出时 Haiku 5.5 要 $0.1250,Luna 只要 $0.0250。这是两者差距最大的一段。

  • 超过 27.2 万:仍是 Luna 赢,差距收窄

    Luna 超过 27.2 万后输入 2 倍、输出 1.5 倍,但 Haiku 5.5 早已是基准价的 5 倍。30 万输入 + 1 万输出:Haiku 5.5 为 $0.1750,Luna 为 $0.0675,约为 2.6 倍。缓存读取在这一档保持同样的倍数关系。

成本按标价、全新(未命中缓存)提示计算:提示 token × 输入单价 + 输出 token × 输出单价,美元,保留四位小数。Haiku 5.5 在 10 万提示 token 以内取 $0.10/$0.50,超过取 $0.50/$2.50;Luna 在 27.2 万以内取 $0.10/$0.50,超过后输入 2 倍、输出 1.5 倍。缓存行把各自的缓存读取价套用到整个提示。未计入 Batch 折扣与 Fast 模式。

正面对比基准(厂商自测)

Anthropic 在 Haiku 5.5 发布稿中做了这七项对比,除 Humanity's Last Exam 未公布 Luna 成绩外均有数据。数值越高越好。

项目Claude Haiku 5.5GPT-6 Luna
GDPval-AA v2.116201437
AA-Briefcase v1.115781336
OSWorld 2.1(离线子集)72.4%48.9%
Terminal-Bench 4.039.2%16.4%
FrontierCode 1.1 Main46.4%42.4%
Chartography46.4%29.1%
Humanity's Last Exam无工具 45.9% / 有工具 57.4%未公布——Anthropic 表中 Luna 为空白

本页所有分数都来自 Anthropic 2026 年 10 月 7 日的 Haiku 5.5 发布文章,该文汇编了多个评测套件的结果;每一行的方法论记录在 Haiku 5.5 系统卡(System Card)中,而非发布页。因此这是厂商汇编的数据,不是独立正面对比,也没有第三方实验室复跑过这一组合——跨行比较请谨慎,引用某一行前先查系统卡。Haiku 5.5 的 Humanity's Last Exam 成绩已公布(无工具 45.9%、有工具 57.4%),GPT-6 Luna 的该项成绩未公布。

生态与可调用平台

价格差距在许多场景下很小,模型能跑在哪里反而决定账单。

  • Haiku 5.5 跟着 Claude 走

    Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 与 Claude Platform on AWS,同一个模型 ID 可以跨平台迁移。如果团队已经在 Claude 体系里,接入成本最低。

  • Luna 只在 OpenAI Responses API 上

    GPT-6 Luna 通过 OpenAI Responses API 提供。接口成熟统一,但没有 Bedrock、Vertex 或 Foundry 这些备选入口。

  • Batch 与缓存规则几乎一致

    两家的 Batch API 都是 $0.05 输入 / $0.25 输出,基准档缓存读取都是 $0.01。切换主要是换 SDK,而不是重做架构。

该选哪一个

先看提示长度,再看技术栈。

  • 短提示(10 万以内):按生态与质量决定

    同价。Haiku 5.5 的厂商自测分数更高,如果你在 Claude 体系内或在意基准差距,选它。

  • 长提示(10 万–27.2 万):选 Luna

    这是两者价格真正拉开的一档,20 万提示 token 处相差 5 倍。除非 Haiku 5.5 的准确率对你值这 5 倍,否则 Luna 明显更划算。

  • 超长提示(27.2 万以上):还是 Luna,优势收窄

    Luna 超过 27.2 万后加价,但在这档仍比 Haiku 5.5 便宜约 2.5–3.3 倍。

  • 智能体与电脑操作类任务:Haiku 5.5

    Anthropic 自家的 Terminal-Bench 4.0、OSWorld 2.1 与 AA-Briefcase 对比中 Haiku 5.5 大幅领先,而且它本身就定位为 Opus 5.5 / Sonnet 5.5 下的子智能体。

  • 高频分类与抽取:价格上两者皆可

    10 万提示 token 以内费率一致、Batch 折扣一致。选你已经在付费的那家即可;Haiku 5.5 还多了 effort 参数,可以把思考成本压得更低。

  • 上线前再核对一次

    两家厂商 2026 年都两次调整过小模型定价。按工作量上线当天的文档核对,别以本文写作日期为准。

本页只比较标价。批量折扣、承诺用量价、区域附加费(Luna 区域端点 +10%)与 Fast 模式(Luna,2 倍)均未计入。

用你自己的工作量算一遍账单

把提示长度、输出长度与缓存命中率填进计算器,再去 Haiku 5.5 页面看完整规格。

常见问题:Haiku 5.5 与 GPT-6 Luna