Haiku 5.5 于 2026 年 10 月 7 日发布
本页于 2026 年 10 月 8 日依据 Anthropic Haiku 5.5 发布稿与平台定价文档、以及 OpenAI GPT-6 Luna 文档完成核对。价格与分档会变,正式计费前请再核对厂商页面。
Claude Haiku 5.5 规格与价格核对于 2026 年 10 月 8 日
Claude Haiku 5.5 与 GPT-6 Luna 对比
两款便宜小模型标价相同,却在 10 万 token 之后彻底分道扬镳。Haiku 5.5 在 Anthropic 自家正面对比中全面领先;Luna 在长提示上更便宜,并且完全长在 OpenAI 生态里。下面按场景给出结论,每个数字都标注来源与日期。
一句话结论:该选哪个
提示在 10 万 token 以内时两者同价,按生态选:已在 Claude API / Bedrock 体系或更看重分数,选 Haiku 5.5;已在 OpenAI Responses API 上,选 GPT-6 Luna。一旦提示超过 10 万 token,价格立刻反转:Haiku 5.5 升至 $0.50 输入 / $2.50 输出,而 Luna 到 27.2 万仍保持 $0.10/$0.50——20 万 token 的请求在 Haiku 5.5 上是 $0.1250,在 Luna 上只要 $0.0250。超过 27.2 万后两者都加价,Luna 依旧更便宜。下方基准均出自 Anthropic 官方发布,属于厂商自测数据。
规格与价格逐项对照
两款模型的起步价完全一样,差别在于提示变长之后这个价格怎么算。
| 项目 | Claude Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| 模型 ID | claude-haiku-5-5 | gpt-6-luna |
| 发布日期 | 2026 年 10 月 7 日 | 2026 年 9 月 22 日 |
| 输入价,基准档(每百万 token) | $0.10 | $0.10 |
| 输出价,基准档(每百万 token) | $0.50 | $0.50 |
| 超出基准档后 | 提示超过 100K token 后为 $0.50 输入 / $2.50 输出,是基准档的 5 倍;未超过时不加价。 | 提示在 272K token 以内维持 $0.10 输入 / $0.50 输出;超过后输入与缓存 2 倍、输出 1.5 倍。 |
| 缓存读取,基准档 | $0.01 | $0.01 |
| 缓存写入 5 分钟,基准档 | $0.125 | $0.125 |
| 缓存写入 1 小时 | $0.20 | 厂商未公布 |
| Batch API(每百万 token) | $0.05 / $0.25 | $0.05 / $0.25 |
| 上下文窗口 | 1M | 1.05M |
| 最大输出 | 128K | 128K |
| 知识截止 | 2026 年 6 月 | 2026 年 5 月 18 日 |
| 思考 / effort 控制 | adaptive 思考,默认 effort 为 medium——首个带 effort 旋钮的 Haiku | 推理模型,可选 effort;Fast 模式为 2 倍价 |
| 可调用平台 | Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry、Claude Platform on AWS | OpenAI Responses API |
Haiku 5.5 采用 Anthropic 2026 年 10 月 7 日发布稿与平台文档的标价:10 万提示 token 以内为基准档,超过后按 5 倍计费。GPT-6 Luna 采用 OpenAI 公开标价(核对于 2026-09-25):$0.10/$0.50 平价,提示超过 27.2 万 token 后输入与缓存 2 倍、输出 1.5 倍。两家的缓存读取、5 分钟缓存写入与 Batch 费率在基准档上完全一致,只有 Haiku 5.5 公布了 1 小时缓存写入价。以上均为厂商标价,单位为美元/百万 token。
关键分歧:长提示让成本结论反转
两款模型标价都是 $0.10 输入 / $0.50 输出(每百万 token)。Haiku 5.5 的基准档止于 10 万提示 token,Luna 的平价一直撑到 27.2 万。同一个请求跑两边,便宜的那一方在 10 万处易主。
| 项目 | Claude Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| 9 万提示 + 1 万输出 | $0.0140 | $0.0140 |
| 20 万提示 + 1 万输出 | $0.1250 | $0.0250 |
| 30 万提示 + 1 万输出 | $0.1750 | $0.0675 |
| 30 万缓存提示 + 1 万输出 | $0.0400 | $0.0135 |
10 万 token 以内:打平
两边都是 $0.10 输入 / $0.50 输出,9 万提示加 1 万输出在两家都是 $0.0140。这一段按生态和基准选,不必比价。
10 万–27.2 万:Luna 便宜 5 倍
Haiku 5.5 在 10 万提示 token 处跳入高价档,Luna 仍是平价,因此 20 万输入 + 1 万输出时 Haiku 5.5 要 $0.1250,Luna 只要 $0.0250。这是两者差距最大的一段。
超过 27.2 万:仍是 Luna 赢,差距收窄
Luna 超过 27.2 万后输入 2 倍、输出 1.5 倍,但 Haiku 5.5 早已是基准价的 5 倍。30 万输入 + 1 万输出:Haiku 5.5 为 $0.1750,Luna 为 $0.0675,约为 2.6 倍。缓存读取在这一档保持同样的倍数关系。
成本按标价、全新(未命中缓存)提示计算:提示 token × 输入单价 + 输出 token × 输出单价,美元,保留四位小数。Haiku 5.5 在 10 万提示 token 以内取 $0.10/$0.50,超过取 $0.50/$2.50;Luna 在 27.2 万以内取 $0.10/$0.50,超过后输入 2 倍、输出 1.5 倍。缓存行把各自的缓存读取价套用到整个提示。未计入 Batch 折扣与 Fast 模式。
正面对比基准(厂商自测)
Anthropic 在 Haiku 5.5 发布稿中做了这七项对比,除 Humanity's Last Exam 未公布 Luna 成绩外均有数据。数值越高越好。
| 项目 | Claude Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| GDPval-AA v2.1 | 1620 | 1437 |
| AA-Briefcase v1.1 | 1578 | 1336 |
| OSWorld 2.1(离线子集) | 72.4% | 48.9% |
| Terminal-Bench 4.0 | 39.2% | 16.4% |
| FrontierCode 1.1 Main | 46.4% | 42.4% |
| Chartography | 46.4% | 29.1% |
| Humanity's Last Exam | 无工具 45.9% / 有工具 57.4% | 未公布——Anthropic 表中 Luna 为空白 |
本页所有分数都来自 Anthropic 2026 年 10 月 7 日的 Haiku 5.5 发布文章,该文汇编了多个评测套件的结果;每一行的方法论记录在 Haiku 5.5 系统卡(System Card)中,而非发布页。因此这是厂商汇编的数据,不是独立正面对比,也没有第三方实验室复跑过这一组合——跨行比较请谨慎,引用某一行前先查系统卡。Haiku 5.5 的 Humanity's Last Exam 成绩已公布(无工具 45.9%、有工具 57.4%),GPT-6 Luna 的该项成绩未公布。
生态与可调用平台
价格差距在许多场景下很小,模型能跑在哪里反而决定账单。
Haiku 5.5 跟着 Claude 走
Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 与 Claude Platform on AWS,同一个模型 ID 可以跨平台迁移。如果团队已经在 Claude 体系里,接入成本最低。
Luna 只在 OpenAI Responses API 上
GPT-6 Luna 通过 OpenAI Responses API 提供。接口成熟统一,但没有 Bedrock、Vertex 或 Foundry 这些备选入口。
Batch 与缓存规则几乎一致
两家的 Batch API 都是 $0.05 输入 / $0.25 输出,基准档缓存读取都是 $0.01。切换主要是换 SDK,而不是重做架构。
该选哪一个
先看提示长度,再看技术栈。
短提示(10 万以内):按生态与质量决定
同价。Haiku 5.5 的厂商自测分数更高,如果你在 Claude 体系内或在意基准差距,选它。
长提示(10 万–27.2 万):选 Luna
这是两者价格真正拉开的一档,20 万提示 token 处相差 5 倍。除非 Haiku 5.5 的准确率对你值这 5 倍,否则 Luna 明显更划算。
超长提示(27.2 万以上):还是 Luna,优势收窄
Luna 超过 27.2 万后加价,但在这档仍比 Haiku 5.5 便宜约 2.5–3.3 倍。
智能体与电脑操作类任务:Haiku 5.5
Anthropic 自家的 Terminal-Bench 4.0、OSWorld 2.1 与 AA-Briefcase 对比中 Haiku 5.5 大幅领先,而且它本身就定位为 Opus 5.5 / Sonnet 5.5 下的子智能体。
高频分类与抽取:价格上两者皆可
10 万提示 token 以内费率一致、Batch 折扣一致。选你已经在付费的那家即可;Haiku 5.5 还多了 effort 参数,可以把思考成本压得更低。
上线前再核对一次
两家厂商 2026 年都两次调整过小模型定价。按工作量上线当天的文档核对,别以本文写作日期为准。
本页只比较标价。批量折扣、承诺用量价、区域附加费(Luna 区域端点 +10%)与 Fast 模式(Luna,2 倍)均未计入。