对照 Anthropic 文档核对,截至 2026 年 9 月

Fable 5.1 于 2026 年 9 月 2 日发布,SWE-bench Verified 87.7%,安全回退约 2.1%。本页层级定义匹配 2026 年 6 月 system card 与 2026 年 9 月 API 文档。

Fable 5.1 对比 Fable 5

Mythos 级 AI · 2026 年 9 月

什么是 Mythos 级 AI?

Mythos 级是 Anthropic 对「能力超越以往任何公开发布模型」的标注——面向数小时级自主多步工作,而非聊天轮次。Claude Fable 5(及 Fable 5.1)是该层级的带安全分类器公开版本。

TL;DR

Mythos 级描述的是能力层级,不是单一 benchmark 分数。这类模型面向 100+ 步自主代理、百万 token 上下文与 Mythos 级安全路由。Fable 5 是带分类器保护的公开版;Claude Mythos 5 是同一权重、对部分组织放宽 safeguards 的版本。

Mythos 级能力的五大支柱

Mythos 级与标准前沿模型的差异——以及溢价存在的原因。

  • 自主代理能力

    面向 100+ 步工具循环,无需每步人工介入。Fable 5.1 在长链 Agent 完成率上明显高于 Opus 档——中间错误更少,重启成本更低。

  • 百万 token 上下文

    100 万 token 窗口用于整库分析、多文档综合,以及每步重读大上下文的 Agent 运行。上下文是自主工作的货币——Mythos 级模型会 deliberate 地消耗它。

  • 世界模型深度

    对代码库、系统与因果链更强的内部建模——区别在「打补丁」与「理解跨模块爆炸半径」。

  • effort 下的扩展推理

    Fable 5.1 的自适应思考预算与 high/xhigh effort 档位,让模型在难决策上花输出 token。不是更快聊天——是任务值得时的更深求解。

  • Mythos 级安全路由

    ASL-3/ASL-4 就绪分类器、强制 30 天留存监控,以及触发时回退到 Opus。该层级以部分合规灵活性换取敏感域能力。

三种模型原型对比

Mythos 级相对标准前沿与深度推理档的位置——示意区间,非厂商产品名。

维度标准前沿深度推理Mythos 级
原型交互助手深度推理模型自主 Agent 模型
核心能力聊天与短任务链式思维分析多工具自主运行
SWE-bench 区间65% - 75%70% - 80%87.7% (Fable 5.1)
自主步数 horizon5 - 15 steps15 - 30 steps100+ steps autonomous
安全层级ASL-2ASL-2 / ASL-3ASL-3 / ASL-4 ready
典型 API 价格$3 / $15$5 / $25$10 / $50

SWE-bench 区间为 2026 年 9 月示意能力带。Fable 5.1 的 87.7% SWE-bench Verified 来自 Anthropic 9 月 2 日发布(vendor-reported)。价格为 API 标价(每百万 token)。

mythos_class_page.safeguard_title

mythos_class_page.safeguard_subtitle

Mythos 级模型的安全回退行为

Fable 5 / Fable 5.1 运行安全分类器, flagged 请求可能路由到 Opus 4.8(Fable 5.1 截至 2026 年 9 月约 2.1% 回退)。网络/生物域最常见。零留存协议不适用——强制 30 天留存。

何时值得为 Mythos 级付溢价

按任务 horizon 与失败成本路由——而非默认模型习惯。

  • 自主软件工程

    多文件重构、框架迁移、20–50+ 步 Agentic SWE。Fable 5.1 的 87.7% SWE-bench 优势集中在长程编程——在此用 Mythos 级。

  • 复杂多文档研究

    尽调式综合、竞品分析、需数小时保持多线程的会话。Mythos 级是 Anthropic 内部长任务评测首个突破 90% 的模型族。

  • 多工具 Agent 工作流

    终端 Agent、MCP 工具链、每步重读上下文的流程。token 消耗大,中档模型易失败——Mythos 级减少 babysitting。

  • 便宜模型更划算时

    短聊天、摘要、补全、规格明确的单次任务。Opus 5 $5/$25 对 Fable 5 $10/$50——质量差距近零,延迟往往 Opus 更优。

  • 合规与留存约束

    强制 30 天留存会完全卡住零留存团队。若需 ZDR,Anthropic 路线选 Opus 5——即使任务本身 justify Mythos 能力。

选型指南截至 2026 年 9 月。Opus 5 在许多公开 benchmark 上与 Fable 5 同档且标价一半——仅当便宜模型失败且重试成本真实时,Mythos 溢价才划算。

并排对比 Mythos 级模型

看 Fable 5.1 与 Fable 5 在 benchmark、价格与安全回退上的差异——再估算你的工作负载。

常见问题