对照 Anthropic 文档核对,截至 2026 年 9 月
Fable 5.1 于 2026 年 9 月 2 日发布,SWE-bench Verified 87.7%,安全回退约 2.1%。本页层级定义匹配 2026 年 6 月 system card 与 2026 年 9 月 API 文档。
Fable 5.1 对比 Fable 5Mythos 级 AI · 2026 年 9 月
什么是 Mythos 级 AI?
Mythos 级是 Anthropic 对「能力超越以往任何公开发布模型」的标注——面向数小时级自主多步工作,而非聊天轮次。Claude Fable 5(及 Fable 5.1)是该层级的带安全分类器公开版本。
TL;DR
Mythos 级描述的是能力层级,不是单一 benchmark 分数。这类模型面向 100+ 步自主代理、百万 token 上下文与 Mythos 级安全路由。Fable 5 是带分类器保护的公开版;Claude Mythos 5 是同一权重、对部分组织放宽 safeguards 的版本。
Mythos 级能力的五大支柱
Mythos 级与标准前沿模型的差异——以及溢价存在的原因。
自主代理能力
面向 100+ 步工具循环,无需每步人工介入。Fable 5.1 在长链 Agent 完成率上明显高于 Opus 档——中间错误更少,重启成本更低。
百万 token 上下文
100 万 token 窗口用于整库分析、多文档综合,以及每步重读大上下文的 Agent 运行。上下文是自主工作的货币——Mythos 级模型会 deliberate 地消耗它。
世界模型深度
对代码库、系统与因果链更强的内部建模——区别在「打补丁」与「理解跨模块爆炸半径」。
effort 下的扩展推理
Fable 5.1 的自适应思考预算与 high/xhigh effort 档位,让模型在难决策上花输出 token。不是更快聊天——是任务值得时的更深求解。
Mythos 级安全路由
ASL-3/ASL-4 就绪分类器、强制 30 天留存监控,以及触发时回退到 Opus。该层级以部分合规灵活性换取敏感域能力。
三种模型原型对比
Mythos 级相对标准前沿与深度推理档的位置——示意区间,非厂商产品名。
| 维度 | 标准前沿 | 深度推理 | Mythos 级 |
|---|---|---|---|
| 原型 | 交互助手 | 深度推理模型 | 自主 Agent 模型 |
| 核心能力 | 聊天与短任务 | 链式思维分析 | 多工具自主运行 |
| SWE-bench 区间 | 65% - 75% | 70% - 80% | 87.7% (Fable 5.1) |
| 自主步数 horizon | 5 - 15 steps | 15 - 30 steps | 100+ steps autonomous |
| 安全层级 | ASL-2 | ASL-2 / ASL-3 | ASL-3 / ASL-4 ready |
| 典型 API 价格 | $3 / $15 | $5 / $25 | $10 / $50 |
SWE-bench 区间为 2026 年 9 月示意能力带。Fable 5.1 的 87.7% SWE-bench Verified 来自 Anthropic 9 月 2 日发布(vendor-reported)。价格为 API 标价(每百万 token)。
mythos_class_page.safeguard_title
mythos_class_page.safeguard_subtitle
Mythos 级模型的安全回退行为
Fable 5 / Fable 5.1 运行安全分类器, flagged 请求可能路由到 Opus 4.8(Fable 5.1 截至 2026 年 9 月约 2.1% 回退)。网络/生物域最常见。零留存协议不适用——强制 30 天留存。
何时值得为 Mythos 级付溢价
按任务 horizon 与失败成本路由——而非默认模型习惯。
自主软件工程
多文件重构、框架迁移、20–50+ 步 Agentic SWE。Fable 5.1 的 87.7% SWE-bench 优势集中在长程编程——在此用 Mythos 级。
复杂多文档研究
尽调式综合、竞品分析、需数小时保持多线程的会话。Mythos 级是 Anthropic 内部长任务评测首个突破 90% 的模型族。
多工具 Agent 工作流
终端 Agent、MCP 工具链、每步重读上下文的流程。token 消耗大,中档模型易失败——Mythos 级减少 babysitting。
便宜模型更划算时
短聊天、摘要、补全、规格明确的单次任务。Opus 5 $5/$25 对 Fable 5 $10/$50——质量差距近零,延迟往往 Opus 更优。
合规与留存约束
强制 30 天留存会完全卡住零留存团队。若需 ZDR,Anthropic 路线选 Opus 5——即使任务本身 justify Mythos 能力。
选型指南截至 2026 年 9 月。Opus 5 在许多公开 benchmark 上与 Fable 5 同档且标价一半——仅当便宜模型失败且重试成本真实时,Mythos 溢价才划算。