2026 年 7 月 27 日核实

在 Aider 里使用 Claude Fable 5

Aider 非常乐意去跑一个它一无所知的模型 —— 包括不知道这模型花你多少钱。

一句话结论

支持:设好 ANTHROPIC_API_KEY,跑 aider --model claude-fable-5。然后把两件最容易跳过的事做掉 —— 写一份 .aider.model.metadata.json,别让成本统计一直悄悄报零;在 .aider.model.settings.yml 里设 use_temperature: false,让 Aider 别再发一个 Fable 5 会拒绝的参数。永远不要传 --thinking-tokens。

支持状态

支持,但需要手动配置,2026 年 7 月 27 日核实。Aider 会把模型字符串透传给 LiteLLM,所以走 Anthropic 这条路不需要改任何代码:export ANTHROPIC_API_KEY,然后传 --model claude-fable-5。Aider 缺的是这个模型的 metadata。它依赖 LiteLLM 的 model_prices_and_context_window.json;对于该文件没描述的模型,Aider 会打印那条「unknown context window size and costs」警告,然后按无限上下文窗口和免费模型来假设。功能都还能跑,但在你自己把数字补上之前,token 账目是虚构的。

配置步骤

第一、二步让你跑起来。第三到第五步让你别再盲飞。

  1. 1

    装 Aider,导出 key

    用 python -m pip install aider-install 再跑 aider-install 装好,然后在 macOS/Linux 上 export ANTHROPIC_API_KEY=你的key,在 Windows 上 setx ANTHROPIC_API_KEY 你的key 并重启 shell。Aider 也接受用 --anthropic-api-key 参数传 key。

  2. 2

    先跑一次,确认这条路通

    cd 进你的仓库,跑 aider --model claude-fable-5。Aider 会识别这个 ID 并通过 Anthropic API 转发。会话内可以用 /model claude-fable-5 切换 —— 想为某一个难题临时升级模型,这是最快的办法,不用重启。

  3. 3

    在 .aider.conf.yml 里把它设成默认

    在 git 根目录或 home 目录建 .aider.conf.yml,写上 model: claude-fable-5 和 cache-prompts: true。Aider 会先看当前目录,再回落到 home 里的文件,所以按项目覆盖是可行的:值得花钱的项目默认用 Fable 5,其他项目留在更便宜的模型上。

  4. 4

    补上 model metadata,让成本数字是真的

    建一个 .aider.model.metadata.json,键要写全限定名 anthropic/claude-fable-5,与 litellm_provider 字段对应,然后填上 litellm_provider、max_input_tokens 为 1000000、max_output_tokens、mode: chat、input_cost_per_token 为 0.00001、output_cost_per_token 为 0.00005。不写这个,/tokens 和实时成本显示就毫无意义。

  5. 5

    在 .aider.model.settings.yml 里把参数改对

    为这个模型加一条设置:use_temperature: false 和 cache_control: true。不要从 Aider 文档里 Claude 3.7 或 Opus 4 的示例中照抄含 thinking_tokens 的 accepts_settings 块,也不要在 extra_params 下面放 thinking budget —— 这两样在这个模型上都会 400。

Aider 的默认值是为上一代模型调的,那一代接受的参数比这一代多。

  • metadata 未知,等于 Aider 认为这个模型免费

    Aider 自己的文档说,那条「未知上下文窗口」的警告通常可以忽略 —— 对大多数模型确实如此,但在这里不行。Aider 会假设窗口无限、成本为零,也就是说:在一个 1M token 的模型上没有任何上下文上限保护,而在你能跑的最贵的模型上成本显示为零。

  • map-tokens 悄悄决定了你每回合的成本下限

    repo map 会被拼在请求前面,所以 map-tokens: 4096 意味着:在你开口之前,每一回合就已经有大约四千 token 的输入。按 Fable 5 的输入价,长会话下来这不是个小数目。开缓存能缓解,在 repo map 帮不上忙的仓库上就把它调小。

  • 除非你明说,Aider 会一直发 temperature

    use_temperature 在 Aider 里是按模型配置的,而它不认识的模型不会自动继承内置设置里那些 Claude 条目上的 false 默认值。Fable 5 直接拒绝 temperature、top_p 和 top_k,所以「不认识的模型 + 默认 temperature」等于第一条消息就 400。

  • --thinking-tokens 在这个模型上就是 400

    Aider 文档里开启 thinking 的方式是给一个 budget_tokens 值,走命令行开关或者 model settings 文件里的 accepts_settings。Fable 5 已经移除 budget_tokens:thinking 永远开着,也不能用这种方式配置。Aider 没有对应 effort 的开关,所以推理深度就是模型的默认值。

成本注意事项

Architect 模式是 Aider 提供的杠杆最高的成本控制:跑 --architect,主模型用 Fable 5,--editor-model 用便宜模型,让贵的那个决定改什么,便宜的那个把 diff 写出来。再配合 cache-prompts: true 和一个不过分的 map-tokens。还有一点值得知道:metadata 补对之后,Aider 的实时成本显示会变成一个真实的反馈回路 —— 它对你使用习惯的改变,比任何单一设置都大。

把 metadata 文件要的数字拿全

上下文窗口、最大输出、按 token 的输入输出价格 —— 我们的规格页把 metadata 文件需要的每一项都列了出来,单位也是它要的那个单位。

常见问题