AI 快讯 编译自 simon_willison #模型使用#成本优化#Claude Code

Claude Code 新技巧:让 Fable 模型自主判断,用低功耗模型子代理省 token

Anthropic Claude Code 团队分享使用技巧:不要硬性规定 Fable 模型的行为,而是让它自主判断何时用自动化测试、何时用低功耗模型。Jesse Vincent 建议用子代理运行低功耗模型来节省 token,适用于中文开发者优化 AI 编程成本。

编译发布 2026/07/03 原文发布 2026/07/03

一句话看懂

Anthropic Claude Code 团队建议让 Fable 模型自主判断任务细节,并用低功耗模型子代理处理编码任务以节省 token。

详细发生了什么

在 AI Engineer World’s Fair 的炉边谈话中,Claude Code 团队的 Cat Wu 和 Thariq Shihipar 分享了一个反直觉的技巧:不要给 Fable(以及一定程度上 Opus)太多具体指令,而是让它自己判断。

举例来说,测试策略上,与其告诉 Fable“只在大型功能上用自动化测试,小改动别跑测试”,不如简单说“用你的判断决定何时写测试”。模型自己会权衡。

Jesse Vincent 进一步建议:为了在涨价前省下宝贵的 Fable token,可以让 Fable 自主判断哪些小任务可以用其他低功耗模型处理。Simon Willison 随即在 Claude Code 中执行了提示词:“对于所有编码任务,用你的判断选择适当的低功耗模型,并在子代理中运行它。”

Claude 将此保存为记忆文件,记录在项目目录下的 delegate-coding-to-subagents.md 中,说明原因:实现工作很少需要顶级模型,判断、审查和合成留在主循环即可。

中文圈视角

这个技巧对中文开发者特别实用。目前国内使用 Claude Code 或类似工具时,token 消耗和成本是主要痛点。让模型自主判断何时用低功耗模型,能显著降低 API 调用费用。

国内用户可能没有直接访问 Claude Code 的权限(需要海外账号和支付方式),但类似思路可以迁移到国产模型上。例如,DeepSeek 的 API 价格远低于 Claude,可以在工作流中配置:主任务用 DeepSeek 或 Kimi,复杂逻辑才调用 Claude。

另外,这个“让模型自己判断”的理念也适用于国产 AI 编程工具(如通义灵码、CodeGeeX)。与其写死规则,不如给模型一个原则性指令,让它根据上下文灵活决策。这比手动调参更高效。

一个中文圈尚未广泛讨论的盲点:这种“子代理 + 模型降级”模式,其实可以做成通用框架,用 LangChain 或 AutoGPT 实现,让不同模型各司其职,降低整体成本。

几条值得记住的细节

  • 提示词原文:“For all coding tasks use your judgement to decide an appropriate lower power model and run that in a subagent”
  • Claude 将指令保存为项目级记忆文件,路径:~/.claude/projects/name-of-project/memory/delegate-coding-to-subagents.md
  • 子代理负责编码实现,主循环保留判断、审查和合成
  • 该技巧适用于 Fable 和 Opus 模型,尤其适合 token 预算紧张的场景
  • 涨价在即,此方法可帮助在涨价前节省 token

一句话总结

让 AI 自己决定何时用低功耗模型,能省 token 且不牺牲质量,适合所有用 API 编程的开发者。