llm-anthropic 0.26 发布:支持 Claude 5 系列模型与服务器端工具,简化思考参数
llm-anthropic 0.26 更新带来 claude-fable-5、claude-sonnet-5、claude-opus-5 新模型,新增 WebSearch 等服务器端工具,并简化 extended thinking 配置。了解这些变化如何影响 CLI 用户和 Python 开发者,以及中文圈用户如何利用这些新特性。
一句话看懂
llm-anthropic 0.26 发布,新增 Claude 5 系列模型和服务器端工具,并简化了思考参数配置,让 CLI 和 Python 调用 Anthropic 模型更灵活。
详细发生了什么
llm-anthropic 0.26 是 Simon Willison 维护的 LLM 命令行工具(CLI)的 Anthropic 插件更新,依赖 LLM 0.32 的新特性。主要变化包括:
- 新模型支持:新增
claude-fable-5、claude-sonnet-5和claude-opus-5三个模型,覆盖不同性能层级。 - 服务器端工具:新增
WebSearch、WebFetch、CodeExecution和AnthropicMCP四种服务器端工具,可通过-T参数或 Python 的tools=参数调用。旧的-o web_search*选项被移除,统一为-T WebSearch。 - 流式事件:升级到 LLM 0.32 后,推理过程、工具调用、工具结果和服务器端工具结果都以类型化事件流式传输。CLI 提示的推理内容默认显示到标准错误,除非使用
--hide-reasoning/-R隐藏。 - 简化思考参数:将 extended thinking 简化为
thinking和thinking_effort(可选low、medium、high、xhigh、max)。Claude 5 模型默认开启思考;-o thinking 0可关闭 Sonnet 5 和 Opus 5 的思考,但 Fable 5 始终思考。-R/--hide-reasoning现在会从响应和日志中移除推理内容。旧的thinking_budget、thinking_display、thinking_adaptive选项已删除。
中文圈视角
对中文开发者来说,llm-anthropic 0.26 的价值在于更便捷地调用 Anthropic 最新模型。但需要注意,Anthropic API 目前在国内无法直接访问,需要自行解决网络问题。不过,LLM 工具本身是开源的,可以配合国内模型(如 DeepSeek、Kimi)使用,只是本插件专为 Anthropic 设计。
新加入的服务器端工具(如 WebSearch、WebFetch)对中文用户尤其有用,可以简化需要联网搜索或抓取网页的 AI 应用开发,无需自己实现工具调用逻辑。但要注意,这些工具依赖 Anthropic 服务器,数据会经过境外服务,涉及数据出境合规问题,企业用户需谨慎评估。
此外,思考参数的简化降低了使用门槛,但 Claude 5 默认思考可能增加 token 消耗,中文用户在使用时需关注成本。对于习惯使用 OpenAI 兼容接口的开发者,LLM 工具也支持其他模型,但本插件的更新只针对 Anthropic。
几条值得记住的细节
- 新模型:
claude-fable-5、claude-sonnet-5、claude-opus-5,覆盖不同性能需求。 - 服务器端工具:
WebSearch、WebFetch、CodeExecution、AnthropicMCP,通过-T或tools=使用。 - 旧选项
-o web_search*已移除,改用-T WebSearch。 - 思考参数简化为
thinking和thinking_effort,支持low到max五档。 -R/--hide-reasoning可隐藏推理内容,Fable 5 始终思考,不可关闭。
一句话总结
对中文开发者而言,这是 Anthropic 模型 CLI 调用的重要更新,但需注意网络和合规问题。