Claude Code 是最快 agent 框架,但成本比最便宜对手高近三倍
Composio 测试 Deepseek V4 Flash 在四个 agent 框架上的表现,成功率相近但成本差异近 3 倍:OpenCode 每任务 $0.073 最便宜,Claude Code 需 $0.195。了解框架选择如何影响成本与速度,以及中文用户的替代方案。
一句话看懂
Composio 实测四个 agent 框架运行 Deepseek V4 Flash,成功率相近但成本差近 3 倍:OpenCode 每任务 $0.073,Claude Code 要 $0.195,尽管后者工具调用和输出 token 最少。
详细发生了什么
Composio 做了一项基准测试,用 Deepseek V4 Flash 模型在四个主流 agent 框架上执行 30 个真实世界任务,比较成功率、速度和成本。结果显示,各框架的成功率差别不大,但成本差异显著:OpenCode 最便宜,平均每个任务花费 $0.073;Claude Code 最贵,达到 $0.195,几乎是前者的 2.7 倍。有趣的是,Claude Code 在测试中使用的工具调用次数和输出 token 数量都是最少的,但单价仍然最高,说明其定价策略或底层 API 成本更高。其他两个框架(未具体点名)介于两者之间。Composio 指出,框架的选择主要取决于对价格和速度的权衡,而不是能力上的巨大差异。
中文圈视角
对中文开发者来说,这个测试很有参考价值,因为 Deepseek V4 Flash 是国内模型,API 价格相对亲民,但框架选择会直接影响最终成本。Claude Code 目前在国内访问受限,需要特殊网络环境,而且按美元计费,对个人开发者不友好。相比之下,OpenCode 这类开源框架可以本地部署,配合 Deepseek 或国产模型(如通义千问、Kimi)的 API,成本更低,也更容易接入。另外,国内也有类似的开源 agent 框架,比如 Dify、FastGPT,它们对中文任务和国内模型支持更好,但性能对比数据还比较缺乏。建议中文用户优先考虑成本敏感的框架,尤其是做批量任务时,省下的费用相当可观。
几条值得记住的细节
- 测试基于 30 个真实世界任务,覆盖典型 agent 使用场景。
- OpenCode 每任务成本 $0.073,是四个框架中最低的。
- Claude Code 每任务成本 $0.195,比 OpenCode 贵 167%。
- Claude Code 的工具调用次数和输出 token 最少,但成本最高,说明其 API 定价较高。
- 成功率在各框架间差异不大,因此成本成为主要决策因素。
一句话总结
选 agent 框架时,别只看能力,成本差异可能高达 3 倍,开源框架搭配国产模型更划算。