编码与开发 agent
这一类是给开发者用的:读代码库、改代码、跑测试。它们跑在开发者的机器或 IDE 里,模型多数走云端。
一页看全:十个产品
| 产品 | 榜位 | 机房 | 一句话 |
|---|---|---|---|
| Claude Code | ② | 只能上云 | 命令行编码 agent,模型必须走云 |
| Cline | ③ | 可进机房 | IDE 里的开源 agent,接哪个模型自己定 |
| Kilo Code | ④ | 视情况 | 覆盖三端,取决于所接模型 |
| pi | ⑤ | 可进机房 | 极简可改造,明确支持本地推理栈 |
| Oh-My-Pi(omp) | ⑥ | 可进机房 | Rust 引擎的终端工具包,MIT |
| Codex | ⑧ | 只能上云 | OpenAI 的编码 agent |
| Freebuff | ⑪ | 可进机房 | 九个专用子 agent 分工的免费编码 agent |
| OpenHands | ⑲ | 可进机房 | 端到端完成工单的开源 agent |
| Cursor | ㉑ | 只能上云 | AI 代码编辑器,模型走自家通道 |
| ZCode | ㉓ | 视情况 | GLM-5.2 免费,支持 BYOK |
逐个看:第一梯队(前十里的六个)
Claude Code② · 1.03T只能上云
是什么 命令行编码 agent,读整个代码库、自己规划并执行修改、跑测试。
谁做的 Anthropic,闭源。
能不能进机房 客户端在本地跑,但模型必须走云。数据不出域的场景直接排除。
什么场景适合 开发团队提效。不适合作为企业智能体底座。
Cline③ · 416B可进机房
是什么 开源编码 agent,活在 IDE 里,自主探索代码库。
谁做的 开源。
能不能进机房 客户端开源可审计;接哪个模型可以自己定,理论上可接内网模型。
什么场景适合 已有 IDE 工作流、又要求代码不外传的团队。
Kilo Code④ · 374B视情况
是什么 编码 agent,同时覆盖 VS Code、JetBrains 和命令行。
谁做的 —
能不能进机房 取决于所接模型。
什么场景适合 团队 IDE 不统一时值得看。
公开信息较少,落地前建议自己实测一轮。
pi⑤ · 241B可进机房
是什么 极简、可改造的编码 agent CLI。口号是「编码 agent 很多,但这个是你自己的」。
谁做的 earendil-works,开源 MIT。
能不能进机房 可以。 明确支持 llama.cpp、Ollama、vLLM、LM Studio 等本地推理,配置在 ~/.pi/agent/models.json,只要是 OpenAI 兼容端点就能接。
什么场景适合 想要一个能自己看懂、自己改的最小内核,配内网模型跑。本地化路线的首选之一。
Oh-My-Pi(omp)⑥ · 188B可进机房
是什么 终端里的编码 agent 工具包。
谁做的 开源 MIT,Rust 引擎,支持 Windows / macOS / Linux。
能不能进机房 开源可审计,Rust 引擎开销低。
什么场景适合 偏好命令行、在意性能与可审计性的团队。
Codex⑧ · 146B只能上云
是什么 编码 agent。
谁做的 OpenAI。
能不能进机房 模型走云。
什么场景适合 已经在用 OpenAI 生态的团队。
排名一路上行:08-29 第 11、09-01 第 10、09-09 第 8。
逐个看:前十边缘与其后
Freebuff⑪ · 98.9B可进机房
是什么 免费编码 agent,用 9 个专用子 agent(代码审查、浏览器操作、文件选择、深度思考等)分工,而不是所有任务丢给同一个模型。
谁做的 CodebuffAI。此前长期以社区分支 Zazen 的名义上榜。
能不能进机房 开源,可自托管;接哪个模型可配置。
什么场景适合 想了解「多子 agent 分工」这种架构长什么样。
上一期榜上是它的分支 Zazen(第 3);本期分支退榜、本尊第 11 —— 榜单连「谁在榜上」都会变。
OpenHands⑲ · 33.3B可进机房
是什么 自主软件工程 agent,能执行命令、浏览网页、调用 API。
谁做的 开源。
能不能进机房 开源可自托管,模型可换。
什么场景适合 想让 agent 端到端完成一个工单而不只是补全代码。
09-01 曾滑出前 20,本期又回到第 19 —— 榜单周内波动的活例。
Cursor㉑ · 30.7B只能上云
是什么 AI 代码编辑器。
谁做的 Anysphere,闭源商业产品。
能不能进机房 编辑器本地,模型走云。
什么场景适合 个人与小团队提效;企业侧受数据出域限制。
已滑到第 21,因为多数用户走 Cursor 自家的模型通道、不经 OpenRouter —— 又一个「榜单看不全」的例子。
ZCode㉓ · 29.4B视情况
是什么 智能体编码环境,2026-07 上线,基于自家 GLM-5.2 模型,免费。
谁做的 Z.ai(中国团队)。
能不能进机房 支持 BYOK,可接 Anthropic / DeepSeek / Kimi / OpenRouter —— 正因为支持自带 key,它的流量才会出现在这张榜上。
什么场景适合 想用国产模型、又要保留换模型余地的团队。
这一类的共同教训
客户端跑在本地 ≠ 数据不出域。
数据跟着模型走 —— 判断标准只有一条:模型端点在谁的机房。
所以同样是「装在你电脑上」的工具,Claude Code 与 Cursor 被排除,Cline 与 pi 却能进选型 —— 差别不在客户端,在模型可不可以换成内网的。
榜单数据截至 2026-09-09,来自 OpenRouter 应用榜与编码分类榜。排名每周变动,请当参考而非结论。