跳到主要内容

Agent 图谱 · Agents

成品 Agent

自己能跑的成品 AI agent,共用八维(模型接入 / 运行位置 / 本地文件 / 关机后任务 / 工具扩展 / 上下文 / 权限 / 适合场景)。按形态分三列——IDE 形态、CLI 形态、厂商云形态。前两者是同一产品的不同装法、不是竞争关系;厂商云形态则是另一个方向:不需要自己装,工作在别人的机器上做。

17 个对象 8 个固定维度 0 个已完整核验 最后核验 2026-10-03

先回答一件事:你要它替你干多少事

这一分区 17 份档案,分三个方向:14 份是装在自己机器上的(IDE 形态 8 + CLI 形态 6,其中三组是同一个产品的两种装法——Aider、Claude Code、Codex 各有一份 IDE 形态和一份 CLI 形态,它们不是竞品,差别在装在哪、怎么被唤起、能不能塞进脚本);另 3 份是厂商云形态——本机什么都不装,工作在别人的机器上做。

  1. 1我要一个自己能开的编辑器
    看 IDE · 独立编辑器Cursor、已改称 Devin Desktop 的 Windsurf、Zed 都在这一类。
  2. 2我已经在用 VS Code / Cursor 了
    看 IDE · 扩展形态Claude Code、Codex、Copilot、Cline都是在既有编辑器里装。注意前两者另有 CLI 形态,别当成两个产品比。
  3. 3我不想换编辑器,也不想装插件
    看 Aider(Watch 模式)它不是编辑器插件而是后台常驻进程,你在任意编辑器里加 AI 注释它就响应。
  4. 4我要它每一步都问我
    看默认逐次确认的那几个 CLICrush 默认每次工具调用都问;Aider 有自动提交但沙箱机制未核验。
  5. 5我要它在指定范围内自己跑
    看有明确沙箱 / 可信目录的那几个Gemini CLI 的沙箱与 Trusted Folders 都有独立官方文档;Claude Code CLI 的权限粒度最细,还有「允许这一次」。
  6. 6我要它能塞进 CI / 脚本里跑
    有两个有官方证据的落点Gemini CLI 明确支持非交互模式;Codex CLI 的 docs/exec.md 标题即 Non-interactive mode(正文为外链)。其余未核验。
  7. 7我要关掉客户端后它还在干活
    看厂商云形态那3 份这一层只有它们:14 份本地形态的 background 维度一致写着不支持后台长任务。Dot / Muse / Grok Bot 的差别在审批机制怎么设计——Muse 有独立的 Sentinel agent,Dot 是自动审核,Grok Bot 官方页没写。
  8. 8我要数据完全不离开本机
    这一层也没有合适的厂商云形态的机器在别人那里(Dot 默认与本机隔离、授权后才碰);本地形态里只有 sandbox / 可信目录那一档能限制写入范围。

⚠ 两个最容易踩的误解:「AI 原生编辑器」不等于「模型可自选」——形态看 runtime,模型接入看 model_access,两个维度是分开的;Codex CLI 的审批模式与沙箱档位在 CLI 文档里查不到,在它 SDK 的源码里有——四种审批 × 三档沙箱(read-only / workspace-write / danger-full-access),还能按路径 deny 掉读 .env,跨平台差异仍未核验。

按装法分

同一产品常有 IDE 与 CLI 两种装法,它们不是竞品——装在哪、怎么被唤起、能不能进脚本都不同。选你实际要用的那个。

IDE 形态 8

装进编辑器,或本身就是独立编辑器。看得见界面,权限多在对话里给。

不是编辑器插件,是一种使用模式——Aider 常驻 watch 你的文件,你在任意编辑器里加 AI 注释,它就响应。

部分核验 详情 →

一个进程、三种入口——终端、IDE、GitHub @claude 提及共用同一套权限与上下文机制。

部分核验 详情 →

Cline

Cline Bot

本赛道唯一三形态全覆盖的对象——CLI、Desktop App、VS Code 扩展共享同一开源核心,且模型自选。

部分核验 详情 →

不是独立 IDE,是装进 VS Code / Cursor / Windsurf 的扩展——通过 app server 与

部分核验 详情 →

GitHub Copilot

GitHub / Microsoft

形态最广、生态最依附 GitHub 的一个——从网站到 CLI 到主流编辑器全覆盖,且能把任务委派给 Claude / Co

部分核验 详情 →

Cursor

Anysphere

本赛道架构最激进的三个之一:云端 Agent 合上笔记本不中断、自托管代码不出网、代码审查拆成两个 bot 分工。

部分核验 详情 →

Zed

Zed Industries

不是「又一个 AI 编码工具」,而是三种 agent path 的编排层 —— 能在同一个编辑器里用 Zed 原生 Agen

部分核验 详情 →

CLI 形态 6

在终端里跑。能进脚本与 CI,权限确认粒度是最细的一层。

Aider

Aider-AI

Git 集成是核心设计而非附加功能的终端 pair programming 工具——AI 改动始终在版本控制里,可 diff

部分核验 详情 →

Claude Code CLI

Anthropic

本赛道数据质量最高、发布最频繁的条目 —— 自带 CHANGELOG + Atom feed,权限设计颗粒度最细。

部分核验 详情 →

Codex CLI

OpenAI

OpenAI 官方的终端编码 agent,Rust 实现,架构上强调 app server 与线程续接。

部分核验 详情 →

Crush

Charm

Charm 生态的 TUI 编码 agent,MCP 三种传输方式标注最完整,并提供官方订阅方案 Hyper。

部分核验 详情 →

Gemini CLI

Google

Google 官方的开源终端 agent,npx 免安装 + 明确 MCP 支持 + 非交互脚本模式,是三者里工程化最完整的

部分核验 详情 →

OpenCode

OpenCode

MIT 许可的多 provider 编程 harness,运行 bash 命令前会询问权限,并支持 ACP 载入。

部分核验 详情 →

厂商云形态 3

本机不装任何东西,在厂商的云端机器上持续工作(OpenAI Dot / Meta Muse / xAI Grok Bot)。差别不在功能多寡,而在机器归谁 —— 代价是本地文件与离线能力基本让出,收益是关机后仍在跑。

三家同期发布里唯一一家官方页上能读到「jobs 清单」的 —— 它不谈机制,直接列了九个岗位(销售线索、网站搭建、收件箱、会

部分核验 详情 →

Meta Muse

Meta

唯一一家把「审批权交给另一个 agent」的 —— Muse Secure VM 上跑着两个系统级隔离的东西:干活的 Mus

部分核验 详情 →

OpenAI Dot

OpenAI

本机什么都不装,所有工作发生在 OpenAI 的云端机器上——官方给的能力边界写得很直白:独立云端电脑 + 自带浏览器 +

部分核验 详情 →

本站目前是「核验快照」,还没有实测数据

下面每一个字段都能回到官方原文核对,但我们还没有在同一批任务上跑过这些工具。 实测协议已经写好(统一任务、统一验收、记录人工介入与返工次数),任务清单也已就绪, 尚未执行。

所以本站给的是能力边界与证据,不是「哪个更好用」的结论。 真正的选型请用你自己的输入、预算与验收标准跑一遍。

8 个维度,每格都能回溯

所有对象在同一坐标系下被描述。 点开任一对象,每一格下面都有官方源链接与核验日期——不认同可以自己回去查。

01

模型与开放条件

用谁的模型?能不能换第三方?多模型路由怎么配?

02

运行位置

本地 / 云端 / 混合?索引在本地还是云端?远程控制不等于云端执行。

03

本地文件

能访问多大范围?未打开的大文件怎么读?符号级能力如何?

04

关机后的任务

电脑关了还能继续跑吗?这是本地形态最常见的误解来源。

05

工具与扩展

工具链有多宽:MCP · LSP · 插件 · Hooks · 自定义指令。

06

上下文与记忆

索引算法、上下文窗口、会话恢复与分叉、跨会话记忆边界。

07

权限与限制

沙箱与审批边界、凭据管理、数据是否出境、额度如何计算。

08

适合什么任务

最擅长什么任务?什么情况下别用它?

全部数据一览

同一张表横向对比。点对象名进详情页看逐格证据。

对象形态厂商适合核验日状态
AAider CLI 形态 Aider-AI 希望 AI 改动始终留在 git 版本控制里、可 diff 可撤销的场景。 需要连接本地模型或多家云端模型的用户。 需要「写新代码时复用已有 2026-09-29 partial
AAider Watch 模式 IDE 形态 Aider-AI 习惯在任意编辑器里工作,不愿切换到专门的 Agent 界面的人。 需要「加注释 → 自动响应」这种轻量交互的人。 2026-09-29 partial
CCClaude Code CLI CLI 形态 Anthropic 重视权限可控性、需要 MCP 生态、希望用 Anthropic 官方模型的用户。 不适合需要开源许可或自托管的场景(许可明确 proprie 2026-09-29 partial
CCClaude Code IDE 扩展 IDE 形态 Anthropic 已在用 IDE 且希望不切换工具就能用 Claude 的人。 需要在终端、IDE、GitHub 三处用同一工具的人。 重视权限可控性与 MC 2026-09-29 partial
CCline IDE 形态 Cline Bot 需要同一工具覆盖编辑器、终端、桌面三种工作形态的用户。 需要模型自选(不绑定单一厂商)的人。 需要 CI/CD 集成(CLI headles 2026-09-29 partial
CCodex CLI CLI 形态 OpenAI 在终端里做工程任务,需要接入 CI 或自建客户端的场景。 非交互模式有官方文档支持(docs/exec.md标题即 Non-interact 2026-09-29 partial
CCodex IDE 扩展 IDE 形态 OpenAI 已在用 VS Code / Cursor / Windsurf 等编辑器, 希望在同一环境里用 Codex 而不切换工具的人。 需要 IDE 2026-09-29 partial
GHGitHub Copilot IDE 形态 GitHub / Microsoft 已在 GitHub 生态内(用 PR / Issue / Actions 工作)的人; 需要最广编辑器覆盖的人(VS Code / JetB 2026-09-29 partial
CRCrush CLI 形态 Charm 喜欢 Charm 生态的终端体验(TUI 审美与交互)。 需要在多个 provider 间切换,或想用官方订阅方案 Hyper 的用户。 想 2026-09-29 partial
CCursor IDE 形态 Anysphere 需要云端 Agent 且希望合上笔记本任务继续跑的人; 需要长周期(数月级)上下文维持与大规模子智能体编排的人; 代码不能离开自有基础设施的 2026-10-03 partial
GGemini CLI CLI 形态 Google 需要无安装快速试用、需要 MCP 扩展、需要脚本化非交互运行的场景。 尤其适合想把 Gemini 的多模态生成能力接进 Agent 工作流的 2026-09-29 partial
xAIxAI Grok Bot 厂商云形态 xAI 官方给的是岗位化的 jobs 清单(见 tools 维),选型时可当清单用: 销售线索、网站搭建、邮箱清理、客服、游戏素材、办公排程、收件箱 2026-10-03 partial
MUMeta Muse 厂商云形态 Meta 官方定位是「for billions of people worldwide, so there's no learning curve」, 2026-10-03 partial
OAOpenAI Dot 厂商云形态 OpenAI 官方给的是岗位化场景,值得直接抄成选型依据: 把反馈转成经过测试的修复(交完整 PR 附演示视频)、 产品范围变化时调整发布方案、拿到新证据 2026-10-03 partial
OCOpenCode CLI 形态 OpenCode 需要多 provider 可切换、且重视命令执行前确认的用户。 ACP 生态参与者。 2026-09-29 partial
WWindsurf / Devin Desktop IDE 形态 Cognition 需要多模型供应商可选(不想被单一模型绑定)的人; 需要 ACP 以接入自定义 agent 的人(注意是 preview); 需要远程主机(S 2026-09-29 partial
ZZed IDE 形态 Zed Industries 重视编辑器性能(Rust 实现)、语法解析准确度(Tree-sitter)与多人协作的场景。 想在一个编辑器里同时用 Zed 原生 Agen 2026-09-29 partial

为什么这里不给总分排名

这不是省略,是方法上的明确取舍。

  • 缺统一实测,就不给分。跨工具的跑分口径不同——题目、预算、执行环境都不一样,A 的 90 分和 B 的 88 分不可比。
  • 「未知」是合法答案。查不到就写「未知」并说明为什么,不用推测填充。缺信息本身也是信息。
  • 每条判断挂官方源。来源链接、类型与核验日都在详情页里,可以逐条回去复核。
  • lifecycle 单独标注。核验日新不等于数据有效——上游归档后数据会失效,所以单独标 active / maintenance / archived。
  • 不同层不混排。成品 agent、自己搭的底座、给 agent 装的工具是三种角色,坐标系不同;硬合成一张 33 行的表只会制造假的可比性。

可信度标记怎么读

详情页与上表都带 confidence,它反映本站数据的完整度,不是对产品的评价。

verified8 个维度均有官方源支撑,且核验日在 90 天内
partial部分维度标为未知,或官方文档不可访问,或核验日超过 90 天
stale官方已发布重大变化,本站尚未核验

本站当前的完整度

数据层用 node scripts/audit-gaps.mjs 可随时复核这个数字。 以下是最近一次核验的快照(核验日 2026-09-29):

形态已补齐说明
IDE 形态 29/64 多为闭源产品,索引策略等细节官方不公开
CLI 形态 22/48 部分对象的官方文档不完整

全站合计 120/211 维度已补齐(57%)

剩余未补齐项分三类:官方未公开(索引算法、沙箱实现细节本就不对外说明)、 需实测才能确定(大仓库表现、CI 无 TTY 行为)、 客观渠道不可达。

我们选择留白而不是填「已支持」——错误的成本最终由使用者承担。

数据来源与复核方式

全部数据来自开源仓库 speculcom/ai-agent-guide(CC BY 4.0)。

每个条目都是纯 Markdown + frontmatter,含 8 个维度、证据链接、核验日与可信度标记。仓库内含:

  • METHODOLOGY.md —— 方法论总纲与四条核心规则
  • axes/ —— 每个维度的定义与判定标准(含正反例)
  • SCHEMA.md —— 数据格式规范与构建校验规则
  • tracks/*/tasks/_protocol.md —— 实测协议(尚未执行,故本站暂无实测结论)

发现错误或有新证据,欢迎提 Issue 或 PR——每条修正都会注明依据与影响范围。