# 发动机 · Agent 自己把活干完 · Cursor · 一台元工具

**作者** Aklman · **章节** 03 / 11 · **首发** 2026.07 · **语言** 中文为主, 中英双语
**原文** https://library.aklman.com/books/cursor/03-agent
**全书 markdown** https://library.aklman.com/books/cursor/llms.md
**上一章** https://library.aklman.com/books/cursor/02-base/llms.md
**下一章** https://library.aklman.com/books/cursor/04-terminal/llms.md

> 本章来自 Aklman · Library, 完整免费阅读。允许 AI 摘读、引用、问答; 转载请保留作者署名与原文链接 (CC BY-NC-ND 4.0, https://library.aklman.com/license)。

---

> Chat 给你一段代码，你再去粘、去跑、去改。Agent 不是 —— 它自己改多个文件、自己在终端跑命令、看结果、再调整，直到这件事做完。这是 Cursor 从「编辑器」变成「工作台」的那台发动机。这一章讲怎么给它定任务、它默认用哪个模型、什么时候该换前沿模型或开 Max，以及别让它漫无目的地跑。

Chat 给你一段代码，你再去粘、去跑、去改。Agent 不是这样 —— 它自己改多个文件、自己在终端跑命令、看结果、再调整，直到这件事做完。

这是 Cursor 从「编辑器」变成「工作台」的那台发动机，也是你多付那笔钱真正买到的东西。前一章的底座替你打字，这一章的 Agent 替你把一件事跑完 —— 这本书后面所有的面（终端、索引、MCP、云端），都是给这台发动机加燃料。

### I · 它的循环：改、跑、看、再改

Agent 不是给你代码，是替你把一件事跑完。

给它一个任务（Cmd+I），它会跨文件改代码、在终端跑命令、读回输出、对索引过的代码库做语义搜索、必要时开浏览器验证、调你接的 MCP 工具 —— 然后看结果不对就自己调整，直到达成。[^1]这一圈「改 → 跑 → 看 → 再改」是它和 Chat 的本质区别：Chat 把一段代码丢给你，闭环在你手上；Agent 把闭环收在它自己手里。

你的工作因此换了形状：从「逐行写」变成「定义任务、审结果」。这不是说你不看代码了 —— 是你看的从「每一行怎么敲」挪到「这个 diff 对不对」。会用 Agent 的人，省下的不是打字，是把注意力从执行挪到判断。

---

### II · 先 Plan，别让它瞎跑

把验收标准定在前面，它就不容易跑偏；不定，它会很自信地做错。

复杂、要动很多文件、有多种做法的任务，先按 Shift+Tab 进 Plan 模式：它会提澄清问题、研究你的代码库，生成一份可编辑的实现计划，你审完、改完再让它动手。[^2]计划默认存在 home，可以 Save to workspace 给团队看。最值得记的一条：如果它做偏了，回到计划改，比在执行里一处处纠错更干净。

尺子很简单：一句话能说清的小改动、你做过很多遍的活，直接 Agent；要动很多文件、有多种做法、或你自己都没想清楚的，先 Plan。它最强的活是「有明确验收标准」的 —— 先写测试再让它实现，跑得过测试就是做完。别在 Agent 里跑漫无目的的长会话，它会越改越远。会话卫生很简单：一会话一任务、任务尽量控制在三五个文件；一看它在报错里越钻越深，就按 ESC 停、回到计划，别由着它继续挖。岔出去的问题 —— 查个用法、比较个替代方案 —— 别塞进主会话：3.11 起可以用 /side 开一个 side chat，它带着主线的上下文、默认只查只答不动手，答案要用再 @ 回主线。[^4]主会话保持一件事。

| 任务大小 | 适合入口 | 例子 | 验收 |
|---|---|---|---|
| S | Cmd+K / Agent | 改一个函数、补一个错误分支 | 肉眼 review + 单测 |
| M | Agent | 跨 2–5 个文件修 bug、补测试、改文档 | 明确测试命令 + diff review |
| L | Plan → Agent | 重构一块模块、改 API 契约、迁移配置 | 先审计划，再分阶段跑测试 |
| XL | 拆成多个 Agent / 多个 PR | 优化整个项目、重做架构、迁移框架 | 先写 spec，不直接跑 |

| 阶段 | 你给什么 | Agent 做什么 | 你审什么 |
|---|---|---|---|
| Plan | 目标、范围、禁止事项、验收标准 | 读代码、提方案、列文件和测试 | 是否越界、是否漏了验收 |
| Edit | 批准后的计划 | 改文件、保持小步 | 是否碰了不该碰的文件 |
| Run | 允许跑的命令类型 | 跑测试、lint、脚本、读输出 | 命令是否可逆、输出是否可信 |
| Test | 测试命令和通过标准 | 修到通过或解释阻塞 | 是否只修了症状 |
| Review | 你自己的判断 | 解释 diff、列风险 | 设计意图、安全、成本、回滚 |

**提示词 · Cursor Agent**

```text
目标：<一句话说清要做成什么>
验收：
- <可检验的条件，最好能跑测试>
- <另一个条件>
约束：用<某库 / 某风格>，别碰<某目录 / 文件>
先给计划，我确认后再动手。
```

**示例**

```text
目标：给 /api/orders 加分页，支持 page 和 pageSize 两个查询参数
验收：
- tests/orders.test.ts 全绿，新增一条「翻到第二页拿到下一批」的用例
- pageSize 上限 100，超出返回 400
约束：用现有的 zod 校验，别碰 lib/db.ts 的连接逻辑
先给计划，我确认后再动手。
```

- 禁止把「优化一下项目」「提升质量」「整理一下」这种模糊任务直接交给 Agent。

- 禁止让它无监督处理生产数据库、真实支付、密钥、云控制台、删除类批处理。

- 禁止把你自己都没有验收标准的任务交给 Cloud Agents 长跑。

- 禁止把 Bugbot 或 Agent 的解释当成人工 code review 结论。

---

### III · 它背后用哪个模型：默认 Auto

日常活让 Auto 选，难的那一成才手动换前沿模型。

Auto 在智能、成本、稳定之间替你路由，配上 Cursor 自家的 Composer 2.5（专为 agentic 编码训练、又快又省 —— 现在连 Bugbot 也由它驱动），覆盖你大多数的活；这套走的是更宽的「第一方模型池」（Auto、Composer 2.5、Grok 4.5 共用）。[^3]遇到难推理、长链路、它反复卡住的题，再手动切到前沿模型（Claude / GPT / Gemini 这些，走 API 池）；不想自己挑，还有 Premium 路由替你直接挑最强的、按该模型 API 价计费；上下文实在塞不下时开 Max（最大上下文窗口，按模型 API 价计费，烧得快）。

判断：默认就让 Auto 跑，别每次手动挑模型 —— 那是在替路由器干活，还更费额度。模型不是越贵越好，是越贵越该留给真难的题。计费的细账（两套额度池、Max 怎么算）放到第 10 章一起说。

> 让它先写测试、再实现 —— 验收标准定死，它就不容易跑偏；把项目规范和常用命令写进 AGENTS.md（第 6 章），省得每次重新交代。任务大就先 Plan，宁可在计划上多花五分钟，不在错的执行上耗半小时。

- Diff 是否只动了任务范围内的文件？

- 测试是新增真实断言，还是只改了快照 / 跳过失败？

- 有没有新依赖、网络调用、权限扩大、配置改动？

- 失败路径、回滚路径、日志是否还说得通？

- 它解释的风险，和你自己看到的风险是否一致？

把这章用到一个你最近手动做过的改动上 —— 编码或非编码都行：

- **挑一个跨 3 个以上文件的小任务**:
 可以是代码改动，也可以是非代码的（整理一个笔记文件夹并生成索引、按规则改一批文件）。

- **先 Plan，把验收标准写清楚，再让 Agent 动手**:
 你只定义任务和「做完算什么样」，让它去改，你不逐行写。

- **审它的 diff，记下分工**:
 记下哪一步它明显比你快、哪一步你还得自己来。这条分工就是你之后该不该开 Agent 的依据。

> 你从写每一行，
> 变成定义任务、审结果

## 引用与参考

01 · Cursor Docs · Agent —— Agent（Cmd+I）会跨文件改代码、执行终端命令并读输出、对索引过的代码库做语义搜索、控制浏览器验证、调 MCP 工具，看结果后自我调整直到任务完成。截至 2026-07-10。  (Cursor Docs · Agent)
02 · Cursor Docs · Plan Mode —— Shift+Tab 进入；Agent 先提澄清问题、研究代码库，生成一份可编辑、可审阅的实现计划（默认存 home，可 Save to workspace），批准后再动手；结果偏了「回到计划」比中途纠错更干净。  (Cursor Docs · Plan Mode)
03 · Cursor Docs · Models —— 个人档两套额度池：「第一方模型池」（Auto、Composer 2.5、Grok 4.5，included 用量宽得多）与 API 池（手动选 Claude / GPT / Gemini 等前沿模型，按该模型 API 价）。Auto 在智能/成本/稳定间路由；另有 Premium 路由，替你挑最强模型、按所选模型 API 价计费；Max（最大上下文）按模型 API 价。Composer 2.5 是 Cursor 自家 agentic 模型，官方 changelog（2026-06-10）称其现在也驱动 Bugbot。截至 2026-07-10。  (Cursor Docs · Models)
04 · Cursor Changelog · 3.11（2026-07-10）—— Side chats：/side 或 /btw 在主会话旁开一个带上下文的支线会话，默认偏向只读的查证与回答，可事后 @ 回主线；Agents 窗口新增会话转录搜索（Cmd+K），会话内 Cmd+F。  (Cursor Changelog · Side chats)

---

*发动机 · Agent 自己把活干完 · Cursor · 一台元工具 · Aklman 著 · CC BY-NC-ND 4.0 · https://library.aklman.com/books/cursor/03-agent*
