# 节奏 · 档位、模型、成本与同类分工 · Codex · 多 Agent 的异步编码工作流

**作者** Aklman · **章节** 11 / 12 · **首发** 2026.08 · **语言** 中文为主, 中英双语
**原文** https://library.aklman.com/books/codex/11-cadence
**全书 markdown** https://library.aklman.com/books/codex/llms.md
**上一章** https://library.aklman.com/books/codex/10-review/llms.md
**下一章** https://library.aklman.com/books/codex/12-closing/llms.md

> 本章来自 Aklman · Library, 完整免费阅读。允许 AI 摘读、引用、问答; 转载请保留作者署名与原文链接 (CC BY-NC-ND 4.0, https://library.aklman.com/license)。

---

> 截至 2026-08-05,Codex 已覆盖 Free、Go 到组织档,Work 与 Codex 在可用时共用 agentic usage;计划内用量先消耗,eligible 账号再用 credits 延长。费率已按每百万 input / cached input / output token 计,Terra 与 Luna 又在 7 月审校后降价。本章把档位、Sol / Terra / Luna、多 Agent 总 token、fast mode 与 API key 两套账摆开,所有比例都写清分母。

选档的错误问法是「哪档划算」,正确问法是「我撞的是哪堵墙」。计划内用量不够,是一堵;模型不合适,是另一堵;等不起响应速度,是第三堵。三堵墙对应的开关不同,多 Agent 还会把账叠加:换模型可能省 credits,fast mode 会多吃 credits,升级或加购才抬高总量。这一章把计划、模型、力度与现行 token-based credits 摆开,最后划一条和同类的分工线。

### I · 档位与三堵墙

先把商业口径摆平:定价页把 Work 与 Codex 都列入 Free、Go、Plus、Pro、Business、Enterprise、Edu,不是另买一份「Work 订阅」;Free 是 quick、Go 是 light、Plus 起更完整。价格仍是 Free $0、Go $8、Plus $20、Pro 从 $100 起(选比 Plus 多 5× 或 20× 用量)、Business $20/人·月(年付;月付 $25)。[^1]但**内含关系不等于今天每个账号都看得到入口**:Help Center 仍把 Work 的网页 / 移动端可用性写成 eligible 付费账号,桌面也要套餐已经包含;Codex 则是桌面独立体验。读者若看不到 Work,先按账号 / 平台 / rollout 待核,不要据此推断计费另有一档。[^10]API key 是另一条账:按 API token 价付费,且没有 Codex cloud。计划内含用量先吃;eligible Plus / Pro 到限后才可加购 credits。Work 与 Codex 在可用处共用一池,切个界面不会凭空多一份额度。[^9]

| 你撞的墙 | 症状 | 开关 |
|---|---|---|
| 总量 | 计划内用量见底,新活停在门口 | 先降模型 / 收上下文;再考虑 credits 或升档 |
| 模型 | 难题上明显吃力 | 换 Sol、升思考力度(第 II 节) |
| 速度 | 交互时等不起 | /fast(走 credits,另一本账) |

这里必须删掉一套已经过期的心算:「Plus 每 5 小时能发 Sol 15–90 条,Pro 再乘 5 或 20」。2026 年 4 月起,Plus / Pro / Business 与新 Enterprise 的 Codex 用量已迁到**按实际 input / cached input / output token 折 credits**;少量既有 Enterprise 账户才可能仍在 legacy per-message。[^8]所以当前没有一张对多数人都成立的固定「每五小时消息数」表 —— 同一句 prompt,读十个文件和读一个文件不是一条消息的成本。判断顺序也该换:先看是哪种 token、哪个模型在烧,再决定收上下文、换模型、关 fast,最后才动钱包。

---

### II · 三兄弟与力度:两个旋钮

模型的日常分工是三个 GPT-5.6 兄弟。**Sol** 管复杂、开放、高价值的活(旗舰,拿不准就用它);**Terra** 是务实全能的日常主力;**Luna** 跑清晰可重复、量大的活:抽取、分类、转换。[^2]默认 Power 就是 Sol 加 medium 推理。最省事的路由是:架构、疑难 bug、最终打磨留 Sol;常规实现先 Terra;批量读 / 扫 / 整理先 Luna。云端对话的默认模型当前不能改,所以这套路由主要用于本地 app / CLI / IDE 与你配置的 subagent roles,别在 cloud UI 里找一个不存在的切换器。[^2]

第二个旋钮是**推理力度**:从 Light(应用)/ Low(CLI)、Medium、到 High、Extra High,控制它每一步想多深 —— 难题升档、机械活降档,同一个模型,力度对了常比换模型便宜。[^2]再上面有两个特殊档:**Max** 给单个任务更多推理时间;**Ultra** 会在 eligible Work 账号里主动用 subagents 并行拆解能分块的复杂活 —— 多数活两个都用不上,入口可见性也要按账号待核。[^2]**Ultra 不是包价**:它和你手动开的子线程一样,所有 agent 的 token 都进总账。需要可控路由时,用第 6 章的 `default_subagent_model` 和窄角色,别把每个探索线程都固定成 Sol。还有 Pro 专属的 **GPT-5.3-Codex-Spark**(研究预览):near-instant 的纯文本迭代,是独立模型、有自己的限额,和 fast mode 不是一回事。[^3]

---

### III · 成本:credits 按哪种 token 算

credits 不是「一条消息一个价」,也不是把所有 token 模糊揉成一团。现行标准 GPT-5.6 rate card 按**模型 × token 类型**分别算;下面每个数字的分母都是 100 万 token,单位是 credits:[^8]

| 模型 | 输入 / 100 万 | 缓存输入 / 100 万 | 输出 / 100 万 |
|---|---:|---:|---:|
| Sol | 125 | 12.50 | 750 |
| Terra | 50 | 5 | 300 |
| Luna | 5 | 0.50 | 30 |

同一 token 类型下,Terra 的**当前费率水平**是 Sol 的 40%(便宜 60%),Luna 是 Sol 的 4%(便宜 96%);分母始终是 100 万同类 token。输出又是同模型输入的 6 倍,缓存输入是普通输入的十分之一。[^8]别把水平差当成一段时间里的降幅:和本书 2026-07-17 的实测表相比,Terra 三类单价都从 62.5 / 6.25 / 375 降到当前 50 / 5 / 300,即**各降 20%**;Luna 从 25 / 2.5 / 150 降到 5 / 0.5 / 30,即**各降 80%**。这是以 7 月 17 日旧价为分母的变化比较。费率会变,读到时先看实时表。

多 Agent 的账最容易被「并行更快」遮住。主线程、explorer、worker、reviewer 各自读上下文、推理、回摘要;rate card 明确说 Ultra 任务里的**所有 agent token 都计入总量**,手动子线程也该按同一总账心算。[^8]并发缩短的是**墙上时间**,不保证降低 token。第 6 章的省钱顺序因此很具体:读密集型探索可并行,但限定目录与问题;子 agent 回结论与证据,不抄整份日志;写密集型只留一个 owner;用 `max_concurrent_threads_per_session` 限并发,再用 Luna / Terra 做适合的默认子 agent,把 Sol 留给架构与最终裁决。

支付顺序也别倒过来:先吃计划内含用量;eligible Plus / Pro 到限后才加购 credits,不必立刻升档。买到的 credits 在支持的 agentic 功能间共用,12 个月过期、不滚存;能不能买、能花在哪还受计划 / 地区 / rollout 影响。[^9]少量 legacy Enterprise 若仍按消息计,上表不直接套用 —— 看你组织后台的实际计费口径。

**Fast mode** 是用 credits 换等待,想清楚再开。以同一个 GPT-5.6 模型的 standard mode 为基准,官方平均速度约 1.5×(即快约 50%),credit 消耗却是 2.5×(即多 150%);`/fast on` 切。[^3]这是 ChatGPT 登录下的 credit 特性;API key 走 API token 价,没有这笔 credit 倍率。正确用法窄而清晰:赶工的一小时开,长自动化与 CI 关 —— 速度墙也会花钱,只是花法不同于总量墙。

最省钱的仍是纪律:**管住上下文与输出**。prompt 写精、只喂相关文件、AGENTS.md 保持短而准(第 5 章)、子 agent 角色收窄(第 6 章)、闲置 MCP 关掉(第 7 章)、常规活降到 Terra / Luna、别让 agent 复述整份日志。前面几章的每个习惯,现在都能在表里找到分母:上下文纪律,就是 credits 纪律。

---

### IV · 同类分工:入口跟着活走

最后划分工线 —— 不是黑稿,是各自的主场。**Claude Code**(Pro $20 / Max 从 $100,均含在订阅里)的主场在终端里的编排:计划、记忆、subagents、hooks 拼成的那套「派活 + 验收」循环,是它写得最透的地方。[^4]**Cursor**(Pro $20 起,顶上还有 Pro+ / Ultra)的主场在编辑器:你要「陪着改、盯每一步 diff」的工作节奏时,它的 agent 工作台仍是最顺的入口。[^5]**Copilot** 的主场在 GitHub 本体:Pro $10 起能把 issue 派给 Copilot 自家的 cloud agent、收回一个 PR;若要再转派给 Claude、Codex 这些第三方 coding agent,则要 Pro+ $39 或 Max。你的团队整个活在 GitHub 流程里时,它是那条流程自带的手。[^6]**Warp** 自我定位「面向 agentic coding 的现代终端」(Build $20/月):活以终端会话本身为中心时,它贴得更近。[^7]

Codex 自己的主场,是这本书的整条主线:**本地分工 + 隔离执行 + GitHub 验收** —— 已经付着 ChatGPT、常做「subagents 分头查、独立任务上云、回来收 PR」的人,先用的是计划内含用量;到限后才面对 credits / 升档的选择,不能再说成永远「不额外付费」。[^1][^9]组合原则仍只一句:**入口跟着活走,订阅别叠着买** —— 每加一份订阅,都该对应一类你真在做、且 Codex 明显干得不如它的活。

> 本章全部价格、档位、模型名与 credit rate 核对于 2026-08-05;这些是全书更换最勤的数字,读到时请以各家实时页为准。Work / Ultra 的账号可见性仍标作条件式待核。判断框架 —— 三堵墙、三兄弟加力度、按 token 类型看账 —— 比数字活得久。每个比例上面都写了类型、比较基准与分母;别把水平差读成一段时间里的涨跌。

动手 · 用一周数据代替直觉:

- 记录一周你每次「用不了」的原因:计划内用量见底、模型吃力、还是嫌慢 —— 别再记消息条数,记任务类型与模型。

- 把批量读 / 扫降到 Luna、常规实现放 Terra、难活留 Sol,跑一周对照 input / cached input / output 的 credit 分布。

- 只在赶工的一小时开 /fast,完事就关 —— 对照 standard 基线,确认快约 50% 是否值多 150% credits。

> 入口跟着活走,
> 订阅别叠着买

## 引用与参考

01 · OpenAI Codex 文档 · Pricing —— 页面把 Work 与 Codex 列为 ChatGPT Free、Go、Plus、Pro、Business、Enterprise、Edu 的内含能力,共用计划用量;Free 是 quick、Go 是 light、Plus 起更完整。价格:Free $0、Go $8、Plus $20、Pro 从 $100(选比 Plus 多 5× 或 20× 用量)、Business $20/人·月(年付,月付 $25)。实际 Work 入口仍受平台、账号与 rollout 限制;API key 旁路按 API token 计费、不含 Codex cloud。截至 2026-08-05。  (OpenAI · Codex pricing)
02 · OpenAI Codex 文档 · Models —— Codex 有三个 GPT-5.6 模型:Sol(复杂开放 / 高价值任务旗舰)、Terra(日常主力)、Luna(清晰可重复、量大的抽取 / 分类 / 转换)。默认 Power = Sol + medium。力度:Light(应用)/ Low(CLI)、Medium、High、Extra High;Max 给单任务更多推理,Ultra 会在 eligible Work 账号里主动用 subagents 并行拆解。gpt-5.2 与 gpt-5.3-codex 对 ChatGPT 登录的一般任务已弃用,但 GitHub / cloud code review 当前仍按 GPT-5.3-Codex 计费。云端对话默认模型不可改。截至 2026-08-05。  (OpenAI · Models)
03 · OpenAI Codex 文档 · Speed —— Fast mode 把支持的模型提速 1.5×,按更高倍率吃 credits:GPT-5.6 / 5.5 为标准的 2.5×,GPT-5.4 为 2×;/fast on|off|status 切,或 config 里 service_tier = "fast"。仅 ChatGPT 登录可用(是 credit 特性);API key 走 API token 价、无 credit 倍率。GPT-5.3-Codex-Spark 是另一个更快、能力较弱的独立模型(研究预览,仅 ChatGPT Pro),有自己的用量限额,和 fast mode 不是一回事。截至 2026-08-05。  (OpenAI · Speed)
04 · Claude · Pricing —— Pro:月付 $20,年付折合每月 $17(一次预付 $200);Max:从 $100 起,可选比 Pro 多 5× 或 20× 用量两档;Pro 与 Max 均含 Claude Code。截至 2026-08-05。  (Claude · Pricing)
05 · Cursor · Pricing —— Hobby 免费;个人付费从 Pro $20/月起(页面另有 Pro+ / Ultra 更高档);Teams $40/座·月,Enterprise 定制。卖点为 Agent 请求、code review、cloud agents。截至 2026-08-05。  (Cursor · Pricing)
06 · GitHub Copilot · Plans —— Free / Pro $10 / Pro+ $39 / Max $100(每人·月),另有 Business 与 Enterprise。Copilot 自家的 cloud agent /「把活派给 Copilot,它创建一个 pull request」从 Pro 起;但对比表里「把任务转派给 Claude、OpenAI Codex 等第三方 coding agent(Preview)」明确是 Pro 不含、Pro+ 与 Max 才含。页面顶部 Pro 摘要与详细对比行表述冲突,这里按更具体的 feature row 写 Pro+ 起。截至 2026-08-05。  (GitHub Copilot · Plans)
07 · Warp · Pricing —— 自我定位「面向 agentic coding 的现代终端」;Free / Build $20 / Max $200(月付),另有 Business $50/人·月(年付 $45)与 Enterprise。截至 2026-08-05。  (Warp · Pricing)
08 · OpenAI Help Center · Codex rate card —— 2026-04 起,Plus / Pro / Business 与新 Enterprise 的 Codex 用量从按消息迁到与 API token 对齐的 credits;少量既有 Enterprise 仍可能是 legacy per-message。2026-08-05 直接读取实时表确认,标准 GPT-5.6 每 100 万 token 的 credit rate:Sol 输入 125 / 缓存输入 12.5 / 输出 750;Terra 50 / 5 / 300;Luna 5 / 0.5 / 30。Ultra 没有独立单价:任务里所有 agent 的 token 都计入总量。code review 当前用 GPT-5.3-Codex 的独立费率。费率会变,以实时表为准。  (OpenAI · Codex rate card)
09 · OpenAI Help Center · Credits in ChatGPT —— 先用计划内含额度;eligible Plus / Pro 到限后可加购 credits,不用立刻升级。Work 与 Codex 在可用处共用计划用量和 credits;购买后 12 个月过期、不滚存、不可退款。实际可购性和适用功能因计划 / 地区 / rollout 而异。截至 2026-08-05。  (OpenAI · Credits in ChatGPT)
10 · OpenAI Help Center · ChatGPT Work and Codex —— Codex 是新版 ChatGPT 桌面应用里的独立体验;Work 在 eligible 付费账号的网页 / 移动端提供,桌面端仅在套餐已包含时出现。Codex 有独立入口与历史,不是普通 ChatGPT 网页 / 移动端的可选体验。入口可见性受账号与 rollout 影响。截至 2026-08-05。  (OpenAI · Work and Codex)

---

*节奏 · 档位、模型、成本与同类分工 · Codex · 多 Agent 的异步编码工作流 · Aklman 著 · CC BY-NC-ND 4.0 · https://library.aklman.com/books/codex/11-cadence*
