Aklman · Library

11 / 第十一章

节奏 · 档位、模型、成本与同类分工.

截至 2026-08-05,Codex 已覆盖 Free、Go 到组织档,Work 与 Codex 在可用时共用 agentic usage;计划内用量先消耗,eligible 账号再用 credits 延长。费率已按每百万 input / cached input / output token 计,Terra 与 Luna 又在 7 月审校后降价。本章把档位、Sol / Terra / Luna、多 Agent 总 token、fast mode 与 API key 两套账摆开,所有比例都写清分母。

MD海报

选档的错误问法是「哪档划算」,正确问法是「我撞的是哪堵墙」。计划内用量不够,是一堵;模型不合适,是另一堵;等不起响应速度,是第三堵。三堵墙对应的开关不同,多 Agent 还会把账叠加:换模型可能省 credits,fast mode 会多吃 credits,升级或加购才抬高总量。这一章把计划、模型、力度与现行 token-based credits 摆开,最后划一条和同类的分工线。

I

档位与三堵墙.

先把商业口径摆平:定价页把 Work 与 Codex 都列入 Free、Go、Plus、Pro、Business、Enterprise、Edu,不是另买一份「Work 订阅」;Free 是 quick、Go 是 light、Plus 起更完整。价格仍是 Free $0、Go $8、Plus $20、Pro 从 $100 起(选比 Plus 多 5× 或 20× 用量)、Business $20/人·月(年付;月付 $25)。1注 1OpenAI Codex 文档 · Pricing —— 页面把 Work 与 Codex 列为 ChatGPT Free、Go、Plus、Pro、Business、Enterprise、Edu 的内含能力,共用计划用量;Free 是 quick、Go 是 light、Plus 起更完整。价格:Free $0、Go $8、Plus $20、Pro 从 $100(选比 Plus 多 5× 或 20× 用量)、Business $20/人·月(年付,月付 $25)。实际 Work 入口仍受平台、账号与 rollout 限制;API key 旁路按 API token 计费、不含 Codex cloud。截至 2026-08-05。内含关系不等于今天每个账号都看得到入口:Help Center 仍把 Work 的网页 / 移动端可用性写成 eligible 付费账号,桌面也要套餐已经包含;Codex 则是桌面独立体验。读者若看不到 Work,先按账号 / 平台 / rollout 待核,不要据此推断计费另有一档。10注 10OpenAI Help Center · ChatGPT Work and Codex —— Codex 是新版 ChatGPT 桌面应用里的独立体验;Work 在 eligible 付费账号的网页 / 移动端提供,桌面端仅在套餐已包含时出现。Codex 有独立入口与历史,不是普通 ChatGPT 网页 / 移动端的可选体验。入口可见性受账号与 rollout 影响。截至 2026-08-05。API key 是另一条账:按 API token 价付费,且没有 Codex cloud。计划内含用量先吃;eligible Plus / Pro 到限后才可加购 credits。Work 与 Codex 在可用处共用一池,切个界面不会凭空多一份额度。9注 9OpenAI Help Center · Credits in ChatGPT —— 先用计划内含额度;eligible Plus / Pro 到限后可加购 credits,不用立刻升级。Work 与 Codex 在可用处共用计划用量和 credits;购买后 12 个月过期、不滚存、不可退款。实际可购性和适用功能因计划 / 地区 / rollout 而异。截至 2026-08-05。
你撞的墙症状开关
总量计划内用量见底,新活停在门口先降模型 / 收上下文;再考虑 credits 或升档
模型难题上明显吃力换 Sol、升思考力度(第 II 节)
速度交互时等不起/fast(走 credits,另一本账)
这里必须删掉一套已经过期的心算:「Plus 每 5 小时能发 Sol 15–90 条,Pro 再乘 5 或 20」。2026 年 4 月起,Plus / Pro / Business 与新 Enterprise 的 Codex 用量已迁到按实际 input / cached input / output token 折 credits;少量既有 Enterprise 账户才可能仍在 legacy per-message。8注 8OpenAI Help Center · Codex rate card —— 2026-04 起,Plus / Pro / Business 与新 Enterprise 的 Codex 用量从按消息迁到与 API token 对齐的 credits;少量既有 Enterprise 仍可能是 legacy per-message。2026-08-05 直接读取实时表确认,标准 GPT-5.6 每 100 万 token 的 credit rate:Sol 输入 125 / 缓存输入 12.5 / 输出 750;Terra 50 / 5 / 300;Luna 5 / 0.5 / 30。Ultra 没有独立单价:任务里所有 agent 的 token 都计入总量。code review 当前用 GPT-5.3-Codex 的独立费率。费率会变,以实时表为准。所以当前没有一张对多数人都成立的固定「每五小时消息数」表 —— 同一句 prompt,读十个文件和读一个文件不是一条消息的成本。判断顺序也该换:先看是哪种 token、哪个模型在烧,再决定收上下文、换模型、关 fast,最后才动钱包。

II

三兄弟与力度:两个旋钮.

模型的日常分工是三个 GPT-5.6 兄弟。Sol 管复杂、开放、高价值的活(旗舰,拿不准就用它);Terra 是务实全能的日常主力;Luna 跑清晰可重复、量大的活:抽取、分类、转换。2注 2OpenAI Codex 文档 · Models —— Codex 有三个 GPT-5.6 模型:Sol(复杂开放 / 高价值任务旗舰)、Terra(日常主力)、Luna(清晰可重复、量大的抽取 / 分类 / 转换)。默认 Power = Sol + medium。力度:Light(应用)/ Low(CLI)、Medium、High、Extra High;Max 给单任务更多推理,Ultra 会在 eligible Work 账号里主动用 subagents 并行拆解。gpt-5.2 与 gpt-5.3-codex 对 ChatGPT 登录的一般任务已弃用,但 GitHub / cloud code review 当前仍按 GPT-5.3-Codex 计费。云端对话默认模型不可改。截至 2026-08-05。默认 Power 就是 Sol 加 medium 推理。最省事的路由是:架构、疑难 bug、最终打磨留 Sol;常规实现先 Terra;批量读 / 扫 / 整理先 Luna。云端对话的默认模型当前不能改,所以这套路由主要用于本地 app / CLI / IDE 与你配置的 subagent roles,别在 cloud UI 里找一个不存在的切换器。2注 2OpenAI Codex 文档 · Models —— Codex 有三个 GPT-5.6 模型:Sol(复杂开放 / 高价值任务旗舰)、Terra(日常主力)、Luna(清晰可重复、量大的抽取 / 分类 / 转换)。默认 Power = Sol + medium。力度:Light(应用)/ Low(CLI)、Medium、High、Extra High;Max 给单任务更多推理,Ultra 会在 eligible Work 账号里主动用 subagents 并行拆解。gpt-5.2 与 gpt-5.3-codex 对 ChatGPT 登录的一般任务已弃用,但 GitHub / cloud code review 当前仍按 GPT-5.3-Codex 计费。云端对话默认模型不可改。截至 2026-08-05。 第二个旋钮是推理力度:从 Light(应用)/ Low(CLI)、Medium、到 High、Extra High,控制它每一步想多深 —— 难题升档、机械活降档,同一个模型,力度对了常比换模型便宜。2注 2OpenAI Codex 文档 · Models —— Codex 有三个 GPT-5.6 模型:Sol(复杂开放 / 高价值任务旗舰)、Terra(日常主力)、Luna(清晰可重复、量大的抽取 / 分类 / 转换)。默认 Power = Sol + medium。力度:Light(应用)/ Low(CLI)、Medium、High、Extra High;Max 给单任务更多推理,Ultra 会在 eligible Work 账号里主动用 subagents 并行拆解。gpt-5.2 与 gpt-5.3-codex 对 ChatGPT 登录的一般任务已弃用,但 GitHub / cloud code review 当前仍按 GPT-5.3-Codex 计费。云端对话默认模型不可改。截至 2026-08-05。再上面有两个特殊档:Max 给单个任务更多推理时间;Ultra 会在 eligible Work 账号里主动用 subagents 并行拆解能分块的复杂活 —— 多数活两个都用不上,入口可见性也要按账号待核。2注 2OpenAI Codex 文档 · Models —— Codex 有三个 GPT-5.6 模型:Sol(复杂开放 / 高价值任务旗舰)、Terra(日常主力)、Luna(清晰可重复、量大的抽取 / 分类 / 转换)。默认 Power = Sol + medium。力度:Light(应用)/ Low(CLI)、Medium、High、Extra High;Max 给单任务更多推理,Ultra 会在 eligible Work 账号里主动用 subagents 并行拆解。gpt-5.2 与 gpt-5.3-codex 对 ChatGPT 登录的一般任务已弃用,但 GitHub / cloud code review 当前仍按 GPT-5.3-Codex 计费。云端对话默认模型不可改。截至 2026-08-05。Ultra 不是包价:它和你手动开的子线程一样,所有 agent 的 token 都进总账。需要可控路由时,用第 6 章的 default_subagent_model 和窄角色,别把每个探索线程都固定成 Sol。还有 Pro 专属的 GPT-5.3-Codex-Spark(研究预览):near-instant 的纯文本迭代,是独立模型、有自己的限额,和 fast mode 不是一回事。3注 3OpenAI Codex 文档 · Speed —— Fast mode 把支持的模型提速 1.5×,按更高倍率吃 credits:GPT-5.6 / 5.5 为标准的 2.5×,GPT-5.4 为 2×;/fast on|off|status 切,或 config 里 service_tier = "fast"。仅 ChatGPT 登录可用(是 credit 特性);API key 走 API token 价、无 credit 倍率。GPT-5.3-Codex-Spark 是另一个更快、能力较弱的独立模型(研究预览,仅 ChatGPT Pro),有自己的用量限额,和 fast mode 不是一回事。截至 2026-08-05。

III

成本:credits 按哪种 token 算.

credits 不是「一条消息一个价」,也不是把所有 token 模糊揉成一团。现行标准 GPT-5.6 rate card 按模型 × token 类型分别算;下面每个数字的分母都是 100 万 token,单位是 credits:8注 8OpenAI Help Center · Codex rate card —— 2026-04 起,Plus / Pro / Business 与新 Enterprise 的 Codex 用量从按消息迁到与 API token 对齐的 credits;少量既有 Enterprise 仍可能是 legacy per-message。2026-08-05 直接读取实时表确认,标准 GPT-5.6 每 100 万 token 的 credit rate:Sol 输入 125 / 缓存输入 12.5 / 输出 750;Terra 50 / 5 / 300;Luna 5 / 0.5 / 30。Ultra 没有独立单价:任务里所有 agent 的 token 都计入总量。code review 当前用 GPT-5.3-Codex 的独立费率。费率会变,以实时表为准。
模型输入 / 100 万缓存输入 / 100 万输出 / 100 万
Sol12512.50750
Terra505300
Luna50.5030
同一 token 类型下,Terra 的当前费率水平是 Sol 的 40%(便宜 60%),Luna 是 Sol 的 4%(便宜 96%);分母始终是 100 万同类 token。输出又是同模型输入的 6 倍,缓存输入是普通输入的十分之一。8注 8OpenAI Help Center · Codex rate card —— 2026-04 起,Plus / Pro / Business 与新 Enterprise 的 Codex 用量从按消息迁到与 API token 对齐的 credits;少量既有 Enterprise 仍可能是 legacy per-message。2026-08-05 直接读取实时表确认,标准 GPT-5.6 每 100 万 token 的 credit rate:Sol 输入 125 / 缓存输入 12.5 / 输出 750;Terra 50 / 5 / 300;Luna 5 / 0.5 / 30。Ultra 没有独立单价:任务里所有 agent 的 token 都计入总量。code review 当前用 GPT-5.3-Codex 的独立费率。费率会变,以实时表为准。别把水平差当成一段时间里的降幅:和本书 2026-07-17 的实测表相比,Terra 三类单价都从 62.5 / 6.25 / 375 降到当前 50 / 5 / 300,即各降 20%;Luna 从 25 / 2.5 / 150 降到 5 / 0.5 / 30,即各降 80%。这是以 7 月 17 日旧价为分母的变化比较。费率会变,读到时先看实时表。 多 Agent 的账最容易被「并行更快」遮住。主线程、explorer、worker、reviewer 各自读上下文、推理、回摘要;rate card 明确说 Ultra 任务里的所有 agent token 都计入总量,手动子线程也该按同一总账心算。8注 8OpenAI Help Center · Codex rate card —— 2026-04 起,Plus / Pro / Business 与新 Enterprise 的 Codex 用量从按消息迁到与 API token 对齐的 credits;少量既有 Enterprise 仍可能是 legacy per-message。2026-08-05 直接读取实时表确认,标准 GPT-5.6 每 100 万 token 的 credit rate:Sol 输入 125 / 缓存输入 12.5 / 输出 750;Terra 50 / 5 / 300;Luna 5 / 0.5 / 30。Ultra 没有独立单价:任务里所有 agent 的 token 都计入总量。code review 当前用 GPT-5.3-Codex 的独立费率。费率会变,以实时表为准。并发缩短的是墙上时间,不保证降低 token。第 6 章的省钱顺序因此很具体:读密集型探索可并行,但限定目录与问题;子 agent 回结论与证据,不抄整份日志;写密集型只留一个 owner;用 max_concurrent_threads_per_session 限并发,再用 Luna / Terra 做适合的默认子 agent,把 Sol 留给架构与最终裁决。 支付顺序也别倒过来:先吃计划内含用量;eligible Plus / Pro 到限后才加购 credits,不必立刻升档。买到的 credits 在支持的 agentic 功能间共用,12 个月过期、不滚存;能不能买、能花在哪还受计划 / 地区 / rollout 影响。9注 9OpenAI Help Center · Credits in ChatGPT —— 先用计划内含额度;eligible Plus / Pro 到限后可加购 credits,不用立刻升级。Work 与 Codex 在可用处共用计划用量和 credits;购买后 12 个月过期、不滚存、不可退款。实际可购性和适用功能因计划 / 地区 / rollout 而异。截至 2026-08-05。少量 legacy Enterprise 若仍按消息计,上表不直接套用 —— 看你组织后台的实际计费口径。 Fast mode 是用 credits 换等待,想清楚再开。以同一个 GPT-5.6 模型的 standard mode 为基准,官方平均速度约 1.5×(即快约 50%),credit 消耗却是 2.5×(即多 150%);/fast on 切。3注 3OpenAI Codex 文档 · Speed —— Fast mode 把支持的模型提速 1.5×,按更高倍率吃 credits:GPT-5.6 / 5.5 为标准的 2.5×,GPT-5.4 为 2×;/fast on|off|status 切,或 config 里 service_tier = "fast"。仅 ChatGPT 登录可用(是 credit 特性);API key 走 API token 价、无 credit 倍率。GPT-5.3-Codex-Spark 是另一个更快、能力较弱的独立模型(研究预览,仅 ChatGPT Pro),有自己的用量限额,和 fast mode 不是一回事。截至 2026-08-05。这是 ChatGPT 登录下的 credit 特性;API key 走 API token 价,没有这笔 credit 倍率。正确用法窄而清晰:赶工的一小时开,长自动化与 CI 关 —— 速度墙也会花钱,只是花法不同于总量墙。 最省钱的仍是纪律:管住上下文与输出。prompt 写精、只喂相关文件、AGENTS.md 保持短而准(第 5 章)、子 agent 角色收窄(第 6 章)、闲置 MCP 关掉(第 7 章)、常规活降到 Terra / Luna、别让 agent 复述整份日志。前面几章的每个习惯,现在都能在表里找到分母:上下文纪律,就是 credits 纪律。

IV

同类分工:入口跟着活走.

最后划分工线 —— 不是黑稿,是各自的主场。Claude Code(Pro $20 / Max 从 $100,均含在订阅里)的主场在终端里的编排:计划、记忆、subagents、hooks 拼成的那套「派活 + 验收」循环,是它写得最透的地方。4注 4Claude · Pricing —— Pro:月付 $20,年付折合每月 $17(一次预付 $200);Max:从 $100 起,可选比 Pro 多 5× 或 20× 用量两档;Pro 与 Max 均含 Claude Code。截至 2026-08-05。Cursor(Pro $20 起,顶上还有 Pro+ / Ultra)的主场在编辑器:你要「陪着改、盯每一步 diff」的工作节奏时,它的 agent 工作台仍是最顺的入口。5注 5Cursor · Pricing —— Hobby 免费;个人付费从 Pro $20/月起(页面另有 Pro+ / Ultra 更高档);Teams $40/座·月,Enterprise 定制。卖点为 Agent 请求、code review、cloud agents。截至 2026-08-05。Copilot 的主场在 GitHub 本体:Pro $10 起能把 issue 派给 Copilot 自家的 cloud agent、收回一个 PR;若要再转派给 Claude、Codex 这些第三方 coding agent,则要 Pro+ $39 或 Max。你的团队整个活在 GitHub 流程里时,它是那条流程自带的手。6注 6GitHub Copilot · Plans —— Free / Pro $10 / Pro+ $39 / Max $100(每人·月),另有 Business 与 Enterprise。Copilot 自家的 cloud agent /「把活派给 Copilot,它创建一个 pull request」从 Pro 起;但对比表里「把任务转派给 Claude、OpenAI Codex 等第三方 coding agent(Preview)」明确是 Pro 不含、Pro+ 与 Max 才含。页面顶部 Pro 摘要与详细对比行表述冲突,这里按更具体的 feature row 写 Pro+ 起。截至 2026-08-05。Warp 自我定位「面向 agentic coding 的现代终端」(Build $20/月):活以终端会话本身为中心时,它贴得更近。7注 7Warp · Pricing —— 自我定位「面向 agentic coding 的现代终端」;Free / Build $20 / Max $200(月付),另有 Business $50/人·月(年付 $45)与 Enterprise。截至 2026-08-05。 Codex 自己的主场,是这本书的整条主线:本地分工 + 隔离执行 + GitHub 验收 —— 已经付着 ChatGPT、常做「subagents 分头查、独立任务上云、回来收 PR」的人,先用的是计划内含用量;到限后才面对 credits / 升档的选择,不能再说成永远「不额外付费」。1注 1OpenAI Codex 文档 · Pricing —— 页面把 Work 与 Codex 列为 ChatGPT Free、Go、Plus、Pro、Business、Enterprise、Edu 的内含能力,共用计划用量;Free 是 quick、Go 是 light、Plus 起更完整。价格:Free $0、Go $8、Plus $20、Pro 从 $100(选比 Plus 多 5× 或 20× 用量)、Business $20/人·月(年付,月付 $25)。实际 Work 入口仍受平台、账号与 rollout 限制;API key 旁路按 API token 计费、不含 Codex cloud。截至 2026-08-05。9注 9OpenAI Help Center · Credits in ChatGPT —— 先用计划内含额度;eligible Plus / Pro 到限后可加购 credits,不用立刻升级。Work 与 Codex 在可用处共用计划用量和 credits;购买后 12 个月过期、不滚存、不可退款。实际可购性和适用功能因计划 / 地区 / rollout 而异。截至 2026-08-05。组合原则仍只一句:入口跟着活走,订阅别叠着买 —— 每加一份订阅,都该对应一类你真在做、且 Codex 明显干得不如它的活。 动手 · 用一周数据代替直觉:

入口跟着活走, 订阅别叠着买.

Entrances follow the work; don't stack subscriptions.

Aklman Library

讨论

讨论.

评论区初始化中…