Aklman · Library

03 / 第三章

路由 · 模型路由表.

输入框那个模型名,你大概从没换过。这一章你拿自己的三个真问题跑一次对照,做出一张属于你的三行路由表 —— 哪类活走 Haiku,哪类走 Sonnet,哪类值得花 Opus,然后把结论钉进工作区默认。

MD海报

输入框右上角那个模型名,是你每次对话都在用、却几乎从没动过的开关。默认那一档不一定是最划算的那一档 —— 但「哪一档划算」这件事,别人替你答不了,只能你拿自己的活跑一遍。

I

当前阵容,与三种代价.

Sonnet 是默认主力,Opus 贵在难题,Haiku 快在量大。 三个日常主力,价格差到 5 倍。截至 2026-08:1注 1Claude API Docs · Models overview —— 当前阵容:Claude Opus 5($5/$25 每百万输入/输出 token,1M 上下文,128K 输出)、Claude Sonnet 5($3/$15,1M;至 2026-08-31 入门价 $2/$10)、Claude Haiku 4.5($1/$5,200K,64K 输出)。Opus 4.8 / 4.7 / 4.6、Sonnet 4.6 / 4.5 等已列入 legacy。截至 2026-08。
模型每百万 token(入/出)上下文什么时候选它
Claude Opus 5$5 / $251M最难的推理、长代码、要一次想透的题
Claude Sonnet 5$3 / $151M日常主力:大多数活它就够(至 8 月底入门价 $2/$10)
Claude Haiku 4.5$1 / $5200K量大、要快、不烧脑的轻活
对只用网页的人,价格不体现为账单,而是三种代价 —— 而且只有第一种你能直接感觉到:
额度消耗速度
同一件活,Opus 比 Sonnet 更快撞到限额。这是你唯一能直接观察到的代价,也是第 11 章那本账要记的东西。
等待时间
越强的模型想得越久。一个五分钟的深度回答和一个八秒的够用回答,在「我正等着用」的场景里不是同一件商品。
你的注意力
被低估的一种。弱模型答得快,但你要多审两遍 —— 省下的额度换成了你的时间,这笔账常常是亏的。
所以那句常听的「贵的模型买的不是上限,是下限」有一半是对的:你多花的额度,换的是它在难题上更少翻车 —— 但只有当你真的在做难题时才成立。

II

思考已经不是一个开关.

模型自己决定想多久,你不用再替它按。 当前主力模型都用「自适应思考」—— 按任务难度自动决定要不要多想一会儿、想多久,旧版那个手动的「延长思考」token 预算,在当代模型上已经移除。3注 3Claude API Docs · Models overview —— 当前模型使用自适应思考(模型自行决定想多久),手动的「延长思考」token 预算已在当代模型上移除;effort 参数在 Claude Opus 5 与 Sonnet 5 上于 Claude API 与 Claude Code 默认 high。截至 2026-08。如果你从来没动过那个开关,什么都不用改。 代价和以前一样:想得越多,推理越稳,额度消耗也越快。所以同一段提示,复杂题比简单题更耗额度 —— 因为它在后台多想了。这意味着你真正在调的从来不是「开不开思考」,而是「我这件活配不配得上它想那么久」。那正是这一章要你做的路由表。

III

动手:跑一次三行对照.

十五分钟,换掉你以后几百次对话的默认选项。
01

从近一周的对话里挑三个真问题

一个简单的(查个说法、翻译一段、格式转换),一个中等的(写一段东西、整理一份材料),一个真正烧脑的(多步推理、长文档综合、难调的 bug)。必须是你真问过的 —— 编的题会得到编的结论。
02

每个问题在两个模型上各跑一遍

简单题跑 Haiku 和 Sonnet,中等题跑 Sonnet 和 Opus,烧脑题跑 Sonnet 和 Opus。同一句提示词,不要改。每次记三样:答案够不够用、等了多久、你有没有再追问。
03

只问一个问题:便宜那档够不够用

不是「哪个更好」——贵的那个几乎总是略好一点,那个比较没有意义。要问的是:便宜那档的答案,我能不能直接用?能,这行就归它。
04

写成三行,钉进工作区

按「这类活 → 走这个模型 → 因为」写三行。然后把结论钉进你常用的工作区默认(第 4 章会建那个 Project)—— 光记在脑子里,两周后你又回到默认那档了。
嫌自己判断费劲,可以让它先替你定档、再动手 —— 这一句同时也是个长期习惯:把「该用哪档」变成它每次开工前的第一步。
提示词让 Claude 替你定档
先别急着答。看一眼下面这个任务,告诉我:
1. 它该用 Haiku、Sonnet 还是 Opus?一句话说为什么(按难度 / 步数 / 有没有唯一正确答案)。
2. 如果我现在用的档比你建议的高,说清高在哪儿浪费了。
说完你的判断,再按它直接做。
任务:<把你的任务贴这里>
先别急着答。看一眼下面这个任务,告诉我:
1. 它该用 Haiku、Sonnet 还是 Opus?一句话说为什么(按难度 / 步数 / 有没有唯一正确答案)。
2. 如果我现在用的档比你建议的高,说清高在哪儿浪费了。
说完你的判断,再按它直接做。
任务:把这段 300 字的产品公告翻成英文,保留所有数字和产品名,语气正式。
错了要紧 · 做一遍Opus。一次性的高风险判断 —— 合同条款、架构选型、要发出去的对外声明。这格最值得花。
错了要紧 · 做很多遍Opus 打样,Sonnet 量产。先用 Opus 把一件做到位、连同判断标准一起沉淀成 Skill(第 5 章),之后交给 Sonnet 照着做。
错了不要紧 · 做一遍Sonnet,别想了。这格占你日常的大头,而它的正确答案就是「用默认那档,别在选模型上花时间」。
错了不要紧 · 做很多遍Haiku。批量分类、格式转换、初筛。这格是唯一一个「换到更便宜的档」能立刻见效的地方。
两个轴就够:这件活错了要不要紧(纵),和你要做多少遍(横)。跑完对照之后,把你的三行填进对应的格子 —— 大多数人会发现自己长期站在右上角,用最贵的档做量大又不要紧的活。

IV

换个域,路由表长什么样.

Haiku:把英文材料批量翻成中文、生成填空卡片、把一节笔记压成三句话。Sonnet:讲解一个概念、出练习题、批改我的答案。Opus:留给「我卡住了、而且不知道自己卡在哪」的那种题 —— 它更擅长指出你问错了问题。这一栏的经验是:批改用 Sonnet 就够,但「为什么我这个思路是错的」值得上 Opus。
Haiku:抽取元数据、按关键词初筛一批文献、统一引用格式。Sonnet:读单篇、写摘要、做对比表。Opus:跨十几个来源的综合,尤其是证据互相打架、需要有人指出「这两篇的分歧其实在样本选择上」的时候 —— 便宜的档在这里会把分歧抹平,而抹平了你看不出来。这一栏是全书里最不该省钱的地方。
Haiku:写测试桩、批量改名、生成样板代码、把报错翻译成人话。Sonnet:日常改功能、写单测、code review 第一遍。Opus:调那种「日志看着一切正常但结果就是不对」的 bug,和要动多个模块的重构。判断标准很土但很准:你自己看着 diff 心里发虚的改动,就该上 Opus。
Haiku:把一堆邮件分类、把会议纪要拆成待办、统一表格格式。Sonnet:写周报、起草对外邮件、把数据整理成一页纸。Opus:定价、取舍、要向上汇报的判断 —— 凡是「这件事我要为它背书」的,别省那点额度。反过来也成立:日报周报这类每周都写、错了改一句就好的东西,用 Opus 是纯浪费。

四张示例路由表。别照抄 —— 抄下来的表和你自己跑出来的表,唯一的区别是你会不会真的照着切。

V

边界:三个容易想歪的地方.

1M 上下文不是越满越好
真需要长上下文的场景很少:一次读完整本书、整个大代码库。什么时候别:把零散资料一股脑全贴进对话 —— 那种该分段,或者交给 Project 的知识库去检索(第 4 章),让它只取相关的几页,而不是每次都重读全部。
窗口大小不等于装得下多少字
当代模型用的新 tokenizer,同一段文字比早期模型产生约 30% 更多 token —— 这是变化量(相对 Opus 4.7 之前),不是水平值,具体幅度随内容而定。4注 4Claude API Docs · Models overview —— Claude Opus 4.7 起引入的新 tokenizer 沿用至今:同一段文字产生约 30% 更多 token(相对 Opus 4.7 之前的模型;具体幅度随内容而定)。这是变化量,不是水平值。截至 2026-08。日常问答感觉不到,整本书、整个代码库这种场景可能比你预期更早碰到边界。
换模型本身不花钱,但会打断上下文
在同一段对话里切档,前面聊的它还看得见,但它的思路是新起的 —— 复杂问题聊到一半才想起来该升档,不如换个新对话把问题重述一遍,反而更快。

VI

收束 · 本章验收.

下一章把这张表钉住 —— Project 的默认模型、固定文件和一段自定义指令,是同一个工作区里的三件事。

默认选项替你选了模型, 没替你省钱.

The default picks your model, not your bill.

Aklman Library

讨论

讨论.

评论区初始化中…