# 路由 · 给你的活配一张模型路由表 · Anthropic · 一份会员该用的那部分

**作者** Aklman · **章节** 03 / 12 · **首发** 2026.07 · **语言** 中文为主, 中英双语
**原文** https://library.aklman.com/books/anthropic/03-models
**全书 markdown** https://library.aklman.com/books/anthropic/llms.md
**上一章** https://library.aklman.com/books/anthropic/02-prompting/llms.md
**下一章** https://library.aklman.com/books/anthropic/04-projects/llms.md

> 本章来自 Aklman · Library, 完整免费阅读。允许 AI 摘读、引用、问答; 转载请保留作者署名与原文链接 (CC BY-NC-ND 4.0, https://library.aklman.com/license)。

---

> 输入框那个模型名，你大概从没换过。这一章你拿自己的三个真问题跑一次对照，做出一张属于你的三行路由表 —— 哪类活走 Haiku，哪类走 Sonnet，哪类值得花 Opus，然后把结论钉进工作区默认。

输入框右上角那个模型名，是你每次对话都在用、却几乎从没动过的开关。默认那一档不一定是最划算的那一档 —— 但「哪一档划算」这件事，别人替你答不了，只能你拿自己的活跑一遍。

> 本章产出：**一张三行模型路由表**（简单 / 中等 / 烧脑各一个你自己的真问题，实测过），加**一次固化**——把结论写进第 4 章要建的那个 Project 的默认。验收标准：你能说出「这类活我以后默认走哪个模型」，而且这句话背后有你自己跑出来的对照，不是我说的。

### I · 当前阵容，与三种代价

Sonnet 是默认主力，Opus 贵在难题，Haiku 快在量大。

三个日常主力，价格差到 5 倍。截至 2026-08：[^1]

| 模型 | 每百万 token（入/出） | 上下文 | 什么时候选它 |
|---|---|---|---|
| Claude Opus 5 | $5 / $25 | 1M | 最难的推理、长代码、要一次想透的题 |
| Claude Sonnet 5 | $3 / $15 | 1M | 日常主力：大多数活它就够（至 8 月底入门价 $2/$10） |
| Claude Haiku 4.5 | $1 / $5 | 200K | 量大、要快、不烧脑的轻活 |

对只用网页的人，价格不体现为账单，而是三种代价 —— 而且只有第一种你能直接感觉到：

- **额度消耗速度**: 同一件活，Opus 比 Sonnet 更快撞到限额。这是你唯一能直接观察到的代价，也是第 11 章那本账要记的东西。

- **等待时间**: 越强的模型想得越久。一个五分钟的深度回答和一个八秒的够用回答，在「我正等着用」的场景里不是同一件商品。

- **你的注意力**: 被低估的一种。弱模型答得快，但你要多审两遍 —— 省下的额度换成了你的时间，这笔账常常是亏的。

所以那句常听的「贵的模型买的不是上限，是下限」有一半是对的：你多花的额度，换的是它在难题上更少翻车 —— 但只有当你真的在做难题时才成立。

> 严格说不止三个。**Claude Fable 5**（$10/$50）是专攻长时程 agent 活的一档 —— 大型代码迁移、能跑很久的自动任务，任务越长越复杂它越占优；2026-06-09 起全面可用。**Claude Mythos 5** 规格与它相同，但只在 Project Glasswing 里以邀请制提供、面向防御性网络安全，没有自助注册，普通用户遇不到。[^2]还有一批 legacy（Opus 4.8 / 4.7 / 4.6、Sonnet 4.6 / 4.5 等）仍可调用，但不该是你的新默认。[^1]如果你的活不是一跑几小时的 agent 任务，这一节和你无关 —— 这章仍按你天天在选的那三个讲。

> 一条口径要说清：上面这张表是**开发者平台**侧的当前阵容与价格。你在 claude.ai 那个选择器里实际能选到哪几个，官网价格页只笼统列了 Mythos、Fable、Opus、Sonnet、Haiku 五个家族名，不按档位拆。[^5]所以本章一律以「你选择器里那几个」为准 —— 名字对不上就以你账号里看到的为准，判断逻辑不变。

---

### II · 思考已经不是一个开关

模型自己决定想多久，你不用再替它按。

当前主力模型都用「自适应思考」—— 按任务难度自动决定要不要多想一会儿、想多久，旧版那个手动的「延长思考」token 预算，在当代模型上已经移除。[^3]如果你从来没动过那个开关，什么都不用改。

代价和以前一样：想得越多，推理越稳，额度消耗也越快。所以同一段提示，复杂题比简单题更耗额度 —— 因为它在后台多想了。这意味着你真正在调的从来不是「开不开思考」，而是「我这件活配不配得上它想那么久」。那正是这一章要你做的路由表。

---

### III · 动手：跑一次三行对照

十五分钟，换掉你以后几百次对话的默认选项。

- **从近一周的对话里挑三个真问题**:
 一个简单的（查个说法、翻译一段、格式转换），一个中等的（写一段东西、整理一份材料），一个真正烧脑的（多步推理、长文档综合、难调的 bug）。必须是你真问过的 —— 编的题会得到编的结论。

- **每个问题在两个模型上各跑一遍**:
 简单题跑 Haiku 和 Sonnet，中等题跑 Sonnet 和 Opus，烧脑题跑 Sonnet 和 Opus。同一句提示词，不要改。每次记三样：答案够不够用、等了多久、你有没有再追问。

- **只问一个问题：便宜那档够不够用**:
 不是「哪个更好」——贵的那个几乎总是略好一点，那个比较没有意义。要问的是：便宜那档的答案，我能不能直接用？能，这行就归它。

- **写成三行，钉进工作区**:
 按「这类活 → 走这个模型 → 因为」写三行。然后把结论钉进你常用的工作区默认（第 4 章会建那个 Project）—— 光记在脑子里，两周后你又回到默认那档了。

嫌自己判断费劲，可以让它先替你定档、再动手 —— 这一句同时也是个长期习惯：把「该用哪档」变成它每次开工前的第一步。

**提示词 · 让 Claude 替你定档**

```text
先别急着答。看一眼下面这个任务，告诉我：
1. 它该用 Haiku、Sonnet 还是 Opus？一句话说为什么（按难度 / 步数 / 有没有唯一正确答案）。
2. 如果我现在用的档比你建议的高，说清高在哪儿浪费了。
说完你的判断，再按它直接做。
任务：<把你的任务贴这里>。
```

**示例**

```text
先别急着答。看一眼下面这个任务，告诉我：
1. 它该用 Haiku、Sonnet 还是 Opus？一句话说为什么（按难度 / 步数 / 有没有唯一正确答案）。
2. 如果我现在用的档比你建议的高，说清高在哪儿浪费了。
说完你的判断，再按它直接做。
任务：把这段 300 字的产品公告翻成英文，保留所有数字和产品名，语气正式。
```

 <Cell label={错了要紧 · 做一遍}>Opus。一次性的高风险判断 —— 合同条款、架构选型、要发出去的对外声明。这格最值得花。</Cell>
 <Cell label={错了要紧 · 做很多遍}>Opus 打样，Sonnet 量产。先用 Opus 把一件做到位、连同判断标准一起沉淀成 Skill（第 5 章），之后交给 Sonnet 照着做。</Cell>
 <Cell label={错了不要紧 · 做一遍} highlight>Sonnet，别想了。这格占你日常的大头，而它的正确答案就是「用默认那档，别在选模型上花时间」。</Cell>
 <Cell label={错了不要紧 · 做很多遍}>Haiku。批量分类、格式转换、初筛。这格是唯一一个「换到更便宜的档」能立刻见效的地方。</Cell>

---

### IV · 换个域，路由表长什么样

#### 学习

Haiku：把英文材料批量翻成中文、生成填空卡片、把一节笔记压成三句话。Sonnet：讲解一个概念、出练习题、批改我的答案。Opus：留给「我卡住了、而且不知道自己卡在哪」的那种题 —— 它更擅长指出你问错了问题。这一栏的经验是：批改用 Sonnet 就够，但「为什么我这个思路是错的」值得上 Opus。

#### 研究

Haiku：抽取元数据、按关键词初筛一批文献、统一引用格式。Sonnet：读单篇、写摘要、做对比表。Opus：跨十几个来源的综合，尤其是证据互相打架、需要有人指出「这两篇的分歧其实在样本选择上」的时候 —— 便宜的档在这里会把分歧抹平，而抹平了你看不出来。这一栏是全书里最不该省钱的地方。

#### 开发

Haiku：写测试桩、批量改名、生成样板代码、把报错翻译成人话。Sonnet：日常改功能、写单测、code review 第一遍。Opus：调那种「日志看着一切正常但结果就是不对」的 bug，和要动多个模块的重构。判断标准很土但很准：你自己看着 diff 心里发虚的改动，就该上 Opus。

#### 商业 / 管理

Haiku：把一堆邮件分类、把会议纪要拆成待办、统一表格格式。Sonnet：写周报、起草对外邮件、把数据整理成一页纸。Opus：定价、取舍、要向上汇报的判断 —— 凡是「这件事我要为它背书」的，别省那点额度。反过来也成立：日报周报这类每周都写、错了改一句就好的东西，用 Opus 是纯浪费。

---

### V · 边界：三个容易想歪的地方

- **1M 上下文不是越满越好**: 真需要长上下文的场景很少：一次读完整本书、整个大代码库。什么时候别：把零散资料一股脑全贴进对话 —— 那种该分段，或者交给 Project 的知识库去检索（第 4 章），让它只取相关的几页，而不是每次都重读全部。

- **窗口大小不等于装得下多少字**: 当代模型用的新 tokenizer，同一段文字比早期模型产生约 30% 更多 token —— 这是**变化量**（相对 Opus 4.7 之前），不是水平值，具体幅度随内容而定。[^4]日常问答感觉不到，整本书、整个代码库这种场景可能比你预期更早碰到边界。

- **换模型本身不花钱，但会打断上下文**: 在同一段对话里切档，前面聊的它还看得见，但它的思路是新起的 —— 复杂问题聊到一半才想起来该升档，不如换个新对话把问题重述一遍，反而更快。

> 别把选模型变成一件要想的事。日常一律走默认那档；只在两种时刻停下来想一秒 —— 「这件活我要为它背书」（升档），和「这活我今天要做二十遍」（降档）。除此之外都别管。

---

### VI · 收束 · 本章验收

- 挑了三个自己真问过的问题：一个简单、一个中等、一个烧脑。

- 每个问题在两个模型上各跑了一遍，同一句提示词没改过。

- 记下了三样：够不够用、等了多久、有没有追问。

- 写出了三行路由表，每行都带一个「因为」。

- 至少有一行的结论是「降档就够」—— 如果三行全是「上 Opus」，多半是你没敢让便宜的那档真的交卷。

下一章把这张表钉住 —— Project 的默认模型、固定文件和一段自定义指令，是同一个工作区里的三件事。

> 默认选项替你选了模型，
> 没替你省钱

## 引用与参考

01 · Claude API Docs · Models overview —— 当前阵容：Claude Opus 5（$5/$25 每百万输入/输出 token，1M 上下文，128K 输出）、Claude Sonnet 5（$3/$15，1M；至 2026-08-31 入门价 $2/$10）、Claude Haiku 4.5（$1/$5，200K，64K 输出）。Opus 4.8 / 4.7 / 4.6、Sonnet 4.6 / 4.5 等已列入 legacy。截至 2026-08。  (Claude API Docs · Models)
02 · Claude API Docs · Models overview —— Claude Fable 5（$10/$50，1M）是面向长时程 agent 的一档，2026-06-09 起在 Claude API、Bedrock、Google Cloud 与 Microsoft Foundry 全面可用；Claude Mythos 5 规格与定价相同，但只在 Project Glasswing 内以邀请制提供，面向防御性网络安全，没有自助注册。截至 2026-08。  (Claude API Docs · Models)
03 · Claude API Docs · Models overview —— 当前模型使用自适应思考（模型自行决定想多久），手动的「延长思考」token 预算已在当代模型上移除；effort 参数在 Claude Opus 5 与 Sonnet 5 上于 Claude API 与 Claude Code 默认 high。截至 2026-08。  (Claude API Docs · Models)
04 · Claude API Docs · Models overview —— Claude Opus 4.7 起引入的新 tokenizer 沿用至今：同一段文字产生约 30% 更多 token（相对 Opus 4.7 之前的模型；具体幅度随内容而定）。这是变化量，不是水平值。截至 2026-08。  (Claude API Docs · Models)
05 · Anthropic · Claude 套餐与价格 —— 价格页把可用模型列为 Mythos、Fable、Opus、Sonnet、Haiku 五个家族，不按档位逐一拆分；付费档标注「更多用量」与「高流量时段优先访问」。截至 2026-08。  (Claude · Pricing)

---

*路由 · 给你的活配一张模型路由表 · Anthropic · 一份会员该用的那部分 · Aklman 著 · CC BY-NC-ND 4.0 · https://library.aklman.com/books/anthropic/03-models*
