配置
Claude 模型选型:Haiku / Sonnet / Opus / Fable 怎么分工省钱
哪个任务该用哪档模型?一套不随版本过期的分工框架,把每月账单砍掉一半。
8 分钟2026-07-03
四档一张表
按"档位"选,不用背版本号。当前各档的代表型号如下,实时单价以 价格对比表 为准(已逐个核对官方定价)。
| 档位 | 当前代表 | 速度 | 相对成本 | 主战场 |
|---|---|---|---|---|
| 轻量 | Haiku 4.5 | 极快 | 最低 | 翻译 · 分类 · 摘要 · 简单 Q&A |
| 均衡 | Sonnet 5 | 中 | 中 | 日常 code · 写作 · review · 大部分对话 |
| 旗舰 | Opus 4.8 | 慢 | 高 | 复杂推理 · 长文生成 · 架构决策 · 难 debug |
| 最强旗舰 | Fable 5 | 慢 | 最高 | 最难的推理 / 长链任务,不计成本要最优解时 |
档位是耐久的,型号会换代——认准"轻量 / 均衡 / 旗舰"的分工,换代时对号入座即可。
决策树
任务来了
│
├─ 是简单的"输入→输出"映射?(翻译/格式转换/分类)
│ └─ 轻量档(Haiku)
│
├─ 需要思考但不算难?(写代码/读文档/写文案)
│ └─ 均衡档(Sonnet)← 默认就选它
│
├─ 需要长链推理 / 跨多个文件 / 长篇结构化输出?
│ └─ 旗舰档(Opus)
│
└─ 最难的活、要最优解且不在乎成本?
└─ 最强旗舰(Fable)
实战分配策略(80 / 15 / 5)
经验值:
- 80% 均衡档 — 默认
- 15% 旗舰档 — 关键场景(review 重要 diff、写架构文档、debug 顽固 bug)
- 5% 轻量档 — 批量预处理(如把 100 条用户反馈先分类,再让均衡档深入分析 top 10)
省钱技巧
1. Haiku 预筛 + 升级
把 100 条客户邮件先丢给轻量档分类 / 提取要点,再把"高优先级"那 10 条丢给均衡档起草回复。账单可能砍掉 80%。
2. Prompt 缩短
每个 token 都花钱。把无意义的客套语 / 重复的上下文删掉。结构化字段(如 markdown 表格)比自然语言密度高。
3. 用 prompt caching
Anthropic 支持 prompt caching — 同一个长 system prompt 复用时,缓存部分的 token 降到 1/10 价。Claude Code 的 /cache 命令可以手动 pin。
4. 别把旗舰档当 chatbot
跟旗舰档闲聊是浪费钱。日常切到均衡档,重活再升旗舰档。
速度示意(相对快慢,非精确基准)
越强的档位越慢,这是常态。下表只示意相对量级,具体因 prompt、负载、网络而异:
| 任务 | 轻量 | 均衡 | 旗舰 |
|---|---|---|---|
| 写一首七绝 | 最快 | 快 | 中 |
| review 200 行 React | 快 | 中 | 慢 |
| 写 1500 字 PRD 草稿 | 不胜任 | 中 | 慢 |
切换方法
Claude Code 里用 /model 命令(型号 ID 会随版本更新,以客户端 /model 列表为准):
/model claude-haiku-4-5-20251001
/model claude-sonnet-5
/model claude-opus-4-8
/model claude-fable-5
或者在 .claude/settings.json 配 model 字段做项目默认。