模型 ID 与选型
模型 ID 会随版本迭代,本页给出当前(2026 年视角)主流可用的 ID 和一份选型思路,让你在质量和成本之间做出合理取舍。
为什么选型这么重要
Claude Code 里挂什么模型直接决定了三件事:回答质量、响应速度、账单金额。同样一段需求,Haiku 可能三秒返回但结构粗糙,Opus 半分钟出来但一次就能过 review。日常工作里没有绝对最好的模型,只有和当前任务最匹配的模型。这一页就是帮你建立这种直觉,避免每次都要现查文档。
选型这件事有点像点菜。经常做同一类需求的人,很快就会把常用模型固定成两三个。不熟的时候按下面的表格保守选,跑几周会形成自己的偏好。
当前主流模型 ID
| Model ID | 定位 | 典型场景 |
|---|---|---|
claude-fable-5 | 实验性叙事/推理模型 | 长文写作、复杂推理 |
claude-opus-4-8 | 旗舰,最强 | 关键任务、疑难 bug、架构设计 |
claude-opus-4-7 | 上一代旗舰 | Opus 4-8 未开放时的替代 |
claude-sonnet-5 | 主力平衡款 | 日常写代码、调试、code review |
claude-haiku-4-5-20251001 | 快速廉价款 | 批处理、CI 脚本、简单问答 |
日常选型直觉
不知道选什么就先用 Sonnet 5。碰到啃不动的问题再切 Opus 4-8。要跑成千上万次的自动化流程直接上 Haiku。
历史版本
老项目的 settings.json 里可能还留着这些 ID:
claude-3-5-sonnet-20241022claude-3-5-haiku-20241022claude-3-opus-20240229
它们大概率还能用,但性能和价格早就被新一代甩开。如果新版本兼容,直接把 ID 换成上面的最新 ID 即可。老 ID 的一个特点是带日期后缀,格式像 模型名-日期,看到这种格式就知道是快照版本,通常只是为了固定行为不变,日常用不着追。
任务选型表
| 任务类型 | 建议模型 | 备注 |
|---|---|---|
| 架构设计、需求拆解 | Opus 4-8 | 思考深度重要,成本次要 |
| 复杂 bug 排查 | Opus 4-8 或 Sonnet 5 | 先 Sonnet 试,卡壳升 Opus |
| 日常写代码、改代码 | Sonnet 5 | 主力用 |
| Code review、单文件重构 | Sonnet 5 | 平衡最优 |
| 单元测试生成 | Sonnet 5 或 Haiku | 简单场景 Haiku 就够 |
| commit message、PR 描述 | Haiku | 便宜快 |
| 日志摘要、批量分类 | Haiku | 跑量首选 |
| 长文档写作、教程创作 | Fable 5 或 Opus 4-8 | 风格与叙事更好 |
| 数据分析、SQL 生成 | Sonnet 5 | 生产力最优 |
| 大规模 pipe 处理 | Haiku | 成本敏感 |
价格档次直觉
只是估算
下面数字是 2026 年时点的粗略量级,官方随时调整,做预算前请到 Anthropic 定价页核对。
| 档次 | 每百万输入 token | 每百万输出 token | 代表模型 |
|---|---|---|---|
| 旗舰 | 十几美元量级 | 几十美元量级 | Opus 4-8 |
| 主力 | 几美元量级 | 十几美元量级 | Sonnet 5 |
| 廉价 | 亚美元量级 | 一美元量级 | Haiku 4.5 |
Opus 大概是 Sonnet 的 4 到 5 倍价格,Sonnet 大概是 Haiku 的 5 到 10 倍。日常九成的活儿在 Sonnet 就该结束,别无脑上 Opus 烧钱。
上下文窗口对比
| 模型 | 上下文窗口 |
|---|---|
| Opus 4-8 | 200K token 起步,部分场景更长 |
| Sonnet 5 | 200K token |
| Haiku 4.5 | 200K token |
| Fable 5 | 200K token |
单纯就上下文长度而言,几个模型差别不大。真正差异在推理深度和输出质量。窗口大不代表你就该塞满,Prompt 越长模型越容易走神,能压就压,这一点在附录第一节的模型类问题里也提到过。
Fast 模式说明
/model 里能看到 Opus 有一个 Fast 变体。这不是切了别的模型,而是同一个 Opus 用了更激进的解码策略换更快的响应。质量整体接近,某些需要深度推理的场景略有折扣。
想要极致答案:普通 Opus。想要秒回:Fast Opus。日常用 Sonnet 5 其实已经比 Fast Opus 还快,别本末倒置。
在 Claude Code 里切换
有三个层级可以指定模型,优先级从高到低:
会话内临时切
REPL 里输入 /model,弹出的选择器里挑一个。当前会话立刻生效,退出后恢复默认。
/model
> claude-opus-4-8
> claude-sonnet-5 (current)
> claude-haiku-4-5-20251001项目级默认
在项目根目录 .claude/settings.json 里配:
{
"model": "claude-sonnet-5"
}这个项目所有会话默认走这个模型。团队协作时把它 commit 进 git 保持一致。
全局默认
~/.claude/settings.json(Windows 下 %USERPROFILE%\.claude\settings.json),字段一样:
{
"model": "claude-sonnet-5"
}新项目没配项目级的话,就用这个全局默认。
什么时候值得升 Opus
一个粗糙的判断:Sonnet 5 已经跑了两三轮还没搞定,或者 diff 里出现了它自己也拿不准的注释,切 Opus 一次基本能过关。日常小活儿硬上 Opus 就是烧钱。
组合用法
高阶用法是同一个项目里根据阶段切模型。规划阶段用 Opus 想清楚方向,实现阶段切 Sonnet 高速产出,最后用 Haiku 跑批量 commit message 和 lint 修复。用 subagent 或 skill 编排的话,还可以让每个子任务各挂各的模型,成本和质量都能兼顾。这套玩法在 SDK 章节里有更详细的例子,可以回去翻。
观察成本的方法
在 REPL 里可以随时输入 /cost 查看当前会话的累计 token 消耗和大致费用估算。跑长任务的时候养成隔一段时间瞟一眼的习惯,防止无脑烧钱。团队里可以约定一个上限,超过就切模型或者压缩上下文。
想跑大批量任务前,先拿五条样本做一次小规模跑测。看清楚每条平均耗时、平均 token、平均费用,再乘以总量估算,比一开始就上万条稳妥得多。
一句话总结
不确定就 Sonnet,卡壳就 Opus,跑量就 Haiku。三句话记住就够用了。以后新模型出来时,只要弄清楚它对应的是哪一档,用法基本沿用即可,不用每次都重新学一遍。