Skip to content

模型 ID 与选型

模型 ID 会随版本迭代,本页给出当前(2026 年视角)主流可用的 ID 和一份选型思路,让你在质量和成本之间做出合理取舍。

为什么选型这么重要

Claude Code 里挂什么模型直接决定了三件事:回答质量、响应速度、账单金额。同样一段需求,Haiku 可能三秒返回但结构粗糙,Opus 半分钟出来但一次就能过 review。日常工作里没有绝对最好的模型,只有和当前任务最匹配的模型。这一页就是帮你建立这种直觉,避免每次都要现查文档。

选型这件事有点像点菜。经常做同一类需求的人,很快就会把常用模型固定成两三个。不熟的时候按下面的表格保守选,跑几周会形成自己的偏好。

当前主流模型 ID

Model ID定位典型场景
claude-fable-5实验性叙事/推理模型长文写作、复杂推理
claude-opus-4-8旗舰,最强关键任务、疑难 bug、架构设计
claude-opus-4-7上一代旗舰Opus 4-8 未开放时的替代
claude-sonnet-5主力平衡款日常写代码、调试、code review
claude-haiku-4-5-20251001快速廉价款批处理、CI 脚本、简单问答

日常选型直觉

不知道选什么就先用 Sonnet 5。碰到啃不动的问题再切 Opus 4-8。要跑成千上万次的自动化流程直接上 Haiku。

历史版本

老项目的 settings.json 里可能还留着这些 ID:

  • claude-3-5-sonnet-20241022
  • claude-3-5-haiku-20241022
  • claude-3-opus-20240229

它们大概率还能用,但性能和价格早就被新一代甩开。如果新版本兼容,直接把 ID 换成上面的最新 ID 即可。老 ID 的一个特点是带日期后缀,格式像 模型名-日期,看到这种格式就知道是快照版本,通常只是为了固定行为不变,日常用不着追。

任务选型表

任务类型建议模型备注
架构设计、需求拆解Opus 4-8思考深度重要,成本次要
复杂 bug 排查Opus 4-8 或 Sonnet 5先 Sonnet 试,卡壳升 Opus
日常写代码、改代码Sonnet 5主力用
Code review、单文件重构Sonnet 5平衡最优
单元测试生成Sonnet 5 或 Haiku简单场景 Haiku 就够
commit message、PR 描述Haiku便宜快
日志摘要、批量分类Haiku跑量首选
长文档写作、教程创作Fable 5 或 Opus 4-8风格与叙事更好
数据分析、SQL 生成Sonnet 5生产力最优
大规模 pipe 处理Haiku成本敏感

价格档次直觉

只是估算

下面数字是 2026 年时点的粗略量级,官方随时调整,做预算前请到 Anthropic 定价页核对。

档次每百万输入 token每百万输出 token代表模型
旗舰十几美元量级几十美元量级Opus 4-8
主力几美元量级十几美元量级Sonnet 5
廉价亚美元量级一美元量级Haiku 4.5

Opus 大概是 Sonnet 的 4 到 5 倍价格,Sonnet 大概是 Haiku 的 5 到 10 倍。日常九成的活儿在 Sonnet 就该结束,别无脑上 Opus 烧钱。

上下文窗口对比

模型上下文窗口
Opus 4-8200K token 起步,部分场景更长
Sonnet 5200K token
Haiku 4.5200K token
Fable 5200K token

单纯就上下文长度而言,几个模型差别不大。真正差异在推理深度和输出质量。窗口大不代表你就该塞满,Prompt 越长模型越容易走神,能压就压,这一点在附录第一节的模型类问题里也提到过。

Fast 模式说明

/model 里能看到 Opus 有一个 Fast 变体。这不是切了别的模型,而是同一个 Opus 用了更激进的解码策略换更快的响应。质量整体接近,某些需要深度推理的场景略有折扣。

想要极致答案:普通 Opus。想要秒回:Fast Opus。日常用 Sonnet 5 其实已经比 Fast Opus 还快,别本末倒置。

在 Claude Code 里切换

有三个层级可以指定模型,优先级从高到低:

会话内临时切

REPL 里输入 /model,弹出的选择器里挑一个。当前会话立刻生效,退出后恢复默认。

/model
> claude-opus-4-8
> claude-sonnet-5   (current)
> claude-haiku-4-5-20251001

项目级默认

在项目根目录 .claude/settings.json 里配:

json
{
  "model": "claude-sonnet-5"
}

这个项目所有会话默认走这个模型。团队协作时把它 commit 进 git 保持一致。

全局默认

~/.claude/settings.json(Windows 下 %USERPROFILE%\.claude\settings.json),字段一样:

json
{
  "model": "claude-sonnet-5"
}

新项目没配项目级的话,就用这个全局默认。

什么时候值得升 Opus

一个粗糙的判断:Sonnet 5 已经跑了两三轮还没搞定,或者 diff 里出现了它自己也拿不准的注释,切 Opus 一次基本能过关。日常小活儿硬上 Opus 就是烧钱。

组合用法

高阶用法是同一个项目里根据阶段切模型。规划阶段用 Opus 想清楚方向,实现阶段切 Sonnet 高速产出,最后用 Haiku 跑批量 commit message 和 lint 修复。用 subagent 或 skill 编排的话,还可以让每个子任务各挂各的模型,成本和质量都能兼顾。这套玩法在 SDK 章节里有更详细的例子,可以回去翻。

观察成本的方法

在 REPL 里可以随时输入 /cost 查看当前会话的累计 token 消耗和大致费用估算。跑长任务的时候养成隔一段时间瞟一眼的习惯,防止无脑烧钱。团队里可以约定一个上限,超过就切模型或者压缩上下文。

想跑大批量任务前,先拿五条样本做一次小规模跑测。看清楚每条平均耗时、平均 token、平均费用,再乘以总量估算,比一开始就上万条稳妥得多。

一句话总结

不确定就 Sonnet,卡壳就 Opus,跑量就 Haiku。三句话记住就够用了。以后新模型出来时,只要弄清楚它对应的是哪一档,用法基本沿用即可,不用每次都重新学一遍。

本教程为社区中文学习整理,非官方发布。Claude Code 属于 Anthropic。