最后更新:
Opus 5.5 和 Sonnet 5.5 怎么选
两者都在 2026 年 9 月发布,只隔了一周,上下文都是 1M。所以区别主要在价格、速度和任务难度。
一句话 默认用 Sonnet 5.5。每 token 只要一半的钱,按 Anthropic 自己的数据,Terminal-Bench 4.0 上它是 70.6%,Opus 5.5 是 66.4%。在列出的 6 项测试里,Opus 5.5 有 5 项领先,但最多只高 3.2 分,所以留给最难、最开放的任务。
参数对比
| Sonnet 5.5 | Opus 5.5 | |
|---|---|---|
| 发布日期 | 2026-09-28 | 2026-09-22 |
| 输入 / 输出(每百万 token) | $2.00 / $10.00 | $4.00 / $20.00 |
| 缓存命中(每百万) | $0.20 | $0.20 |
| 上下文窗口 | 1M | 1M |
| 最大输出 | 128K | 128K |
| 速度(Anthropic 称) | 比 Sonnet 5 快 30% 以上 | 比 Opus 5 快 30% 以上 |
| 免费版 Claude | 可用 | 不可用(Pro 起) |
| API 模型 ID | claude-sonnet-5-5 | claude-opus-5-5 |
跑分对比
数据来自 Anthropic 的 Sonnet 5.5 发布页,两个模型并排列出(Opus 5.5 为最高 effort)。
| 测试 | Sonnet 5.5 | Opus 5.5 | Sonnet 5 |
|---|---|---|---|
| Terminal-Bench 4.0 | 70.6% | 66.4% | 10.3% |
| FrontierCode 1.1 (xhigh) | 52.1% | 54.4% | 42.4% |
| CursorBench 4.0 | 55.5% | 57.8% | 34.1% |
| OSWorld 2.1 | 80.1% | 81.8% | 57.0% |
| Humanity's Last Exam | 64.5% | 67.7% | 54.9% |
| GDPval-AA v2.1 (Elo) | 1844 | 1846 | 1449 |
来源: Anthropic 官方:Claude Sonnet 5.5 发布页
每次编程任务的成本
按官方标价和成本计算器的假设,每次 agent 任务:
| 代码库规模 | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| 小(1 万行以内) | $0.115 | $0.223 |
| 中(1 万-10 万行) | $0.258 | $0.498 |
| 大 / monorepo(10 万行以上) | $0.618 | $1.188 |
每月 173 次任务、中等代码库:Sonnet 5.5 约 $45,Opus 5.5 约 $86。
该选哪个
选 Sonnet 5.5 的情况
- Claude Code 里的日常 agent 编程
- 跑测试、构建、脚本这类终端任务多的场景
- 用量大、对成本敏感的 API 调用
- 免费版用户(用不了 Opus)
选 Opus 5.5 的情况
- 困难、开放式的问题,Anthropic 说它在这方面仍明显更强
- 跨很多文件的大重构
- Sonnet 5.5 已经修不好的 bug
- 安全类工作:Sonnet 5.5 会把部分高风险网络安全请求回退给 Sonnet 5
在 Claude Code 里搭配使用
会话中可以用 /model 随时切换模型。实用的做法是默认跑 Sonnet 5.5,任务卡住了再换 Opus 5.5。
常见问题
Opus 5.5 比 Sonnet 5.5 强吗?
强一点,而且不是每项都强。Anthropic 的测试里 Opus 5.5 大多领先,最多 3.2 分,但 Terminal-Bench 4.0 上 Sonnet 5.5 更高(70.6% 对 66.4%),价格还只要一半。
Opus 5.5 值两倍价格吗?
日常编程一般不值。最难、跑得最久的任务,或者 Sonnet 卡住的时候,多花的钱可能是值得的。
Sonnet 5 和 Sonnet 5.5 差多少?
Sonnet 5 的 Terminal-Bench 4.0 只有 10.3%,远低于两者。Sonnet 5.5 和 Sonnet 5 价格一样,没理由继续用旧版。
Claude Code 里选哪个?
默认 Sonnet 5.5,难题用 Opus 5.5。付费套餐的 Claude Code 两个都能用。
独立站点,与 Anthropic 无关联。跑分来自 Anthropic,本站没有自己做测试。