非官方指南,与 Meta 无关联。

最后更新:

Opus 5.5 和 Sonnet 5.5 怎么选

两者都在 2026 年 9 月发布,只隔了一周,上下文都是 1M。所以区别主要在价格、速度和任务难度。

一句话 默认用 Sonnet 5.5。每 token 只要一半的钱,按 Anthropic 自己的数据,Terminal-Bench 4.0 上它是 70.6%,Opus 5.5 是 66.4%。在列出的 6 项测试里,Opus 5.5 有 5 项领先,但最多只高 3.2 分,所以留给最难、最开放的任务。

参数对比

Sonnet 5.5Opus 5.5
发布日期2026-09-282026-09-22
输入 / 输出(每百万 token)$2.00 / $10.00$4.00 / $20.00
缓存命中(每百万)$0.20$0.20
上下文窗口1M1M
最大输出128K128K
速度(Anthropic 称)比 Sonnet 5 快 30% 以上比 Opus 5 快 30% 以上
免费版 Claude可用不可用(Pro 起)
API 模型 IDclaude-sonnet-5-5claude-opus-5-5

跑分对比

数据来自 Anthropic 的 Sonnet 5.5 发布页,两个模型并排列出(Opus 5.5 为最高 effort)。

测试Sonnet 5.5Opus 5.5Sonnet 5
Terminal-Bench 4.070.6%66.4%10.3%
FrontierCode 1.1 (xhigh)52.1%54.4%42.4%
CursorBench 4.055.5%57.8%34.1%
OSWorld 2.180.1%81.8%57.0%
Humanity's Last Exam64.5%67.7%54.9%
GDPval-AA v2.1 (Elo)184418461449

来源: Anthropic 官方:Claude Sonnet 5.5 发布页

每次编程任务的成本

按官方标价和成本计算器的假设,每次 agent 任务:

代码库规模Sonnet 5.5Opus 5.5
小(1 万行以内)$0.115$0.223
中(1 万-10 万行)$0.258$0.498
大 / monorepo(10 万行以上)$0.618$1.188

每月 173 次任务、中等代码库:Sonnet 5.5 约 $45,Opus 5.5 约 $86。

在计算器里算你自己的用量

该选哪个

选 Sonnet 5.5 的情况

选 Opus 5.5 的情况

在 Claude Code 里搭配使用

会话中可以用 /model 随时切换模型。实用的做法是默认跑 Sonnet 5.5,任务卡住了再换 Opus 5.5。

常见问题

Opus 5.5 比 Sonnet 5.5 强吗?

强一点,而且不是每项都强。Anthropic 的测试里 Opus 5.5 大多领先,最多 3.2 分,但 Terminal-Bench 4.0 上 Sonnet 5.5 更高(70.6% 对 66.4%),价格还只要一半。

Opus 5.5 值两倍价格吗?

日常编程一般不值。最难、跑得最久的任务,或者 Sonnet 卡住的时候,多花的钱可能是值得的。

Sonnet 5 和 Sonnet 5.5 差多少?

Sonnet 5 的 Terminal-Bench 4.0 只有 10.3%,远低于两者。Sonnet 5.5 和 Sonnet 5 价格一样,没理由继续用旧版。

Claude Code 里选哪个?

默认 Sonnet 5.5,难题用 Opus 5.5。付费套餐的 Claude Code 两个都能用。

独立站点,与 Anthropic 无关联。跑分来自 Anthropic,本站没有自己做测试。