Anthropic 9 月 22 日发布 Opus 5.5,6 天后发布 Sonnet 5.5,于是大家都在问:便宜的那个现在够不够用?Anthropic 自己说得很直接:Sonnet 5.5 是给边界清楚的日常任务用的、更快更便宜的搭档,Opus 5.5 是给需要细致判断的复杂工作用的。下面的数字都取自这两款模型的官方发布页,不是第三方估算。
两者都是 Claude 5.5 家族,API 形状完全一样,切换只改一个模型名字符串。真正要算的是「完成一个任务花多少钱」,而不是标价:Anthropic 称 Sonnet 5.5 完成同样任务比 Sonnet 5 用更少的 token 和工具调用,Opus 5.5 在典型负载上比 Opus 5 省 40%。
智能体编码上两者很接近、互有胜负:Terminal-Bench 4.0 Sonnet 5.5 领先,FrontierCode 和 CursorBench Opus 5.5 领先。知识工作(GDPval-AA)只差 2 个 Elo 分。唯一差距明显的一行是 Chartography,Opus 5.5 遥遥领先 —— 这提示了大模型仍然值这个价的地方:需要密集阅读、多步推理和判断的活,而不是需求清晰的改动。
| 基准 | Opus 5.5 | Sonnet 5.5 | 备注 |
|---|---|---|---|
| Terminal-Bench 4.0 | 66.4% | 70.6% | Sonnet 5 为 10.3% |
| FrontierCode 1.1 | 54.4% | 46.2%(high) | |
| CursorBench 4.0 | 57.8% | 55.5% | |
| GDPval-AA v2.1 | 1846 Elo | 1844 Elo | 知识工作 |
| OSWorld 2.1 | 81.8% | 80.1% | 操作电脑 |
| Chartography | 89.0% | 61.6% | 差距最大 |
Sonnet 5.5 完全沿用 Sonnet 5 的价格,所以 Sonnet 线的输入输出价都是 Opus 的一半。在 apimodels.app 上 Opus 5.5 每百万 token $2.40 / $12,比 Anthropic 官方低 40%,按 token 计费、失败不收钱。Sonnet 5.5 暂未上架;Sonnet 5 在同一个 key、同一个端点上可用,$1.60 / $8,比官方低 20%。
| 每百万 token | Opus 5.5 | Sonnet 5.5 | Sonnet 5 |
|---|---|---|---|
| Anthropic 官方 输入 / 输出 | $4 / $20 | $2 / $10 | $2 / $10 |
| 缓存读 / 写(官方) | $0.20 / $5 | $0.20 / $2.50 | — |
| apimodels.app | $2.40 / $12 | 暂未上架 | $1.60 / $8 |
| 发布 | 2026-09-22 | 2026-09-28 | 更早 |
任务需求清楚时选 Sonnet 5.5:修一个已知 bug、给现有代码补测试、写文档、填表格、跑一个能一步步描述清楚的终端流程。它 Terminal-Bench 领先、输出快 30%,是高频智能体循环更好的默认选择。
任务开放、或者判断失误代价高时选 Opus 5.5:跨大型代码库的架构改动、需求模糊、长时间调研、阅读密集的图表和文档。Anthropic 自己的说法是 Sonnet 5.5 在需要持续判断的复杂工作上仍明显更弱,Chartography 的差距也印证了这一点。注意 Opus 5.5 总是会思考(自适应思考关不掉),用 effort 调深度,默认 medium。
Sonnet 5 对 5.5:价格相同,但 Anthropic 称 5.5 输出快 30% 以上、单任务成本最多低 30%,Terminal-Bench 从 10.3% 升到 70.6%。如果你在用 Sonnet 5 做智能体编码,5.5 就是该计划的升级。
cURL
curl https://api.apimodels.app/v1/messages \
-H "x-api-key: $APIMODELS_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-opus-5-5",
"max_tokens": 16000,
"messages": [{"role": "user", "content": "Review this function for race conditions: ..."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.apimodels.app/v1", api_key="YOUR_APIMODELS_KEY")
# Same prompt, two models, one key: compare them on your own task before you commit.
for model in ["claude-opus-5-5", "claude-sonnet-5"]:
r = client.chat.completions.create(
model=model,
messages=[{"role": "user", "content": "Refactor this module and explain the risky parts: ..."}],
)
print(model, r.usage.prompt_tokens, r.usage.completion_tokens)
print(r.choices[0].message.content[:400])部分跑分上是的:Anthropic 公布 Terminal-Bench 4.0 为 70.6% 对 66.4%。其余大多数 Opus 5.5 略领先(CursorBench 57.8% 对 55.5%、GDPval-AA 1846 对 1844),Chartography 则大幅领先(89.0% 对 61.6%)。官方定位是 Sonnet 5.5 做边界清楚的任务、Opus 5.5 做复杂判断。
官方价是一半:每百万 token $2 / $10 对 $4 / $20。在 apimodels.app 上 Opus 5.5 是 $2.40 / $12;Sonnet 5.5 暂未上架,Sonnet 5 是 $1.60 / $8。
暂时不能。Opus 5.5 和 Sonnet 5 现在都可用,同一个 key,走 /v1/messages 或 OpenAI 兼容的 /v1/chat/completions。Sonnet 5.5 上架当天本页会更新价格。
已宣布、未发布。Anthropic 在 2026 年 9 月 22 日说 Haiku 5.5 会在未来几周内跟进,目前没有日期、价格和跑分。在它发布之前,Sonnet 5.5 是 Claude 5.5 家族里最便宜的。
价格不变。Anthropic 称输出快 30% 以上,靠更少的 token 和工具调用使单任务成本最多降 30%,Terminal-Bench 4.0 从 10.3% 升到 70.6%。